Studii de caz/APIA — Reconstrucția infrastructurii
Sector public · Calcul, stocare și virtualizare · România
APIA — Reconstrucția infrastructurii
Stocare ieșită din suport, cu date care nu puteau aștepta. 34 de servere, două sisteme de stocare all-flash și o rețea redundantă în două locații — cu datele în uz migrate de pe infrastructura care ceda, în timp ce sarcinile de lucru continuau să ruleze.

01Provocarea
Înlocuirea fundației în timp ce clădirea rămâne locuită
Nodul IT central al APIA funcționa pe o stocare care ieșea treptat din acoperirea producătorului. O parte considerabilă din capacitatea existentă nu mai era în garanție sau în suport, iar sarcinile de lucru găzduite erau chiar cele ale agenției — nu puteau fi pur și simplu puse pe pauză.
Sarcina a fost instalarea unei noi platforme în două locații, mutarea datelor în uz pe aceasta cu cât mai puține întreruperi și livrarea unei infrastructuri care se extinde prin adăugarea de hardware, nu printr-o nouă înlocuire.
02Amploare
Ce s-a instalat,
în două centre de date.
Cinci cabinete de 42U, treizeci și patru de servere dual-socket, două sisteme de stocare all-flash cu șaizeci și două de SSD-uri enterprise în total, patru switch-uri de centru de date, două switch-uri de management out-of-band și un UPS trifazat paralel-redundant — livrate, montate în rack, cablate și configurate la sediul central și într-un centru de date secundar.
03Ce am livrat
Șapte niveluri, o singură livrare
Resursele de calcul, stocarea și serviciile de date construite peste ea, rețeaua, virtualizarea și alimentarea au fost furnizate și configurate ca o singură soluție integrată — cu toate licențele incluse și fiecare sistem la cea mai recentă versiune în ziua instalării.
Douăzeci și două de servere gazdă în locația centrală și douăsprezece în cea secundară, fiecare cu două procesoare de 24 de nuclee, 512 GB de memorie și cinci SSD-uri enterprise. Montate în perechi pentru un flux de aer optim, în cinci cabinete de 42U cu distribuție dublă a alimentării.
Câte un sistem de stocare all-flash în fiecare locație — 40 de SSD-uri cu 52 TB utili în locația centrală și 22 de SSD-uri cu 27 TB în cea secundară, ambele în RAID 5. Fiecare sistem are două controllere hot-swap, cu câte 128 GB de cache protejat de baterii, astfel încât conținutul cache-ului este salvat pe flash la o cădere a alimentării, iar toate funcțiile software sunt licențiate și activate.
Compresie și deduplicare inline pentru volumele de tip bloc și fișier, thin provisioning, tiering automat care mută blocurile cele mai accesate pe mediile cele mai rapide, snapshot-uri și clone thin pentru copiile de producție și replicare jurnalizată care permite restaurarea datelor la orice moment anterior, grupată pe aplicații, astfel încât sistemele interdependente revin într-o stare consistentă.
Fibre Channel și iSCSI pentru accesul la nivel de bloc, alături de SMB, NFS, FTP și SFTP pentru fișiere — astfel, același sistem de stocare deservește atât platforma de virtualizare, cât și sarcinile de lucru pe fișiere, fără un al doilea echipament.
Două switch-uri de centru de date în fiecare locație, cu porturi de acces de 10/25 Gbps și uplinkuri de 100 Gbps, configurate ca pereche virtual port-channel. Fiecare echipament are câte un port conectat la fiecare switch: un switch poate cădea fără pierderea vreunei căi, iar cât timp ambele funcționează, capacitățile lor se însumează — 20 Gbps de date pentru fiecare server gazdă. Traficul de stocare este izolat într-un VLAN propriu, care există doar local.
Un hipervizor Linux enterprise pe fiecare server, toate licențiate pentru utilizare în centre de date virtuale. Fiecare locație este administrată de propriul manager, care rulează el însuși ca mașină virtuală de înaltă disponibilitate în cluster — dacă serverul său gazdă cade, repornește pe alt nod, astfel încât planul de management rezistă la pierderea unui nod.
Un UPS trifazat de 40 kVA în configurație paralel-redundantă în locația centrală, cu două unități de distribuție a alimentării în fiecare cabinet, fiecare alimentată dintr-o sursă independentă, UPS sau generator, astfel încât niciun echipament nu depinde de o singură cale de alimentare.
04Arhitectură
Fiecare echipament, cu dublă conectare
Diagrama prezintă modelul arhitecturii de referință — nu implementarea internă reală. Principiul este însă vizibil: în fiecare locație, fiecare echipament are câte un port conectat la fiecare dintre cele două switch-uri, stocarea este accesată pe patru căi independente, iar rețeaua de management este complet separată de calea de date.
05Migrare
Mutarea datelor de pe un sistem de stocare care cedează
Partea dificilă a acestui proiect a fost migrarea, nu instalarea.
06Rezultat
Ce a obținut agenția
Datele, scoase din zona de risc
Sarcinile de lucru care rulau pe o stocare fără suport și ieșită din garanție funcționează acum pe două sisteme all-flash complet licențiate, cu controllere redundante și cache protejat de baterii.
O cale care rezistă la defecțiuni
Controllere duble, switch-uri duble, alimentare dublă, interfețe de server agregate și porturi de stocare duble — fiecare nivel al platformei livrate are o a doua cale.
Performanță acolo unde este nevoie
Medii all-flash cu tiering automat, compresie și deduplicare inline și 20 Gbps de date pentru fiecare server gazdă.
O infrastructură care se extinde
Adăugarea de discuri, de servere gazdă și de sertare de discuri se face pe loc, în infrastructura existentă, astfel încât următorul pas de creștere nu înseamnă o nouă reconstrucție.
07Notă de confidențialitate
Nu dezvăluim schema de adresare IP a locațiilor, denumirile serverelor, credențialele, dispunerea rackurilor sau arhitectura tehnologică internă reală a proiectului.
Diagrama și cifrele de pe această pagină descriu modelul arhitecturii de referință și amploarea proiectului care poate fi comunicată public.