- Një dështim i RAID kërkon ndalimin e menjëhershëm të të gjitha shkrimeve për të shmangur dëmtime të pakthyeshme.
- Rindërtimi logjik në një mjedis të sigurt dhe nga klonet është çelësi për rikuperimin e të dhënave.
- Gabimet njerëzore (rindërtimet e detyruara, ndryshimet e gabuara të diskut) janë shkaku më i rrezikshëm.
- Kombinimi i kopjeve rezervë të mira me shërbimet profesionale maksimizon probabilitetin e suksesit.

Çfarë është një sistem RAID dhe pse është kaq i rëndësishëm për të dhënat tuaja?
RAID (Redundant Array of Independent Disks) është një teknologji që kombinon disqe të shumta fizike në një vëllim të vetëm logjik për të rritur performancën, kapacitetin e përdorshëm dhe/ose tolerancën ndaj gabimeve. Është themeli i shumicës së serverëve, pajisjeve NAS dhe vargjeve SAN , dhe përdoret në mjedise ndërmarrjesh, zyra të vogla dhe nga përdoruesit e përparuar.
Sistemi operativ e sheh RAID-in si një njësi të vetme, edhe pse në fakt mund të përbëhet nga dy, tre ose edhe dhjetëra disqe të forta. Të dhënat shpërndahen nëpër disqe sipas nivelit të zgjedhur të RAID-it: ndonjëherë janë me vija, ndonjëherë janë të pasqyruara dhe në nivele të avancuara, blloqet e paritetit ose informacioni i tepërt llogariten për të lejuar rindërtimin e të dhënave nëse një disk dështon.
Nivelet RAID më të përdorura në servera dhe pajisje NAS janë 0, 1, 4, 5, 6 dhe 10, si dhe konfigurimet lineare ose JBOD, përveç varianteve specifike nga prodhues të caktuar (RAID 50, 60, 5E, 5EE, ADG, etj.). Ekzistojnë gjithashtu implementime pronësore si Microsoft RAID, Storage Spaces, Apple RAID, Linux RAID, ZFS RAIDZ dhe RAIDZ2 , ndër të tjera, të cilat kanë karakteristikat e tyre specifike kur bëhet fjalë për rikuperimin e të dhënave.
Është e rëndësishme të kuptohet që RAID nuk zëvendëson kopjet rezervë . Një RAID i konfiguruar mirë rrit disponueshmërinë dhe toleron disa dështime të diskut, por nuk mbron nga fshirjet aksidentale, korruptimi logjik, ransomware-i, gabimet e kontrolluesit ose gabimet njerëzore gjatë mirëmbajtjes.
Nivelet kryesore të RAID dhe rreziqet e tyre për humbjen e të dhënave
Nivelet e ndryshme të RAID ndryshojnë në mënyrën se si i shpërndajnë të dhënat dhe redundancën nëpër disqe. Kjo ndikon drejtpërdrejt në rrezikun e humbjes së të dhënave dhe në mënyrën e qasjes ndaj rikuperimit të të dhënave.
RAID 0 (striping i pastër) shpërndan të dhënat në blloqe në të gjitha disqet në matricë pa asnjë tepricë. Ofron performancë të lartë leximi dhe shkrimi dhe shfrytëzon kapacitetin e plotë, por nëse edhe një disk dështon, humbet qasja e plotë në vëllim. Në rast të një fatkeqësie, rikuperimi i të dhënave nga një matricë RAID 0 është kompleks dhe zakonisht kërkon mjete profesionale për të rindërtuar sekuencën e blloqeve nga disqet mbijetuese.
RAID 1 (pasqyrimi) dublikon të dhënat në dy ose më shumë disqe, duke ruajtur kopje identike në secilin prej tyre. Ky nivel ofron besueshmëri të lartë dhe tolerancë ndaj defekteve : nëse një disk dështon, sistemi mund të vazhdojë të funksionojë me kopjen. Kapaciteti i përdorshëm është ekuivalent me madhësinë e një disku, por në këmbim, ai siguron besueshmëri të leximit të të dhënave dukshëm më të mirë.
RAID 4 përdor ndarjen e të dhënave në disqe të shumta dhe rezervon njërin prej tyre ekskluzivisht për ruajtjen e paritetit. Kapaciteti i përdorshëm është shuma e të gjithë disqeve minus një, duke lejuar që të dhënat të rikuperohen nëse një disk i të dhënave dështon. Megjithatë, disku i paritetit bëhet një pengesë dhe një pikë kritike në konfigurim.
RAID 5 është niveli më i zakonshëm RAID në serverat e nivelit të mesëm dhe pajisjet NAS. Ai shpërndan si të dhënat ashtu edhe vijat e paritetit në të gjitha disqet, duke eliminuar bllokimin e një disku të dedikuar pariteti. Kapaciteti i përdorshëm është shuma e kapacitetit të vargut minus kapacitetin e çdo disku të vetëm. Ai lejon dështimin e një disku pa humbje të të dhënave, por gjatë rindërtimit, sistemi funksionon në limitin e tij dhe çdo dështim i dytë mund ta bëjë vargun të parikuperueshëm pa ndërhyrjen e ekspertëve.
RAID 6 shton një shirit të dytë pariteti, duke siguruar tolerancë ndaj dështimit të njëkohshëm të dy disqeve. Kapaciteti i përdorshëm është shuma e të gjithë disqeve minus kapaciteti i dy disqeve. Ky nivel ofron siguri më të madhe me koston e rikuperimit pak më kompleks dhe llogaritjeve më të kushtueshme të paritetit.
RAID 10 (1+0) kombinon pasqyra (RAID 1) të grupuara në vija (RAID 0). Kjo do të thotë që krijohen çifte disqesh të pasqyruara dhe më pas të dhënat shpërndahen nëpër ato pasqyra. Ofron një ekuilibër të shkëlqyer midis performancës dhe tolerancës ndaj gabimeve , megjithëse kërkon një minimum prej katër disqesh dhe kostoja për sa i përket kapacitetit është më e lartë.
Konfigurimet lineare dhe JBOD thjesht bashkojnë disqe me kapacitet të barabartë ose të ndryshëm për të formuar një vëllim më të madh. Nuk ka vijazim, paritet ose redundancë të vërtetë. Nëse një disk dështon, i gjithë vargu mund të bëhet i paarritshëm dhe rikuperimi kërkon rindërtimin manual të kufijve të secilit disk brenda vëllimit të përgjithshëm.
"Ora e artë": gabime kritike pas një dështimi të RAID-it
Pas një paralajmërimi për dështim ose degradim të RAID-it , 60 minutat e para janë kritike. Është gjatë kësaj periudhe që ndodh humbja më e parandalueshme e të dhënave, zakonisht për shkak të përpjekjeve për ta "rregulluar shpejt" pa një diagnozë të qartë ose kopje rezervë të azhurnuara.
Gabimet tipike njerëzore gjatë kësaj ore të artë përfshijnë ndërrimin e disqeve të gabuara , veçanërisht në shasitë me shumë ndarje; një disk i shëndetshëm hiqet duke menduar se është i dëmtuari, dhe kur futet një i ri, detyrohet një rindërtim mbi një themel të paqëndrueshëm. Kjo mund ta dëmtojë plotësisht strukturën e vëllimit.
Një tjetër gabim i zakonshëm është zëvendësimi i kontrolluesit RAID me një model të ndryshëm ose të papajtueshëm pa dokumentuar konfigurimin origjinal. Në shumë raste, mënyra se si shkruhet pariteti, rendi i diskut ose madhësia e shiritit ndryshon midis kontrolluesve, duke bërë që vargu të duket i korruptuar ose të interpretohet me parametra të pasaktë.
Vendosja e detyruar e disqeve në linjë ose inicializimi i disqeve pa analizuar gjendjen e tyre është gjithashtu shumë e rrezikshme. Inicializimi mund të mbishkruajë meta të dhënat RAID ose tabelat e ndarjeve; vendosja e një disku në linjë kur është i paqëndrueshëm krijon sektorë shtesë të këqij, dhe çdo përpjekje për të rindërtuar mbi një disk të dëmtuar fizikisht përshpejton dëmtimin.
Rindërtimet dhe rikthimet e dështuara nga kopjet rezervë të paplota në të njëjtin sistem janë një tjetër burim i zakonshëm fatkeqësish. Përpjekja për të rindërtuar një varg RAID 5 ose RAID 6 me sektorë të këqij pa i klonuar më parë disqet në imazhe të qëndrueshme mund të rezultojë në një gjendje ku edhe një laborator profesional nuk mund ta rimontojë vargun në mënyrë të besueshme.
Rregulli i artë pas zbulimit të një problemi serioz me RAID : ndaloni menjëherë të gjithë aktivitetin e shkrimit, mos kryeni rindërtime ose inicializime dhe mos vazhdoni "testimin e gjërave" në prodhim. Çdo shkrim i ri në grupin origjinal RAID zvogëlon shanset e një rikuperimi të plotë.
Softuer i specializuar: si ndihmon në rindërtimin e RAID-eve të dëmtuara
Në shumë skenarë të dështimit logjik , mjetet profesionale të rikuperimit të të dhënave mund ta rindërtojnë virtualisht RAID-in pa shkruar në disqet origjinale. Një shembull tipik është përdorimi i softuerëve si R-Studio, i cili punon me konceptin e grupeve të vëllimeve dhe RAID-ve virtuale.
Kur RAID-i origjinal bëhet i paarritshëm , por të gjitha ose pothuajse të gjitha disqet (ose imazhet e plota të diskut) janë të disponueshme, procesi profesional përfshin së pari klonimin e çdo disku në një imazh disku për të ruajtur gjendjen aktuale. Nga këto imazhe, softueri lejon krijimin e një RAID virtual me të njëjtat parametra si sistemi aktual.
Një RAID virtual ndërtohet duke zgjedhur disqet e duhura , duke i vendosur ato në rendin e duhur dhe duke përcaktuar konfigurimin e saktë: numrin e disqeve, madhësinë e shiritit, zhvendosjen fillestare, llojin e RAID (0, 1, 5, 6, 10, JBOD, etj.), dhe rendin e blloqeve (majtas, djathtas, sinkron, asinkron, i personalizuar, etj.). Ndërsa kryhet kjo montim logjik, softueri nuk shkruan në disqet fizike; gjithçka përpunohet virtualisht.
Në një konfigurim të thjeshtë RAID 5 me tre disqe , për shembull, të paktën dy disqe duhet të jenë në gjendje të mirë për të provuar një rindërtim logjik. Një matricë virtuale RAID 5 krijohet duke specifikuar tre pajisjet (ose imazhet) dhe madhësinë e bllokut, dhe më pas testohet derisa të gjendet një kombinim parametrash që i lejon softuerit të zbulojë një ndarje të vlefshme dhe të rendisë skedarët.
Në konfigurime më komplekse , siç është RAID 5 i avancuar me renditje të personalizuar të blloqeve, mund të përcaktohet një tabelë renditjeje e blloqeve, duke specifikuar sekuencën e saktë të të dhënave dhe paritetin (P, 1, 2, 3, etj.) sipas rreshtit. Tekniku fut modelin e vijëzimit rresht pas rreshti dhe programi nxjerr në pah kombinimet e pavlefshme me të kuqe, duke ndihmuar në identifikimin e shpejtë të gabimeve të konfigurimit.
Pasi zbulohet një sistem skedarësh konsistent brenda RAID virtual, dosjet dhe skedarët numërohen, testohen pamjet paraprake (veçanërisht të skedarëve të mëdhenj) dhe verifikohet që përmbajtja të jetë konsistente, pa ndonjë fragmentim të pazakontë ose korruptim të dukshëm. Ky hap është thelbësor sepse ndonjëherë softueri gjen struktura konsistente të sistemit të skedarëve edhe nëse një nga parametrat RAID është i pasaktë.
Për të verifikuar konfigurimin e vargut, është e zakonshme të përdoret një formulë e përafërt që ndihmon në zgjedhjen e madhësisë minimale ideale të skedarit për testimin paraprak: madhësia e bllokut shumëzuar me (numri i disqeve minus 1). Për shembull, në një varg RAID 5 me tre disqe dhe një madhësi blloku prej 64 KB, një skedar prej të paktën 128 KB zakonisht ofron një pikë të mirë referimi për të vërtetuar se shpërndarja e të dhënave dhe pariteti janë të sakta.
Mjetet profesionale ju lejojnë gjithashtu të trajtoni disqet që mungojnë duke i zëvendësuar ato me objekte "disk bosh" ose "disk që mungon" me të njëjtën madhësi. Kjo është e dobishme kur njëri nga disqet është plotësisht i parikuperueshëm: softueri simulon praninë e tij bazuar në paritetin dhe informacionin e disqeve të tjerë, duke ju lejuar ndonjëherë të rikuperoni shumicën e të dhënave të mbetura.
Për më tepër, shabllonet e konfigurimit RAID mund të krijohen, ruhen dhe ringarkohen , si dhe të lidhet ose shkëputet dinamikisht çdo disk brenda RAID virtual për të parë se si ndikon në varg. Kjo veçori është thelbësore për të përcaktuar se cili disk ishte në të vërtetë i dëmtuar në një RAID 5, për shembull, duke i shkëputur ato një nga një dhe duke vëzhguar sjelljen e sistemit të skedarëve të simuluar.
Shkaqet e zakonshme të dështimit të sistemit RAID
Dështimet e sistemit RAID mund të jenë logjike, fizike ose të shkaktuara nga njeriu , dhe shpesh ndodhin në kombinim. Edhe pse RAID-et janë projektuar për të rritur besueshmërinë, ato nuk janë imune ndaj gabimeve të përsëritura ose mirëmbajtjes joadekuate.
Humbja e shiritit të paritetit është një problem logjik që ndodh kur informacioni i përdorur për të rindërtuar të dhënat (pariteti) bëhet i korruptuar ose i paqëndrueshëm. Në këto situata, vetë sistemi RAID nuk është në gjendje të rikuperohet dhe kërkohet ndërhyrja e jashtme për të lokalizuar dhe rindërtuar saktë këto shirita pariteti.
Dështimet fizike të disqeve në një matricë RAID nuk janë shumë më të shpeshta sesa në disqet individuale, por ndikimi i tyre shumëfishohet sepse matrica varet nga të gjithë ata. Është vlerësuar se midis 2% dhe 3% të disqeve të instaluara mund të dështojnë çdo vit, të prekura nga problemet tipike: sektorë të këqij, rritje të tensionit, temperatura ekstreme, motorë të bllokuar, koka leximi/shkrimi të dëmtuara, komponentë elektronikë me defekt, etj.
Faktorë të tjerë si viruset, ransomware-i ose korruptimi i sistemit të skedarëve mund të shkaktojnë që RAID të ndalojë së montuari siç duhet ose, edhe nëse shfaqet "në linjë", ta bëjë ndarjen ose vëllimin logjik të paarritshëm. Drajverët e instaluar gabimisht, përditësimet e dështuara të firmware-it ose ndërprerjet e përsëritura të energjisë gjithashtu mund të korruptojnë meta të dhënat e RAID.
Situata bëhet më e ndërlikuar kur ndodhin dy ose më shumë dështime radhazi . Për shembull, në një grup RAID 5 ku një disk degradohet dhe nuk zëvendësohet menjëherë, nëse një disk i dytë fillon të dështojë gjatë procesit të rindërtimit, sistemi nuk është më në gjendje të rindërtojë automatikisht të dhënat. Nga ky moment e tutje, çdo përpjekje për riparim pa metodologji profesionale mund ta përkeqësojë dëmin në mënyrë të pakthyeshme.
Gabimi njerëzor është padyshim shkaku më i rrezikshëm : lënia e një disku të shënuar si defektoz pa e zëvendësuar atë, injorimi i alarmeve të degradimit, përzierja e disqeve nga vargje të ndryshme, mbyllja e sistemit në mes të një rindërtimi ose zgjedhja e opsioneve të gabuara në firmware-in e kontrolluesit. Në shumë nga këto raste, dëmi përfundimtar nuk shkaktohet nga dështimi fillestar, por nga përgjigja joadekuate.
Procesi profesional i rikuperimit të të dhënave në sistemet RAID
Laboratorët e specializuar ndjekin një rrjedhë pune shumë të rreptë për të maksimizuar shanset e rikuperimit të të dhënave nga një RAID i dështuar. Edhe pse çdo rast është i ndryshëm, procedura e përgjithshme është zakonisht e ngjashme.
Së pari, kryhet një diagnozë teknike , zakonisht falas dhe pa detyrime te shumë ofrues shërbimesh profesionale. Kjo përfshin identifikimin e nivelit RAID, markës dhe modelit të kontrolluesit ose NAS, numrit dhe llojit të disqeve, gjendjes fizike të secilit disk dhe çdo simptomë të vëzhguar (degradim, dështim i nisjes, zhurma mekanike, gabime leximi, etj.).
Më pas, disqet e mbetura funksionale klonohen sektor pas sektori . Ky hap është thelbësor: media origjinale nuk përpunohet kurrë për periudha të gjata, pasi një kokë e dëmtuar, një pjatë e gërvishtur ose sektorë të paqëndrueshëm mund të shkaktojnë përkeqësim të mëtejshëm gjatë rikuperimit. Kopjet bëhen duke përdorur pajisje dhe softuerë forenzikë të aftë për të trajtuar gabimet e leximit duke kontrolluar ripërpjekjet dhe kohët e pritjes.
Duke përdorur imazhe të të gjitha disqeve të disponueshme , RAID rindërtohet logjikisht në një mjedis të izoluar. Përcaktohen parametra të tillë si madhësia e bllokut, rendi i diskut, lloji i paritetit dhe çdo ndryshim specifik i prodhuesit (p.sh., implementime specifike të RAID 5, RAID 6, RAID 50 ose RAID 60). Në konfigurime të përziera ose komplekse, analizohen gjithashtu shtresa shtesë si LVM, menaxherët e vëllimit, enkriptimi dhe sistemet e skedarëve si ZFS, ext4, Btrfs, XFS, HFS+, NTFS, etj.
Pasi të montohet RAID virtual , bëhet një përpjekje për të gjetur dhe montuar sistemin e skedarëve. Nëse zbulohet një ndarje e vlefshme, struktura e direktorisë listohet dhe kryhen kontrolle të integritetit: parapamje të skedarëve kritikë, verifikim i bazave të të dhënave, skedarëve të makinës virtuale, imazheve, etj. Kur është i pranishëm korruptim i pjesshëm, teknikat e rindërtimit të sistemit të skedarëve kombinohen me rikuperimin "të papërpunuar" (bazuar në nënshkrim) të llojeve specifike të skedarëve.
Pasi laboratori përfundon analizën , zakonisht i ofron klientit një listë skedarësh të rikuperueshëm për shqyrtim përpara se të miratojë shërbimin. Vetëm atëherë të dhënat e rikuperuara kopjohen në disqe të reja të jashtme të forta ose në një pajisje të dakorduar, kurrë në grupin origjinal RAID, i cili mbetet i paprekur në rast se ndonjë pjesë e procesit duhet të përsëritet ose rishikohet.
Shërbimet profesionale të rikuperimit zakonisht punojnë me të gjitha llojet e markave të disqeve (Seagate, Western Digital, Toshiba, Samsung, Crucial, SanDisk, Kingston, LaCie, etj.) dhe një gamë të gjerë kontrolluesish dhe kutish RAID: nga kartat RAID SAS/SATA të serverit deri te zgjidhjet e jashtme Thunderbolt, USB, iSCSI, Fibre Channel, grupet komerciale NAS ose sistemet e ruajtjes së të dhënave të ndërmarrjeve.
Praktikat më të mira dhe gabimet që duhen shmangur kur një RAID dështon
Nëse RAID-i juaj fillon të ketë probleme , ka një numër veprimesh që duhet t'i shmangni me çdo kusht nëse nuk jeni specialist i rikuperimit të të dhënave. Shumë fatkeqësi të plota mund të ishin minimizuar thjesht duke mos prekur butona të caktuar.
Mos kryeni kurrë një rindërtim të verbër . Kontrolluesi ose magjistari i NAS zakonisht ofron opsionin "rindërto" ose "rindërto vargun" sapo zbulon një disk të ri. Nëse sistemi ka përjetuar disa dështime, informacioni se cilët disqe ishin të mirë dhe cilët jo mund të jetë i vjetëruar, dhe rindërtimi në ato kushte mund të shkatërrojë përgjithmonë paritetin e vlefshëm.
Mos i zëvendësoni disqet pa përcaktuar më parë se cilat prej tyre kanë dështuar dhe kur . Zëvendësimi i diskut të gabuar mund ta detyrojë sistemin ta trajtojë një disk që përmban të dhëna të vjetruara si "të mirë". Në vargjet RAID si RAID 5 ose RAID 6, rendi dhe koha e saktë e dështimeve janë kritike për të siguruar integritetin e të dhënave që do të kombinohen gjatë rindërtimit.
Mos e fikni RAID-in gjatë një rindërtimi në vazhdim, përveç nëse udhëzoheni posaçërisht për ta bërë këtë nga një teknik i kualifikuar dhe nëse nuk kryhet në kushte të kontrolluara. Gjatë një rindërtimi, redundanca zakonisht çaktivizohet dhe sistemi funksionon në një gjendje shumë të brishtë. Një ndërprerje e energjisë, një ndërprerje e energjisë ose një rinisje e detyruar mund ta lërë RAID-in në një gjendje të ndërmjetme nga e cila nuk mund të rikuperohet.
Mos u përpiqni t’i riparoni vetë fizikisht disqet . Hapja e një hard disku jashtë një dhome të pastër, goditja e tij, ngrirja e tij ose ndonjë "truk DIY" tjetër që qarkullon në internet jo vetëm që nuk do të ndihmojë, por mund të shkatërrojë plotësisht sipërfaqen magnetike të pllakave, duke eliminuar çdo shans suksesi edhe për një punishte profesionale riparimi.
Nëse dëgjoni zhurma, kërcitje ose fishkëllima të çuditshme nga ndonjë disk në grupin RAID, veprimi më i sigurt është ta fikni sistemin në mënyrë të sigurt dhe të mos e rinisni derisa të jetë vlerësuar. Detyrimi i një procesi nisjeje në mënyrë të përsëritur me një disk të dëmtuar mekanikisht shpesh rezulton në koka leximi/shkrimi të prishura që gërvishtin pjatën.
Rekomandimi i përgjithshëm në çdo skenar serioz është të ndaloni të gjitha operacionet, të dokumentoni me qetësi atë që ka ndodhur (mesazhet e gabimit, datat, ndryshimet e fundit në harduer ose softuer) dhe të kontaktoni një shërbim të specializuar në rikuperimin e të dhënave RAID. Sa më pak manipulime paraprake, aq më të mëdha janë gjasat e suksesit dhe aq më e ulët është kostoja e ndërhyrjes.
Edhe pse sistemet moderne RAID janë shumë të fuqishme dhe teknologjitë e ruajtjes përmirësohen në kapacitet dhe besueshmëri çdo vit, kopjet rezervë të rregullta në media të veçanta mbeten thelbësore. Me një plan të mirë kopje rezervë dhe një mendje të ftohtë përballë çdo dështimi, kombinimi i parandalimit dhe shërbimeve të specializuara profesionale siguron që, edhe në rast të fatkeqësive serioze RAID, shanset për të rikuperuar informacionin kritik mbeten shumë të larta.
