• br00ky
  • Registratie: Januari 2014
  • Laatst online: 30-08 16:29

br00ky

Moderator Harde Waren
Topicstarter
Mede-auteurs:
  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51

Renault


Check je SMART topic


Afbeeldingslocatie: https://goughlui.com/wp-content/uploads/2013/10/Toshiba3Tb-Drive1.png


Voor wie is dit topic?
Is jouw schijf al met één platter in de digitale hemel? Of zijn al die waarschuwingen maar overdreven en kan je schijf nog prima mee?

In dit topic kun je ons vragen om de SMART van jouw hardeschijf of SSD te analyseren. Je post een screenshot van de SMART-gegevens met daarbij de informatie om welke schijf het gaat en welke klachten er zijn. Wij zullen vervolgens jouw SMART bekijken en je van advies voorzien. Gratis en voor niets! ;)


Wat zijn de regels?
  • Je post een beknopte uitleg over waarom je om advies vraagt en of er concrete klachten zijn of vermoedens dat de schijf niet goed werkt.
  • Je post een screenshot waarbij alle SMART gegevens zichtbaar zijn.
Het posten van lange lappen text is niet toegestaan; maak een plaatje/screenshot van de SMART gegevens. Alleen als het echt niet anders kan, mag je als text posten. Maar dan moet het wel specifiek om de SMART attributen gaan en niet de gehele SMART error log. Dergelijke posts worden verwijderd.


Tip: stel de output in als decimaal
Gebruik je CrystalDiskInfo om de SMART uit te lezen, weet dan dat je het beste de output kunt instellen op decimaal ipv hexadecimaal. Dit doe je als volgt:

Menu: Function -> Advanced Feature -> Raw Values -> 10 [DEC]


Tip: doe NOOIT actieve tests voordat je de SMART hebt uitgelezen!
Maar al te vaak gaan mensen bij veronderstelde problemen met hun hardeschijf allerlei testjes uitvoeren. Populair daarbij is ook de utility van de fabrikant. Maar al te vaak gebeurt het dat zij deze utilities draaien voordat de SMART-gegevens zijn uitgelezen. In dat geval kun je spreken van contaminatie omdat de SMART niet meer betrouwbaar bewijs is. Het zou namelijk prima kunnen dat de hardeschijf utility van de fabrikant wijzigingen heeft aangebracht en bad sectors heeft verholpen. Vaak gebeurt dit zonder de gebruiker goed te informeren. De gebruiker krijgt dan gewoon te zien dat de schijf 'PASSED' is en dus in orde lijkt te zijn. Als de gebruiker daarna de SMART uitleest en ziet dat er geen bad sectors zijn, is de waarheid compleet verhuld. Zo zou de gebruiker nooit weten of er iets mis is geweest met de schijf.

Dus doe jezelf een lol en stel eerst de SMART gegevens veilig voordat je gaat prutsen met allerlei utilities. Bovendien is het zo dat een simpele surface scan genoeg is; het is niet alsof speciale utilities andere dingen doen. Alle handelingen met je hardeschijf kunnen de SMART beïnvloeden. Je wilt graag bewijs zodat je weet of je schijf een probleem heeft gehad. Dit verstoor je door eerst actieve utilities te draaien en daarna pas de SMART uit te lezen; dat kun je dus beter andersom doen. Lees je dit te laat en heb je al actieve utilities gedraaid? Dan zul je nooit meer zeker weten of de SMART die je nu ziet is veranderd. Als er nu staat 0 bad sectors kan het zijn dat je eerst wel degelijk bad sectors hebt gehad. Die informatie is dan voorgoed verdwenen; alsof het bewijs op professionele wijze is verdoezeld. Kortom, probeer zuinig te zijn met je SMART als je wat over je hardeschijf of SSD wilt weten.

Wat betekenen die Current, Worst en Threshold waarden?
Current/Worst/Threshold (Nederlands: Huidig/Slechtste/Drempel) zijn genormaliseerde waarden tussen de 0 en 255, oftewel precies één byte, 8 bits.

Voor deze waarden geldt dat hoe hoger hoe beter. Vaak beginnen de waarden op 100, 150 of 200. Dat is de best mogelijke waarde. Zodra een bepaald attribuut het slechter doet, kan de genormaliseerde waarde doen afnemen. De Current-waarde is de genormaliseerde waarde op dit moment, terwijl Worst de laagste waarde is die ooit gemeten is.

Voorbeeld: de temperatuur kan absoluut 40 graden zijn. De Current-waarde kan dan 60 zijn (100 - 40) terwijl de Worst-waarde 50 kan zijn. Dat verhult dat in het verleden de schijf ooit maximaal 50 graden is geworden. De Threshold kan 40 zijn, wat overeenkomt met 60 graden celcius.

De Threshold-waarde geeft aan dat als de Current-waarde onder deze waarde zakt, er een SMART failure wordt gegenereerd. Dan kan bijvoorbeeld je BIOS zeggen dat je hardeschijf aan het falen is. Officiëel hoor je dan 'FAILING NOW' te zien als je met een goed programma de SMART uitleest. Is de huidige waarde echter al weer hoger geworden, dan zal nog steeds de 'Worst'-waarde onthullen dat in het verleden deze waarde onder de Threshold is gezakt. Een goed programma zegt dan 'In_The_Past'.

Het interpreteren van SMART gaat altijd fout. Er is geen enkel programma ter wereld die dit helemaal correct doet. Fabrikanten misbruiken SMART ook en houden zich vaak niet aan de SMART-specs. Bijvoorbeeld door de temperatuur in absolute getallen weer te geven in de Current waarde; waardoor een lager getal beter is ipv slechter zoals SMART ontworpen is. Vooral OCZ en andere misbaksels maken zich hier schuldig aan.

Uitleg over de SMART attributen:

1: Raw Read Error Rate
Dit attribuut geeft de verhouding weer tussen leesacties die géén errorcorrectie nodig hebben en leesacties die zouden mislukken als er geen ECC errorcorrectie voorhanden was. Hardeschijven kunnen niet meer zonder ECC maar als je relatief vaak ECC nodig hebt, kun je sneller onleesbare sectoren krijgen.

Kortom, dit attribuut geeft weer hoe snel je - relatief aan hoeveel data je leest - naar errorcorrectie moet grijpen. Ideaal zou zijn dat je nooit errorcorrectie nodig hebt en dus een grote marge hebt dat als een sector een keer veel slechter dan het gemiddelde doet, je heel veel errorcorrectie mogelijkheid over hebt. Maar als je standaard al heel veel bit errors moet corrigeren voor elke sector, en sector X heeft meer dan gemiddeld aantal biterrors, dan is het risico groot dat het aantal bit errors groter is dan de ECC errorcorrectie kan corrigeren. Een dergelijke schijf wordt gatenkaas met veel bad sectors; dat betekent omruilen voor garantie of permanent afschrijven.

2: Reallocated Sector Count
Aantal omgewisselde sectoren met reserve sectoren. Dit gebeurt alleen als een sector fysiek beschadigd is. Maar dat is tegenwoordig vrij zeldzaam. Minimaal 90% van de bad sectors zijn bad sectors zonder fysieke schade maar waarbij de errorcorrectie mogelijkheid onvoldoende is om de data foutloos te kunnen lezen. Typerend hierbij is dat het overschrijven van de sector met nieuwe data betekent dat die sector weer bruikbaar is; bij een fysiek beschadigde sector is dat niet zo. Zodra je een bad sector overschrijft met nieuwe data zal de hardeschijf testjes doen en als de sector nog steeds problemen geeft, dan wordt deze omgewisseld met een reserve sector; zo niet dan blijft hij gewoon in gebruik en is het geen bad sector meer.

3: Current Pending Sector
De allerbelangrijkste SMART-attribuut. Dit is het aantal onleesbare sectoren; dat kunnen bad sectors zijn mét of zónder fysieke schade, zoals hierboven uitgelegd. Zodra je deze sectoren overschrijft, verdwijnen ze omdat de sector dan weer in gebruik genomen wordt en goed werkt, of deze wordt omgewisseld met een reserve sector. De Current Pending Sector raw-value wordt dan weer lager. De raw value moet altijd 0 zijn, wat betekent geen bad sectors op dit moment.

4: Offline Uncorrectable
Hetzelfde als Current Pending Sector maar dit attribuut wordt niet continu bijgewerkt. Dus als je bewijs hebt vernietigt met een zero-write en Current Pending Sector is 0, dan kun je hieraan nog wel zien dat je in het verleden bad sectors had.

5. UDMA CRC Error Count
Dit betreffen kabelfouten. Niet de stroomkabel maar de roodkleurige datakabel die van het opslagapparaat naar de I/O controller gaat - vaak het moederbord. In tegenstelling tot veel andere attributen, gaat dit getal nooit meer omlaag. Dus als je eenmaal 30 kabelfouten hebt, blijft dit zo totdat er nieuwe fouten bij komen. Dit betekent dat je de eerste keer dat je dit ziet, niet weet hoe lang geleden dit is gebeurd. Het kan zijn dat dit in een ver verleden was en je schijf nu absoluut geen kabelfouten meer heeft. Dit kun je vrij eenvoudig controleren: bekijk de SMART nogmaals een paar dagen later. Is de (raw-)waarde gelijk gebleven? Dan heb je geen kabelfouten meer gehad sinds de laatste keer. Indien de waarde is gestegen, heb je dus nog wel problemen en is het vervangen van de kabel een optie. In mijn eigen ervaring is het goed aandrukken van de kabel en zorgen dat deze geen sterke buigingen heeft veelal voldoende. Maar je kunt ook een slechte kabel hebben. Het kan zijn dat een kabel prima werkt op SATA/300 snelheid, maar dat op SATA/600 er zich problemen voordoen. Er bestaat echter maar één 'SATA' kabel. Dus als je kabel niet werkt op SATA/600 - ook al is hij oud - dan is het gewoon een slechte kabel die niet aan de specificaties voldoet. Je kunt grofweg aan de dikte afleiden hoe goed de kabel is.

  • LankHoar
  • Registratie: April 2013
  • Laatst online: 00:48

LankHoar

Langharig tuig

Vandaag bij mijn vader hoorde ik een tikkend geluid bij zijn externe schijf. Zo oud is die nog niet, en wordt slechts zo nu en dan aangesloten om backups op weg te schrijven. Het klonk als een klok. Na afsluiten computer tikte het door tot ik hem loskoppelde. Bij herstarten was het er ook nog, hoewel wat minder regelmatig. Gelijk maar even een SMART gedraaid, en ik zie zo niets bijzonders?

Afbeeldingslocatie: https://tweakers.net/i/j5GtQEhvT-SVpt28o3z8GM3awFc=/fit-in/4000x4000/filters:no_upscale():strip_exif()/f/image/H4RBobHLa9i2fWpW48FVFuyT.png?f=user_large

When life throws you a curve, lean into it and have faith!


  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
Qua SMART- cijfers is er inderdaad niets afwijkends te zien op de waarde voor opstarttijd na.

[ Voor 21% gewijzigd door Renault op 03-03-2026 20:33 ]


  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
@LankHoar Tikken als een klok kan wijzen op het herhaaldelijk bewegen van de koppen. Bij dit fimpje hoor je zo'n geluid: YouTube: How To Repair WD Clicking HDD ?

Als klinkt als een klik, kan hetzelfde aan de hand zijn. Dat kun je hier horen:
YouTube: HDD CLICK OF DEATH - what it sounds and looks like!

De magneet in een hard disk drive bij de arm zorgt vaak voor een typische klik.

  • The_Doman
  • Registratie: Augustus 2005
  • Laatst online: 00:42
LankHoar schreef op maandag 2 maart 2026 @ 16:48:
Vandaag bij mijn vader hoorde ik een tikkend geluid bij zijn externe schijf. Zo oud is die nog niet, en wordt slechts zo nu en dan aangesloten om backups op weg te schrijven. Het klonk als een klok. Na afsluiten computer tikte het door tot ik hem loskoppelde. Bij herstarten was het er ook nog, hoewel wat minder regelmatig. Gelijk maar even een SMART gedraaid, en ik zie zo niets bijzonders?
Ik heb hier ook wel externe HDD's waarvan ik van sommige wel eens kan horen dat ze lange tijd "bezig zijn" terwijl deze niet in gebruik zijn, ook niet door Windows defrag.
Waarschijnlijk behoort dat dan bij de interne huishouding van de drive,
Klikkende geluiden in combinatie met leesfouten is natuurlijk wel iets heel anders.

Maar voor WD drives is het wel een bekend iets:
Google: WD Preventive Wear Leveling PWL

Als je twijfelt aan de conditie van de HDD, SMART zegt ook niet altijd alles, kan je natuurlijk altijd een full diagnostic scan doen via de WD diagnose software of andere tools:

Externe hdd bewogen tijdens opstarten
The_Doman schreef op donderdag 12 juni 2025 @ 13:33:
Wil je het echt zeker weten dan kan je een zogenaamde "bad sector test" op de schijf uitvoeren.
Daar zijn diverse tooltjes voor zoals het bekende HD Tune
Ook wel prima is deze zo te zien:
Macrorit Disk Scanner (Free Portable)

  • LankHoar
  • Registratie: April 2013
  • Laatst online: 00:48

LankHoar

Langharig tuig

mrmrmr schreef op dinsdag 3 maart 2026 @ 22:59:
@LankHoar Tikken als een klok kan wijzen op het herhaaldelijk bewegen van de koppen. Bij dit fimpje hoor je zo'n geluid: YouTube: How To Repair WD Clicking HDD ?

Als klinkt als een klik, kan hetzelfde aan de hand zijn. Dat kun je hier horen:
YouTube: HDD CLICK OF DEATH - what it sounds and looks like!

De magneet in een hard disk drive bij de arm zorgt vaak voor een typische klik.
Het klinkt niet zoals in deze filmpjes. Echt meer zoals een klok. Heel regelmatig 1 tik, ongeveer elke seconde. Klik, klik, klik. Geen idee hoe ik dat beter moet typen :P

Ik zal eens kijken of ik er een filmpje van kan maken waarop het te horen is.
The_Doman schreef op woensdag 4 maart 2026 @ 15:47:
[...]

Ik heb hier ook wel externe HDD's waarvan ik van sommige wel eens kan horen dat ze lange tijd "bezig zijn" terwijl deze niet in gebruik zijn, ook niet door Windows defrag.
Waarschijnlijk behoort dat dan bij de interne huishouding van de drive,
Klikkende geluiden in combinatie met leesfouten is natuurlijk wel iets heel anders.

Maar voor WD drives is het wel een bekend iets:
Google: WD Preventive Wear Leveling PWL

Als je twijfelt aan de conditie van de HDD, SMART zegt ook niet altijd alles, kan je natuurlijk altijd een full diagnostic scan doen via de WD diagnose software of andere tools:

Externe hdd bewogen tijdens opstarten

[...]
Check, ik ga eens met van die tooltjes kijken of ik het kan achterhalen!

Bedankt voor de tips, ik kom er op terug binnenkort :)

When life throws you a curve, lean into it and have faith!


  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
@LankHoar
Maak wel eerst een backup van onmisbare data als je tooltjes laat draaien. Dat is vooral van belang bij een defect in de koppen of oppervlak. Bijvoorbeeld ddrescue heeft een parameter "-n" die daar voor zorgt.

Het probleem met een aantal tools is dat ze oneindig proberen data te lezen en dat daardoor koppen en/of het betrokken gebied slechter kunnen worden. Als er zoiets aan de hand is, kan dat er voor zorgen dat de disk stopt met werken of onbruikbaar wordt. Goede tools hebben een functie om slechte plekken over te slaan en eerst wel leesbare data veilig te stellen.

Als de data eenmaal veilig is, of voor ingebruikname van een disk, gebruik ik de tool h2testw. Die schrijft de disk vol met echte data en leest die terug. Het gaat langzaam en grondig, beter dan tools die de datagebieden van een disk niet volledig testen.

  • LankHoar
  • Registratie: April 2013
  • Laatst online: 00:48

LankHoar

Langharig tuig

mrmrmr schreef op donderdag 5 maart 2026 @ 22:28:
@LankHoar
Maak wel eerst een backup van onmisbare data als je tooltjes laat draaien. Dat is vooral van belang bij een defect in de koppen of oppervlak. Bijvoorbeeld ddrescue heeft een parameter "-n" die daar voor zorgt.

Het probleem met een aantal tools is dat ze oneindig proberen data te lezen en dat daardoor koppen en/of het betrokken gebied slechter kunnen worden. Als er zoiets aan de hand is, kan dat er voor zorgen dat de disk stopt met werken of onbruikbaar wordt. Goede tools hebben een functie om slechte plekken over te slaan en eerst wel leesbare data veilig te stellen.

Als de data eenmaal veilig is, of voor ingebruikname van een disk, gebruik ik de tool h2testw. Die is schrijft de disk vol met echte data en leest die terug. Het gaat langzaam en grondig, beter dan tools die de datagebieden van een disk niet volledig testen.
Bedankt voor de tips wat betreft tooling, ik ga er mee aan de slag. Betreft de data: deze schijf dient enkel als backup schijf, dus dat zit wel snor. Er staat ook nog een backup in de cloud, dus ook wat dat betreft is alles goed :)

When life throws you a curve, lean into it and have faith!


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
Goed topic. Ik moet eigenlijk bekennen dat ik nooit de status van mijn disks check en een beete (naïef wellicht) op de reporting van Synology vertrouw. Vanwege dit topic toch maar eens een check gedaan op 2 paar disks. Het eerste paar zijn 2x 3TB WD Red uit 2013 die eerst in mijn NAS zaten en nu al sinds 2017 in mijn PC draaien als een soort extra opslagplek. In 2017 heb ik namelijk 2x 8TB WD Red in mijn NAS gegooid. Dat is inmiddels al een hele poos geleden en dat zie je ook wel aan het aantal draaiuren. Alles lijkt ok, behalve de 2e 3TB disk die waarde 16 geeft bij de Read Error Rate? Ik heb er te weinig verstand van dus ik laat het oordeel graag aan de kenners over:

WD RED 3TB Disk 1

Afbeeldingslocatie: https://tweakers.net/i/MSTLbaTdaAQDPLXPvoxWkP3HtQA=/800x/filters:strip_icc():strip_exif()/f/image/shQnKFLyeNx3R2GmQoH3JmyU.jpg?f=fotoalbum_large

WD RED 3TB Disk 2

Afbeeldingslocatie: https://tweakers.net/i/LhgaepCR2aGYUTz-sPfqJYEH4Ig=/800x/filters:strip_icc():strip_exif()/f/image/G0LYy6lVCQK42fpZFkKIVmWH.jpg?f=fotoalbum_large

WD RED 8TB Disk 1

Afbeeldingslocatie: https://tweakers.net/i/7987ZMSRUKi98WCVOSDSV1NJ8gA=/800x/filters:strip_icc():strip_exif()/f/image/f08Nem5m1BjR7MKjxh0rMg5n.jpg?f=fotoalbum_large

WD RED 8TB Disk 2

Afbeeldingslocatie: https://tweakers.net/i/MDToS1kSkTLb6nzfRf36XobuH40=/800x/filters:strip_icc():strip_exif()/f/image/lCHVdlryQ3OiwvSrtIxBLDIw.jpg?f=fotoalbum_large

  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
@benchMarc

De "WD RED 3TB Disk 2" heeft alleen een error rate als bijzondere waarde. WD geeft er geen WD-specifieke uitleg over. Uit onderzoeksdata blijkt dat er geen correlatie is tussen het falen van een drive en deze waarde, misschien omdat diverse fabrikanten er diverse waarden in stoppen, levert dat niet een goed beeld op. Seagate bijvoorbeeld gebruikt de waarde als een datastructuur. Er worden meerdere waarden in opgeslagen in dezelfde (samengestelde) variabele. De aanwezigheid of hoogte van een waarde zegt dan weinig op de betrouwbaarheid van de drive.

In het algemeen is er wel een duidelijke correlatie tussen falen en deze SMART waarden:
smartwaarde nr.omschrijving
5Reallocated Sectors Count
187Reported Uncorrectable Errors
197Current Pending Sector Count
198Uncorrectable Sector Count
De disk zal zelf proberen problemen op te lossen. Bijvoorbeeld door slechte sectoren te verplaatsen: dan neemt Current Pending Sector Count af en neemt Reallocated Sectors Count toe.

De 8TB disks zijn ok wat betreft SMART, maar ze zijn wel oud. Ze hebben meer dan 8 jaar gedraaid.

De 3TB disks hebben een draaitijd van 4,5 jaar gehad. 5-7 jaar is ongeveer de economische levensduur van hard disks. In data storage centers worden SATA disks soms bij 5 jaar al vervangen.

Het is efficiënt om zo weinig mogelijk disks te hebben aan staan, met name kleine 3.5" disks zijn inefficiënt. De metriek die ik wel eens gebruik is het aantal Watt per 10 TB. Een cijfer rondom 2 of zelfs lager is efficiënt voor mechanische hard disks.

Oude hard disks kunnen periodiek (bijvoorbeeld in een externe behuizing) worden aangezet voor backup doeleinden. Backup is nodig als je bestanden niet wil kwijtraken. Mirroring beschermd niet tegen bijvoorbeeld gebruikersfouten (toch het meest voorkomend, ook of juist onder IT professionals) of fouten door applicaties en besturingssysteem.

  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
mrmrmr schreef op zaterdag 7 maart 2026 @ 22:19:
@benchMarc

De "WD RED 3TB Disk 2" heeft alleen een error rate als bijzondere waarde. WD geeft er geen WD-specifieke uitleg over. Uit onderzoeksdata blijkt dat er geen correlatie is tussen het falen van een drive en deze waarde, misschien omdat diverse fabrikanten er diverse waarden in stoppen, levert dat niet een goed beeld op. Seagate bijvoorbeeld gebruikt de waarde als een datastructuur. Er worden meerdere waarden in opgeslagen in dezelfde (samengestelde) variabele. De aanwezigheid of hoogte van een waarde zegt dan weinig op de betrouwbaarheid van de drive.
Klopt, dat van Seagate had ik ook gelezen toen ik op onderzoek uit ging. Ik kon er zelf ook niks nuttigs over vinden wat WD betreft, maar ik vind het wel apart dat die andere disk (identiek model) wel de waarde 0 heeft.
De 8TB disks zijn ok wat betreft SMART, maar ze zijn wel oud. Ze hebben meer dan 8 jaar gedraaid.

De 3TB disks hebben een draaitijd van 4,5 jaar gehad. 5-7 jaar is ongeveer de economische levensduur van hard disks. In data storage centers worden SATA disks soms bij 5 jaar al vervangen.

Het is efficiënt om zo weinig mogelijk disks te hebben aan staan, met name kleine disks zijn inefficiënt. De metriek die ik wel eens gebruik is het aantal Watt per 10 TB. Een cijfer rondom 2 of zelfs lager is efficiënt voor mechanische hard disks.

Oude hard disks kunnen periodiek (bijvoorbeeld in een externe behuizing) worden aangezet voor backup doeleinden. Backup is nodig als je bestanden niet wil kwijtraken. Mirroring beschermd niet tegen bijvoorbeeld gebruikersfouten (toch het meest voorkomend, ook of juist onder IT professionals) of fouten door applicaties en besturingssysteem.
Ik weet het. Het zijn oude disks en de huidige prijzen van harddisks daar word ik niet bepaald blij van. Toch heb ik de knoop een paar dagen geleden doorgehakt en heb ik een nieuwe NAS (UGreen) met 4x10TB WD REDs besteld. Het kost echt een behoorlijke duit, maar ik wil ook weer niet het risico lopen dat er dadelijk bijv over een half jaar 1 schijf mee ophoudt van mijn RAID1 config en ik daardoor alsnog hals over kop iets nieuws moet kopen met wie weet wat voor prijzen er dan gelden.
Ook heb ik de 8TBs altijd nonstop laten draaien zonder spinning down. Wellicht niet zo verstandig, maar in mijn "wijsheid" meende ik dat het constant laten draaien van NAS-schijven beter zou zijn voor de levensduur dan de schijven in slaapstand te laten zetten.
Ik ben me ervan bewust dat RAID1 nooit een backup is, dat probeer ik ook mensen op mijn werk altijd duidelijk te maken. Daarom heb ik alle mission critical data van mijn NAS nog op twee andere plaatsen staan. De series/films die te groot werden voor mijn huidige 8TB storage die ik naar de 3TB disks heb verhuisd zijn nice to haves en daar zal ik niet van wakker liggen als een van de schijven er binnenkort mee ophoudt.
Als ik mijn NAS met 4x10TB (RAID5 zat ik aan te denken) binnen heb dan laat ik m'n huidige DS214+ NAS met 8TB mooi van de stroom af als extra backup staan.

[ Voor 0% gewijzigd door benchMarc op 07-03-2026 23:54 . Reden: typo ]


  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
Gewoon doordraaien mmet die twee disks.
En een actuele backup is nooit weg ...

  • Vodgen
  • Registratie: Oktober 2000
  • Laatst online: 20:52
De prijzen van harddiks rijzen de pan uit. De 3 TB WD Red schijven in mijn Synology draaien vooralsnog 24/7 vrolijk door en hopelijk blijven ze dat nog even doen met die hoge prijzen. De Smart waardes zijn volgens mij nog steeds prima. _/-\o_ Op naar de 100.000 draaiuren.

Afbeeldingslocatie: https://tweakers.net/i/JqvgN3ORH9ozTTya2WH9xRMib6g=/fit-in/4920x3264/filters:max_bytes(3145728):no_upscale():strip_icc():strip_exif()/f/image/4Igcbxkq4Ljy0pw2E28pvxA9.jpg?f=user_large

Afbeeldingslocatie: https://tweakers.net/i/uomlV6n_SvrrD3Xy0T4wyrB0dkI=/fit-in/4920x3264/filters:max_bytes(3145728):no_upscale():strip_icc():strip_exif()/f/image/finYU09fWTTSHRPajwPa8u3z.jpg?f=user_large

  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
In beide tabellen staat in elk geval niets verkeerds.

  • FlashWeave
  • Registratie: September 2018
  • Laatst online: 04-07 12:26
Bedankt om dit topic te starten. Ik ben heel het weekend bezig geweest om data te proberen kopiëren van deze schijf:

Afbeeldingslocatie: https://tweakers.net/i/_flU50iYFZtkkdjIfktgbOr2z1M=/x800/filters:strip_exif()/f/image/sgy9Uja6tXVeyJxBGpNiz8mZ.webp?f=fotoalbum_large

Dit is een Patriot P220 SSD van 2TB, geformatteerd als EXFAT.
Als ik ze via SATA aansluit, verhindert ze dat mijn PC boot.
Nu en dan kan ik ze (wispelturig) aansluiten via een USB enclosure.
Maar het lukt me niet om de bestanden te bekijken, ook experimenten met ddrescue, testdisk en photorec, ... hebben geen resultaat opgeleverd.
Vreemd dat CrystalDiskInfo er nog OK uitziet, maar dat er toch fundamenteel iets fout lijkt te zijn met deze SSD.
Hebben jullie een idee wat ik nog kan doen om data van deze schijf te halen?

[ Voor 4% gewijzigd door FlashWeave op 26-04-2026 15:47 ]


  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
@FlashWeave
Heb je een Mac? Als je die niet hebt, waarom is de SSD geformateerd als EXFAT?

Mac disks kun je soms niet lezen onder Windows.

Als dat niet het probleem is: gebruik dan software die eerste de leesbare data kopieert. Daarna kun je als tweede stap de rest proberen veilig te stellen.

Als het een defecte SSD lijkt, dan zou dat kunnen liggen aan een kapot onderdeel. De onderdelen op de printplaat (pcb) zijn hier te zien:
https://www.tweaktown.com...iii-ssd-review/index.html

Als je de behuizing open hebt kun je een scherpe foto maken op zeer hoge resolutie en die hier posten, dan kunnen we meekijken. Soms is zichtbaar dat een smd onderdeel kapot is, bijvoorbeeld een condensator. Dan is het een kwestie van die verwijderen (lossolderen) en testen of de data leesbaar is.

  • FlashWeave
  • Registratie: September 2018
  • Laatst online: 04-07 12:26
@mrmrmr Ja, wij hebben een Mac in huis.
Ik formatteer dataschijven altijd als exfat, zodat ze compatibele zijn met Windows, Mac en Linux.
Ik heb de behuizing geopend. Dit is hoe de printplaat eruit ziet:
Afbeeldingslocatie: https://tweakers.net/i/HD6AklbM3Lb8vSNEh7Tj3B37RJ0=/800x/filters:strip_icc():strip_exif()/f/image/eCsEORjsJ1lqn1T456oPZxBe.jpg?f=fotoalbum_large

Afbeeldingslocatie: https://tweakers.net/i/yZLFkx0zjCPbKVCqNyAT2Sj3LTo=/800x/filters:strip_icc():strip_exif()/f/image/Wihti8GAbRtUA1ruICCU1Ui9.jpg?f=fotoalbum_large

Afbeeldingslocatie: https://tweakers.net/i/ThvE1LW-2URwfoPtjcBVP0957nw=/800x/filters:strip_icc():strip_exif()/f/image/E9O2MfN9uFgin6NRz16tveds.jpg?f=fotoalbum_large

  • The_Doman
  • Registratie: Augustus 2005
  • Laatst online: 00:42
FlashWeave schreef op zondag 26 april 2026 @ 15:43:
Als ik ze via SATA aansluit, verhindert ze dat mijn PC boot.
Nu en dan kan ik ze (wispelturig) aansluiten via een USB enclosure.
Maar het lukt me niet om de bestanden te bekijken, ook experimenten met ddrescue, testdisk en photorec, ... hebben geen resultaat opgeleverd.
USB is vaak problematisch met recovery.
Maar wat gebeurt er precies als de SSD (het is er toch maar een?) via USB zichtbaar is?
Zijn er bestanden zichtbaar of alleen de SSD/partitie?
Voordat je gaat recoveren met tools moet je wel zeker weten dat de SSD/Schijf ook daadwerkelijk toegankelijk is/wordt gelezen op sector niveau.
The_Doman schreef op maandag 9 februari 2026 @ 14:01:
Een scan op bad sectors en/of image maken zal dan waarschijnlijk hetzelfde probleem geven:
Je krijgt dan alleen maar i/o errors zonder dat er werkelijk data wordt gelezen.
The_Doman schreef op donderdag 12 juni 2025 @ 13:33:
Wil je het echt zeker weten dan kan je een zogenaamde "bad sector test" op de schijf uitvoeren.
Daar zijn diverse tooltjes voor zoals het bekende HD Tune
Ook wel prima is deze zo te zien:
Macrorit Disk Scanner (Free Portable)
Via SATA blijft de PC blijft in het BIOS scherm hangen neem ik aan?
MBR/Legacy of UEFI proberen of dat verschil maakt?
Wordt de SSD dan gezien in bios/boot menu?
Soms kan dat heel erg lang duren (minuten) bij problematische HDD/SSD's is mijn ervaring.
Andere PC/Laptop uiteraard proberen indien beschikbaar.
Zelf gebruik ik hiervoor oudere PC/laptops met eSATA poorten zodat je eenvoudig kan hotswappen/hot-pluggen.
Gebruik eventueel een WinPe USB om te kunnen starten in MBR/Legacy mode
Bijvoorbeeld de bekende/bekendste is Hiren’s BootCD PE of meer geavanceerd/uitgebreid Sergei Strelec WinPE.

  • FlashWeave
  • Registratie: September 2018
  • Laatst online: 04-07 12:26
Afbeeldingslocatie: https://tweakers.net/i/yXL_EclkRJdQTHWYTFfeG-SBqtc=/800x/filters:strip_exif()/f/image/WVLVcUyWlAAnqH3AjKmwLNR6.png?f=fotoalbum_large

De schijf is nu aangesloten, en is op deze manier zichtbaar in schijfbeheer.
Tools als Testdisk en Photorec zien de schijf ook, maar restoren lukt (nog) niet.

Afbeeldingslocatie: https://tweakers.net/i/EGhvQJdsnqGvHQxOpbznK9h9bZE=/800x/filters:strip_exif()/f/image/Uq0K2fJHHIQbPM4UHdgE7Dot.png?f=fotoalbum_large

  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
Geen HDTune gebruiken en beter ook geen Macrorit (Chinees). In het algemeen geen tools gebruiken die iets veranderen aan de ssd/data.

Met de juiste parameters om alleen leesbare data te lezen kun je ddrescue gebruiken. Zorg dat er niets "hersteld" wordt. Dat kan destructief uitpakken. De eerste stap is het veiligstellen van de data, pas daarna kun je met hersteltools aan de slag.

Ik heb de foto's vergroot en bekeken. Ze zijn schuin genomen en ze zijn mede daardoor niet erg scherp, dus ik kan niet veel zien. Ik zag met het beperkte zicht geen breuk in de condensatoren (geel/bruin) en weerstanden (zwart), diodes. Er zijn ook nog een controller, nand, spoelen, 33 Mhz kristal en diverse IC's zichtbaar. Je zou kunnen controleren bij de spoelen welke spanning daarop komt. Daarvoor moet je wel een goede multimeter en een vaste hand hebben (geen kortsluiting veroorzaken).

Het lijkt alsof er een relatief grote component ontbreekt linksonder.
Afbeeldingslocatie: https://tweakers.net/i/iFoWm9BEg48v0MoY1ZR0L9IgZgw=/fit-in/4920x3264/filters:max_bytes(3145728):no_upscale():strip_icc():strip_exif()/f/image/opcC1fwEDalEiBWj0ZvkD8FA.jpg?f=user_large

Bij andere soldeerpads zie je een blinkend soldeerheuveltje, bij deze twee deuken erin met mogelijk lichtbruine fragmenten keramiek. Misschien was het een grote maat tantaal condensator?

Helaas heeft deze printplaat geen erop gedrukte componentcodes waaruit je zou kunnen afleiden wat voor component op een locatie aanwezig zou kunnen zijn.

  • The_Doman
  • Registratie: Augustus 2005
  • Laatst online: 00:42
mrmrmr schreef op zondag 26 april 2026 @ 19:20:
Geen HDTune gebruiken en beter ook geen Macrorit (Chinees). In het algemeen geen tools gebruiken die iets veranderen aan de ssd/data.
Deze tools lezen alleen data, of proberen dat, net als ddrescue of andere tools die een image backup maken.
Natuurlijk ga je niet zomaar data schrijven of dingen veranderen rechtstreeks naar de te recoveren HDD/SSD.

  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
The_Doman schreef op zondag 26 april 2026 @ 19:55:
Deze tools lezen alleen data, of proberen dat, net als ddrescue of andere tools die een image backup maken.
Natuurlijk ga je niet zomaar data schrijven of dingen veranderen rechtstreeks naar de te recoveren HDD/SSD.
Dat laatste zijn we het over eens.

@FlashWeave

Met ddrescue kun je een image of kopie maken, dat is het doel. Een falende SSD zo weinig mogelijk belasten met check- en testtools om de resterende levensduur niet te verlagen.

Dit is een beschrijving van het proces:
https://www.technibble.co...ng-ddrescue-recover-data/

[ Voor 10% gewijzigd door mrmrmr op 26-04-2026 21:44 ]


  • westlym
  • Registratie: December 2007
  • Laatst online: 25-08 00:09
Ik gebruikte deze twee schijven onder linux, namelijk openmediavault en ineens kon ik een ervan niet meer gebruiken. waarom weet ik niet, omdat ik de smart binnen openmediavault niet meer kon aflezen, want ik jammer vond. ik heb ze vandaag eruit gehaald en ik heb nog niks getest, aleen maar crystaldiskinfo gebruikt. zijn ze nog oke? ik hoor het graag.

Afbeeldingslocatie: https://tweakers.net/i/HSVY8MdpU9LUv89YukMiTTi9ty8=/x800/filters:strip_exif()/f/image/H29oUcm8w58Hc4j3at2UzCsZ.png?f=fotoalbum_large

Afbeeldingslocatie: https://tweakers.net/i/0C3G9pw9liu_UuaK7oa3nCtgpzM=/x800/filters:strip_exif()/f/image/xrtSs5AFVe0kc73KI2V0sCHM.png?f=fotoalbum_large

  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
Ik zie niets afwijkends (op eenmaal "4" na bij BF, maar die waarde is niet erg) bij beide tabellen.

  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
De tweede heeft kennelijk schok(ken) gehad. De eerste toont seek errors, maar dat is een samengesteld getal, bytes met meerdere waarden. Je kan het controleren met een Seagate SeaTools.

Nadat je dat gedaan hebt kun je de disks controleren. Ik doe dat meestal met h2testw, met een lege disk. Als de disks een Linux-only formattering hebben heb je een Linux tool nodig die hetzelfde doet (volschrijven en teruglezen). Er zijn allerlei tools die leeschecks doen, maar die zijn niet zo grondig.

  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
Wat is "ik kon een ervan niet meer gebruiken"?
Was de hele schijf niet meer benaderbaar, kreeg je een foutmelding?
Geef aub wat meer informatie.

En de smart-tabel zegt iets over de hardware (de disk), maar niets over het bestandssysteem.
Ik denk dat je voorzichtig wat meer onderzoek moet doen onder Linux of kijken wat openmediavault wat dat betreft voor mogelijkheden biedt.

En ben je nu data kwijt die je moet recoveren?
Of stonden de schijven als mirror ingesteld RAID1)?
Heb je een volledige backup van je data?

  • LankHoar
  • Registratie: April 2013
  • Laatst online: 00:48

LankHoar

Langharig tuig

Ik liet mijn eHDD per ongeluk vallen. Hij lag op de PC case en viel, niet aangesloten. Gelijk even een SMART gedraaid, moet ik me zorgen maken? Ik hoor niets vreemds.

Afbeeldingslocatie: https://tweakers.net/i/LHPzEDSOMfNuws5u9Ni4I1DUnJo=/fit-in/4000x4000/filters:no_upscale():strip_exif()/f/image/HFvdKKkq1b4At0WPPKhGjTKN.png?f=user_large

Direct ook maar even SMART van mijn interne HDD en SSD gemaakt. Health check zeg maar :) Ik zie zo niets vreemds hier, eens?

HDD:
Afbeeldingslocatie: https://tweakers.net/i/yVLrUNDbUuAiu8dNCp9w8ZKV9KQ=/fit-in/4000x4000/filters:no_upscale():strip_exif()/f/image/qtpduqZyWwwprPL99wG0jcv7.png?f=user_large

SSD:
Afbeeldingslocatie: https://tweakers.net/i/mpfmjNnCvgXPGRgRLiyTYdXxqms=/fit-in/4000x4000/filters:no_upscale():strip_exif()/f/image/CIxOY5lAky1m1MqlcN0rYJqW.png?f=user_large

[ Voor 41% gewijzigd door LankHoar op 01-07-2026 14:48 ]

When life throws you a curve, lean into it and have faith!


  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
De eerste twee hebben geen G-force (schok) indicator, dus daar kun je niets aan zien. Het is goed als de disk niet draaide, een vallende draaiende disk zou ik niet meer vertrouwen. Dan is het z.s.m. veilig stellen. De meeste disks zetten de koppen van de diskoppervlak af als ze uitgaan en dat vermindert de kans op schade.

Je kan met een testtool proberen alle data terug te lezen. Zodra daarvoor meer dan 1 poging nodig is, heb je misschien een slechte plek. Voor een test van de vrije ruimte kun je een tool gebruiken zoals h2testw.

Ik zou in de gaten houden of de tweede een oplopende UltraDMA CRC error waarde heeft. Dat wijst vaak op een kabelprobleem. Eerst de stekker loshalen en opnieuw aansluiten aan beide zijden.

De laatste mist een aantal variabelen.

  • Renault
  • Registratie: Januari 2014
  • Laatst online: 20:51
Mazzel gehad.

Open deur: Kijk uit hoe je omgaat met je opslagmedia.

  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
Nou, zoals ik in mijn laatste post in dit topic had vermeld heb ik uiteindelijk de UGreen DXP 4800+ NAS gekocht met 1x PNY CS1030 250GB SSD (NVME) als boot, 1x een Samsung 990 PRO 1TB SSD (NVME) als app-pool en 4x 10TB WD reds. Ik draai er TrueNAS op die op de PNY 250GB SSD draait als boot-pool.

Eerst maar even het scenario uitleggen waarom ik mijn SMART post, zoals de openingspost vraagt:

Alles ging ok, totdat ik na een paar weken al ineens 's morgens ontdekte dat ik de verbinding met mijn NAS kwijt was. Reboot hielp ook niet. NAS aan een scherm gehangen en er kwamen wat mount errors voorbij tijdens de boot. De PNY SSD eruit gehaald, keer blazen en teruggestopt. Werkte weer direct zonder errors.
De pret duurde niet lang, 2 weken later hing de NAS zichzelf weer op en kwam ik daar pas achter toen ik na 4 weken vakantie terug kwam. Een reboot gegeven en weer door.
Vannacht kreeg ik ineens een email van mijn NAS:
Boot pool status is ONLINE: One or more devices has experienced an unrecoverable error. An attempt was made to correct the error. Applications are unaffected..

Eerst de SMART-status gecontroleerd, maar kon niks geks ontdekken. Het enige wat me opviel was dat de "Available Spare" op 99% stond. En dat terwijl bijv de SSD van mijn PC (die al 5 jaar mee loopt te draaien op 100% staat. Maar goed, verder geens errors of iets in de SMART log. Dus met behulp van wat google en AI troubleshooting een test gedaan door een flinke file weg te schrijven en weer in te lezen. Bam, systeem vast. Dit geprobeerd ter eerlijke vergelijking op de Samsung 1TB SSD: niks aan de hand.

Om er zeker van te zijn dat het niet het NVME slot was heb ik beide SSDs van slot gewisseld. Test weer uitgevoerd. Eerste keer ging hij er doorheen, 2e keer weer vast, met allerlei mount errors zichtbaar op mijn scherm die ik aan de NAS had gehangen:
code:
1
2
3
4
5
6
nvme nvme1: Device not ready; aborting reset, CSTS=0x1 
nvme nvme1: Device not ready; aborting shutdown, CSTS=0x5 
I/O error, dev nvme1n1, sector 361785568 op 0x1 (WRITE) flags 0x0 phys_seg 1 prio class 2 
I/O error, dev nvme1n1, sector 360651392 op 0x0 (READ) flags 0x0 phys_seg 1 prio class 2 
zio pool=boot-pool vdev=/dev/nvme1n1p3 error=5 type=1 offset=184113496064 size=12288 flags=3145856 
nvme nvme1: Disabling device after reset failure: 0
En meer van dat soort flauwekul. Dit was maar een kleine greep uit alle errors die voorbij kwamen.
Weer een SMART opgevraagd en wat schetst mijn verbazing? De "Available Spare" nu alweer gezakt van 99% naar 98%.

Omdat de openingspost vraagt om een volledige screenshot van de SMART:
Afbeeldingslocatie: https://tweakers.net/i/baOsK1Wp_vwfXT2MJrNgRXQNh20=/x800/filters:strip_exif()/f/image/zHgvsRAyudPJHunPwcyDeoOJ.png?f=fotoalbum_large

Ik denk dat er dus iets echt niet goed is met mijn PNY SSD, maar tot dusver heb ik nog helemaal niks concreets om te bewijzen dat dat ding niet 100% is. Wat is jullie mening als je zo dit verhaal leest in combinatie met de geposte SMART-info?

  • mrmrmr
  • Registratie: April 2007
  • Niet online

mrmrmr

𓅓 𓂋 𓅓 𓂋 𓅓 𓂋

Topicstarter
Disk redundantie (RAID c.s.) compliceert e.e.a. enorm. Het KISS principe is beter.

Kleine consumenten-SSD's hebben altijd een groter verval dan SSD's met grotere omvang. Bijvoorbeeld gedetailleerde logging en processen die enorm veel gebruik maken van /tmp kan SSD's flink laten slijten.

Bij het inrichten van een thuisserver is het bijna altijd een goed idee om de snoeischaar te hanteren en onnodige logging en processen uit te schakelen. Door een reductie in overhead vermindert het energieverbruik, dat bespaart kosten voor apparaten die altijd aan staan.

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
@benchMarc Ik zie geen SMART attributen, gebruik commando:
code:
1
smartctl -s on -A /dev/<naamdiskhier>

Knowledge can be communicated, but not wisdom.


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
Transmitter schreef op vrijdag 28 augustus 2026 @ 09:02:
@benchMarc Ik zie geen SMART attributen, gebruik commando:
code:
1
smartctl -s on -A /dev/<naamdiskhier>
Dat geeft exact dezelfde info als het onderste deel van mijn screenshot?

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
Weet je echt zeker dat je -A hebt gebruikt en niet -a ?

Knowledge can be communicated, but not wisdom.


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
Transmitter schreef op vrijdag 28 augustus 2026 @ 09:13:
Weet je echt zeker dat je -A hebt gebruikt en niet -a ?
Ja. Heb je mijn screenshot wel volledig bekeken of wordt hij toevallig niet volledig weergegeven? Het gedeelte vanaf === START OF SMART DATA SECTION === tot het "Error Information (NVMe Log 0x01, 8 of 8 entries) in mijn screenshot is ook precies wat ik te zien krijg na dat commando.

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
Ja je hebt wel gelijk. Bij SSD's ziet het er gewoon anders uit. Het is niet veel info wat je daar mee kunt doen.

Je hebt dus zfs issues, kun je de zpool status posten of heb je dat in een ander topic gedaan?
Edit: je kunt ook dit topic posten voor ZFS-gerelateerde zaken: Het grote ZFS topic.

[ Voor 20% gewijzigd door Transmitter op 28-08-2026 09:27 ]

Knowledge can be communicated, but not wisdom.


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
De pool status is helemaal top. Geen errors, alles staat op online en read, write cksum op 0 en "no known data errors", maar dat kan ook zijn omdat ik hem dus gisterenavond na de vastloper heb gereboot en daardoor de tellers weer op 0 worden gezet.
Ik weet niet of het zfs issues zijn, maar enkel PNY NVME SSD die kuren begint te vertonen na bepaalde lees en schrijfacties. Ik vraag me dus af of die "Available Spare" van 98%, die zelfs nog van 99% naar 98% ging gisteren een indicator is dat er iets fout zit?

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
Rebooten zou de pool status niet mogen veranderen, alleen als je 'zpool clear' gebruikt. In je grote post hierboven schrijf je:
Boot pool status is ONLINE: One or more devices has experienced an unrecoverable error. An attempt was made to correct the error. Applications are unaffected..
Dus je pool status van je SSD boot-pool is in elk geval in het verleden niet 'ok' geweest. Hier zullen je problemen waarschijnlijk door komen. Het kan zijn dat je SSD problemen heeft of corrumpeert. Firmware-update is iets dat je kunt checken.

Je kunt voor de zekerheid ook een andere device eraan hangen, al is het tijdelijk, zodat je boot pool van een single disk naar een mirror gaat. Later kun je die weer 'detachen'.
code:
1
zpool attach boot-pool /dev/nvme1n1p3 /dev/<tijdelijkemirrordisk>
Mag een grotere disk zijn, ook een HDD. USB HDD zou prima kunnen werken. Je kunt evt. een partitie maken zodat je de overige capaciteit kunt gebruiken.

Knowledge can be communicated, but not wisdom.


  • _JGC_
  • Registratie: Juli 2000
  • Laatst online: 07:32
Ik zie toch echt kernel meldingen van de nvme driver over een SSD die niet meer werkt, dus dit heeft verder niks met ZFS te maken.

@benchMarc Heb je toevallig laatst nog kernel updates geïnstalleerd? Kan ook zijn dat het een regressie is in de linux kernel, soms worden er quirks toegevoegd of verwijderd waar jouw ene SSD niet blij mee is en de andere vrolijk blijft werken zonder problemen.

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
Ja maar het gaat wel hoe ZFS ermee omgaat. Uiteindelijk escaleert zo het probleem van disk error naar pool problemen. De output die @benchMarc gaf zegt wel "Applications are unaffected" dus dan heeft ZFS dit keer de fout opgevangen zonder gevolgen voor de pool. Ik vermoed dat dit in andere gevallen niet is gelukt. Alleen metadata is redundant met een single-disk ZFS pool, tenzij je copies=2 gebruikt.

Stel hij maakt er tijdelijk een mirror van, dan kan hij wel weer een werkende NAS hebben terwijl de oorzaak verder kan worden onderzocht. Ik neem aan dat met de HDDs niets mis is, alleen een boot SSD die kennelijk niet lekker werkt. Dus als hij zijn NAS snel weer werkend wilt hebben, is die mirror denk ik een leuke feature van ZFS.

Knowledge can be communicated, but not wisdom.


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
Transmitter schreef op vrijdag 28 augustus 2026 @ 09:45:
Rebooten zou de pool status niet mogen veranderen, alleen als je 'zpool clear' gebruikt. In je grote post hierboven schrijf je:


[...]


Dus je pool status van je SSD boot-pool is in elk geval in het verleden niet 'ok' geweest. Hier zullen je problemen waarschijnlijk door komen. Het kan zijn dat je SSD problemen heeft of corrumpeert. Firmware-update is iets dat je kunt checken.

Je kunt voor de zekerheid ook een andere device eraan hangen, al is het tijdelijk, zodat je boot pool van een single disk naar een mirror gaat. Later kun je die weer 'detachen'.
code:
1
zpool attach boot-pool /dev/nvme1n1p3 /dev/<tijdelijkemirrordisk>
Mag een grotere disk zijn, ook een HDD. USB HDD zou prima kunnen werken. Je kunt evt. een partitie maken zodat je de overige capaciteit kunt gebruiken.
Je hebt gelijk. Even teruggekeken in mijn opgeslagen logs en na die email die ik 's nachts kreeg met die waarschuwing was de boot-pool status zo:
code:
1
2
3
4
5
6
7
8
9
10
11
12
13
  pool: boot-pool
 state: ONLINE
status: One or more devices has experienced an unrecoverable error.  An
        attempt was made to correct the error.  Applications are unaffected.
action: Determine if the device needs to be replaced, and clear the errors
        using 'zpool clear' or replace the device with 'zpool replace'.
   see: https://openzfs.github.io/openzfs-docs/msg/ZFS-8000-9P
  scan: scrub repaired 0B in 00:00:47 with 0 errors on Thu Aug 27 03:45:48 2026
config:
        NAME         STATE     READ WRITE CKSUM
        boot-pool    ONLINE       0     0     0
          nvme0n1p3  ONLINE       0     0     1
errors: No known data errors
Firmware heb ik inderdaad ook naar gekeken, maar dat is totaal hopeloos bij PNY. Ze hebben hier dus zo'n tool "PCIe SSD Toolbox and Firmware Updater" waar je met Linux niks mee kan. Ik heb dus de NVME uit mijn NAS geschroefd en in mijn PC gehangen en die tool geïnstalleerd, maar hij ziet mijn drive niet eens terwijl hij wel in Windows disk management naar voren komt. Waardeloze tool dus.
_JGC_ schreef op vrijdag 28 augustus 2026 @ 09:51:
Ik zie toch echt kernel meldingen van de nvme driver over een SSD die niet meer werkt, dus dit heeft verder niks met ZFS te maken.

@benchMarc Heb je toevallig laatst nog kernel updates geïnstalleerd? Kan ook zijn dat het een regressie is in de linux kernel, soms worden er quirks toegevoegd of verwijderd waar jouw ene SSD niet blij mee is en de andere vrolijk blijft werken zonder problemen.
Ik ben begonnen op op TrueNAS 25.10.4 en inmiddels zit ik op 25.10.6. Ik zie wel dat er een kernelupdate in de laatste zit, maar ik had al vage problemen (zoals plotselinge vastlopers) bij 25.10.4. Ik vind het wel gek dat het wegschrijven en teruglezen van een 5gb of 20gb file via de shell problemen geeft, maar dat ik toch probleemloos TrueNAS heb kunnen installeren en updaten. Of ik heb gewoon mazzel gehad toen. Hij liep gisteren ook niet vast bij de eerst 20gb wegschrijven en teruglezen, wel na de 2e keer. Ik zal zo nog eens een loop schrijven van 5x een 20gb file wegschrijven en teruglezen. Ik test dat nu voor de zekerheid op de app pool en so far so good. Dus die Samsung SSD heeft deze problemen duidelijk niet.
Transmitter schreef op vrijdag 28 augustus 2026 @ 09:58:
Ja maar het gaat wel hoe ZFS ermee omgaat. Uiteindelijk escaleert zo het probleem van disk error naar pool problemen. De output die @benchMarc gaf zegt wel "Applications are unaffected" dus dan heeft ZFS dit keer de fout opgevangen zonder gevolgen voor de pool. Ik vermoed dat dit in andere gevallen niet is gelukt. Alleen metadata is redundant met een single-disk ZFS pool, tenzij je copies=2 gebruikt.

Stel hij maakt er tijdelijk een mirror van, dan kan hij wel weer een werkende NAS hebben terwijl de oorzaak verder kan worden onderzocht. Ik neem aan dat met de HDDs niets mis is, alleen een boot SSD die kennelijk niet lekker werkt. Dus als hij zijn NAS snel weer werkend wilt hebben, is die mirror denk ik een leuke feature van ZFS.
Dat is wel een goede optie, maar eerlijk gezegd maakt het me nog niet zoveel uit al moet ik ff zonder NAS zitten. Ik heb mijn oude Synology nog staan mocht ik echt behoefte hebben om bepaalde data in te zien. Ik heb er nog aan zitten denken om de UGreen SSD te gebruiken waar het Ugreen OS nog op staat. Ik kan daar met clonezilla een image van trekken aangezien ik vanaf dag 1 met TrueNAS ben begonnen en nog geen moment heb geboot van die SSD. Dus die backup van het OS is mooi onaangetast. Vervolgens zou ik dan TrueNAS op die SSD kunnen installeren om te kijken of dat wel goed gaat. Maarja, stel dat het goed gaat. Waar sta ik dan? Ik wil eigenlijk gewoon kunnen vaststellen dat mijn PNY SSD drive niet goed is zodat ik hem met goede redenen kan terugsturen.
Nog een mogelijkheid is om hem uit de NAS te halen, in mijn PC te hangen, een format te geven met NTFS file system (ik heb een backup van de TrueNAS config file) en dan bestanden te kopiëren om te kijken of dat ook fout gaat.

Maar angezien dit een SMART topic is ben ik dus vooral benieuwd of iemand iets kan zeggen over die "Available Spare" status?

  • _JGC_
  • Registratie: Juli 2000
  • Laatst online: 07:32
@benchMarc Je zou eens kunnen booten met pcie_aspm=off

Deze PNY SSD heeft wel meer issues als ik zo wat google. Is overigens een QLC drive met SLC cache. Is relatief snel als je weinig schrijft, totdat de SLC cache vol is en data rechtstreeks naar QLC moet, dan wordt de hele drive traag of bevriest zelfs.

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
Ik wil eigenlijk gewoon kunnen vaststellen dat mijn PNY SSD drive niet goed is zodat ik hem met goede redenen kan terugsturen.
Ik vermoed dat dit een moeilijke weg kan worden. Zoals ik via de DM al schreef, veel SSDs worden enkel getest op Windows en het is mogelijk dat firmware problemen zich alleen voordoen als je buiten de gangbare paden komt, dus de SSD werkt dan goed onder Windows maar geeft problemen op non-Windows operating systems. Zoals _JGC_ schreef kan dit ook komen door device quirks etcetera.

Maar zie dat maar eens te bewijzen. Als de fabrikant of leverancier de SSD test en hij werkt, zie dan maar eens te bewijzen dat het aan het product ligt. Het feit dat je checksum problemen hebt gehad kan een ding zijn, maar die kunnen ook optreden zonder fout van de SSD zoals wanneer je op de reset-knop drukt of een unsafe powercycle.
Maar angezien dit een SMART topic is ben ik dus vooral benieuwd of iemand iets kan zeggen over die "Available Spare" status?
Het zou twee dingen kunnen betekenen: overprovisioned area en reserve pages in geval er fysieke schade is en dus een 'sector' (maar dan NAND page of erase block) wordt omgewisseld. Even gezocht online en mensen zeggen dat het dit laatste is. Als het een nieuwe drive is, zou dat een grond kunnen zijn de drive in te leveren als hardwarematig 'beschadigd'. Het is echter wel normaal voor een oudere SSD dat je er wat pages zijn die niet lekker werken, daar is de reservepool ook voor. 98% betekent dat 2% van die pool gebruikt is, dus opzich zou je daar nog lang verder mee moeten kunnen.

Je kunt natuurlijk je probleem voorleggen aan zowel de fabrikant en leverancier en vragen of je een ander product mag. Ik vermoed een beetje dat als je eenzelfde SSD krijgt met dezelfde firmware, dat je op den duur ook dezelfde problemen zult ervaren. Maar dat is speculatie uiteraard.

Temperatuur
Nog wel één vraag: heb je de SSD gemonteerd met heatsink, zoals veel moederborden hebben, of gewoon 'kaal'? In dat laatste geval zou temperatuur een ding kunnen zijn. In je SMART-gegevens staat 40 graden en een SSD kan bij sustained sequential write best warm worden, maar hij mag niet té warm worden. Throttlen werkt misschien niet evengoed als andere modellen en zou ik niet op vertrouwen. Zeker zonder heatsink kan het zijn dat de throttling niet 'snel' genoeg kan reageren. Ik vroeg je eerder naar de 'echte' SMART output omdat die normaliter ook een 'worst' waarde toekent aan temperatuur, zodat je kunt zien wat deze in het verleden is geweest. Maar die output geeft je SSD dus niet en dat is toch jammer!

Knowledge can be communicated, but not wisdom.


  • benchMarc
  • Registratie: Oktober 1999
  • Laatst online: 30-08 19:39
_JGC_ schreef op vrijdag 28 augustus 2026 @ 10:28:
@benchMarc Je zou eens kunnen booten met pcie_aspm=off

Deze PNY SSD heeft wel meer issues als ik zo wat google. Is overigens een QLC drive met SLC cache. Is relatief snel als je weinig schrijft, totdat de SLC cache vol is en data rechtstreeks naar QLC moet, dan wordt de hele drive traag of bevriest zelfs.
Ik heb dat met pcie_aspm=off doorgevoerd en hij draait nu sinds 11:25 stabiel zonder een enkele vastloper. Heb inmiddels al meerdere cycles van 5 met 20gb, 50gb en nog wat burst read-writes doorgevoerd, maar ik krijg hem niet meer vastgelopen. Misschien nog te vroeg om te juichen, want het klinkt bijna te mooi om waar te zijn dat uitschakelen van de aspm de kern van het hele euvel zou zijn?
Transmitter schreef op vrijdag 28 augustus 2026 @ 15:34:
[...]

Ik vermoed dat dit een moeilijke weg kan worden. Zoals ik via de DM al schreef, veel SSDs worden enkel getest op Windows en het is mogelijk dat firmware problemen zich alleen voordoen als je buiten de gangbare paden komt, dus de SSD werkt dan goed onder Windows maar geeft problemen op non-Windows operating systems. Zoals _JGC_ schreef kan dit ook komen door device quirks etcetera.

Maar zie dat maar eens te bewijzen. Als de fabrikant of leverancier de SSD test en hij werkt, zie dan maar eens te bewijzen dat het aan het product ligt. Het feit dat je checksum problemen hebt gehad kan een ding zijn, maar die kunnen ook optreden zonder fout van de SSD zoals wanneer je op de reset-knop drukt of een unsafe powercycle.


[...]

Het zou twee dingen kunnen betekenen: overprovisioned area en reserve pages in geval er fysieke schade is en dus een 'sector' (maar dan NAND page of erase block) wordt omgewisseld. Even gezocht online en mensen zeggen dat het dit laatste is. Als het een nieuwe drive is, zou dat een grond kunnen zijn de drive in te leveren als hardwarematig 'beschadigd'. Het is echter wel normaal voor een oudere SSD dat je er wat pages zijn die niet lekker werken, daar is de reservepool ook voor. 98% betekent dat 2% van die pool gebruikt is, dus opzich zou je daar nog lang verder mee moeten kunnen.

Je kunt natuurlijk je probleem voorleggen aan zowel de fabrikant en leverancier en vragen of je een ander product mag. Ik vermoed een beetje dat als je eenzelfde SSD krijgt met dezelfde firmware, dat je op den duur ook dezelfde problemen zult ervaren. Maar dat is speculatie uiteraard.

Temperatuur
Nog wel één vraag: heb je de SSD gemonteerd met heatsink, zoals veel moederborden hebben, of gewoon 'kaal'? In dat laatste geval zou temperatuur een ding kunnen zijn. In je SMART-gegevens staat 40 graden en een SSD kan bij sustained sequential write best warm worden, maar hij mag niet té warm worden. Throttlen werkt misschien niet evengoed als andere modellen en zou ik niet op vertrouwen. Zeker zonder heatsink kan het zijn dat de throttling niet 'snel' genoeg kan reageren. Ik vroeg je eerder naar de 'echte' SMART output omdat die normaliter ook een 'worst' waarde toekent aan temperatuur, zodat je kunt zien wat deze in het verleden is geweest. Maar die output geeft je SSD dus niet en dat is toch jammer!
Precies, bewijs maar eens dat zo'n SSD gaar is en dat het niet aan iets anders ligt wanneer de SMART-info niks bijzonders laat zien. Vandaar mijn vraag over dat "Available Spare" omdat dat eigenlijk het enige is dat ik bijzonder vind voor een drive van een maand of 3-4 oud. Hopelijk dat nog wat andere SMART-guru's hier iets over kunnen zeggen.

Bedoel je met worst waarde de maximale waarde die hij mag worden? Want als je dat bedoelt is dat:
Warning Comp. Temp. Threshold: 100 Celsius
Critical Comp. Temp. Threshold: 110 Celsius

Wel vreemd trouwens dat de temperatuur van die PNY SSD àltijd 40gr is. Load of idle, altijd 40. In de reporting graph van TrueNAS staat er 39, maar dat is mogelijk een afrondingsfout gok ik zo. Die trendgrafiek laat al maandenlang altijd 39gr zien. Ook tijdens mijn stress tests gaat de temperatuur nog geen graad omhoog. De Samsung SSD laat wel wat fluctuaties zien, al is dat ook maar minimaal. Laagste temp gelogged is 32gr en de hoogste is 37gr.
Beide SSD's zitten onderin de NAS met elk een heatpad dat vervolgens contact maakt met de onderkant van de NAS. Mogelijk dat dus de hittegeleiding gewoon erg goed werkt in dit geval aangezien de hele behuizing een geleider is.

  • Transmitter
  • Registratie: Augustus 2026
  • Laatst online: 30-08 19:42
benchMarc schreef op vrijdag 28 augustus 2026 @ 16:00:
Bedoel je met worst waarde de maximale waarde die hij mag worden? Want als je dat bedoelt is dat:
Warning Comp. Temp. Threshold: 100 Celsius
Critical Comp. Temp. Threshold: 110 Celsius
Nee dit zijn 'threshold' waardes. Dit is de waarde waarop de SSD zelf vindt dat het te gortig wordt. De 'worst' waarde is de hoogst/slechtst gemeten waarde in het verleden. Deze kan ik dus niet terugvinden in je SMART maar dat is dus omdat de SSD die niet geeft. Dat is wel een kritiek ding vind ik zelf. Je kunt wel met regelmatige SMART polling zelf problemen uit te vogelen hoe hoog de temperatuur wordt, maar SMART is er juist ook voor om problemen in het verleden te kunnen verklaren en met zo weinig info als jouw drive geeft is dat dus lastig.
Beide SSD's zitten onderin de NAS met elk een heatpad dat vervolgens contact maakt met de onderkant van de NAS. Mogelijk dat dus de hittegeleiding gewoon erg goed werkt in dit geval aangezien de hele behuizing een geleider is.
Ja een SSD is maar een paar watt, tot max 7W schat ik zo. Dus als het maar een beetje heatsink heeft gaat het al snel goed zeker met zo'n ontwerp zal het lastig zijn hem op een hoge temp te krijgen. Lijkt allemaal goed dus. Blijft over firmware problemen dan wel benodigde quirks onder Linux OS.

Knowledge can be communicated, but not wisdom.

Pagina: 1