- Un PC figé en pleine partie est entré dans une boucle BIOS et un seul des deux SSD Seagate Firecuda 530 1 To était détecté, rendant la récupération des données urgente
- En constatant qu’il ne fonctionnait brièvement qu’à froid, le SSD a été placé 30 minutes dans un congélateur à -18 °C ; le disque est alors apparu sur un Mac via un boîtier USB NVMe M.2
- La température seule ne suffisait pas, et l’auteur a trouvé qu’il fallait appuyer sur une puce précise de la carte pour le faire fonctionner, puis a maintenu la pression avec un serre-joint en G et un morceau de carte
- Comme la chaleur augmentait pendant la copie, un dissipateur de PC et une partie d’une équerre de menuisier ont été fixés avec du ruban adhésif thermique conducteur, tandis qu’une caméra thermique CAT S60 servait à surveiller la température
- Après avoir réussi à copier
/Userset à créer une image de 1 To avecdd, un traitement au pistolet à air chaud SMD a permis au SSD de fonctionner sans outil, puis l’image système Windows a été restaurée sur un nouveau Firecuda avant d’activer les sauvegardes
Découverte de la panne et diagnostic initial
- Le PC de jeu utilisait deux SSD Seagate Firecuda 530 1 To comme stockage
- Après quelques mois d’utilisation, le PC s’est figé en plein jeu puis est entré dans une boucle BIOS, sans plus pouvoir démarrer
- Un seul des deux SSD était détecté et, même en changeant de slot, le même disque posait problème, ce qui a permis de cibler la panne sur l’un des SSD
- Après avoir laissé le PC tel quel pendant quelques jours, un nouveau démarrage a permis d’entrer dans Windows, mais le système a aussitôt planté
Suivi du problème de température et de faux contact
- Le fait qu’il semble fonctionner brièvement à froid a renforcé l’hypothèse d’une panne liée à la température
- Après avoir placé le Firecuda 30 minutes dans un congélateur à -18 °C, puis l’avoir monté dans un boîtier USB NVMe M.2, le disque est apparu sur un Mac
- Il ne restait fonctionnel que quelques minutes, puis échouait à nouveau dès qu’il se réchauffait
- Soupçonnant un mauvais contact quelque part sur la carte, l’auteur a répété les essais d’insertion et de retrait jusqu’à trouver la zone où le SSD fonctionnait lorsqu’on appuyait sur une puce précise
Un dispositif de maintien improvisé avec serre-joint et morceau de carte
- Comme il était impossible de copier les données en maintenant la puce appuyée à la main, un serre-joint métallique en G a été utilisé
- Pour soutenir le PCB du SSD, un morceau d’une carte de crédit Silicon Valley Bank a été glissé sous le SSD
- En serrant le serre-joint avec la bonne force pour appliquer une pression sur la puce, le SSD s’est remis à fonctionner
- Cette méthode a permis de faire reconnaître le disque même sans basse température
Renforcement du refroidissement et copie des données
- Le SSD chauffait fortement en fonctionnement, ce qui imposait un refroidissement pour une copie stable
- Un dissipateur provenant du PC et une partie d’une équerre de menuisier ont été fixés avec du ruban adhésif thermique conducteur afin de servir de dissipateur improvisé
- Pendant la copie, la caméra thermique du téléphone CAT S60 a été utilisée pour surveiller la température
- Avec cette configuration, le répertoire
/Usersdu disque a d’abord été copié et mis de côté - Ensuite,
dda servi à créer une image complète du disque dans un fichier unique de 1 To
Traitement à l’air chaud et restauration finale
- L’auteur a hésité à tenter une réparation permanente du SSD au pistolet à air chaud SMD, estimant qu’un remplacement pouvait être préférable
- Il a ensuite utilisé un pistolet à air chaud SMD sur la puce marquée par une flèche rouge, et le SSD s’est mis à fonctionner sans outils de menuiserie
- Après cette réparation, le SSD a même pu redémarrer le PC
- Une image système Windows de ce SSD a été créée sur un autre disque, puis restaurée sur un nouveau Firecuda
- Enfin, les sauvegardes ont été activées
1 commentaires
Commentaires sur Hacker News
Il y a longtemps, quand je travaillais comme technicien d’atelier dans une boutique de réparation de PC, j’ai fait quelque chose de similaire. C’était un vieux disque Connor de 40 Mo sous DOS : si on le comprimait juste comme il fallait, il fonctionnait ; si on appuyait trop fort ou pas assez, on obtenait « Abort/retry/ignore »
J’ai donc gardé le disque pressé à la main tout en appuyant sans arrêt sur
rpour réessayer, et ça a fini par marcher. Le patron est passé et m’a demandé : « Mais qu’est-ce que tu fabriques ? », ce à quoi j’ai répondu : « Je suis en train d’essorer les données de ce disque ! »Il existe aussi une visite intéressante qui montre à quel point les anciennes technologies de disques étaient étonnamment simples : https://www.youtube.com/watch?v=8LbFKV_pPAE
Si ça ne marchait toujours pas et que les données étaient vraiment nécessaires, on l’envoyait chez Ontrack. Là-bas, ils sortaient les plateaux en salle blanche et lisaient les données directement
Ça me rappelle l’époque où, étudiant fauché, j’ai réparé un ordinateur avec des baguettes. À l’époque, je ne connaissais pas les soudures froides, mais j’avais découvert qu’en tordant une carte mère instable dans une certaine direction, elle fonctionnait
J’ai donc coincé une baguette en bambou entre la carte mère et le boîtier pour la maintenir légèrement fléchie, et ça a tenu tout le reste de l’année
J’ai été vraiment soulagé quand de nouveaux designs de supports sont arrivés ensuite
Ce n’étaient pas des outils de menuiserie, mais c’est la réparation la plus bizarre que j’aie faite. Ma Surface Pro 3, qui fonctionnait bien, est soudainement morte et ne s’allumait plus ; j’ai fini par tomber sur Reddit sur quelqu’un qui racontait avoir ressuscité sa SP3 en la mettant dans un sac de congélation hermétique, puis au congélateur
J’étais sceptique et je pensais qu’en la gelant, j’avais surtout de grandes chances de l’abîmer davantage, mais comme l’appareil était déjà mort, je n’avais rien à perdre. Je l’ai mise dans un sac de congélation hermétique en chassant le plus d’air possible, je l’ai laissée quelques heures au congélateur, puis je l’ai sortie et branchée : elle s’est allumée
Au début, elle n’a tenu que quelques jours, mais en la recongelant elle est revenue à la vie, et plusieurs années plus tard elle fonctionne encore. Ça ressemblait à un problème d’alimentation, et je suppose qu’en gelant la batterie, un quelconque cycle chimique a pu se produire et la remettre d’aplomb
Cela dit, j’avais enveloppé la Surface dans plusieurs couches de serviettes pour que la température remonte lentement. C’était surtout pour éviter que de l’humidité ne se forme quelque part à l’intérieur
https://www.reddit.com/r/Surface/comments/5tficj/how_i_reviv...
Il disait que le SSD chauffait pas mal en fonctionnement et qu’il l’avait refroidi avec un dissipateur de PC, une partie d’une équerre de menuisier et du ruban adhésif thermoconducteur ; à sa place, je conseillerais plutôt un ventilateur. Même un petit ventilateur placé à côté de l’appareil génère bien plus de flux d’air que nécessaire
On pourrait certes produire un flux d’air avec une perceuse, un aspirateur industriel ou une scie circulaire, mais ce serait nettement moins efficace énergétiquement qu’un dissipateur passif
J’ai réussi deux fois jusqu’ici avec un reflow du contrôleur. Une fois sur un disque Intel Optane qui avait fonctionné sans souci pendant trois ans avant de se mettre soudainement à surchauffer, et une autre fois sur le disque mSATA d’une machine fanless morte un dimanche, alors que je n’avais même pas de disque mSATA de secours
Dans les deux cas, j’ai cherché au microscope un condensateur en court-circuit, sans rien trouver ; au final, le problème venait des billes de soudure BGA fatiguées du contrôleur. J’ai pu les sauver avec un reflow : maintien à 225 °C → pic à 400 °C → maintien à 325 °C
https://microchip.my.site.com/s/article/SAM-Cortex-M3-M4-M7-...
C’est un excellent exemple. On dirait la version moderne du coup de l’ingénieur qu’on donnait autrefois aux anciens disques rotatifs quand ils ne voulaient plus démarrer
J’imagine que, quand la machine restait éteinte un certain temps, le lubrifiant interne se figeait ou quelque chose du genre. J’ai donc retiré le cache de la baie du lecteur, et en touchant le disque avec le doigt, il a démarré de façon fiable pendant des années
J’ai obtenu la même pression avec une rondelle sur la bride du dissipateur thermique, et ça tourne bien depuis plusieurs mois. Les soudures du GPU deviennent fragiles sous l’effet du stress thermique, et la compression rétablit le contact
Mettre sous pression ou faire un reflow n’est qu’un pis-aller ; la vraie réparation consiste à rebiller le GPU, mais cela revient cher
Le fait qu’un Firecuda placé 30 minutes dans un congélateur à -18 °C, puis branché dans un boîtier USB NVMe M.2, soit apparu sur un Mac signifie donc apparemment que le truc du frigo marche aussi avec les NVMe
Il y a environ 20 ans, j’avais déjà mis un vieux HDD au frigo pendant une demi-heure pour en extraire les fichiers avant de jeter le disque
J’ai récupéré de la glace à la machine à glaçons de l’hôtel, et avec un ventilateur et un plateau métallique, j’ai maintenu le portable en vie jusqu’à la fin du travail
Je me demande si 42 °C est vraiment une température élevée pour un NVMe. J’ai récemment commencé à collecter les statistiques SMART de plusieurs disques chez moi, et sur les miens, même au repos ou presque, ce genre de valeur semble normal
J’ai aussi lu quelque part que garder un NVMe trop froid pouvait nuire aux performances. Le plus important, c’est surtout qu’il faut absolument faire des sauvegardes. Mes amis autour de moi aiment bien Synology, mais comme je suis plutôt économe j’utilise urbackup, et ça m’a évité plusieurs grosses catastrophes
https://www.worldbackupday.com/
La capacité de diagnostic et la créativité pour récupérer les données sont impressionnantes, mais dans la même situation, je pense que j’aurais simplement restauré depuis une sauvegarde. De mon côté, de façon un peu atypique, j’ai un serveur de fichiers de homelab basé sur du vrai matériel serveur, sur lequel mes desktops et laptops sont sauvegardés, et ce serveur local est lui-même sauvegardé vers un serveur distant
Exemple : Samsung https://download.semiconductor.samsung.com/resources/data-sh...
Je me demande s’il existe un moyen d’accéder aux données d’un HDD dont la carte contrôleur est défectueuse, autrement qu’en l’envoyant à un service professionnel de récupération de données. Il n’accepte pas non plus la carte contrôleur de rechange prélevée sur un HDD neuf du même modèle
Avec du matériel et des logiciels spécialisés, on peut extraire ces données et les enregistrer dans la mémoire d’une autre carte, mais la méthode bon marché consiste à transférer la puce physique de l’ancienne carte vers une nouvelle carte identique.
On appelle souvent cela un swap de ROM ; c’est généralement une simple puce à 8 broches, donc si l’on est à l’aise avec la soudure et le dessoudage, on peut le faire soi-même. Sinon, un atelier de réparation hardware, comme une boutique de réparation de téléphones, le fera généralement.
Cela dit, sur des disques durs relativement récents, il peut ne pas y avoir de puce séparée, donc il faut vérifier le modèle. Plus d’informations ici : https://hddpcb.eu/gb/content/how-to-swap-hdd-pcb
Une bonne partie des disques « morts » peuvent ainsi fonctionner au moins quelques heures de plus. S’il montre des signes de vie comme dans le billet d’origine, mieux vaut ne pas toucher aux serre-joints ni au reflow, mais l’utiliser avec de longs câbles d’alimentation/SATA pour le relier à un ordinateur à l’extérieur de la porte du congélateur ou du four, et en extraire les données.
Pour l’extraction des données, je recommande GNU ddrescue. Quand il ne reste que quelques heures avant la panne complète, il maximise la quantité récupérée dans le temps disponible. Si l’on soupçonne que le disque est en grande partie vide, il existe aussi plusieurs façons de créer un fichier de carte afin d’ignorer la récupération des blocs vides.
https://www.hddzone.com/hard_drive_pcb_replacement.html
Si c’est bien la carte voulue et qu’il ne se passe toujours rien, il est peut-être temps de faire appel à un spécialiste ou de considérer les données comme perdues.
Réparer temporairement une mémoire flash suspecte avec un serre-joint de menuiserie et un morceau de carte de crédit Silicon Valley Bank, c’est l’histoire la plus HN que j’aie vue jusqu’ici.