Os sete sinais, na ordem em que costumam aparecer
Primeiro vêm os erros de arquivo: uma foto que não abre, uma cópia que morre no meio com erro de CRC, um salvamento que do nada informa disco corrompido. Segundo, os travamentos: segundos em que o mouse mexe mas nada carrega, causados por timeout do disco que o sistema reseta; o Visualizador de Eventos mostra como evento 129 de stornvme ou storahci, e disco que é resetado toda semana é disco de saída. Terceiro, o número do sumiço: o SSD some de vez em quando do Explorador ou da BIOS, quase sempre depois de acordar do sono; às vezes é bug de firmware ou de estado de energia, mas num controlador moribundo é contagem regressiva, não birra.
Quarto, gravações bem mais lentas que antigamente: NAND gasta e cache SLC encolhido estrangulam a gravação contínua, mas disco cheio acima de 90% faz o mesmo — meça primeiro com espaço livre, entre em pânico depois. Quinto, os avisos do SMART: no NVMe, Percentage Used subindo e qualquer valor diferente de zero em Media and Data Integrity Errors; no SATA, Reallocated Sector Count e Uncorrectable Sector Count engordando. Sexto, corrupção do sistema de arquivos que o chkdsk fica reencontrando. Sétimo e terminal: o disco entra em modo somente leitura e se recusa a gravar — a proteção contra desgaste liga e faz a última cortesia antes do fim.
O que fazer no dia em que você vir um
A ordem importa mais que a lista: o backup é o passo um, porque cada diagnóstico depois dele estressa exatamente o disco que você tenta salvar. As ferramentas são gratuitas, levam minutos e leem os mesmos sensores em que o fabricante confia. O firmware merece menção à parte: uma fatia notável dos SSDs NVMe "moribundos", principalmente os que somem depois do sono, roda firmware com bugs conhecidos, e uma atualização já salvou mais discos do que qualquer ajuste.
- Fazer backup do que importa imediatamente — antes de qualquer diagnóstico: varreduras são leituras e gravações num disco doente
- Ler o SMART com o CrystalDiskInfo: status "Atenção" ou "Ruim", ou valores diferentes de zero em Media and Data Integrity Errors, significam planejar a troca
- Checar a ferramenta do fabricante — Samsung Magician, WD Dashboard, Crucial Storage Executive: percentual de saúde e TBW consumido
- Parar o trabalho pesado de gravação nesse disco: nada de desfragmentar, formatação completa "reparadora" nem reseeding de torrents
- Atualizar o firmware se o fabricante oferecer: boa parte dos NVMe "moribundos" o firmware cura, não a cirurgia
- Trocar com planejamento quando o Available Spare se aproximar do limite, não quando o disco morrer nos próprios termos
Por que a morte de um SSD é mais repentina que a de um HD
Discos mecânicos costumam se desgastar devagar, com meses de aviso audível; SSDs morrem mais vezes por um AVC do controlador ou do firmware — em segundos, pulando a fase de aviso. O desgaste da NAND em si é gradual — é isso que Percentage Used e os índices de TBW medem — mas num SSD de consumo típico o controlador desiste bem antes de as células acabarem. Na prática, monitorar SMART pega na melhor das hipóteses metade das falhas reais; a outra metade chega sem avisar.
Daí a conclusão que ninguém vende mas todo mundo deveria ouvir: um SSD não precisa de rotina de limpeza, precisa de rotina de backup. Confira os números de saúde por trimestre, troque quando a reserva cair e trate qualquer sinal da lista como alarme de incêndio, não como sugestão. O disco que morre amanhã normalmente não mostrou nada ontem — e o que mostrou algo hoje está dizendo exatamente quanta pista ainda resta.
Perguntas e respostas
Quais são os primeiros sinais de falha do SSD?
Arquivos que de repente falham ao copiar com erros de leitura e travamentos de vários segundos por timeout do disco — costumam chegar antes de o SMART marcar qualquer coisa.
Dá para ver a saúde do SSD sem programas de terceiros?
Não de jeito útil. O Windows mostra pouco além de um status básico; o CrystalDiskInfo ou a ferramenta do fabricante mostram os atributos que realmente preveem a morte.
Veja exatamente o que está incluído antes de comprar.
O teste único de 30 minutos cobre os recursos básicos. Os recursos marcados PRO ficam bloqueados até a ativação de uma licença paga.
Continue lendo
Fale com a gente: [email protected]