Что такое S.M.A.R.T. и чего он не может сказать
S.M.A.R.T. — это система самомониторинга, встроенная прямо в микропрограмму накопителя. Диск считает события, которые считает значимыми — секторы, которые пришлось переназначить, команды чтения, которые пришлось повторить, часы под питанием, объём записанных данных, — и открывает эти счётчики операционной системе. По умолчанию их никто не интерпретирует за вас: Windows показывает только один общий флаг «исправен/неисправен», который диск поднимает, когда один из его счётчиков пересекает порог, заданный производителем.
Именно из-за этого единственного флага фраза «Windows говорит, что диск в порядке» — слабое доказательство. Порог задан на точке, где отказ уже очень вероятен, поэтому диск может месяцами накапливать тревожное число переназначенных секторов и всё равно отвечать OK. Именно чтение отдельных атрибутов превращает S.M.A.R.T. из некролога в предупреждение.
У него есть и жёсткое ограничение, которое никаким чтением не исправить: S.M.A.R.T. описывает тенденции износа и ошибок, а не внезапные события. Отказ платы контроллера, баг микропрограммы, скачок напряжения или падение ноутбука могут перевести диск от идеальных атрибутов к нечитаемости без какой-либо промежуточной стадии. Хорошие атрибуты означают «нет признаков деградации», а не «безопасно», и именно поэтому бэкапы не опциональны, что бы ни говорили счётчики.
Что Windows показывает бесплатно
Начните со встроенных команд. Каждая из них работает в Windows 10 и 11 без установки чего-либо; команды PowerShell для чтения счётчиков надёжности нужно запускать в окне с повышенными правами. Выполняйте их в указанном порядке — первые две занимают секунды и часто сразу закрывают вопрос.
- wmic diskdrive get model,status,size — собственный вердикт диска «исправен/неисправен»
- Get-PhysicalDisk | Select FriendlyName, MediaType, HealthStatus, OperationalStatus
- Get-PhysicalDisk | Get-StorageReliabilityCounter | Format-List — износ, температура, счётчики ошибок
- Get-Disk | Select Number, FriendlyName, HealthStatus, OperationalStatus, Size
- chkdsk C: /scan — онлайн-проверка файловой системы без отключения тома
- Optimize-Volume -DriveLetter C -ReTrim -Verbose — повторная выдача TRIM на SSD
- Просмотр событий → Журналы Windows → Система, отфильтровано по источникам disk и Ntfs
Как читать цифры: инструменты Windows против собственных данных диска
Get-StorageReliabilityCounter — самое полезное встроенное представление. На SSD она обычно возвращает Wear (примерно процент израсходованного расчётного ресурса), Temperature, PowerOnHours, ReadErrorsTotal и WriteErrorsTotal. На механическом диске она возвращает счётчики ошибок и температуру, но часто оставляет Wear пустым, поскольку это понятие к нему не применимо. Нулевые значения счётчиков ошибок на диске с тысячами часов под питанием — это та картина, которая нужна.
Сырую таблицу атрибутов с номерами ID сама Windows не показывает; её показывает специализированная программа чтения S.M.A.R.T., и каждый крупный производитель дисков тоже выпускает бесплатную утилиту для своего оборудования — Samsung, Crucial, Western Digital, Seagate и Kingston публикуют свои, и утилита производителя — самый надёжный источник для его собственных дисков, потому что она знает, как эта микропрограмма определяет каждый атрибут. Страница здоровья диска в Kleaner PRO читает те же атрибуты и показывает их по каждому диску простым языком — этого достаточно, чтобы понять, аппаратная у вас проблема или программная.
Одно предупреждение про интерпретацию сырых значений: производители нормализуют их не одинаково. Один и тот же ID атрибута может нести просто счётчик на одном диске, счётчик вместе с упакованной временной меткой на другом и специфичное для производителя значение на третьем. Доверяйте направлению движения — счётчику, который был 0 в прошлом месяце, а теперь стал 14, — больше, чем абсолютному числу.
Атрибуты жёсткого диска, которые имеют значение
Для механического диска почти всю предсказательную ценность несут пять атрибутов. Reallocated Sector Count (ID 05) считает секторы, которые диск нашёл плохими и переназначил в резервную область; любое ненулевое значение на потребительском диске — повод начать наблюдение, а значение, растущее неделя за неделей, — повод заменить диск. Current Pending Sector Count (ID C5) считает секторы, которые не прочитались и ожидают вердикта, — этот атрибут больше всего связан с файлами, которые внезапно перестают открываться, и он должен быть нулевым.
- 05 Reallocated Sector Count — переназначенные плохие секторы; ноль — норма, рост — фатально
- C4 Reallocation Event Count — сколько раз предпринималось переназначение
- C5 Current Pending Sector — нечитаемые секторы, ожидающие переназначения; должно быть 0
- C6 Offline Uncorrectable — секторы, которые не удалось восстановить вообще
- C7 UDMA CRC Error Count — ошибки передачи; почти всегда плохой SATA-кабель, а не диск
- 0A Spin Retry Count — двигателю потребовалась не одна попытка раскрутки
- BB Reported Uncorrectable Errors — ошибки, которые микропрограмма не смогла исправить внутри
SSD и NVMe: износ, резервная область и ошибки носителя
SSD отказывает иначе, поэтому атрибуты другие. На NVMe-накопителях два самых важных — Percentage Used, который растёт от 0 к 100 по мере расхода расчётного ресурса, и Available Spare, процент оставшихся резервных блоков с порогом — обычно 10% — ниже которого диск формально считается деградировавшим. Percentage Used выше 100 — это не немедленный отказ; диск просто превысил гарантийный ресурс, и к нему нужно относиться как к живущему в долг.
Media and Data Integrity Errors — счётчик, который должен быть равен нулю всегда. Он записывает неисправимые ошибки, когда диск вернул плохие данные или вообще не смог их вернуть, и даже пара таких случаев — повод переезжать с этого диска. Рост Unsafe Shutdowns обычно безобиден — он растёт каждый раз, когда машина теряет питание без чистой сброски кэша, — но высокое значение на настольном ПК может указывать на отказывающий блок питания, который со временем повреждает диски.
SATA SSD раскрывают примерно ту же информацию через специфичные для производителя ID атрибутов, чаще всего как «Percentage Lifetime Remaining», убывающий от 100, плюс Total LBAs Written. Если процент здоровья заметно падает месяц за месяцем на машине, которая не делает интенсивную запись, значит что-то в системе пишет намного больше, чем кажется, — неправильно настроенный файл подкачки на маленьком диске, приложение-логгер или клиент синхронизации, который повторно перезаписывает большую папку.
TBW: что на самом деле означает ресурс записи
TBW — terabytes written, «терабайт записано» — это общий объём записи, который производитель гарантирует для данной модели. Потребительские диски публикуют этот показатель по ёмкости: 1-терабайтный TLC-диск обычно рассчитан на несколько сотен терабайт, а больший объём даёт пропорционально более высокий рейтинг, потому что запись распределяется на больше флеш-памяти. Это гарантийная цифра, а не обрыв: диски регулярно превышают её, а иногда, по не связанным причинам, и отказывают задолго до неё.
Число, которое делает этот показатель значимым, — ваша собственная скорость записи. Возьмите Total Host Writes из атрибутов диска, разделите на PowerOnHours, чтобы получить скорость в час, и умножьте на год. Типичный настольный компьютер для браузера, офисной работы и игр пишет порядка нескольких терабайт в год, что отодвигает расчётный ресурс современного потребительского SSD на десятилетия и делает износ незначимой заботой. Машина с виртуальными машинами, черновыми файлами видеомонтажа или непрерывной работой с базами данных может писать на порядок больше, и именно тогда TBW становится реальным числом для планирования.
Именно эта арифметика снимает большую часть тревог по поводу SSD. Если Percentage Used за два года выросло с 1% до 3%, диск переживёт сам компьютер. Если за тот же срок оно выросло с 1% до 30%, стоит выяснить, что пишет, — вкладка «Подробности» диспетчера задач с включённой колонкой байтов записи ввода-вывода или вкладка «Диск» в resmon назовут процесс за минуту.
Симптомы, которые S.M.A.R.T. не замечает, и что делать первым делом
Некоторые отказы заявляют о себе через поведение раньше, чем сдвинется хоть один счётчик. Механический диск, который ритмично щёлкает, многократно раскручивается и останавливается или пропадает из BIOS до холодной перезагрузки, отказывает независимо от того, что говорят атрибуты. SSD, который замораживает всю систему на несколько секунд подряд, падает до доли обычной скорости копирования или сам перемонтируется в режим только для чтения, тоже отказывает — режим только для чтения — это намеренное поведение последней надежды, позволяющее скопировать данные, и это самый ясный возможный сигнал перестать использовать диск для чего-либо ещё.
Просмотр событий подтверждает всё это. Отфильтруйте журнал «Система» по источнику disk и ищите события с ID 7 (плохой блок), 51 (ошибка при операции подкачки) или 153 (повторная попытка операции ввода-вывода). Повторяющиеся записи от одного диска, особенно сгруппированные вокруг моментов, когда машина запиналась, — более веское доказательство, чем одно значение атрибута.
Порядок действий при первом плохом признаке не обсуждается: сначала скопируйте данные, потом разбирайтесь дальше. Диагностика читает диск, а чтение диска с ожидающими секторами — это ровно та нагрузка, которая превращает восстановимую ситуацию в невосстановимую. Как только у вас есть проверенная копия, замените диск, если хоть один из фатальных атрибутов ненулевой, переподключите или замените SATA-кабель, если единственная проблема — ошибки CRC, и запустите chkdsk /scan на файловой системе, если сам диск чист, а плохо ведёт себя только том.
Вопросы и ответы
Как проверить здоровье SSD без установки программ?
Выполните wmic diskdrive get model,status,size для собственного вердикта диска, затем Get-PhysicalDisk | Get-StorageReliabilityCounter в PowerShell с повышенными правами — для износа, температуры и счётчиков ошибок.
Один переназначенный сектор — это повод менять жёсткий диск?
Сам по себе — нет, но это значит, что диск начал переназначение и заслуживает наблюдения. Запишите значение, проверьте снова через неделю-две и замените диск, если счётчик растёт.
Сколько живёт SSD?
При обычном использовании — намного дольше самого компьютера: типичный годовой объём записи — малая доля расчётного ресурса современного диска. Тяжёлые нагрузки записи, такие как видеомонтаж или виртуальные машины, заметно сокращают этот срок, поэтому Percentage Used стоит отслеживать.
Что означают ошибки UDMA CRC?
Это ошибки передачи между диском и контроллером, и причина почти всегда — плохо подключённый или повреждённый SATA-кабель, а не сам диск. Переподключите или замените кабель; счётчик никогда не сбрасывается, поэтому важен только новый прирост.
Понятно до покупки: что входит в лицензию
Разовый 30-минутный триал даёт доступ к базовым инструментам. Возможности с меткой PRO остаются закрыты до активации платной лицензии.
Читайте также
Написать нам: [email protected]