Перейти к содержимому
СЦЕНАРИЙ / РЕМОНТ

Восстановление ASIC-парка после перегрева и запыления

Как разделить срочное восстановление и устранение первопричины: безопасное отключение, дефектовка, очистка, ремонт, нагрузочный тест и проверка вентиляции.

Инженер очищает и диагностирует ASIC после перегрева и сильного запыления
Изображение создано для иллюстрации типовой отраслевой задачи и не показывает объект конкретного клиента.
Поштучнодефектовка и решение
Под нагрузкойфинальный тест ремонта
2 контурасервис и инфраструктура

Почему нельзя ограничиться заменой платы

Перегрев и запыление редко повреждают все устройства одинаково. Часть ASIC уходит в защиту, часть теряет хешрейт, часть продолжает работать с ускоренным износом вентиляторов и силовых цепей. Если сразу менять платы без фиксации условий на площадке, отремонтированное оборудование может вернуться в ту же причину отказа.

Этот сценарий разделяет аварийные действия, сервисную диагностику и проверку инфраструктуры. Он не прогнозирует процент восстановления до дефектовки: решение принимается по каждому устройству после осмотра и тестов.

Первые действия на площадке

  • Остановить затронутую секцию по безопасному регламенту и исключить повторный запуск до осмотра.

  • Зафиксировать температуры, состояние фильтров, направление потоков и события питания.

  • Разделить оборудование по проявлениям: не включается, теряет платы, перегревается, нестабильно под нагрузкой.

  • Сохранить серийные номера и места установки, чтобы увидеть связь дефектов с конкретной зоной.

Как строится дефектовка и ремонт

Сервис начинает с внешнего осмотра и безопасной очистки, затем проверяет блок питания, управляющую плату, вентиляторы и хеш-платы. Неисправность фиксируется до замены компонентов. Работы согласуются по результатам диагностики, а отремонтированное устройство проходит повторную проверку и нагрузочный тест.

  • Отдельно отмечать следы перегрева, коррозии и загрязнения.

  • Не смешивать профилактическую очистку и подтверждённый ремонт.

  • Фиксировать неремонтопригодные узлы и причину решения.

  • Возвращать ASIC на площадку только после устранения системной причины.

Как не повторить инцидент

Результат проекта состоит из двух частей: восстановленного оборудования и скорректированного режима эксплуатации. Проверяются фильтрация, воздушные коридоры, плотность установки, уставки мониторинга и периодичность обслуживания. Итоговый реестр показывает, что отремонтировано, что требует наблюдения и какие изменения нужны площадке.

КОНТРОЛЬ ПРОЦЕССА

Как была
устроена работа.

  1. 01

    Стабилизация

    Безопасно остановить секцию, сохранить телеметрию и зафиксировать условия, в которых возникло отклонение.

  2. 02

    Дефектовка

    Очистить и проверить каждый ASIC, разделив неисправности блоков питания, управления, вентиляторов и хеш-плат.

  3. 03

    Ремонт и тест

    Согласовать подтверждённые работы и проверить восстановленные устройства под нагрузкой.

  4. 04

    Устранение причины

    Проверить воздушные потоки, фильтры, плотность установки, мониторинг и график обслуживания.

ОЖИДАЕМЫЙ РЕЗУЛЬТАТ

Что должно быть
на выходе.

  • Поштучный реестр состояния оборудования
  • Согласованный объём ремонта после дефектовки
  • Нагрузочная проверка восстановленных ASIC
  • План устранения причин перегрева и загрязнения
КОНТРОЛЬНЫЕ МАТЕРИАЛЫ

Что нужно
зафиксировать.

  • Фотофиксация и данные мониторинга
  • Карты диагностики устройств
  • Протоколы ремонта и нагрузочного теста
  • Акт проверки вентиляции и рекомендации

Фактический состав документов определяется договором, площадкой и выбранным оборудованием.

ПОХОЖАЯ ЗАДАЧА

Разберём ваш проект
по той же системе.

Сначала проверим исходные данные и ограничения. Только после этого зафиксируем состав работ, сроки и ожидаемый результат.

Смотреть все материалы