Логи в асике: что это, какие бывают и как их читать

Логи — это журнал событий в асике. Всё, что происходит в аппарате, записано здесь. Это значит, что в логах можно увидеть информацию о запуске, температуре, работе чипов, скорости, сети. Всё, о том, как читать логи, как они выглядят в прошивках и без, на Antminer, Whatsminer, Avalon и Goldshell — в нашем подробном практическом гайде. 

Когда всё хорошо, обычно в логи смотреть не надо. Но с появлением ошибки, перегрева или скачков хешрейта, просмотр логов обязателен.

Логи помогают:

  • быстро найти причину, почему упал хешрейт;
  • понять, какая плата умерла или где пропал чип;
  • увидеть перегрев до того, как асик уйдёт в троттлинг;
  • проверить, нормально ли работает прошивка;
  • понять, проблема в асике или в пуле/интернете.

Следовательно, решение проблемы будет зависеть от того, что покажут логи.

Где смотреть логи:

  • Bitmain → Kernel Log
  • Whatsminer → System → Log
  • Avalon → Miner → Log или Advanced → CGMiner API Log
  • Goldshell → System → Log → Kernel Log (основной)

В интерфейсе это выглядит примерно так:

В разных версиях прошивок и моделей текст логов может отличаться. Но смысл и типичные сообщения все здесь. Для удобства, вы можете воспользоваться поиском в браузере Ctrl+F, вбить слово из логов, которое вас интересует, и найти расшифровку.

Разбирая логи, мы с вами начнём с универсальных. Это значит, что они встречаются у всех моделей и производителей. Затем разберём более конкретные и совсем «экзотичные». 

Универсальная таблица логов ASIC-майнеров

ИНИЦИАЛИЗАЦИЯ, ПОИСК ПЛАТ И ЧИПОВ

Строка в логеЧто значитЧто делать
bmminer start / cgminer startЗапустился процесс майнингаНорма
detect hashboard / detect chainКонтроллер сканирует платыНорма
Chain[0]: find 126 asicПервая плата нашла все свои чипыНорма
Chain[1]: only find 47 asicНа второй плате пропала половина чиповВыключить → сильно перетыкать силовые кабели и шлейф этой платы. Часто оживает. Не помогло → несите плату в ремонт
Chain[2]: find 0 asicТретья плата вообще не виднаСначала перетыкать силовые кабели (те толстые провода от БП). На S19kPro/S21 в половине случаев помогает! Не помогло → ремонт платы
hashboard missingПлата отсутствуетПроверить кабели → заменить порт → ремонт
pic error / pic init failНа плате сгорел маленький «мозг» (PIC)Нести плату в ремонт
eeprom read failАсик вообще не может прочитать память платыПлата в ремонт
eeprom checksum failДанные в памяти платы испорчены (как битый файл)Сначала перепрошить асик стоковой прошивкой. Не помогло → плата в ремонт.
EEPROM error / not foundПамять платы физически умерла или отгнила100 % ремонт платы. Меняются микросхема EEPROM

ТЕМПЕРАТУРА И ДАТЧИКИ

СтрокаЧто значитЧто делать
Temp[0]: 72°CНормальная температураНорма
chip temp over max/ board overheatПлата сильно перегреласьУбрать пыль, улучшить обдув, поменять термопрокладки (они могли отвалиться или пересохнуть)
temperature too highАсик сейчас выключится от жарыСрочно охладить помещение или перенести асик в прохладное место
temp sensor read failДатчик температуры не отвечаетПерезагрузка → если повторяется — ремонт
sensor value abnormalДатчик показывает неверные данныеРемонт или замена датчика
read temp errorОшибка чтения датчиковПроверить плату и шлейфы

ВЕНТИЛЯТОРЫ

СтрокаЧто значитЧто делать
Fan0 speed 0/ Fatal Error: some fan lost!Один вентилятор не крутитсяПоменять вентиляторы местами → если ошибка переехала — менять вентилятор. Осталась на том же месте — ремонт контроллера
Fan1 speed lowНизкие оборотыЧистка/замена
Fan errorОшибка вентилятораПроверить кабели
fan speed abnormal/ out of rangeСгорел *ШИМ-контроллер вентиляторовНести в ремонт плату
PWM set to 100%Асик выкручивает обороты на максимумПроверить температуру в помещении
Fan[0]: 31200 RPM / 28–35k RPMСгорел *ШИМ-контроллер вентиляторовНести в ремонт плату
Fan[0]: 0 → 29800 RPM (скачки)*ШИМ-контроллер умерНести в ремонт плату

*ШИМ-контроллер — маленький чип на плате, который отвечает за вентиляторы.

РАБОТА ЧИПОВ, ХЕШРЕЙТ, ЧАСТОТЫ

СтрокаЧто значитЧто делать
hashrate now = 102 TH/sТекущий хешрейтНорма
avg hashrate = XСредний хешрейтСравнить с нормой
freq = 675MHzРабота на частотеНорма
freq down to 450MHzЧастота сниженаПерегрев / слабое питание
chain X lower hashОдна плата даёт намного меньше хеша, чем остальныеСмотреть температуру этой платы и количество найденных чипов. Обычно — начало «смерти» платы
crc errorЧипы на плате плохо передают данные друг другуРемонт платы
asic timeoutЧип «не отвечает»Ремонт цепочки
asic tx failОшибка передачи данныхПроверить питание/плату
nonce errorЧип даёт неверные результатыЕсли разовая история, некритично, если постоянно → ремонт чипа

ПИТАНИЕ, БП (блок питания), НАПРЯЖЕНИЕ

СтрокаЧто значитЧто делать
voltage too lowБлок питания не тянет или проседает сеть 220 ВПроверить розетку, убрать тройники-удлинители, попробовать другой БП
voltage too highПеренапряжениеПроверить БП
domain voltage abnormalНа плате упало напряжение (обычно 1.2 В)Ремонт платы
power limit reachedАсик ограничил мощностьПроверить питание
power lostПитание кратковременно пропалоПроверить кабель/БП
voltage fluctuation detectedНапряжение скачет (обычно 220 В ± 15–20 В)Проверить розетку, убрать тройники-удлинители, подключить напрямую в щиток
input voltage unstableВходящее напряжение нестабильноеТо же самое, что и выше + поставить стабилизатор 220 В
PSU voltage drop / PSU voltage lowБП просаживает напряжение (такое часто бывает при старте или разгоне) Попробовать другой БП, проверить силовые кабели, которые идут от БП к платам
frequency abnormal / PSU frequency errorЧастота сети скачет Чаще всего это плохая проводка, а значит, лучше вызвать электрика 
ERROR_POWER_LOST: power voltage rise or drop, pls check (в прошивке Bitmain)Резкий скачок напряженияВыключить и подождать пару минут. Подключить в розетку без удлинителей, перетыкать все кабели, попробовать другой БП, поставить стабилизатор

ПУЛ, СЕТЬ, СТРАТУМЫ

СтрокаЧто значитЧто делать
stratum connectПодключение к пулуНорма
socket connect failedНет соединенияПроверить интернет
DNS resolve failedПроблемы с DNSПерезапустить роутер / задать DNS вручную
reconnecting…Асик переподключаетсяПроверить сеть
stale shareШары устарелиПроверить задержки сети
rejected shareПул отклоняет шарыЕсли >3%, проверить интернет или настройки
stratum authentication failedОшибка авторизации на пулеПроверить Worker и пароль («x»)
pool 0 slow/downПул не отвечаетСменить пул

ПЕРЕЗАПУСКИ, АВАРИИ

СтрокаЧто значитЧто делать
watchdog rebootingАсик завис → ПерезапускСмотреть причину выше в логе
fatal error, mining stopКритическая ошибкаПроверить питание/чипы
reset reason: temp too highПерегрев вызвал рестартОхлаждение
reset reason: fan missingВентилятор отсутствуетПроверить вентиляторы
power lost, restartПропало питаниеПроверить БП/кабели
system rebootПерезагрузка контроллераЕсли частая — прошивка/контроллер

ПРОШИВКА, АВТОТЮН

СтрокаЧто значитЧто делать
tuning failАвтотюн не смог подобрать частотыПроверить охлаждение/питание
calibration failОшибка калибровки платыРемонт
flash write failПроблема записи прошивкиПовторить прошивку / заменить SD-карту
autotune startЗапуск автотюнаНорма
autotune endЗавершение автотюнаНорма

КОНТРОЛЛЕР, СИСТЕМНЫЕ ОШИБКИ

СтрокаЧто значитЧто делать
control board temp highПерегрев контроллераУлучшить вентиляцию
MCU errorОшибка микроконтроллераПерезагрузка / ремонт
i2c timeoutОшибка шины датчиковПроверить плату
spi communication errorОшибка связи с чипамиОбычно — ремонт платы
uart timeoutКонтроллер не получил ответРемонт платы или контроллера

Логи Bitmain Antminer

Разберём по этапам логи в Kernel Log (в веб-интерфейсе Bitmain → вкладка System → Kernel Log).

  1. Самые частые ошибки
ЛогиЧто это значит Что делать
Chain[X]: find 0 asic или chain find 0 asic, will power off this chainПлата вообще не видна / ни одного чипа1. Выключить асик из розетки 2. Вытащить и сильно вставить обратно оба толстых силовых кабеля на этой плате 3. Включить → в 40–60 % случаев на S19kPro/XP/S21 сразу найдёт 126 чипов и заработаетНе помогло → плата в ремонт
Chain[X]: only find 47–90 asicПоловина чипов пропалаПеретыкаем силовые кабели + шлейф. Не помогло → плата в ремонт
autotune fail (особенно на S21/S21+)Плата не смогла настроить частоты1. Перетыкаем кабели 2. Factory Reset (сброс до заводских настроек) + свежая прошивка 3. Не помогло → 85 % умер VRM (блок питания на плате) → плата в ремонт
domain voltage abnormal / unstableНа плате упало напряжение 1.2 ВНести плату в ремонт
CRC error (даже 1–2 раза в минуту)Чипы плохо передают данные друг другуЭто уже начало конца. Через 1–4 недели плата уйдёт в 0. Несите в ремонт
nonce errorЧип считает «мусор»На старых S9–S17 — мёртвый чип На S19kPro и новее — в 90 % плохое питание платы 
Temp[X]: 90–97 °C на S21Нормально для S21 в 2025 годуНичего не делать, это штатное состояние
Temp[X]: 95–100+ °C (любой модели)Скоро вырубитсяСрочно улучшить обдув, убрать пыль
Fatal Error: some fan lost!Один вентилятор не крутится или не отдаёт оборотыПоменять вентиляторы местами → ошибка переехала → менять вентилятор → ошибка осталась на том же номере → ремонт контроллера
PSU error / voltage too lowБлок питания не тянет или просадка в розеткеУбрать тройники, проверить 220 В, попробовать другой БП
pic error / pic init failНа плате сгорел маленький «мозг» (PIC)Плата в ремонт
EEPROM error / eeprom checksum failПамять платы умерла или данные стёрлись90 % — плата в ремонт. Перепрошивка помогает редко
  1. Запуск — что должно быть при нормальном старте (за 20–40 секунд)

Нормальный лог выглядит примерно так:

Можно закрывать и идти пить кофе 🙂 

Дальше рассмотрим процессы и логи подробнее.

Запуск майнера и софта

Строка в логеЧто значитЧто делать
bmminer start / cgminer startЗапустился основной майнер (движок, который считает хэш)Норма
restart bmminerПерезапуск майнера внутри системы (без полного ребута асика)Смотреть строки выше — почему перезапустился
Found bmminer / start running bmminerКонтроллер нашёл и запускает бинарник майнераНорма
bmminer not running, restart…Процесс упал, watchdog пытается поднять обратноИдём выше по логу, ищем причину падения (температура, чипы, БП)

Определение плат (Chain/Hashboard)

Дальше асик проверят платы.

СтрокаЧто значитЧто делать
check_chain_num: chain_num = 3Асик ожидает 3 хешборда (0, 1, 2)Норма
chain[0] exist / chain[1] existПлата найдена по шлейфуНорма
chain[2] is missing / chain[2] doesn’t existОдна из плат не отвечает вообщеПроверить питание платы, шлейфы, порт; скорее всего ремонт платы
hashboard type: S19Контроллер определил тип платы/моделиНорма
hashboard missingПлаты нет или она «мёртвая»Проверить кабеля, питание. Если не помогает — нести в ремонт

Поиск чипов на платах (ASIC detect)

Это одно из самых важных при инициализации для Bitmain.

СтрокаЧто значитЧто делать
chain[0]: find 126 asicНа плате 0 найдено 126 чипов — норма для S19-серииВсё хорошо
chain[1]: find 0 asicПлата есть физически, но ни один чип не отвечаетПроверить питание и силовые кабели (на S19kPro/S19XP/S21 часто это плохой контакт в разъёме питания платы), в ремонт, если всё равно не видит чипы
chain[1]: only find 47 asicПлата нашла часть чипов, цепочка обрываетсяПроверить шлейф; если повторяется — ремонт цепочки/чипов
chain[2]: asic detected = 76Альтернативный формат: найдено 76 чиповЕсли должно быть 76 — норма, если больше — недочип, ремонт
check_asic_number_with_power_on: Chain[0]: find 0 asic (встречается в кастомных прошивках)Контроллер с питанием попытался прочитать чипы, но не увидел ни одногоХешборд не работает: питания нет, сильная неисправность, ремонт
asic number is not enoughКоличество найденных чипов меньше нормыПлата дефектная, нужна диагностика
chain 1 find asic 0, will power off this chainКонтроллер отключает эту плату, так как чипы не найденыАсик будет работать без этой платы, но хешрейт упадёт; плату в ремонт

Инициализация PIC, сенсоров и служебных контроллеров

PIC — это маленький микроконтроллер на каждой хеш-плате Bitmain. Он работает как «мозг» платы и управляет всем, что связано с безопасностью и стабильностью работы.

СтрокаЧто значитЧто делать
pic init / init pic okPIC-контроллер успешно запустилсяНорма
pic error / failed to init picКонтроллер питания/датчиков не выходит на связьЧаще всего ремонт платы; может лечиться перепрошивкой, но не всегда
read temp sensor okДатчики температуры отвечаютНорма
read temp sensor error / temp sensor read failНе получается прочитать температуру с платыПроверить шлейф; если на одной плате стабильно — ремонт

Проверка вентиляторов при запуске

Bitmain при старте обязательно проверяет вентиляторы.

СтрокаЧто значитЧто делать
check fan NUM: 2Ожидается 2 вентилятора (или 4 — в зависимости от модели)Норма
Fan0 speed = 0, Fan1 speed = 0 (start phase)На запуске вентиляторы ещё не раскрутилисьНорма, если дальше появляется нормальное значение
Fatal Error: some fan lost! (на старте)Уже при запуске контроллер видит, что один вентилятор не отвечаетПроверить вентилятор, кабель, разъём; без исправления асик не запустится в майнинг

Строки с калибровкой, autotune при старте

На новых сериях (S17/S19/S21, L7 и др.) при запуске может идти автотюн.

СтрокаЧто значитЧто делать
start autotune / begin tuning chain 0Запуск подбора частот и напряжений для платНорма
tune chain 0 asic 0-125Идёт настройка всех чипов на плате 0Норма
autotune fail (особенно на S21)Плата не смогла настроить частотыПроверить кабели, перезагрузить прошивку. Если не помогло, проблема в VRM (БП на самой плате) → в ремонт 
calibration OKКалибровка завершена успешноНорма
calibration failНе удалось откалибровать платуПовторный запуск; если повторяется — ремонт

Так выглядит «здоровый» асик при запуске:

А вот «больной» асик выдаст что-то такое:

Давайте расшифруем:

  • chain 1 — недочип (47 вместо нормы) → ремонт платы;
  • chain 2 — полностью мёртвая;
  • Fan0 не крутится → без замены вентилятор асик не запустится;
  • watchdog гоняет его по кругу.

Температура и вентиляторы

Когда асик уже запустился и начал майнить, в Kernel Log появятся строки про:

  • температуру плат и чипов;
  • скорость вентиляторов;
  • попытки системы охладиться;
  • аварии при перегреве.

Это ключевой блок, по нему видно, падает ли хешрейт или вырубается ли асик.

Как выглядит нормальная работа по температуре

Типичные строки:

Или в другом формате (для некоторых серий):

Асик каждые несколько секунд пишет текущую температуру плат (Temp[0], Temp[1], Temp[2]). Нормальный рабочий диапазон:

  • S9 – S19j Pro → до 75–80 °C;
  • S19k Pro, S19XP, S19+ → до 85–90 °C;
  • S21, S21+, S21 Pro, S21 Hydro → до 90–97 °C.

Если все три платы в примерно одинаковом диапазоне и не лезут к верхней границе. На обычных S19 — это 60–73 °C, на S21 — 70–90 °C. 

Если одна плата резко убегает на 10–15 °C выше остальных или приближается к 95–100 °C — это уже тревожный сигнал.

Как лог показывает перегрев

Когда что-то не так с охлаждением, появляются более «жёсткие» строки.

Например:

Или:

Давайте переведём:

  • chip temp over max — датчик на самой горячей точке чипа превысил максимум. 
  • board overheat — перегрелась вся плата, а не один датчик.
  • temp too high, reboot / reset reason: temp too high — асик сам себя перезагрузил из-за перегрева.

Что делать в таком случае:

  1. Смотреть на общую температуру в помещении (душная комната, лето, тепловая пушка и т. д.).
  2. Проверить фильтры, пыль, грязь на воздухозаборе.
  3. Посмотреть, нет ли горячей платы — если одна сильно выше остальных, возможно:
    • забитый радиатор;
    • отвалившиеся термопрокладки;
    • плохой контакт радиатора с чипами.
  4. Если перегрев повторяется каждый час или два — это уже не случайность, а стабильная проблема.

Что такое троттлинг и как он виден в логах

Троттлинг — это когда асик сам снижает частоту или мощность, чтобы не сгореть. В логах это выглядит так:

Это значит, что асик видит, что температура подходит к опасной зоне, и снижает частоты — хешрейт падает, но асик остаётся жив.

Что делать в таком случае:

  • усилить обдув, улучшить вентиляцию помещения;
  • перенести асик в более прохладное место.

Вентиляторы в нормальном режиме

Типичные строки в процессе работы:

Если стоит 4 вентилятора, то будет так выглядеть:

Что это значит:

  • Вентиляторы крутятся, обороты примерно одинаковые.
  • Асик сам регулирует обороты в зависимости от температуры.

Здесь ничего делать не надо. 

Как лог показывает проблемы с вентиляторами

Вариант 1: вентилятор не раскручивается

Fan0 speed = 0

Fan1 speed = 5900

Fatal Error: some Fan lost or Fan speed low!

Это значит, что один вентилятор не крутится или не отдает обороты в контроллер. Асик считает, что охлаждения нет и аварийно останавливается.

Что делать:

  1. Остановить асик.
  2. Проверить разъём вентилятора: не выскочил ли, не болтается ли.
  3. Осмотреть провод: нет ли заломов или залома лопастями.
  4. Поменять вентиляторы местами:
  • если ошибка переехала с Fan0 на Fan1 → виноват сам вентилятор;
  • если ошибка осталась на том же месте → проблема в порте контроллера (ремонт).

Вариант 2: вентилятор крутится, но слишком медленно

Fan1 speed low

fan speed abnormal

Асик видит, что скорость вентилятора ниже заданного минимума (например, 2000–2500 RPM). В таком случае, иногда помогает чистка и смазка, но чаще всего проще заменить вентилятор, чем спасать умирающий.

Вариант 3: асик выкручивает вентиляторы на максимум

fans PWM set to 100%

И при этом в логе видно высокую температуру:

Temp[1]: 80C

chip temp over max

Эти логи говорят, что асик дует на максимум, но ему всё равно жарко. 

Что делать:

  • увеличить обмен воздуха в помещении;
  • убрать асик из шкафа/угла, где воздух не меняется;
  • проверить, не стоит ли он вплотную к стене;
  • иногда помогает банальное открыть дверь/окно, если майнит в маленькой комнате.

Комбинированные симптомы: температура + вентилятор

Часто в логах температура и вентиляторы идут рядом и сразу показывают картину. Пример проблемного фрагмента:

Temp[0]: 78C

Temp[1]: 85C

Temp[2]: 79C

Fan0 speed = 6200

Fan1 speed = 6100

chip temp over max

board overheat, stop mining

watchdog rebooting

Что мы видим из этого:

  • одна плата (Temp[1]) вылезла за 80+ °C;
  • вентиляторы уже на максимуме;
  • асик перегрелся и ушёл в перезагрузку.

В данном случае надо искать причину по этой плате (1). Что может быть:

  • забит радиатор;
  • плохо прижат радиатор;
  • высохли или отвалились термопрокладки;
  • плата расположена так, что на неё хуже всего дует воздух.

Другой пример: когда вентилятор умер и температура растёт:

Temp[0]: 65C

Temp[1]: 74C

Temp[2]: 82C

Fan0 speed = 0

Fan1 speed = 6000

Fatal Error: some Fan lost or Fan speed low!

temp too high, reboot

Мы видим, что один вентилятор не крутится (Fan0 speed = 0); одна из плат стремительно перегревается (Temp[2]: 82C); асик падает в ребут (temp too high, reboot).

Здесь требуется замена вентилятора.

Hashrate, чипы и CRC-ошибки

Задача логов в этом блоке:

  • показать, сколько реально хеширует асик;
  • указать, какая плата или цепочка отстаёт;
  • показать, есть ли ошибки связи между чипами (CRC);
  • предупредить, что плата скоро «умрёт».

Как выглядит здоровая картина по хешрейту

Типичный фрагмент:

hashrate now = 103.2TH/s

avg hashrate = 102.8TH/s

chain[0] rate: 34.4TH/s

chain[1] rate: 34.1TH/s

chain[2] rate: 34.3TH/s

Что это значит:

  • hashrate now — текущий хешрейт (сильнее прыгает).
  • avg hashrate — средний за период (более сглаженный).
  • chain[X] rate — «вклад» каждой платы.

Как мы понимаем, что это — «здоровая картина»:

  • общий хешрейт близок к нужному (например 100–104 TH/s для S19 95T с разгоном);
  • все chain примерно равны (нет платы, которая даёт в 2 раза меньше).

Как лог показывает, что одна плата «сыпется»

Типичные строки:

chain 1 lower hash

chain 1: rate = 18.2TH/s (expect 34TH/s)

hashrate is low, check chain 1

Что это значит:

  • lower hash — плата даёт меньше, чем должна; асик показывает, что одна плата просела, даже если общий хешрейт вроде «нормальный».

Почему такое происходит:

  • часть чипов на плате не работает;
  • много ошибок CRC*;
  • троттлинг по температуре именно этой платы;
  • проблемы с питанием цепочки.

*CRC — это проверка связи между чипами на плате. Когда асик майнит, чипы передают друг другу данные по цепочке. Если в передаче появляются ошибки — в логах видно CRC error. Эти ошибки мы разберём ниже.

Итак, что делать в таком случае:

  1. Сравнить температуры по платам: нет ли одной сильно горячей.
  2. Посмотреть выше по логу:
  • сколько он нашёл ASIC на chain 1 (only find 47 asic и т.д.);
  • нет ли CRC-ошибок на chain 1.
  1. Если chain стабильно ниже — эта плата уже «поехала», и доход будет ниже, чем должен.

CRC error — главный признак умирающей цепочки

CRC — это проверка целостности данных. Когда в логе появляется CRC error, это значит, что данные между чипами передаются с ошибками.

Строки могут выглядеть так:

CRC error, chain[1] asic[23]

crc error on chain 2

chain 0: too many CRC error

Чипы в цепочке не могут нормально общаться друг с другом. И это почти всегда про железо, а не про софт.

Основные причины CRC-ошибок:

  • деградация/умирание одного из чипов;
  • трещина дорожки или пайки;
  • перегрев, из-за которого чип «плавает»;
  • проблемы с питанием цепочки (напряжение гуляет);
  • грязь/окислы в районе соединений (редко, но бывает).

Что делать:

  1. Посмотреть, на какой цепочке CRC: chain[1], chain[2] и т. д.
  2. Если CRC редко (1–2 раза на запуск) — пора выдвигаться на ремонт. Можно сказать, что это «начало конца». 
  3. Если в логах куча CRC, а цепочка даёт lower hash — плата точно уйдёт в ремонт. Перезагрузка или чистка здесь уже не помогут.

«Недочип» и как это бьёт по хешрейту

Если при инициализации вместо 126 ASIC асик нашёл 47–80 — это уже частично мёртвая цепочка. Пример старта:

chain[1]: only find 47 asic

asic number is not enough

chain 1 lower hash

Дальше вы увидите:

chain 1 rate: 14.2TH/s (expect 34TH/s)

hashrate now = 83.1TH/s (expect 103TH/s)

Это значит, что из-за «недочипа» плата даёт меньше терахэшей. При этом, ещё и общий хешрейт падает, хотя асик вроде работает.

Что делать в таком случае:

  1. Это железный дефект платы, то есть дело не в настройках.
  2. Можно майнить дальше «как есть», если устраивает меньший хешрейт.
  3. С точки зрения нормальной эксплуатации, плату надо ремонтировать.

Взаимосвязь: чипы, CRC, hash

Все эти показатели связаны. Обычно за одним появляется другое. 

Это может выглядеть так:

  • При старте: only find 47 asic → уже недочип.
  • В работе: chain 1 lower hash.
  • Параллельно: CRC error on chain 1.

В итоге мы имеем общий хешрейт, который ниже, чем надо.

Если в логах наблюдается именно такая картина, это значит, что асик нашёл меньше чипов на плате, по ней асик начинает выдавать CRC-ошибки и пишет lower hash, то есть плата деградировала. Она работает, но «сыпется» и даёт меньше терахэшей.

Ошибки ASIC, nonce, timeout

Кроме CRC, в логах бывают и другие сигналы, что отдельный чип или цепочка дохнут. Типичные строки:

asic 23 nonce error

asic 17 timeout

asic status abnormal

asic boost fail

Расшифровка:

  • nonce error — чип считает, но выдает «мусор» (неправильные решения);
  • timeout — чип не отвечает вовремя;
  • status abnormal — чип ведёт себя нестандартно;
  • boost fail — режим ускорения (ASICBoost и т. п.) не может быть активирован на этой плате или цепочке.

Если лог был разовым, то можно пережить. А вот если повторяется, то плату надо нести в ремонт.

Как лог показывает, что плата полностью отключилась

Выглядеть это может так:

chain 1 has too many errors, disable it

disable chain 1

chain[1] is off

hashrate now = 68TH/s (expect 103TH/s)

Что это значит:

  • асик сам отрубил плату, чтобы не мучиться;
  • майнинг идёт только на оставшихся chain.

По строкам chain X rate, lower hash, CRC error и only find N asic видно, насколько каждая плата здорова.

Если плата даёт мало хеша (lower hash), на старте найдено меньше чипов, в работе появляются CRC и timeout на этой плате, значит цепочка сыпется, и асик будет зарабатывать меньше, чем должен.

Давайте закрепим.

Что видно в логахЧто это значит Что делать 
chain 1 lower hashЭта плата работает слабее остальных. Дает меньше терахэшей.1) Сравнить температуру этой платы с другими. 2) Посмотреть, сколько чипов она нашла на старте. 3) Есть ли CRC-ошибки? Если есть → плата деградирует.
only find 47 asicАсик нашёл меньше чипов. Плата неполная/частично умерла.Плата рабочая, но уже «криво». Нужна диагностика или ремонт.
CRC error on chain 1Чипы на плате передают данные с ошибками. Цепочка нестабильна.Если CRC повторяются → плата умирает. Временно можно майнить, но хешрейт будет падать → отправлять в ремонт.
disable chain 1Асик сам отключил плату — она совсем плохая.Ничего не сделать. Асик будет майнить только на 1–2 оставшихся платах. Плату в ремонт.
asic X timeout / nonce errorОдин из чипов глючит, плохо отвечает или считает неправильно.Разовая ошибка — норм. Частые ошибки → плата деградирует → ремонт.
hashrate now сильно ниже avgХешрейт прыгает, асик нестабилен.Проверяйте: 1) температуру; 2) работает ли одна из плат хуже; 3) есть ли CRC; 4) не троттлит ли асик из-за жары.

Питание, напряжение, БП в логах Bitmain

Здесь мы в формате таблиц покажем, что значат строки voltage, PSU error, power limit, power lost.

Общие ошибки по питанию

Что видно в логахЧто это значит Что делать
voltage too lowАсик недополучает питание. Напряжение просело.1) Померить напряжение в розетке (должно быть 220–240В). 2) Убрать удлинители/тройники. 3) Проверить кабель питания. 4) Если повторяется → менять БП.
voltage too highНапряжение выше нормы — опасно для асика.Проверить розетку мультиметром. Если это выдаёт БП → заменить БП.
PSU errorБлок питания работает неправильно.1) Проверить кабель и контакты. 2) Заменить БП — это чистый признак его умирания.
power lostПитание кратковременно пропадало/провалилось.1) Проверить розетку и кабель. 2) Проверить автомат/щиток. 3) Если всё ок — менять БП.
power low, rebootАсик уходит в перезагрузку из-за просадки по питанию.Проверить питание, заменить БП.

Внутреннее питание плат (domain voltage)

Что видно в логахЧто это значитЧто делать
domain voltage abnormalНа одной из плат напряжение гуляет или нестабильно. Это уже проблема самой платы, а не розетки.Плата в ремонт. Самостоятельно не чинится.
set volt xx / volt adjustАсик подбирает напряжение для чипов — норма.Ничего делать не нужно.
volt too low for chain XНа этой плате не хватает питания для стабильной работы.Проверить БП. Если БП нормальный → плата деградирует → ремонт.

Ограничение мощности (Power Limit)

Что видно в логахЧто это значитЧто делать
power limit reachedАсик сам урезал мощность, потому что БП не тянет или питание проседает.Проверить: 1) температуру БП; 2) сеть 220В; 3) если повторяется — менять БП.
limited power modeВключился режим экономии — хешрейт снизится.Проверить питание.

Ошибки, которые маскируются под другие

Что видно в логахЧто это значитЧто делать
freq down to XXXMHzАсик снижает частоту из-за плохого питания или перегрева.Сначала проверить питание.
hashrate now < avgХешрейт прыгает. Асик работает нестабильно.Проверить питание → проверить БП → затем уже смотреть цепочки.
crc error (много)CRC растут из-за плохого питания платы.Проверить питание и БП до ремонта платы.
restart bmminerМайнер падает из-за нестабильного питания.Проверить линию 220В и БП.
adjust_freq_by_power: lower freq X → Y / freq set … due to power limitАсик снижает частоту, пытаясь удержаться на просевшем питании.Проверить сеть 220–240В под нагрузкой. Убрать удлинители. Проверить автомат/щиток.
power limit triggered (без PSU error)Лимит мощности сработал, но БП не зафиксировал ошибку — похоже на скачок по сети.Измерить напряжение под нагрузкой. При «плавающей» линии использовать стабилизатор или другую линию.
chain X hashrate abnormal, restart / hashrate now 0.00 GH/sЧастота уже снижена, но питания всё равно не хватает — хеш падает в ноль.Проверить питание и температуру БП. Протестировать другой БП, если сеть норм.
disable chain X → restart chain X / asic_num = нормальныйПлата перезапускается, но не «падает в 0 ASIC», то есть дело в питанииПроверить нагрузку по линии, проводку, переходники. Часто помогает тест с другим БП.
важно: если нет PSU error, power lost, psu_faultБП не успевает зафиксировать скачок, это именно просадка сети.Проверить линию питания; если линия нормальная, БП деградирует. Значит, пора менять.

У Bitmain питание — самая частая скрытая причина проблем. Если асик пишет voltage, PSU error, power limit или power lost, сначала нужно проверить розетку, кабель и БП, а уже потом искать проблемы в платах.

Stratum, пул, сеть в логах Bitmain

Эти логи показывают, что проблема в интернете, пуле или задержках. Если ASIC используется для добычи BTC, сначала проверьте, доступен ли выбранный пул для майнинга биткоина, а также правильно ли указаны Stratum-адрес, порт и имя воркера.

Подключение к пулу

Что видно в логахЧто это значитЧто делать 
stratum connectАсик пытается подключиться к пулу.Норма.
stratum connectedПодключение к пулу успешно.Всё хорошо — майнит.
stratum authenticate successАсик прошёл авторизацию (Worker верный).Норма.

Проблемы с сетью (кабель, интернет, DNS)

Что видноЧто это значитЧто делать
socket connect failedАсик не может подключиться к пулу. Нет интернета.1) Проверить кабель. 2) Проверить роутер. 3) Попробовать другой пул.
reconnecting…Асик теряет связь и пытается заново подключиться.Интернет нестабилен. Проверить сеть.
DNS resolve failedАсик не может найти домен пула (проблема DNS).Поменять DNS в роутере: 8.8.8.8 / 1.1.1.1.
stratum connection interruptedСвязь оборвалась.Проверить интернет, кабель, вилку.
network error, retry after 10 secondsИнтернет есть, но нестабилен.Проверить пинг/задержки.

Проблемы с пулом (ошибки авторизации или сам пул лежит)

Что видноЧто значитЧто делать
stratum authentication failedНеверный Worker или пароль (обычно «x»).Проверить строку воркера на пуле.
pool 0 slow/downПул не отвечает или работает медленно.Сменить пул / подождать.
null work receivedПул прислал пустое задание.Проблема на стороне пула.
pool failed: retry after …Асик не может обменяться данными с пулом.Проверить сеть → попробовать другой пул.

Ошибки шар и подтверждения

Что видноЧто значитЧто делать
accepted shareПул принял шары — всё работает.Норма.
rejected shareПул отклоняет часть шар.Если >3% → проверить интернет (задержки).
stale shareУстаревшие шары — асик прислал слишком поздно.Проблема с задержкой сети. Проверить провайдера.
high stale rateСлишком много устаревших шар.Интернета не хватает. Менять роутер или кабель.

Ключевые симптомы, когда асик не майнит, но выглядит рабочим

Что видноЧто это значитЧто делать
hashrate now = 0, но вентиляторы крутятсяАсик не получает задания от пула.Проверить сеть/пул/DNS.
Нет accepted share за 1–2 минутыАсик подключён, но не выполняет работу.Проблема в пуле или авторизации.
Постоянные reconnectingИнтернет «плавает».Проверить кабель, роутер, сменить порт.
socket send errorАсик не может отправить шары на пул.Проверить сеть.

Watchdog, reboot, reset reason

Watchdog — это встроенный контролёр, который следит, чтобы асик не зависал и продолжал майнить. Его задача — обнаружить сбой и запустить асик заново.

Reboot — это перезагрузка асика, то есть результат, а не причина. Причины же все указываются в логах.

Reset reason — это строка в логах, которая показывает, почему произошла перезагрузка. 

Самые частые причины ребута

Что видно в логахЧто значитЧто делать 
watchdog: restart minerАсик завис или перестал считать → watchdog принудительно перезапустил.Смотреть 10–30 строк выше: температура? CRC? питание? сеть?
restart bmminerСам майнер упал (как программа).Часто бывает при плохом питании или ошибки чипов. Проверить питание → смотреть CRC.
power lost, rebootПитание просело/пропало, асик перезапустился.Проверить розетку, кабель, БП.
fatal error, rebootingЖёсткая ошибка оборудования.Смотреть, какая цепочка или датчик дал сбой → обычно ремонт.

Ребут из-за температуры

Что видноЧто значитЧто делать
temp too high, rebootАсик перегрелся и включил защиту.Проверить вентиляцию, пыль, температуру помещения.
overheat, shutdown, rebootЧипы или плата превысили лимит.Сначала охлаждение, потом тестировать.
fan lost, rebootВентилятор не работает → безопасность → ребут.Проверить вентиляторы, кабели, порты.

Ребут из-за питания (БП, просадка 220В)

ЛогЧто это значитЧто делать
power low, rebootБП не справляется, мало напряжения.Проверить сеть 220В, убрать удлинители, заменить БП.
voltage too low, restartГлубокая просадка питания.То же самое.
psu error, rebootБП работает неправильно.95% случаев → менять БП.

Ребут из-за чипов, платы (chain)

Что видноЧто это значитЧто делать
chain X asic status abnormal, rebootПлата зависла или чипы не отвечают.Смотреть CRC, температуру, недочип.
CRC error … restartЦепочка «сыпется», чипы передают ошибки.Ремонт платы.
chain X lower hash, restartПлата упала по хешрейту → watchdog считает это отказом.Проверить плату (температура, CRC, недочип).
fault on chain X, rebootЖёсткая ошибка цепочки.Плата в ремонт.

Ребут из-за сети, пула

Что видноЧто значитЧто делать
stratum disconnect, rebootАсик теряет пул и считает, что он «мертв».Проверить интернет, DNS, роутер.
no active pool, rebootАсик не нашёл ни одного рабочего пула.Исправить строку воркера, сменить пул.

Асик не должен ребутиться из-за пула, но на перегруженных прошивках такое бывает.

Как читать reset reason (причину перезапуска)

В Bitmain это можно увидеть так:

reset reason: temperature

reset reason: power

reset reason: watchdog

reset reason: fan

reset reason: chain 1 error

Что это значит:

reset reasonОбъяснение 
temperatureПерегрев → защита → перезапуск.
powerУпал БП или сеть.
watchdogАсик завис и перестал считать.
fanВентилятор умер → аварийный ребут.
chain errorПроблема на конкретной плате/цепочке.
overcurrentСлишком высокая нагрузка на питание.

Ошибки контроллера (control board), датчиков, PIC, EEPROM

Control board (контроллер) — это главная плата управления асика. Она запускает майнер, управляет хешбордами, читает датчики, отвечает за сеть, вентиляторы и обмен данными.

PIC — это отдельный маленький микроконтроллер на каждой хеш-плате. 

EEPROM — это чип памяти на каждой хеш-плате. В нём хранятся данные платы: конфигурация, таблицы калибровки, номера чипов. 

Все эти ошибки — аппаратные проблемы. В 80–90% случаев они требуют ремонта платы или контроллера. 

Давайте разбираться, как их распознать в логах.

Ошибки PIC (микроконтроллер на плате)

PIC управляет питанием платы, считывает датчики, запускает хешборд. Если он ломается, плата перестаёт работать.

Что видно в логахЧто значит Что делать 
read pic failКонтроллер не получает данные с PIC.Плата в ремонт. Дома не чинится.
pic init failPIC не запустился при старте.Ремонт платы / прошивка PIC на стенде.
pic sensor errorPIC не может прочитать датчик температуры.Проверить шлейф → если не помогает — ремонт платы.

Ошибки датчиков температуры

У Bitmain датчики стоят на чипах, платах, контроллере и иногда в PSU (блок питания). 

Что видноЧто значитЧто делать
temp sensor errorАсик не видит датчик температуры.Проверить шлейфы. Если привязано к плате → ремонт.
read temp failСбой при чтении датчика.То же самое.
sensor connection lostДатчик не отвечает.Проверить шлейф → ремонт платы.
board temp abnormalДатчик даёт неверные показания.Плата нестабильна → в ремонт.

Ошибки контроллера (control board)

Контроллер управляет всем асиком. Если он глючит, будут хаотичные ребуты, неверные чтения плат, зависания.

ЛогЧто значитЧто делать
control board lost chainКонтроллер не видит плату.Переподключить шлейфы. Если не помогает — ремонт платы или контроллера.
control board rebootСбой контроллера.Прошивка / сброс на заводские.
control board errorКонтроллер работает нестабильно.Перепрошивка. Если остаётся — заменить контроллер.
gpio init errorКонтроллер не может инициализировать линии управления платой.Характерно для S17/T17. Почти всегда ремонт платы.

Ошибки EEPROM

EEPROM — маленькая микросхема, где хранится конфигурация платы: частоты, номера чипов, таблицы калибровки. Если EEPROM повреждён, асик не сможет правильно запустить плату. 

Если кратко: видите в логах слово EEPROM, можете сразу нести плату в ремонт. 

Что видноЧто значитЧто делать
EEPROM errorEEPROM не читается или повреждён.Ремонт платы или перепрошивка EEPROM на программаторе.
eeprom data invalidДанные повреждены.То же самое.
eeprom not foundEEPROM не обнаружен.Плата неисправна → ремонт.

Очень часто встречается на S9 и S17.

Ошибки I2C (шина связи)

I2C — это линия, по которой контроллер общается с платами и датчиками. Если она глючит, платы перестают отвечать.

ЛогЧто значитЧто делать
I2C errorКонтроллер не смог связаться с датчиком/платой.Проверить шлейфы → ремонт платы.
I2C read failОшибка чтения с датчика.То же.
I2C bus busyЛиния связи зависла.Перезагрузка. Если повторяется → ремонт.

Характерно для S17/T17.

Модели асиков Antminer с уникальными логами

Есть аппараты, у которых логи могут вообще показаться странными или вообще неизвестными. Тут не стоит переживать. Мы собрали уникальные логи у таких моделей, чтобы в случае вы могли понять, что значит та или иная строка.

ANTMINER S9, L3, L3+

МодельУникальная ошибкаЧто значитЧто делать
S9/L3+EEPRom errorПамять платы не читается.Плата в ремонт, перепрошивка EEPROM.
S9/L3+ASIC = 63 63 63 …Старый формат вывода всех чипов. Если есть нули → отсутствующие чипы.Проверить хешборд, если много нулей — ремонт.
S9/L3+Chain X ASIC 00 00Плата не нашла чипы.Проверить шлейф → ремонт платы.
S9MM ASIC ID mismatchЧипы отвечают нестабильно.Плата деградирует → ремонт.

ANTMINER S17, T17

МодельУникальная ошибкаЧто значитЧто делать
S17/T17GPIO FailedКонтроллер не инициализирует плату.Проверить шлейф, почти всегда ремонт.
S17/T17I2C ErrorЛиния связи датчиков “висит”.Проверить шлейфы → чаще ремонт платы.
S17/T17PLL not lockedПлата не может выставить частоту.Ошибка платы → ремонт.
S17/T17Chain work abnormalЦепочка работает нестабильно.Проверить CRC, температуру, питание.
S17/T17asic status abnormalНестабильная работа чипов.Диагностика, ремонт.
S17/T17EEPROM init errorEEPROM не запустилась.Ремонт/перепрошивка EEPROM.

ANTMINER S19, S19 Pro, S19j, XP

МодельУникальная ошибкаЧто значитЧто делать
S19 серияstart autotuneЗапуск автотюна частот.Норма.
S19 серияstart voltage tuneНастройка напряжений цепей.Норма.
S19 серияvoltage calibrationКалибровка напряжения на платах.Наблюдать, если ошибка не повторяется.
S19/S19jasic index abnormalСбой в порядке чипов.Проверить CRC, возможно ремонт.
S19/S19jhashboard mismatchПлата не соответствует прошивке/модели.Проверить прошивку, совместимость, иногда плата неоригинальная.
S19/S19 XPdomain voltage abnormalПлохое питание цепочки.Плата в ремонт.
S19 Propic init failPIC не запускается.Ремонт платы.

ANTMINER S21, T21, PRO

МодельУникальная ошибкаЧто значитЧто делать
S21/T21VRM protection triggeredСработала защита питания VRM.Плата неисправна → ремонт.
S21/T21overcurrent on chainСлишком большой ток на плате.Проверить питание, скорее всего ремонт.
S21/T21domain voltage unstableНапряжение скачет.Плата деградирует → ремонт.
S21/T21chip detect timeoutЧипы не прошли инициализацию вовремя.Проверить шлейф → ремонт платы.
S21/T21critical temp: hashing stoppedТемпература достигла критического уровня.Проверить охлаждение.

ANTMINER L7 (LTC/DOGE)

МодельУникальная ошибкаЧто значитЧто делать
L7L7: pll errorЧастота PLL не выставилась.Плата в ремонт или снизить частоту.
L7L7 autotune failАвтотюн не смог подобрать частоты.Проверить питание, температуру.
L7chip temp abnormalПроблема с датчиком температуры платы.Проверить датчики → ремонт.
L7fan lostПотеря вентилятора, критичная для L7.Проверить вентиляторы.

ANTMINER HYDRO

МодельУникальная ошибкаЧто значитЧто делать
S19 Hydro / S21 Hydrowater temp highВода перегрелась.Проверить контур охлаждения.
Hydropump speed lowНасос работает слишком медленно.Проверить насос.
Hydroflow sensor errorНет потока воды.Остановить работу → чинить контур.
Hydrowater cooling protectСработала защита водяного охлаждения.Устранить проблему в охлаждении.
HydroERROR_WATER_REVERSEСработала защита водяного охлаждения.Поменять местами обратку и подачу

Логи MicroBT Whatsminer

Если мы будем сравнить ватсы с антами, что заметим, что у ватсов меньше «слов» в строках. Здесь больше кодовых ошибок. Чтобы посмотреть логи, заходим в System → Kernel Log. 

Если у вас стоит прошивка, то дополнительные логи можно посмотреть в API Log. 

Типичные логи Whatsminer выглядят примерно так:

Температура (Temp, Overheat)

Это основа логов Whatsminer: почти все ошибки связаны с вентиляторами и температурой.

ЛогЧто значитЧто делать
Temperature is higher than 80℃Температура превысила рабочий порог.Проверить обдув, фильтры, убрать нагрев рядом.
Temperature is too high!Критическая температура → майнер остановил хеширование.Охладить, увеличить вентиляцию.
Temp abnormalДатчик температуры даёт неверные данные.Проверить плату, датчик, возможно ремонт.
EC temp abnormalКонтроллер не может прочитать температуру платы.Проверить шлейфы, чаще ремонт платы.
PSU Temp: highПерегрев блока питания PSU.Проверить обдув БП, заменить блок питания.
BoardX Temp highПлата перегрелась.Проверить вентиляторы, обдув, помещение.

Вентиляторы (110–121 коды)

Код / ЛогЧто значитЧто делать
Fanin detect speed error (110)Входной вентилятор не даёт обороты → отсутствует сигнал RPM.Поменяйте местами, если ошибка осталась — ремонт вентилятора. 
Fanout detect speed error (111)Задний вентилятор не даёт обороты.Заменить вентилятор или в ремонт.
Fanin speed error (120)Обороты слишком низкие (отклонение ≥2000 RPM).Проверить кабель, вентилятор.
Fanout speed error (121)Слишком низкие обороты заднего вентилятора.Проверить вентилятор.
Fan abnormalЛюбой сбой работы вентилятора.Проверить питание вентилятора, заменить.
Fan lostВентилятор не работает вообще.Менять вентилятор.

Hashboard, чипы, отвал плат (Board Detect)

ЛогЧто значитЧто делать
Board0 detect failПлата не прошла инициализацию.Проверить шлейф/контакты → ремонт.
Board1/2 detect failЛюбая другая плата не видна.Проверить провода, ремонт платы.
BoardX ASIC detect failЧипы не обнаружились при старте.Выключить и включить силовые кабели, если не помогло, то нести плату в ремонт. 
BoardX hash lowПлата выдаёт меньше хеша, чем должна.Проверить температуру, питание, деградацию.
Hashrate lower than expectedОбщий хешрейт ниже нормы.Смотреть температуры, PSU.
Hashrate unstableХеш скачет.Проверить температуру, PSU, кабели.
Board lostКонтроллер потерял плату во время работы.Проверить контакты → ремонт.

Питание, PSU, напряжение

ЛогЧто значитЧто делать
Power dropМощность резко просела.Проверить напряжение в сети, кабель, PSU.
Reboot by PSUМайнер перезапущен из-за ошибки блока питания.Тестировать PSU, заменить.
Power unstableНестабильная подача питания.Проверить сеть 220V.
PSU Temp: highПерегрев PSU.Улучшить охлаждение.
Setpower drop to XXXX WМайнер снизил мощность из-за температуры/слабого PSU.Проверить охлаждение, блок питания.
PSU protect triggered / Power protectРезкий скачок напряжения Выключить и подождать пару минут. Подключить в розетку без удлинителей, перетыкать все кабели, попробовать другой БП, поставить стабилизатор

Stratum, пул, сеть

Что видноЧто значитЧто делать
Reconnect poolПотеря связи → переподключение.Проверить интернет/кабель.
Auth failedОшибка авторизации на пуле.Проверить Worker/пароль.
Pool not respondПул не отвечает.Сменить пул.
Share rejectedПул отклоняет шары.Проверить задержки сети.
Low diff shareПул дал задачу низкой сложности.Не ошибка, норма.
Net errorОшибка сети.Проверить кабель/роутер.

Температурные и сенсорные ошибки (Sensors)

ЛогЧто значитЧто делать
Temp sensor errorДатчик не отвечает.Проверить плату → ремонт.
Sensor abnormalДатчик даёт странные значения.Диагностика датчиков.
EC detect failКонтроллер не может прочитать датчик.Проверить шлейфы; ремонт.

Ошибки датчиков и платы управления

ЛогЗначениеДействия
EC temp abnormalКонтроллер считает температуру неверной.Диагностика контроллера/датчиков.
Hashboard lostКонтроллер «потерял» плату.Проверить питание, шлейфы.

Перезагрузки, reset

ЛогЧто значитЧто делать
Miner rebootingПерезагрузка.Смотреть 5–10 строк выше.
Reboot by overheatПерегрев.Охлаждение.
Reboot by PSUБП не справился.Проверить PSU.
Reboot by watchdogМайнер завис, watchdog перезапустил.Смотреть чипы/температуру/PSU.
Reboot by errorОшибка в датчиках или платах.Определить по логам выше.

Ошибки прошивки, конфигурации

ЛогЧто значитЧто делать
Firmware errorОшибка прошивки.Перепрошить.
Config load failКонфигурация не загрузилась.Сбросить настройки.
EC firmware abnormalОшибка прошивки контроллера.Перепрошить/заменить control board.

Гидро-версии (M53, Hydro)

ЛогЧто значитЧто делать
Inlet temp highВходящая вода слишком горячая.Проверить охлаждающий контур.
Outlet temp highВыходящая вода слишком горячая.Увеличить поток.
Flow errorНет потока воды.Проверить насос, фильтр, трубки.
Pump speed lowНасос крутится медленно.Проверить насос.
Water protectСработала защита водяного охлаждения.Остановить работу → устранить проблему.

M53 — единственный Whatsminer, который может выключить хеширование по датчику воды, а не только по температуре чипов.

Модели асиков Whatsminer с уникальными логами

Здесь мы покажем строки и логи, которые есть только у определённых моделей.

Серия M20, M21

Эта серия «сырая», в логах — много уникальных ошибок по вентиляторам и температуре PSU.

МодельУникальная строкаЧто значитЧто делать
M20/M21PSU Temp high – rebootБП перегрелся и инициировал перезапуск.Улучшить обдув или заменить БП.
M20/M21Fan deviation too largeВентилятор отклоняется от нормы.Проверить вентилятор/кабель.
M20/M21Temp sensor unstableДатчик температуры «прыгает».Диагностика платы.
M21Board overtemp shutdownПлата отключена по температуре.Проверить охлаждение.

Эти ошибки почти не встречаются в M30/M31, потому что там новая система датчиков.

Серия M30, M30S, M31

Здесь появились новые логи — мощность (Setpower) и новые PSU-события.

МодельУникальная строкаЧто значитЧто делать
M30/M31Setpower: XXXX WМайнер работает на указанной мощности.Норма. Если скачет — проверять PSU.
M30/M31Power drop – adjustingАвтоматическое снижение мощности.Охладить, проверить PSU.
M30/M31EC temp abnormalОшибка датчика контроллера (новый тип).Проверить шлейф/контроллер.
M30/M31Hashboard lost – reconnectingКонтроллер потерял плату во время работы.Проверить питание/шлейф.

Серия M50, M50S, M53

У M50-серии появились уникальные логи по БП.

МодельУникальная строкаЧто значитЧто делать
M50/M50SPSU protect activePSU включил защиту от перегрузки.Заменить PSU или проверить сеть.
M50/M50SPower unstable – limit modeМайнер снижает мощность из-за нестабильной сети.Проверить 220В.
M50/M50SBoard current abnormalНестабильный ток на плате.Деградация платы → ремонт.
M50Current limit reachedДостигнут порог тока (новый VRM-сигнал).Проверить охлаждение и PSU.

S-серии (S21 и S21 Pro)

У Whatsminer S-линеек (кастомные S-версии) есть дополнительные термологи.

МодельУникальная строкаЧто значитЧто делать
S-серияTemp diff too largeБольшая разница температуры между платами.Проверить обдув/вентиляторы.
S-серияSensor mismatchДатчики дают разные значения.Проверить датчики → ремонт.
S-серияOvertemp shutdownСработало аварийное отключение.Охладить помещение.

Логи Avalon

У Avalon своя логика логов, свои коды BOOTBY, своё поведение хешбордов и уникальные ошибки, которых нет ни у Bitmain, ни у Whatsminer.

Где смотреть логи:

  1. Miner → Log — обычный текстовый лог (иногда там бывают ошибки).
  2. Advanced → CGMiner API Log → команда stats — САМЫЙ ГЛАВНЫЙ лог (JSON).
  3. System → Log Viewer — системные сообщения Linux.

Но главное отличие Avalon — коды BOOTBY, которых нет ни у одного другого бренда. Эти коды показывают, почему асик перезагружается. 

Выглядит это так:

Таблица всех BOOTBY-кодов:

КодЧто значитЧто делать
BOOTBY: overheatПерегрев.Проверить обдув, вентиляторы, помещение.
BOOTBY: netПотеря сети или ошибка Stratum.Проверить интернет/кабель.
BOOTBY: apiРебут через API (внешняя команда).Проверить мониторинг/скрипты.
BOOTBY: hardФизическая перезагрузка (кнопка/отключение питания).Проверить питание/PSU.
BOOTBY: tempdiffБольшая разница температур плат.Проверить вентиляторы, запыление.
BOOTBY: sensorОшибка датчика температуры платы.Проверить датчики → ремонт.
BOOTBY: hwerrОшибка хешборда/чипов.Диагностика платы.
BOOTBY: unknownНеопознанная причина → системная ошибка.Проверить ОС, прошивку.

Логи обнаружения плат, чипов (detect)

Avalon использует собственный формат detect-строк: 

ЛогЧто значитЧто делать
ASIC_NUM: 104Нормальная работа платы (у разных моделей разные нормы).Норма.
ASIC_NUM: 0Плата не нашла ни одного чипа.Проверить шлейфы → ремонт платы.
asic detect timeoutПлата не успела пройти инициализацию.Сбои питания или деградация платы.
ChainX lostПлата пропала в процессе работы.Проверить питание/контакты.

Температура и вентиляция

Avalon строго контролирует температуру, особенно модели A10xx–A12xx. 

ЛогЧто значитЧто делать
temp too highПлата перегрелась.Охладить помещение.
sensor errorТемпературный датчик не отвечает.Проверить датчик → ремонт.
fan speed lowВентилятор не раскручивается.Проверить/заменить вентилятор.
fan 0 rpmВентилятор умер.Замена.

Хешрейт, частоты, стабильность плат

ЛогЧто значитЧто делать
Domain voltage abnormalНеисправность питания цепи.Плата в ремонт.
H/W error highВысокий процент hardware errors.Проверить температуру, деградацию платы.
Lower hash on chain XПлата выдает меньше хеша.Проверить температуру и питание.
Freq tune failПлата не смогла подобрать частоту.Деградация → ремонт.

Ошибки PSU, питания

ЛогЧто значитЧто делать
power lostПропадание питания на плате.Проверить кабель/PSU.
voltage too lowПросадка по напряжению.Проверить сеть, БП.
voltage unstableПитание скачет.Диагностика PSU.

Ошибки ОС, системные

Avalon работает на BusyBox Linux, поэтому в логах есть системные сообщения. 

ЛогЧто значитЧто делать
kernel panicОшибка ОС.Перепрошить, заменить контроллер.
cgminer deadMiner-сервис упал.Ребут → если повторяется → контроллер.
mmc read errorОшибка SD-карты/памяти контроллера.Заменить control board.

Модели асиков Avalon с уникальными логами

У некоторых моделей могут быть логи, которых нет у других. Пройдёмся по ним.

A1041, A1047 (10-я серия)

У асиков из этой серии надо отметить старую архитектуру питания и чувствительные датчики вентиляторов.

МодельУникальная ошибкаЧто значитЧто делать
A1041/A1047ChainX: ASIC_NUM abnormalКоличество чипов нестандартное — проблема цепочки.Проверить шлейф → ремонт платы.
A1041/A1047fan stallВентилятор «застрял», не набирает обороты.Заменить вентилятор.
A1041/A1047BOOTBY: tempdiffБольшая разница температур плат.Проверить обдув, запыление.
A1041/A1047sensor abnormalДатчик температуры даёт неверные данные.Проверить датчик → ремонт платы.

A1126, A1166 (11-я серия)

В этой серии появилась новая схема detect, частая деградация плат, нестабильное питание.

МодельУникальная ошибкаЧто значитЧто делать
A1126/A1166asic detect timeoutПлата не прошла инициализацию в отведённое время.Проверить шлейф → ремонт.
A1126/A1166freq tune failПлата не смогла подобрать рабочую частоту.Деградация платы → ремонт.
A1126/A1166voltage domain unstableСкачки питания на доменах.Проверить PSU → ремонт платы.
A1126/A1166ChainX: H/W error highСлишком много HW-ошибок на плате.Проверить температуру → ремонт.

A1246, A1266 (12-я серия) 

Эту серию называют самой капризной. Она отличается нестабильностью питания, датчиков и цепочек.

МодельУникальная ошибкаЧто значитЧто делать
A1246/A1266Domain voltage abnormalПлата даёт аномальные напряжения.Почти всегда ремонт платы.
A1246/A1266sensor mismatchedДатчики температуры конфликтуют.Проверить датчики → ремонт.
A1246/A1266ChainX lostЦепочка (плата) пропала во время работы.Проверить питание/шлейфы.
A1246/A1266BOOTBY: hwerrРебут из-за аппаратной ошибки платы.Диагностика на стенде.
A1246/A1266BOOTBY: sensorПерезагрузка из-за датчика температуры.Проверить датчики → ремонт платы.

A13, A13 Pro 

МодельУникальная ошибкаЧто значитЧто делать
A13/A13 ProPLL tune failЧастота PLL не выставляется.Деградация чипов → ремонт платы.
A13/A13 ProVDD domain protectЗащита по напряжению домена VDD.Проверить PSU → ремонт.
A13/A13 ProBoard OC protectЗащита по превышению тока платы.Проверить охлаждение → ремонт.
A13/A13 ProBOOTBY: overcurrentПерезапуск из-за превышения тока цепей.Проверить PSU → высокая вероятность ремонта платы.

Самая последняя серия A16 вышла в октябре 2025 года. По ним пока нет уникальных логов. В будущем обязательно дополним.

Логи в API выглядят по-другому. Вот для примера:

Покажем, как читать «страшные» логи здесь:

Поле с логомЧто значитНормаПлохо или критичноЧто делать
Hash Board: 3 или 4Сколько хеш-плат асик видит сейчас3 или 4 платы найдены2 или меньшеПеретыкать силовые кабели и шлейфы
MGHS[≈20 21 22]Реальный текущий хешрейт по каждой платеХешрейт по платам примерно одинаковыйОдна сильно ниже или 0Проверить плату и заняться охлаждением
GHSavgСредний хешрейт за всё время работыБлизко к норме<< GHSmmЭто значит, перегрев
DHПроцент дуффов (отбракованных шар)0–7 %10–20 % плохо, >25 % — «смерть»Срочно охлаждать
MTmax[70 73 76]Максимальная температура на каждой платеВсе три ≤ 80 °CОдно из чисел 82+ °CНаправить отдельный мощный вентилятор именно на эту плату
PVT_T0 / PVT_T1 / PVT_T2Массивы температур каждого чипа на плате 1 / 2 / 3 (по 90–120 чисел в строке)50–78 °CЕсть 80–85 °C — плохо, 86+ °C — «смерть» чиповИскать самые горячие чипы
Fan1-Fan4Обороты каждого из четырёх вентиляторов в RPM3500–6500 (зависит от температуры)Один вентилятор <1500–2000 RPMПоменять вентиляторы местами → если ошибка переехала → менять вентилятор
FanRНа каком проценте от максимума сейчас крутятся вентиляторы40–75 %95–100 % постоянноАсик сильно греется → срочно охлаждать асик или помещение
ASICCRC0/1/2CRC-ошибки передачи данных по каждой плате (должны быть нули)0 0 0 0 … во всех трёх строкахПоявились любые цифры больше 0Через 3–14 дней эта плата уйдёт в 0, значит, надо готовиться к ремонту
SF0 / SF1 / SF2Рабочие частоты по платам (обычно четыре значения через пробел: 537 562 587 612)Все три строки почти одинаковыеОдна строка сильно ниже (например 450 475 …)Питание умирает, нести в ремонт
MW0 / MW1 / MW2Количество X-ов на каждой платеДо 20–30 в строке80–150 и больше в одной строкеПлата начинает умирать, через 1–4 недели будет 0 TH

Кратко запомните 3 красных «флага» Avalon (если есть один из них, асик скоро умрёт):

  1. DH выше 15 % → перегрев или смерть платы;
  2. ASICCRC не нули → через неделю-две плата уйдёт в 0;
  3. Одна плата в MGHS сильно ниже остальных → 90 % случаев перегрев третьей/четвёртой платы.

По приведённому примеру можно ориентироваться по логам у своего асика.

Логи Goldshell

Прежде, чем приступим к просмотру логов, вот, что надо учесть. У Goldshell самая нестандартная логика среди всех брендов. У них свои логи, своя структура, свои правила остановки майнинга. Многие ошибки выглядят «безобидно», но на деле означают серьёзные проблемы.

Все логи можно посмотреть в System → Log → Kernel (здесь всё техническое), System → Log → Miner (здесь логи по процессу), System → Log → System (системные ошибки, прошивки и API).

У Goldshell нет «плат» в классическом виде, большинство моделей одноплатные. Оборудование очень чувствительное к температуре и вентиляторам. 

Goldshell часто пишет INFO, но многие INFO-сообщения, на самом деле, предупреждения.

Итак, пойдём по порядку.

Температура и охлаждение

ЛогЧто значитЧто делать
hash stop: temp too highМайнинг остановлен из-за перегрева.Проверить вентиляцию, обдув.
temp high, hash stopТемпература достигла порога защиты.Уменьшить температуру помещения.
temp warningТемпература близка к критической.Усилить обдув.
board temp errorПлата даёт некорректную температуру.Проверить датчик → ремонт.

Вентиляторы

ЛогЧто значитЧто делать
fan abnormalВентилятор работает нестабильно.Проверить вентилятор, кабель.
fan speed lowОбороты ниже нормы.Заменить вентилятор.
fan lostВентилятор отсутствует / умер.Заменить вентилятор.
fan error, hash stopИз-за вентилятора остановлен майнинг.Поменять вентилятор.

Плата и хеширование

ЛогЧто значитЧто делать
hashboard errorОшибка работы платы.Проверить питание и охлаждение → ремонт.
hash rate lowХешрейт ниже нормы.Проверить температуру, PSU.
hash restartПлата перезапустилась.Смотреть строки выше — причина обычно температура.
chip errorОшибки чипов (редко видно напрямую).Плата деградирует → ремонт.
hashboard no responseПлата не отвечает.Сильно вероятен ремонт.

У многих BOX-серий чипы не выводятся, поэтому в логах будут только общие сообщения. То есть детализированных ошибок вроде этого:

вы не увидите. 

Общие сообщения выглядят так:

Это значит, что майнер видит только состояние асика целиком. Понять, что именно сломалось — будет сложно.

Питание и PSU

ЛогЧто значитЧто делать
power errorНестабильное питание.Проверить блок питания.
low power modeАсик снизил потребление.Норма при перегреве.
psu errorОшибка блока питания.Проверить/заменить PSU.
psu protectЗащита БП от перегрузки.Проверить кабель/розетку.

Пул, сеть, стратумы

ЛогЧто значитЧто делать
connect pool failНевозможно подключиться к пулу.Проверить интернет/адрес пула.
stratum errorОшибка протокола stratum.Проверить настройки пула.
stratum reconnectПереподключение к пулу.Проверить сеть.
share rejectПул отклоняет шары.Проверить задержку, ping.
share low diffШара низкой сложности.Норма.

Системные ошибки

ЛогЧто значитЧто делать
system errorОбщая ошибка ОС.Перезагрузка → если повторяется, перепрошивка.
api server errorAPI не отвечает.Перезагрузить майнер.
reset by watchdogМайнер завис → watchdog перезагрузил.Смотреть строки выше — чаще перегрев.
config load failНастройки не загрузились.Сбросить конфигурацию.

Модели асиков Goldshell с уникальными логами

Пройдёмся по аппаратам с уникальными логами.

BOX-серия (KD-Box, HS-Box, LT-Box, SC-Box)

МодельУникальный логЧто значитЧто делать
BOX-серииhash stop: overtempМайнинг остановлен из-за перегрева.Улучшить охлаждение.
BOX-серииfan speed abnormalВентилятор вращается нестабильно.Заменить вентилятор.
BOX-серииhash restart loopПетля перезапусков.Температура или питание.

KD5, KD6 и другие крупные аппараты

МодельУникальный логЧто значитЧто делать
KD5 / KD6boot error power modeОшибка режима мощности.Проверить PSU.
KD5 / KD6overload protectЗащита от перегрузки.Питание/PSU.
KD5 / KD6hash lostПотеря хеширования.Проверить температуру, дать остыть.

SC-Box, Mini Doge Pro, серия «Home miners»

МодельУникальный логЧто значитЧто делать
Mini Dogefreq lockedЧастота фиксирована из-за температуры.Уменьшить температуру вокруг.
SC-boxseal errorОшибка работы чипов SC.Проверить питание → часто ремонт.
Mini Dogehash low protectЗащита при низком хеше.Проверить PSU и сеть.

Как читать логи на самых популярных кастомных прошивках

Большинство майнеров пользуются прошивками, причём, кастомными, то есть не заводскими. 

Самые популярные:

  • VNish / VNish2 — самая массовая в СНГ и Китае
  • Braiins OS+ — Европа и США
  • LuxOS — кто майнит на Luxor
  • HiveOS ASIC — фермы на Hive
  • Asic.to / Epic — тоже часто встречаются

На них логи выглядят совсем по-другому — короче, без длинных строк типа «Chain[1]: find 126 asic». 

Мы рассмотрим две основные: VNish и Braiins OS+. 

Логи на прошивке VNish

Где смотреть: System → Download Log → vnish.log или miner_state.log.

Важное уточнение. У каждого лога есть метки:

  • [INFO] — всё нормально, просто информация;
  • [WARN] или Warning — предупреждение, что скоро может стать плохо;
  • [ERROR] или Error — серьёзная проблема;
  • [CRIT] или Critical — асик сейчас выключится или уже умер.

Пример, как это может выглядеть:

Разбираем сами логи:

ЛогиЧто это значит Что делать 
[INFO] Power ON, version 1.2.6-stableАсик только что включился, версия прошивкиПодождать 1–2 минуты
[INFO] Chain[0]: 200/200 chips OKПервая плата нашла все свои чипы — идеальноНичего, всё отлично
[INFO] Chain[1]: 200/200 chips OKВторая плата тоже полностью живаяНичего
[INFO] Chain[2]: 200/200 chips OKТретья плата тоже полностью живаяНичего
[WARN] Chain[1]: 185/200 chips (15 lost)На второй плате пропало 15 чипов из 200Выключить → сильно перетыкать толстые силовые кабели 6-pin. 
[WARN] Chain[2]: 170/200 chips (30 lost)На третьей плате пропало уже 30 чиповТо же самое, но шансов меньше. Можно готовиться к ремонту
[ERROR] Chain[2]: 0/200 chips, disabledТретья плата вообще не видна, прошивка её отключилаСначала также проверить кабели → потом в ремонт (обычно сгорел VRM)
[INFO] Preset: High Perf (4500W)Включён самый мощный режим разгонаЛетом будет очень жарко, зимой — огонь
[INFO] Preset: Medium (3500W)Средний режим — самый стабильныйСамый безопасный для лета
[INFO] Tuning complete: Avg freq 458 MHz, HW error 0.2%Автотюн прошёл идеально, ошибок почти нетВсё отлично, хешрейт будет максимальный
[WARN] Tuning complete: Avg freq 410 MHz, HW error 2.1%Автотюн прошёл, но с ошибкамиЧерез пару недель начнёт падать хешрейт
[ERROR] Tuning failed: temp limit 98°CАвтотюн не смог поднять частоту — слишком жаркоПочистить от пыли, добавить вентилятор, переключить на Medium или Low пресет
[WARN] HW error 3.8% on Chain 1Очень много ошибок на второй плате (это как старые CRC)Через 1–2 недели плата умрёт, так что можно нести в ремонт
[ERROR] VRM temp 105°C on Chain 0Перегрев питания первой платы (самая дорогая поломка)Сразу выключать и нести в ремонт, иначе сгорит вся плата
[WARN] Fan error: RPM 0 on Fan0Один из вентиляторов не крутитсяПоменять вентиляторы местами. Если ошибка «переехала», покупать новый вентилятор
[INFO] Mining started, hashrate ~280 TH/s expectedАсик запустился и должен выдать 280 терахешейПроверить через 5–10 минут в веб-морде

Логи на прошивке Braiins OS+

Искать в Status → Logs или Metrics. 

Строка в логе Что значит Что делать
[INFO] Boot: Miner started, autotuning enabledАсик включился, авто-тюн включёнЖдать 2–3 минуты, пока настроит частоты
[INFO] Chain 0: 200/200 chips detectedПервая плата нашла все 200 чипов — идеальноНичего, всё супер
[INFO] Chain 1: 200/200 chips detectedВторая плата тоже полностью живаяНичего
[INFO] Chain 2: 200/200 chips detectedТретья плата тоже полностью живаяНичего
[WARN] Chain 1: 182/200 chips detectedНа второй плате пропало 18 чиповВыключить асик, перетыкать толстые силовые кабели (6-pin). Если не помогло, нести в ремонт VRM
[WARN] Chain 2: 170/200 chips (30 lost)На третьей плате пропало 30 чиповТо же самое, но шансов меньше. Можно готовиться к ремонту
[ERROR] Chain 2: 0/200 chips, disabledТретья плата не видна, прошивка её отключилаКабели → шлейфы → ремонт (VRM или контроллер)
[INFO] Preset: High Performance (4500W)Включён мощный режим разгонаНорма, но следи за температурой <90°C
[INFO] Preset: Balanced (3500W)Средний безопасный режимИдеально для лета
[INFO] Autotune complete: Avg freq 452 MHz, errors 0.1%Авто-тюн прошёл идеально: частота 452 МГц, ошибок почти нетВсё отлично, хешрейт максимальный
[WARN] Autotune complete: Avg freq 410 MHz, errors 2.1%Тюн прошёл, но с ошибками (низкая частота)Через 1–2 недели хеш упадёт. Снижать мощность
[ERROR] Autotune failed: temp limit 98°CТюн не смог — перегревПочистить от пыли, добавить вентилятор, переключить на Low режим
[WARN] High error rate on Chain 2 (3.8%)Много ошибок на третьей плате (как старые CRC)Скоро умрёт. Уже снижать пресет, готовиться к ремонту
[ERROR] VRM temp 105°C on Chain 0Перегрев питания первой платыСразу выключать, в ремонт (самая дорогая поломка)
[WARN] Fan fault: RPM 0 on Fan0Вентилятор 0 не крутитсяПоменять вентиляторы местами. Если ошибка переехала, покупать новый вентилятор
[INFO] Mining started, hashrate ~280 TH/s expectedАсик запустился, ждём 280 TH/sПроверить через 5 мин в дашборде
[WARN] Overheat: throttling Chain 1 to 400 MHzПлата 2 перегрелась — прошивка снизила частотуПочистить от пыли, добавить обдув. Хеш упадёт на 10–15%

Потренируемся

Показываем фрагмент логов реального асика Antminer L9:

Это логи на прошивке Vnish. Они немного отличаются от стандартных, по смыслу и словам очень схожи со стандартными. По INFO видим, что ничего критичного нет. 

Давайте расшифруем:

Сообщение в логеРасшифровка
Power ONАсик включился, подано питание
Setting voltage to 15000 mVСначала выставили тестовое высокое напряжение 15.0 В (нормально при старте)
Switching to automatic fan control (65 °C)Вентиляторы включились в авторежим, цель на старте — 65 °C
Initializing hash boardsЗапуск и проверка хэш-плат
Detecting chipsАсик ищет и считает чипы на платах
chain#1 — 110 chips detected chain#2 — 110 chips detected chain#3 — 110 chips detectedНайдено по 110 чипов на трёх рабочих платах (всего 330). Четвёртая плата отключена — обычная практика в разгоне
Start-up board temperatures: 7 – 11 °CТемпература плат при включении — всего 7–11 °C (холодный старт)
Higher volt: 12270, cfg volt: 12270 offset: 0Реальное напряжение точно совпало с заданным — 12.27 В, всё идеально
Setting voltage to 12270 mVЗафиксировано окончательное рабочее напряжение 12.27 В
Raising freq from 900 to 900 Mhz graduallyЧастота чипов поднимается до целевых 900 МГц
chain#1 / chain#2 / chain#3 – raising freq to 900 MhzВсе три платы синхронно разогнались до 900 МГц
Switching to automatic fan control (75 °C)После прогрева цель вентиляторов поднята до 75 °C — стандартный режим в разгоне

Что по итогу мы видим. Асик включился спокойно, нашёл все платы и все чипы без единого пропуска. Температуру видит правильно, питание ровное, частоты поднялись как нужно, вентиляторы перешли в рабочий режим. Никаких ошибок, недочипов, CRC или странных строк в логе. Такой запуск — лучший показатель того, что асик полностью исправен и готов нормально майнить.

Вот ещё пример лога, только теперь на Whatsminer:

Этот асик «болен» и вот почему:

Строка из логаЧто это значитЧто делать
Code<error>[2010]: All pools disabled for 1s…Асик не может подключиться к пулу (нет интернета или не настроено подключение к пулу)Проверить Wi-Fi, кабель, зайти в настройки пула
Code<error>[2050]: Failed to configure new poolsНе смог загрузить настройки пулаТо же самое
Pool0 interrupted / Pool0 interruptedПостоянно рвёт связь с пуломПерезагрузить роутер, прописать пул вручную
67.9,412,77,88|67.8,411,78,87|64.1,391,77,86Хешрейт по платам: 68 TH – 68 TH – 64 TH Частота: 412-411-391 МГцТемпература чипа 77-78-77 °C Температура платы 86-88 °CСимптом умирающей платы, скорее всего, готовиться к ремонту
Code<warn>[140]: Fan percent too high, percent: 100Вентиляторы крутятся на 100 %Почистить от пыли
0.0,0,0,56,0|0.0,0,56,0|0.0,0,56,0Хешрейт упал до нуля на всех платахАсик перезагружается, следить
Restart btminer as No btminerПрошивка перезапускает майнер, потому что он упал
0.2,174,34,37|0.1,174,33,36|0.2,174,35,38После перезапуска частота упала до 174 МГц (!), хешрейт копейки
4.1,306,43,49|3.8,306,42,48|3.2,306,44,49Частота поднялась до 306 МГц, хешрейт ~11 TH всего асика
11.9,414,75,85|11.5,417,77,86|11.0,412,75,85Иногда на короткое время частота поднимается до нормальных 410–417 МГц, но потом опять падает
66.76|14.0,409,77,87|13.5,401,78,87В какой-то момент вторая и третья платы вообще пропали (0 TH)

Последние строчки показывают уже следствие того, что происходит с асиком. Обычно в логах в таком случае выше есть строчка Fan percent too high, percent: 100. Это значит, что асик очень жарко и вентиляторы крутятся на полную. Если видите такое: выключите асик, почистите, продуйте, перетыкайте все кабели, убедитесь, что в помещении температура не выше 32 °C и есть обдув.

Заключение

Итак, мы надеемся, этот материал вам поможет хоть чуть-чуть разобраться в логах асиков. Рекомендуем пользоваться им с помощью поиска. Нажимаем в браузере Ctrl+F и в строке поиска ищем нужное вам слово, лог. 

По мере выхода новых асиков и информации статью планируем обновлять. 

Что такое логи ASIC-майнера и зачем их смотреть?

Логи ASIC-майнера — это журнал запуска, работы и ошибок оборудования. В них записываются температура, скорость вентиляторов, состояние хешплат и чипов, хешрейт, питание, подключение к пулу и причины перезагрузок. По логам можно понять, почему асик не запускается, теряет хешрейт или постоянно уходит в ребут.

Где посмотреть логи на Antminer, Whatsminer, Avalon и Goldshell?

На Antminer откройте System → Kernel Log. На Whatsminer журнал обычно находится в System → Log, а дополнительные данные можно получить через API Log или WhatsMinerTool. На Avalon используйте Miner → Log либо Advanced → CGMiner API Log. На Goldshell нужные журналы находятся в System → Log → Kernel, Miner или System.

Как скачать или скопировать логи ASIC-майнера?

На Antminer можно открыть Kernel Log, скопировать его содержимое и сохранить в текстовый файл. В WhatsMinerTool выберите IP-адрес устройства, откройте Remote Ctrl, нажмите Export Log и укажите папку для сохранения. Для полноценной диагностики лучше выгружать журнал целиком, а не копировать одну строку с ошибкой.

Как читать логи асика и с чего начать диагностику?

Сначала найдите в логе момент запуска майнера, количество обнаруженных хешплат и чипов. Затем проверьте строки о температуре, вентиляторах, питании, хешрейте и подключении к пулу. При перезагрузке или остановке майнинга смотрите 10–20 строк перед сообщением fatal error, shutdown или watchdog rebooting: причина обычно указана выше.

Что означает ошибка Chain[X]: find 0 asic?

Сообщение Chain[X]: find 0 asic означает, что контроллер видит хешплату или её порт, но не обнаруживает на ней ни одного чипа. Полностью отключите асик от питания, проверьте силовые кабели и сигнальный шлейф этой платы, затем снова запустите устройство. Если ошибка повторяется, хешплате нужна диагностика и, скорее всего, ремонт.

Как по логам понять причину падения хешрейта?

Сравните общий хешрейт и показатели отдельных цепочек или хешплат. На проблему указывают строки chain lower hash, only find ASIC, asic timeout, CRC error, frequency down и сообщения о перегреве. Если одна плата заметно отстаёт от остальных, проверьте количество найденных чипов, её температуру и питание.

Как отличить ошибку пула или интернета от поломки ASIC?

На сетевую проблему обычно указывают socket connect failed, DNS resolve failed, reconnecting, pool down и stratum authentication failed. Аппаратные неисправности сопровождаются сообщениями hashboard missing, find 0 asic, CRC error, fan lost, voltage abnormal или overheat. Если платы и чипы определяются нормально, но соединения с пулом нет, сначала проверяйте сеть и настройки воркера.

Содержание

Не нашли свой ответ на вопрос?
Задайте его нам и мы с удовольствием ответим вам в течение 5 минут!
Комментариев ещё нет!