Модель диагностики Принтум
Что такое модель диагностики
Диагностика в Printum строится по трёхшаговой модели. Цель модели — не перебирать логи наугад, а сначала сузить зону поиска, потом определить конкретное звено в цепочке компонентов, и только затем смотреть логи именно там.
Главный принцип: сначала понять, где проблема — в системе или в инфраструктуре. Потом в какой части системы. Потом смотреть логи.
Четыре шага модели
| Шаг | Вопрос | Результат |
|---|---|---|
| Шаг 1. Локализация | Система или инфраструктура? | Понимаем, стоит ли вообще смотреть в Printum |
| Шаг 2. Сценарий и условия | Что именно происходит, у кого, при каких условиях? | Паспорт инцидента: сценарий, масштаб, воспроизводимость |
| Шаг 3. Карта системы | Какие компоненты участвуют в этом сценарии? | Конкретный контейнер или служба, которую нужно проверить |
| Шаг 4. Логи | Что написано в логах целевого компонента? | Причина проблемы или следующая гипотеза |
Почему именно в таком порядке
Если начать с логов без локализации — потратите время на правильные логи, в которых нет ошибки, потому что проблема вообще за пределами системы. Если не определить сценарий — непонятно, в каком именно контейнере из десятка искать.
Тимур Гусев (встреча по архитектуре): «Если инженер умеет читать поток данных, он сможет диагностировать систему в любом проекте — в самом лёгком и в самом сложном».сложном.
Связанные страницы
Шаг 1 — Локализация: система или инфраструктура?
Цель шага
Понять: проблема находится внутри системы Printum или вне её — в инфраструктуре, сети, настройке принтера, драйвере.
Если проблема вне системы — дальнейшая диагностика Printum не нужна.
Методы проверки
1. Печать мимо системы
Отправьте задание печати напрямую на принтер, минуя Printum: установите принтер как обычный сетевой принтер Windows/Linux и распечатайте тестовую страницу.
2. Другой принтер
Воспроизведите то же действие на другом устройстве того же типа или в другом подразделении.
3. Другой пользователь
Попросите другого сотрудника воспроизвести проблему под своей учётной записью.
4. SNMPwalk
Выполните опрос устройства по SNMP вручную, чтобы проверить доступность и ответ принтера.
snmpwalk -v2c -c public <IP_принтера> 1.3.6.1.2.1.1
Сетевой агент Printum опрашивает устройства по порту 161 и получает ответ по порту 162 (протокол SNMP). Если snmpwalk не отвечает — агент тоже не получит данных.
Результат шага
После проверки становится ясно:
Шаг 2 — Определение сценария и условий
Цель шага
Точно описать, при каких условиях и у кого проявляется проблема, прежде чем искать её в системе. Чем точнее паспорт инцидента, тем быстрее находится нужный компонент.
Сценарий
Определите, какой именно процесс не работает:
Сценарий определяет, какие компоненты участвуют в процессе и где искать разрыв.
Условия
Зафиксируйте технические характеристики окружения:
Масштаб
Сколько объектов затронуто — это ключ к поиску общего знаменателя.
Если проблема у группы — ищите что объединяет эту группу: одна локация, один вендор устройств, одна OU в домене.
Воспроизводимость
Результат шага
Заполненный Паспорт инцидента с описанием сценария, условий, масштаба и воспроизводимости. На основе этих данных строим карту системы.
Шаг 3 — Карта системы и где искать проблему
Ключевая 4мысль
Проблема всегда находится в конкретном звене цепочки. После локализации и заполнения паспорта инцидента — Сборопределите цепочку компонентов для своего сценария, выберите предполагаемое звено и чтениесмотрите логов
Если
инженер умеет читать поток данных, он сможет понять, где именно у нас в этом месте в потоке данных сломалась передача.Пример 1: Задание не печатается
Типичные ошибки: CUPS: Unable to send job to printer, CUPS: Unable to write print data: Broken pipe
Пример 2: Нет данных по принтеру (не отображается в системе)
Типичные ошибки: ERROR [apps.inv.services.sync]: Some snmp data missing for printer 1, Failed to connect to clickhouse:9000
Пример 3: Пользователь не авторизуется
Типичные ошибки: AUTH_ERROR: Invalid credentials, User matching query does not exist
Как читать цепочку
Каждая стрелочка — это передача данных. Если пользователь не видит результат, значит разрыв произошёл где-то в цепочке. Метод диагностики: двигайтесь по цепочке от конца к началу (или от начала к концу) и проверяйте каждое звено по его логам.