К основному содержанию

Кейсы

Работы из эксплуатации, описанные по одной схеме: исходное состояние, что было сделано, измеримый результат. Клиенты не называются, имена узлов и номера в публикацию не выносятся.

Числа в кейсах взяты из систем заказчиков и приведены к агрегатам. Графики и схемы построены на этих же данных.

  1. 4скрытых отказа найдено при установке одного инструмента

    Заказ был один — интерфейс к записям звонков. Нашли ещё четыре отказа

    Заказчик попросил простой веб-интерфейс, чтобы слушать записи разговоров и смотреть детализацию. Пока разворачивали — обнаружили, что на станции четыре месяца не пишутся журналы, 10 ГБ диска заняты невидимым файлом, защита SSH от подбора паролей не срабатывала ни разу, а средства автоматизации вообще не могли зайти. Ни один из отказов не сообщал об ошибке.

    • asterisk
    • телефония
    • cdr
  2. 10держал файл, удалённый четыре месяца назад

    df показывает 27 из 30 ГБ занято (92%), а файлы занимают только 17 ГБ

    На АТС кончалось место: df показывал 27 ГБ занято из 30, а подсчёт всех файлов давал только 17 ГБ. Разбираем, почему возникает такое расхождение, как найти виновника через lsof и как невидимая опечатка в настройке ротации логов на четыре месяца лишила сервер и места, и журналов.

    • linux
    • logrotate
    • asterisk
  3. 65→86%живой ответ в рабочие часы вырос после ввода второго оператора

    «Отвечено» ≠ ответил человек: как мы читаем журнал звонков колл-центра

    Разбор CDR колл-центра заказчика: почему статус «отвечено» вводит в заблуждение, как по длительности звонка отсечь «ложные» отвеченные (эхо автосекретаря), стоит ли выводить смену на выходные и как в цифрах видна отдача от второго оператора. Управленческие выводы из данных, которые АТС пишет и так.

    • asterisk
    • cdr
    • аналитика
  4. 5лимит disk-assisted буфера на время недоступности ELK

    Логи переживают недоступность ELK: disk-assisted очередь rsyslog

    Центральный rsyslog пересылал логи сетевого парка в ELK по UDP и не замечал недоступность приёмника. Переходим на TCP с disk-assisted очередью: во время сбоя строки копятся в пределах выделенного места, а после восстановления досылаются в порядке поступления.

    • rsyslog
    • elk
    • logging
  5. 1,9занимал бэкап одной VM — вернули, вынеся NetFlow-буфер на отдельный диск

    1,9 ТБ бэкапа при 20 ГБ занятых данных: как NetFlow раздувал инкременты

    Одна VM занимала половину репозитория Veeam: цепочка на 1,9 ТБ при ~20 ГБ занятых данных. Почему оборот записи NetFlow давал инкременты по 80 ГБ в сутки и как отдельный vmdk сократил новый полный бэкап до ~30 ГБ.

    • veeam
    • backup
    • vmware
  6. 3300из NetBox отдаются как имя звонящего на аппарат

    Телефонная книга из NetBox в Asterisk: имя на аппарате и карточка контакта в Telegram

    Как связать источник истины по контактам (NetBox) с АТС на Asterisk, которая не умеет ходить в REST из диалплана: реверс-поиск номер→имя через локальный кэш astdb, нормализация 8xx/+7xxx/7xxx к последним 10 цифрам и обогащение CDR-уведомлений в Telegram кликабельными ссылками на объекты NetBox.

    • asterisk
    • netbox
    • telegram
  7. 1061проанализировано за 9 лет

    1061 пост, 9 лет: мы разобрали собственный Telegram-канал как инженерную задачу

    Выгрузили весь архив своего канала и посчитали. Оказалось: постим в 20 раз реже, а читают не меньше. И выигрывает совсем не то, что мы постили чаще всего.

    • аналитика
    • данные
    • контент-стратегия
  8. 0минут простоя мониторинга — старый сервер работал до последней секунды

    Zabbix не переносит историю между СУБД. Перевезли 4.2 → 7.0 с MySQL на PostgreSQL — без потерь и без простоя

    Перенесли Zabbix 4.2 с MySQL на Zabbix 7.0/PostgreSQL, сохранив более полумиллиарда строк истории. Двухфазная миграция, сверка 203 таблиц и переключение без остановки мониторинга.

    • zabbix
    • миграция
    • postgresql
  9. Синтетический Wi-Fi survey: как найти мёртвую зону ещё до выезда на объект

    Ekahau Site Survey в режиме Planning: план этажа плюс модель затухания сигнала через стены сразу показывает мёртвую зону Wi-Fi — без физического обхода объекта с анализатором.

    • wifi
    • survey
    • ekahau
  10. 0…74диапазон температуры платы за полгода наблюдений

    0…74°C на чердаке: что термодатчик MikroTik рассказал о выносливости железа

    Полгода мониторинга бортового термодатчика MikroTik hEX на чердаке в Zabbix: от 0°C зимой до 74°C летом. Суточные качели, сезонный размах и что это значит для ресурса оборудования.

    • zabbix
    • mikrotik
    • мониторинг
  11. 215скачивание по Wi-Fi 5 ГГц в контрольных условиях

    MikroTik hAP ac2 на 5 ГГц: 215 Мбит/с в идеальных условиях — эталон для сравнения

    Контрольный замер пропускной способности Wi-Fi 5 ГГц на MikroTik hAP ac2: 2 метра, прямая видимость, минимум помех. Не рекорд, а опорная точка — с чем сравнивать скорость на реальных объектах.

    • mikrotik
    • wifi
    • speedtest
  12. 99занимает один поток на hAP ac2 против 19% на RB4011 на том же IPsec-трафике

    RB4011 против hAP ac2 на одном IPsec-потоке: 19% CPU против 99%

    Один и тот же IPsec-поток ~100–110 Мбит/с (реальный бэкап Veeam) через два MikroTik. На RB4011iGS — до 19% CPU одного ядра. На hAP ac2 — то же ядро упирается в 99%. Разница — не в модели, а в аппаратном ускорении шифрования.

    • mikrotik
    • ipsec
    • rb4011
  13. 98overhead GRE over IPsec + NAT-T на пакете 1390 байт (реальный расчёт)

    Почему рвётся IPsec: overhead, MTU и настоящий пример на 98 байт

    IPsec не прозрачен для MTU: GRE, ESP и NAT-T добавляют реальный overhead к каждому пакету. Считаем его на конкретном примере и настраиваем MTU/MSS на MikroTik, а не гадаем методом тыка.

    • ipsec
    • mtu
    • mikrotik
  14. 7756адресов в address-list за инцидент

    SSH-флуд со спуфингом IP на MikroTik hEX: почему fail2ban тут бессилен

    Разбираем реальный инцидент: SYN-флуд на нестандартный SSH-порт с подменой исходного IP на каждом пакете. Показываем профиль CPU, address-list на 7756 адресов и почему помогает не блок-лист, а RPF.

    • mikrotik
    • безопасность
    • ddos
  15. 28,9общая загрузка сразу после переноса гигабитного NAT

    Перенос гигабитного NAT на MikroTik CCR1009: 70 тысяч соединений и 28,9% CPU

    Исторический кейс 2019 года: перенесли NAT ~1 Гбит/с клиентского трафика с FreeBSD-сервера на CCR1009. Пропускная способность сохранилась, а роутер начал учитывать до 70 тысяч соединений.

    • mikrotik
    • nat
    • производительность
  16. Как найти MikroTik с macOS без IP: MNDP, LLDP и MAC-Telnet

    Находим MikroTik в локальном L2-сегменте через MNDP или LLDP и подключаемся к RouterOS по MAC-адресу — без Winbox, Wine и заранее известного IP.

    • macos
    • mikrotik
    • mndp