Анализ и прогноз аварий по вашим данным

Вам это нужно, если

вы ищете причины и оптимальные способы решения проблем аварийности и хотите получать прогнозы по ним.

Как это работает?

Три шага: ступень по опросу -> анализ журнала статистическими моделями и ИИ -> ссылка на результаты разбора.

Что умеет модуль?

Восемь проверенных методов: где копится простой, когда и по какому циклу случаются сбои, что изменилось, какие сбои тянут за собой другие, и прогноз.

Безопасность

Без вмешательства в инфраструктуру. Изолированная обработка, автоматическая маскировка чувствительных данных.

Сколько стоит

Начальный анализ - бесплатно. Дальше все зависит от результатов, ступени в мониторинге, автоматизации и ваших пожеланий.

Запустить анализ

Пришлите выгрузку инцидентов - заберите бесплатный базовый разбор, сделанный на ключевых статистических моделях.

Заметки об эксплуатации

Эксплуатация

Лестница эксплуатации: пять ступеней

От «об авариях узнаём от потребителя» до улучшений с измеренным эффектом. Где на этой лестнице стоит ваша служба и какой шаг следующий.

Сбои

Какие инциденты дают больше всего простоя

Немногие инциденты дают большую часть потерянных часов. Парето-анализ находит их - с них и начинать.

Метрики

MTBF и MTTR: как часто падает и как быстро чинится

Время между сбоями и время восстановления - из выгрузки инцидентов, без установки агента мониторинга.

Эксплуатация

Как выглядит идеальная эксплуатация

Обычная компания, а не Google: один рядовой вторник по часам, восемь признаков зрелой службы и десять вопросов для самопроверки.

Сбои

Рейтинг видов сбоев: что сильнее всего портит работу

Плановые работы, провайдеры, электропитание, уровень организации эксплуатации - двенадцать источников отказов по потерянным часам, а не по частоте.

Метрики

Сколько ещё будет сбоев и когда следующий

Сколько инцидентов ждать на следующей неделе и насколько вероятен долгий простой - прогноз по вашей истории.

Эксплуатация

Матрица эскалации и шум оповещений

Почему большая часть сигналов не стоит чтения, чем измерить долю шума и кого будить ночью - по записанному правилу, а не по ощущению.

Сбои

В какие часы чаще всего падают сервисы

Мониторинг ловит сбой в моменте, журнал показывает закономерность: в какие часы и дни копятся инциденты.

Метрики

Почему нашим числам можно верить

Все числа считает статистический движок. ИИ только пишет текст вокруг них и не может их изменить.

Эксплуатация

Практики, которые видит бизнес

Двенадцать практик ITIL по убыванию отдачи: удержанная выручка, доверие клиента, допуск к контрактам, свободная ёмкость команды.

Сбои

Какие сбои возвращаются по циклу

Один и тот же сбой будто возвращается раз в несколько дней или в конце месяца. Движок проверяет, есть ли цикл, и когда ждать следующий сбой.

Эксплуатация

Что делать по итогам анализа

Какие проблемы анализ находит чаще всего и что делать с каждой - в терминах ITIL / ITSM.

Сбои

Какие сбои тянут за собой другие

После отказа одной системы открываются заявки по другим. Движок находит такие пары и считает, сколько заявок - продолжение одной аварии.

Сбои

Стало ли хуже после изменения

Сбоев больше после релиза или миграции? Сравнение «до и после» скажет, реальна разница или это случайность.

Сбои

Какие объекты ломаются снова и снова

Касса одного магазина, сервер из трёх: движок находит объект, который ломается чаще соседей или возвращается сразу после починки.

Сбои

Какая метрика предупреждает о сбое

Процессор, память, трафик: движок сравнивает журнал с метриками мониторинга и находит ту, что меняется за часы до сбоя.

Сбои

Сколько в журнале не сбоев, а запросов

Сброс пароля и выдача доступа в одной очереди со сбоями завышают число аварий и простой. Движок находит их и убирает из расчётов.

Вам это нужно, если

Сети и площадки

Вы - провайдер, хостер, дата-центр, узел обмена трафиком

Наш проект, созданный профильными специалистами с многолетним опытом + ключевые ITIL-практики = полезный для вас результат и/или второе мнение.

Эксплуатация ИТ

У вас аутсорс сетей или МСП, ИТ-отделы со службой заявок и др.

Даже первичный анализ нашим модулем покажет основные группы проблем, дающие 80% даунтайма, и пути их решения.

Не ИТ

У вас на балансе энергосети и ЖКХ, водоканал, транспорт, производство и т.п.

Если ведёте учет аварий (время, объект, событие), то это значит, что наш модуль будет вам полезным.

Как это работает?

Что ищет статистический модуль проекта

Девять методов, которые вы увидите в отчёте. Каждый проверен на базах с известным ответом, а в статье сказано, что он видит и чего нет. Новый метод появится здесь только после такой же проверки.

Приоритет
Приоритет (ранжирование Парето)
Какие 20% инцидентов дают 80% простоя - чтобы чинить немногие важные. Коэффициент Джини (мера неравенства: 0 - все инциденты одинаково вредны, 1 - весь простой дал один) показывает, насколько проблема сконцентрирована.
Закономерности
Когда случаются сбои
Показывает, в какие часы и дни недели идут сбои, и отличает обычную нагрузку рабочего дня от сбоя по расписанию: ночной задачи, бэкапа, регламента. Находит час, который выбивается из вашего собственного ритма, и главную систему в нём.
Цикличность
Циклы (периодичность)
Находит сбои одной системы, которые возвращаются каждые N дней или в одни и те же числа месяца, проверяет, что это не случайность, и называет дату следующего, если ничего не менять.
Проверка
Что изменилось и когда
Показывает, менялась ли частота сбоев за период: когда, насколько и какой это случай - ступенька после изменения, постепенный рост или всплеск, который прошёл. Если по данным не различить, так и говорит.
Прогноз
Прогноз частоты
Оценивает, сколько сбоев ждать в ближайшие 7 и 30 дней, по вашей собственной истории. Ответ - всегда интервал, а не ложно точное одно число.
Связи событий
Связи событий
Находит сбой-триггер: после отказа одной системы в течение 15 минут открываются заявки по другим - чаще, чем совпало бы случайно. Показывает, сколько заявок - продолжение одной аварии.
Надёжность
MTBF и MTTR без агента
Средняя наработка на отказ (MTBF) и среднее время восстановления (MTTR) прямо из выгрузки - без агента и без доступа к вашим серверам. Среднее, медиана и P95 (значение, хуже которого только 5% случаев) вместе показывают не только типичный, но и плохой день.
Риск
Риск долгого простоя
Какова вероятность редкого, но очень длинного простоя - того самого, который ломает SLA. Средняя доступность его прячет, этот расчёт показывает отдельно.
Повторы
Объекты, которые ломаются снова и снова
Находит сервер или магазин, который ломается чаще соседей или возвращается через день-три после починки. Сравнивает это со случаем, чтобы просто загруженную систему не назвать проблемой.
Предвестник
Метрика, которая предупреждает о сбое
Сравнивает журнал инцидентов с метриками мониторинга и находит метрику, которая за часы до сбоя уходит от обычного уровня. Сверяет с теми же часами в обычные дни, чтобы не назвать предупреждением загруженный рабочий день или тревогу по той же метрике.
Ваши данные
Что происходит с вашим файлом
Где считаем, что видит языковая модель, что маскируем и когда удаляем.
Статьи
Все статьи и методы
Как работает каждый метод, что он видит и чего нет, с примерами на реальных данных. А так же информация о результатах исследований и авторские заметки об эксплуатации.

Запустить анализ

CSV, JSON, TXT, XLSX - до 20 МБ; файл больше - в ZIP до 100 МБ.

Ещё не знаете свою ступень?
Двенадцать вопросов, несколько минут: ступень и что подготовить к выгрузке.
Пройти опрос
Уже есть выгрузка? Пришлите её здесь
📂
Перетащите сюда журнал инцидентов - и выгрузку метрик или журнал изменений, если они есть
До 3 файлов · CSV · JSON · NDJSON · TXT · XLSX · до 20 МБ каждый · ZIP до 100 МБ

Данные не могут покинуть контур? Обезличьте файл сами (бесплатный офлайн-скрипт)

или
Отправить через Telegram
✓ Файл получен. Отчёт придёт на {email} с адреса {from} в течение рабочего дня - запрос после 12:00 уходит на следующий рабочий день. Если письма нет - проверьте папку «Спам».
Не больше 3 файлов за раз. Больше - упакуйте их в один zip.
Что-то пошло не так. Попробуйте ещё раз или отправьте файл в Telegram-бот.

Безопасность

✓

Без доступа к инфраструктуре

Никаких агентов, VPN и доступов к серверам. Только файл, который вы сами решили прислать.

✓

Считаем на своём сервере

Все расчёты - на нашем сервере в ЕС, каждый файл отдельно. Текст отчёта оформляет языковая модель: она получает посчитанные числа и замаскированные имена, а не ваш журнал.

✓

Удаление через 30 дней или раньше по запросу

Файл и страница отчёта доступны только вам на сайте до 30 дней.

✓

Никакого обучения на ваших данных

Ваши данные - только для обезличенной аналитики и только с вашего согласия.

✓

Автомаскирование

IP, почта, имена узлов и объектов из журнала заменяются кодами до того, как текст уходит языковой модели.

✓

Обезличивание перед отправкой

Запустите офлайн-скрипт: он заменяет имена сервисов, узлов и людей на коды.

Скачать скрипт · Как запустить

Кто анализирует

За результат анализа отвечает основатель проекта. Главный инструмент: аналитический модуль и многолетний опыт в телекоме и банкинге. Там, где задача требует консилиума и дополнительных компетенций, подключаются дополнительные эксперты.

20+ лет в эксплуатации

Построил несколько центров управления сетью и крупных инфраструктур, вёл проекты обновления ИТ в банке, ритейле. Регулярно проводит независимые аудиты надёжности. Разработал методику анализа и прогнозирования - основу работы модуля аналитики.

Сети

Сетевые инженеры высокого уровня

Имеют экспертный уровень по Cisco, Juniper и Huawei и еще не менее 10 линеек известных производителей. Проектируют и эксплуатируют сети для банков и операторов связи.

Мониторинг

Наблюдение и контроль сетей

Эксперты по транспортным, мультисервисным, объектовым и распределительным сетям: что измерять и как увидеть проблему до того, как она станет аварией. Руководители и специалисты по мониторингу клиентских сервисов и диспетчеризации.

Поддержка

Техническая поддержка и три её линии

Эксперты, которые строят службу поддержки с нуля и обеспечивают правила их работы и совершенствование алгоритмов, отчетов, показателей.

Процессы

Практики ITSM и ITIL

Эксперты по управлению ИТ-услугами: работа с инцидентами, проблемами, изменениями и уровнями услуг по ITIL 4. Делают процесс измеримым: что считается, у кого владелец, какой срок обещан.

Учёт активов

ITAM, CMDB и DCIM

Специалисты по учёту оборудования, конфигураций и инженерной инфраструктуры: собирают базу конфигураций, связывают услуги с железом, от которого они зависят, ведут жизненный цикл активов.

Сколько стоит

Первый разбор бесплатный и без условий. Дальше цена зависит от объёма журнала и глубины работы - счёт выставляем письмом.

Первый разбор €0
бесплатно, без условий
  • Разбор на ваших данных по базовой программе
  • Страница отчёта по ссылке - выводы и графики
  • Ключевые показатели: наработка между отказами, время восстановления, где копится простой
  • Список того, что нужно в ваших данных для полного анализа
Платный разбор (от €250)
разово или ежемесячно
  • Все методы движка, применимые к предоставленным данным
  • Графики, подтверждающие ключевые наблюдения
  • План действий и сверка с порогами вашей отрасли
  • Предложения по оптимизации учёта событий, чтобы следующий разбор был глубже
  • Ежемесячно - тот же документ плюс динамика к прошлому месяцу

Получим ваше сообщение, ответим максимально быстро и предложим варианты.

или просто напишите нам: