Твои серверы. Проверки продолжаются.
mttrly Watchdog выполняет настроенные проверки, алертит о поддерживаемых проблемах и предлагает scoped actions по кнопке. Сначала увидь факты, затем выбери следующий шаг.
Service 'nginx' is down on prod-server-01
Service 'nginx' is running.
Result verified and added to the audit trail.
ERROR: CONNECTION_TIMEOUT
Узнаёшь? Инфраструктура падает в самый неподходящий момент, а ты привязан к ноутбуку.
Сбой в дороге
Сервер упал, а ты в метро или стоишь в пробке. SSH с телефона — мучение, а клиенты уже пишут гневные письма.
Потеря времени
Открывать ноутбук, подключать VPN, вводить пароли ради того, чтобы просто перезагрузить процесс или почистить /tmp.
Тревожность
Страх отойти от компьютера надолго, потому что «вдруг что-то сломается». Становишься заложником своего кода.
Watchdog прикроет
- >Алерты о падениях + фиксы в один тап для типовых сервисов
- >Алерты, когда настроенная проверка обнаружила поддерживаемую проблему
- >Подтверждай фиксы кнопками, без набора команд
- >Готовые действия — быстро, прозрачно, с аудитом
Функции Watchdog
> /status
Все серверы — один тап
CPU, RAM, диск и сервисы в одном месте. Проверь текущее состояние без терминала и восстановления контекста по памяти.
> /logs
Логи в кармане
Смотри логи прямо в мессенджере. Фильтруй ошибки, ищи по ключевым словам. SSH-клиент больше не нужен.
> Фикс в один тап
Восстановление с подтверждением
Приложение упало? Watchdog пришлёт алерт и предложит перезапуск или repair-действие, которое ты подтверждаешь в чате. OOM убил процесс? Примени предложенный фикс без SSH.
> Триггеры
Правила: если X — делай Y
CPU > 90%? Очисти кэш из чата. Диск заполнен? Запусти cleanup-скрипт после подтверждения. Операционные изменения остаются под твоим контролем.
Initialization SETUP_PROTOCOL
STEP 01: Аккаунт
Зарегистрируйся по email, затем выбери, куда отправлять approval.
STEP 02: Агент
Установи Node.js агент на сервер через one-line installer.
STEP 03: Контроль
Сервер онлайн. Управляй им из дашборда, Telegram или MCP-enabled IDE.
SECURITY_AUDIT
Дать боту доступ к серверу — серьёзный шаг. Поэтому безопасность встроена на каждом уровне.
✓ Approval gates и bounded sessions
Runtime policy разделяет read-only и approval-required операции. Отдельно авторизованный Investigation может пропускать per-command подтверждение только для mttrly_execute_command, в пределах сервера, inactivity timeout, hard cap и числа действий.
✓ Отсутствие входящих портов
Агент сам устанавливает outbound TLS/WebSocket-соединение. Новый входящий control-порт для mttrly не нужен; outbound-соединение должно быть разрешено.
✓ Audit logs
Approval-решения, поддерживаемые действия и результаты выполнения записываются. Покрытие и доступный период зависят от текущего runtime и тарифа.
Watchdog vs альтернативы
| Параметр | Watchdog | SSH Mobile Clients | Grafana / Prometheus |
|---|---|---|---|
| Удобство на мобильном | Высокое (Чат) | Низкое (Консоль) | Среднее (Дашборды) |
| Восстановление с подтверждением | Да (фиксы в один тап) | Нет | Не основная задача |
| Активные действия | Да (кнопками) | Да (набор команд) | Нет |
| Сложность настройки | Email + outbound-агент | Ключи, VPN | Существующий monitoring stack |
Standalone-агент ещё готовится.
Код hosted-агента сегодня приватный. Мы планируем отдельный MIT-licensed standalone-режим для одного сервера и собственного Telegram-бота, но он ещё не готов к публичной установке.
- ✓Для standalone-релиза планируется MIT License
- ✓Планируется режим без Central-сервиса
- ✓Планируется подключение собственного Telegram-бота
- ✓В текущем приватном registry — 80+ встроенных playbooks
Watchdog и Deployment Bro: FAQ
Further Reading
Site Reliability Engineering: How Google Runs Production Systems ↗
Betsy Beyer, Chris Jones, Jennifer Petoff, Niall Richard Murphy · Book (Free Online)
The foundational SRE text defining MTTR, monitoring, alerting, and incident response practices used by Google and adopted industry-wide.
The Site Reliability Workbook: Practical Ways to Implement SRE ↗
Betsy Beyer, Niall Richard Murphy, David K. Rensin, et al. · Book (Free Online)
Hands-on companion to the SRE Book with concrete implementation patterns for alerting, on-call, and incident management.
Accelerate: The Science of Lean Software and DevOps
Nicole Forsgren, Jez Humble, Gene Kim · Book
Research-backed evidence that MTTR is one of the four key metrics predicting software delivery performance and organizational outcomes.
The Phoenix Project: A Novel About IT, DevOps, and Helping Your Business Win
Gene Kim, Kevin Behr, George Spafford · Book
Narrative introduction to DevOps principles — why reducing Mean Time to Recovery matters more than preventing all failures.
Пусть Watchdog возьмёт рутину на себя.
Начни бесплатно. Добавь AI-функции когда понадобится.
Бесплатный тариф доступен сейчас в текущих лимитах • Deployment Bro 3900₽/мес • Beta: скидка 75% на первые 3 месяца по коду BETA75