Запустили мониторинг сайтов и SSL-сертификатов
Теперь Togle регулярно проверяет доступность сайта из нескольких локаций, рассчитывает uptime и предупреждает о проблемах с сертификатом.
# Запустили мониторинг сайтов и SSL-сертификатов
Сегодня в Togle появился новый большой раздел — **Мониторинг**.
Теперь сервис умеет не только выполнять разовые сетевые проверки, но и регулярно следить за состоянием сайта, фиксировать его доступность, измерять время ответа и контролировать SSL-сертификат.
Вы добавляете сайт один раз, а дальше Togle выполняет проверки автоматически.
Если что-то перестаёт работать — это становится видно в мониторинге и фиксируется как событие.
Зачем вообще нужен мониторинг сайта
Сайт может перестать работать в самый неожиданный момент.
Причиной может оказаться что угодно:
* проблема на сервере; * ошибка после обновления; * недоступность дата-центра; * проблема с DNS; * истёкший SSL-сертификат; * неправильная конфигурация HTTPS; * сетевой сбой; * слишком долгое время ответа; * недоступность только из отдельного региона.
Главная проблема в том, что владелец сайта часто узнаёт об этом **не первым**.
Например, от клиента:
Мониторинг меняет эту ситуацию: сервис сам регулярно проверяет ресурс и помогает заметить проблему раньше.
Как работает мониторинг Togle
Создание монитора занимает несколько шагов.
1. Укажите сайт или адрес для проверки. 2. Выберите периодичность. 3. Выберите доступные локации проверки. 4. Настройте уведомления. 5. Сохраните монитор.
После этого Togle начнёт выполнять проверки автоматически.
Например:
```text https://togle.ru ```
может проверяться каждые несколько минут.
Для каждой проверки фиксируются результаты, из которых постепенно формируется история работы сайта.
Что проверяет Togle
### Доступность сайта
Togle отправляет запрос к указанному адресу и определяет, отвечает ли ресурс.
Это позволяет обнаружить:
* полную недоступность; * HTTP-ошибки; * превышение таймаута; * проблемы подключения; * нестабильную работу.
Одна неудачная проверка при этом не обязательно означает полноценный инцидент.
Кратковременные сетевые ошибки случаются даже у исправных сервисов, поэтому при определении состояния учитывается последовательность проверок и результаты из доступных локаций.
Время ответа
Для каждой проверки Togle измеряет, сколько времени потребовалось сайту для ответа.
Это полезно не только при авариях.
Сайт может формально работать, но отвечать заметно медленнее обычного.
Например:
```text Обычно: 180–250 ms Сейчас: 1 850 ms ```
Ресурс доступен, однако подобное изменение уже может указывать на:
* повышенную нагрузку; * проблемы базы данных; * медленный backend; * сетевые задержки; * проблемы внешнего API.
История времени ответа позволяет заметить такие изменения.
Uptime
На основании результатов проверок Togle рассчитывает **uptime** — долю времени, в течение которого ресурс был доступен.
Например:
```text 24 часа 100% 7 дней 99,98% 30 дней 99,91% ```
Само по себе значение `99,9%` выглядит почти идеальным, но за месяц это уже может означать десятки минут недоступности.
Поэтому вместе с процентом важно смотреть:
* количество инцидентов; * их продолжительность; * время возникновения; * результаты отдельных локаций.
Проверки из нескольких локаций
Одна из самых неприятных сетевых проблем выглядит так:
Сайт действительно может быть доступен из одного региона и одновременно не работать из другого.
Поэтому Togle поддерживает проверки из нескольких локаций.
Например:
```text Россия ✓ 200 OK Германия ✕ Timeout ```
В такой ситуации сервис не должен объявлять сайт полностью недоступным.
Вместо этого состояние может быть отмечено как **частичная недоступность**.
Это помогает отличить глобальную аварию от локальной сетевой проблемы.
Контроль SSL-сертификата
HTTPS давно стал стандартом, но SSL-сертификаты всё ещё становятся причиной реальных аварий.
Частый сценарий:
1. сертификат был выпущен; 2. сайт несколько месяцев работал нормально; 3. автоматическое продление не сработало; 4. сертификат истёк; 5. браузеры начали показывать предупреждение.
Togle проверяет состояние SSL-сертификата вместе с мониторингом сайта.
Для сертификата можно определить состояния:
* действителен; * скоро истекает; * истёк; * недействителен; * имя сайта не соответствует сертификату; * сертификат не удалось проверить.
Это позволяет заметить проблему **до истечения срока действия**, а не после.
Почему сертификат может оказаться недействительным
Истёкший срок — только одна из возможных причин.
Например, сертификат выпущен для:
```text www.togle.ru ```
а сервер используется по адресу:
```text api.togle.ru ```
Если нужного имени нет в сертификате, проверка HTTPS может завершиться ошибкой.
Проблема также может быть связана с цепочкой сертификатов или конфигурацией сервера.
Инциденты
Когда Togle подтверждает проблему, она может быть зафиксирована как **инцидент**.
Инцидент собирает события, связанные с одной проблемой, в единую историю.
Пример:
```text 14:32 Германия перестала получать ответ 14:35 Ошибка подтверждена повторной проверкой 14:35 Создан инцидент 14:36 Отправлено уведомление 14:41 Россия продолжает получать 200 OK 14:47 Германия снова получает 200 OK 14:50 Восстановление подтверждено ```
Так гораздо удобнее разбирать проблему, чем смотреть на десятки отдельных неудачных проверок.
Повторные ошибки одного и того же сбоя не должны превращаться в десятки разных инцидентов.
Уведомления
Нет смысла постоянно держать страницу мониторинга открытой.
Поэтому при важных событиях Togle может отправлять уведомления.
Например:
* сайт перестал отвечать; * появилась частичная недоступность; * ресурс восстановился; * возникла проблема с SSL; * сертификат скоро истекает; * монитор временно приостановлен.
На первом этапе основной канал уведомлений — **email**.
Дальше список каналов будет расширяться.
Статусы мониторов
Чтобы быстро оценить ситуацию, каждый монитор имеет понятный статус.
Например:
**Работает** Последние проверки успешны.
**Частичная недоступность** Проблема обнаружена только в части локаций.
**Недоступен** Проверки подтверждают проблему с ресурсом.
**Ожидает первую проверку** Монитор только что создан.
**Проверяется** Сейчас выполняется проверка.
**Приостановлен** Автоматические проверки временно отключены.
Статус SSL отображается отдельно от доступности сайта.
Это важно: сайт может прекрасно отвечать `200 OK`, но иметь сертификат, который закончится через несколько дней.
Что доступно на Free
Мониторинг можно попробовать и без платной подписки.
На бесплатном тарифе можно создать до **3 активных мониторов**.
Проверки выполняются каждые **3 минуты** из доступных базовых локаций.
Этого достаточно для:
* личного сайта; * небольшого проекта; * API; * лендинга; * тестового окружения.
Premium+
Для проектов, которым требуется более частый мониторинг, предназначен тариф Premium+.
Он позволяет использовать:
* до 50 мониторов; * проверки каждые 10 секунд; * проверки каждые 30 секунд; * интервал 3 минуты; * дополнительные локации; * расширенную историю; * сравнение результатов между локациями.
Чем критичнее сервис, тем важнее более короткий интервал проверки.
При интервале в три минуты проблема теоретически может оставаться незамеченной почти три минуты.
При проверке каждые 10 секунд реакция происходит значительно быстрее.
Небольшой лайфхак: мониторьте не только главную страницу
Проверка:
```text https://example.com ```
показывает, доступна ли главная страница.
Но для реального приложения полезнее создать специальный endpoint:
```text https://example.com/health ```
Он может проверять не только работу веб-сервера, но и критические зависимости приложения.
Например:
```json { "status": "ok", "database": "ok", "redis": "ok" } ```
Тогда мониторинг становится гораздо полезнее.
Главная страница может возвращать `200 OK`, даже если часть backend-систем уже не работает.
Ещё один лайфхак: не ставьте слишком большой timeout
Если обычный ответ API занимает:
```text 150–300 ms ```
timeout в 30 секунд может оказаться слишком большим.
Пользователь уже давно увидит ошибку, пока монитор всё ещё будет ждать ответ.
Разумный timeout должен учитывать нормальное время работы конкретного приложения.
И ещё: следите не только за падениями
Мониторинг полезен даже тогда, когда uptime равен 100%.
Обращайте внимание на тренд времени ответа.
Например:
```text Неделя 1: 190 ms Неделя 2: 240 ms Неделя 3: 410 ms Неделя 4: 680 ms ```
Формально аварии ещё не произошло.
Но тенденция уже говорит, что стоит посмотреть на инфраструктуру.
Что будет дальше
Мониторинг — одно из направлений, которое мы планируем активно развивать.
Постепенно в Togle будут появляться дополнительные возможности для диагностики, работы с инцидентами и уведомлениями.
При этом принцип останется прежним:
**дать понятный ответ о состоянии сервиса без необходимости собирать несколько разных инструментов.**
IP, DNS, SSL, доступность, время ответа и инциденты должны дополнять друг друга и формировать единую картину.
Попробуйте мониторинг Togle
Создайте монитор для своего сайта и дождитесь первой проверки.
Для начала достаточно указать URL:
```text https://togle.ru ```
После этого Togle начнёт собирать историю доступности, времени ответа и состояния SSL-сертификата.
[Открыть мониторинг](https://togle.ru/monitoring)
---
**Коротко о новом разделе:**
* автоматические проверки сайтов; * uptime; * время ответа; * несколько локаций; * SSL-сертификаты; * история проверок; * автоматическое определение проблем; * инциденты; * email-уведомления.
Мониторинг уже доступен в Togle.