Документация

Мониторинг

Состояние сервисов, производительность и публичная страница статуса.

Мониторинг охватывает состояние самого Coroid, а не ваших приложений. Найдите его в разделе Мониторинг, включая состояние, Производительность и Статус представления.

Состояние

Определяет, работают ли сервисы, от которых зависит Coroid, в штатном режиме.

Стоит проверить этот параметр, если что-то функционирует некорректно, и вы не можете определить, причина ли это в вашей конфигурации или в самой платформе. Исключение платформы из числа подозреваемых занимает несколько секунд и предотвращает длительное расследование в неправильном направлении.

Производительность

Показывает, как функционирует платформа: пропускная способность, задержки и время обработки.

Важное различие при анализе этих данных: время ожидания в очереди — это признак загруженности системы, время выполнения — признак объёма работы. Задача, которая заняла четыре часа из-за трёхчасового ожидания свободного слота, указывает на проблему с пропускной способностью. Задача, занявшая четыре часа при непрерывном выполнении, — признак проблемы со scope или набором тестов. В общем итоге они выглядят одинаково, но требуют разных решений.

Смотрите Емкость и слоты агентов.

Статус

Представление о состоянии сервисов, соответствующее публичной странице статуса Coroid.

Проверьте его в первую очередь, если что-то перестало работать во всей системе, а не в рамках одного проекта. Если симптомы затрагивают всю платформу, а страница статуса показывает нормальное состояние, причина, скорее всего, кроется в вашей собственной конфигурации.

Что это не такое

Это не мониторинг приложений. Coroid не отслеживает ваши рабочие сервисы, и здесь не указано, здорово ли ваше развернутое приложение — для этого используется ваш собственный стек наблюдения.

Coroid может реагировать на сигналы от этих систем. Хук может среагировать на событие деплоя, а Sentinel — отследить условие и инициировать процесс устранения неполадок. Смотрите Хуки и Sentinel.