Мониторинг охватывает состояние самого Coroid, а не ваших приложений. Найдите его в разделе Мониторинг, включая состояние, Производительность и Статус представления.
Состояние
Определяет, работают ли сервисы, от которых зависит Coroid, в штатном режиме.
Стоит проверить этот параметр, если что-то функционирует некорректно, и вы не можете определить, причина ли это в вашей конфигурации или в самой платформе. Исключение платформы из числа подозреваемых занимает несколько секунд и предотвращает длительное расследование в неправильном направлении.
Производительность
Показывает, как функционирует платформа: пропускная способность, задержки и время обработки.
Важное различие при анализе этих данных: время ожидания в очереди — это признак загруженности системы, время выполнения — признак объёма работы. Задача, которая заняла четыре часа из-за трёхчасового ожидания свободного слота, указывает на проблему с пропускной способностью. Задача, занявшая четыре часа при непрерывном выполнении, — признак проблемы со scope или набором тестов. В общем итоге они выглядят одинаково, но требуют разных решений.
Смотрите Емкость и слоты агентов.
Статус
Представление о состоянии сервисов, соответствующее публичной странице статуса Coroid.
Проверьте его в первую очередь, если что-то перестало работать во всей системе, а не в рамках одного проекта. Если симптомы затрагивают всю платформу, а страница статуса показывает нормальное состояние, причина, скорее всего, кроется в вашей собственной конфигурации.
Что это не такое
Это не мониторинг приложений. Coroid не отслеживает ваши рабочие сервисы, и здесь не указано, здорово ли ваше развернутое приложение — для этого используется ваш собственный стек наблюдения.
Coroid может реагировать на сигналы от этих систем. Хук может среагировать на событие деплоя, а Sentinel — отследить условие и инициировать процесс устранения неполадок. Смотрите Хуки и Sentinel.