Первое подозрение — высокая кардинальность метрик. Необходимо проверить количество time-series, нагрузку на TSDB, WAL и найти новые labels с большим количеством уникальных значений.
Готовишься к DevOps-собеседованию?Полные разборы вопросов, карточки с интервальным повторением, квизы и песочница с реальными сломанными Linux-серверами — бесплатно после входа.
Открыть тренажёр →