
Денис Коршунов
Инженер по мониторингу и SRE
Занимается построением отказоустойчивых систем и оптимизацией инфраструктуры. Пишет про мониторинг, инциденты и архитектуру сервисов.
Публикации

Ошибка 404 Not Found: причины, влияние на SEO и как находить битые ссылки
Разбираем, когда 404 нормальна, когда вредит сайту, как диагностировать проблему и настроить правильную обработку битых ссылок.

Ошибка TLS-рукопожатия: причины и способы исправить
Практический разбор TLS handshake error: от сертификатов и SNI до CDN, Nginx, шифров и сетевых проблем.

Как расследовать деградацию производительности по метрикам. Пошаговый подход
Восемь шагов расследования: от подтверждения проблемы по золотым сигналам до проверки того, что найденная аномалия действительно объясняет всю картину.

Мониторинг Nginx. Какие метрики действительно помогают находить проблемы
Подробно объясняем, какие метрики Nginx стоит отслеживать, как интерпретировать активные соединения, время ответа, HTTP-ошибки и показатели upstream, чтобы быстрее находить причины деградации сервисов.

Мониторинг TCP-соединений. Retransmits, resets, SYN backlog и что они говорят о проблемах
Подробно объясняем, что означают TCP retransmits, resets и SYN backlog, как интерпретировать эти показатели и почему они помогают быстрее находить причины сетевых задержек и ошибок.

Что такое burn rate alerts и почему их рекомендует Google SRE
Подробно объясняем принцип работы burn rate alerts, что такое error budget, чем такие алерты отличаются от обычных пороговых уведомлений и как они помогают снизить количество ложных срабатываний.