#CV
#Resume #резюме #Python #Docker #Linux #OpenToWork #remote #ищуработу #SRE #Observability
🚀 Monitoring / Observability / SRE Engineer - Middle+
Более 3 лет занимаюсь мониторингом и надёжностью production-систем. Сейчас развиваю мониторинг крупной видео платформы: от инфраструктурных метрик до полноценных пользовательских E2E-сценариев.
Что умею• Проектировать observability и monitoring для высоконагруженных production-систем
• Определять SLI/SLO, строить сервисные дашборды и настраивать actionable-алерты с фокусом на снижение MTTD и MTTR
• Разрабатывать E2E-мониторинг критичных пользовательских сценариев на Python и Playwright
• Автоматизировать диагностику инцидентов: сбор логов, скриншотов, технического контекста и данных из нескольких источников
• Анализировать деградации производительности, ошибки API, проблемы интеграций и отказы распределённых компонентов
• Разрабатывать внутренние инструменты мониторинга и автоматизации на Python и FastAPI
• Работать с метриками и логами в Zabbix, Prometheus, Grafana, ELK/Kibana, ClickHouse и InfluxDB
• Участвовать в расследовании production-инцидентов, RCA и устранении первопричин отказов
• Развивать мониторинг от инфраструктурного уровня до оценки реальной доступности сервиса для конечного пользователя
Стек:
✅ Zabbix | Prometheus | Grafana
✅ ELK / Kibana | Kafka | InfluxDB | ClickHouse
✅ Python | FastAPI | Playwright
✅ Docker | Linux | SQL | FFmpeg
✅ SLI / SLO | E2E monitoring
📍 Remote | готов к релокации
💼 Формат: Remote | Гибрид | Офис
🌍 Языки: Ru - native | En - B1/B2
LinkedIn:
https://www.linkedin.com/in/evgeny-suslov-a8b108234Tg: @Bamamute
GitHub:
https://github.com/EvgSuslov