Monitoring Engineer
Employment type: Полный рабочий день
Grade: Middle
Skills: Grafana, Zabbix, Prometheus, Linux, Docker
Description:
Мы строим технологичную финтех-компанию ИТ Контакт: с 2019 года мы создаем современные цифровые платформы, которые позволяют упростить процессы, снизить затраты и повысить безопасность сделок, связанных с приобретением жилья. Благодаря нашей работе множество людей по всему миру смогли воплотить в жизнь мечту о собственном доме. Нас уже более 700 человек, и, в связи с активным ростом компании, мы находимся в поисках Инженера по мониторингу в нашу команду.
Требования к кандидату:
От 1 года опыта работы в роли инженера по мониторингу/инженера технической поддержки;
Практический опыт работы с инструментами мониторинга (Zabbix, Grafana, Prometheus, Loki, PagerDuty);
Понимание современных подходов к Observability (Metrics, logs, traces, alerting);
Опыт настройки интеграций между системами мониторинга;
Знания Linux и Windows Server на уровне администратора;
Понимание работы Docker платформы;
Навыки автоматизации и написания скриптов на PowerShell, Bash или Python;
Понимание сетевых технологий и протоколов: TCP/IP, HTTP/HTTPS, SNMP, ICMP, DNS;
Опыт работы с Git (общий уровень);
Уровень английского B1+
Будет плюсом:
Опыт работы с системами ELK/Graylog;
Опыт использования Checkmk, Datadog, Dynatrace, New Relic;
Опыт интеграции мониторинга с Microsoft Teams, Slack, Jira, ServiceNow;
Понимание принципов SRE и управления инцидентами;
Опыт работы в финансовой или высоконагруженной среде.
Чем вы будете заниматься?
Поддержка и развитие систем мониторинга инфраструктуры и приложений;
Настройка и сопровождение мониторинга серверов, сетевого оборудования, баз данных, приложений и облачных сервисов;
Разработка и сопровождение дашбордов в Grafana;
Настройка и оптимизация триггеров, шаблонов и автоматизации в Zabbix;
Работа с Prometheus и Exporters для сбора метрик;
Анализ и визуализация логов с использованием Loki;
Настройка маршрутизации событий и эскалаций через PagerDuty;
Участие в расследовании инцидентов и проведении RCA (Root Cause Analysis);
Разработка и поддержка мониторинга SLA/SLO;
Автоматизация рутинных задач с использованием PowerShell, Bash или Python;
Взаимодействие с командами DevOps, Infrastructure и Development для внедрения новых метрик и алертов;
Подготовка технической документации.
Что мы предлагаем:
Аккредитованная IT-компания;
Комфортный офис в центре Санкт-Петербурга;
Предсказуемый график работы 5/2;
Мультикультурная амбициозная команда;
Общение на иностранных языках с коллегами и клиентами;
Внутреннее комьюнити для сотрудников: кафетерий льгот для сотрудников, сообщества по интересам, участие в спортивных турнирах, благотворительные программы и т.д.
Анонимная аналитика
Мы используем анонимную аналитику, чтобы улучшать поиск вакансий и работу сайта.