DevOps-инженер (middle)
Нужен инженер по эксплуатации инфраструктуры (DevOps/SRE) в продукт Examus — систему прокторинга для онлайн-экзаменов с пиковой сезонной нагрузкой на видеопотоки. Предстоит выстроить мониторинг и алертинг с нуля, убрать единые точки отказа в приеме трафика, развивать CI/CD и перевести конфигурации в Terraform/Ansible, а также сопровождать коробочные поставки в закрытых контурах заказчиков. Ждут от 3 лет опыта с production-инфраструктурой, уверенных Linux и сеть, Docker, Prometheus/Grafana, GitLab CI или GitHub Actions, Bash/Python и опыт работы с российскими облаками. Взамен — влияние на архитектуру эксплуатации, прямой контакт с руководством, оформление по ТК и ДМС после испытательного.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
О продукте Examus — система прокторинга: контроль честности экзаменов в онлайне. Нами пользуются вузы и компании, среди сценариев — приемные кампании, внутренние и внешние экзамены, сертификации. Нагрузка сезонная и пиковая: в дни экзаменов тысячи одновременных сессий с видеопотоками, а стоимость простоя измеряется сорванными экзаменами у конкретных людей. Это накладывает требования к доступности выше среднего по рынку. Инфраструктура, с которой предстоит работать • Облачная инфраструктура в VK Cloud, объектное хранилище в Yandex Cloud • Backend Python/Django + DRF, Celery (worker и beat), Node.js + Socket.IO для сигналинга WebRTC • PostgreSQL (в том числе managed), Redis • Балансировщики нагрузки облачного провайдера, DNS, TLS, TURN/STUN (Coturn) • Коробочные поставки продукта на инфраструктуре заказчиков: docker compose, установочные скрипты Кластеры Kubernetes сопровождает внешний подрядчик по модели managed. Эксплуатация Kubernetes в зону ответственности этой роли не входит — от вас нужно умение ставить подрядчику задачи и проверять результат, а не администрировать кластер.
- Мониторинг и алертинг. Довести наблюдаемость до состояния, когда деградация компонента видна до того, как о ней сообщил клиент: метрики, логи, трейсы, осмысленные алерты, дежурные сценарии реагирования.
- Отказоустойчивость приема трафика. Убрать единые точки отказа в схеме балансировки, DNS и публикации сервиса, обеспечить предсказуемое переключение и проверяемое восстановление.
- CI/CD. Развитие пайплайнов сборки и выката, сокращение времени и риска релиза, воспроизводимые окружения.
- Инфраструктура как код. Перевод конфигураций в код, версионирование, отказ от ручных изменений в проде.
- Коробочные поставки. Упаковка и сопровождение установки продукта в закрытых контурах заказчиков, поддержка внедрения.
- Работа с инцидентами. Участие в разборе аварий, ведение постмортемов, доведение мер до внедрения, а не до протокола.
- Взаимодействие с облачными провайдерами и подрядчиками. Постановка задач, контроль сроков и SLA, эскалация, проверка того, что заявленное подрядчиком действительно сделано.
- Что мы ждем
- От 3 лет в эксплуатации production-инфраструктуры
- Уверенный Linux и сеть: TCP/IP, DNS, TLS, маршрутизация, умение локализовать проблему между приложением, облаком и сетью провайдера
- Docker, docker compose
- Опыт с системами мониторинга (Prometheus, Grafana или аналоги), настройка метрик и алертов с нуля
- CI/CD: GitLab CI, GitHub Actions или аналоги
- Инфраструктура как код: Terraform, Ansible или аналоги
- Скриптование: Bash, Python
- Опыт эксплуатации сервисов в российских облаках
- Способность самостоятельно вести задачу до результата и внятно писать: постмортемы, схемы, инструкции
- Будет плюсом
- Опыт работы с внешними подрядчиками по эксплуатации: постановка задач, приемка, спор по SLA
- Базовое понимание Kubernetes на уровне пользователя: посмотреть логи, состояние подов, разобраться, где проблема, и корректно передать ее подрядчику
- Эксплуатация PostgreSQL под нагрузкой: репликация, бэкапы, проверка восстановления
- Опыт с WebRTC, TURN/STUN, видеотрафиком
- Опыт поставки продукта в закрытые контуры заказчиков (on-premise, изолированные сети)
- Понимание требований регуляторов к размещению данных, опыт прохождения проверок ИБ
- Участие в дежурствах и выстраивании процесса on-call
- Что предлагаем
- Влияние на архитектуру эксплуатации: роль создается, чтобы выстроить процессы, а не поддерживать чужие
- Прямой контакт с руководством, короткий путь принятия решений
- Продукт с реальной нагрузкой и понятной ценой отказа — виден результат работы
- Оформление по ТК + ДМС после испытательного
- Вопрос для отклика
- Ответьте, пожалуйста, в сопроводительном письме — по ответу мы поймем, как вы думаете, и это ускорит нам разговор:
- Представьте: во время экзамена часть пользователей теряет соединение, но сервис в целом «зеленый» — все дашборды в норме. Клиент пишет раньше, чем сработал алерт. С чего вы начнете и как сделаете так, чтобы в следующий раз система увидела деградацию до звонка клиента? Ответьте в двух-трех абзацах, нам важен ход рассуждений, а не готовый рецепт.
- Отбор
- Короткий созвон-знакомство (30 минут)
- Техническое интервью с разбором рабочих кейсов (60-90 минут)
- Финальная встреча с руководством, обсуждение условий
- Общение строго через hh.ru
Стек и инструменты
Зарплата ниже рынка
На 24% ниже медианы DevOps по 69 вакансиям за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как DevOps-инженера — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Похожие вакансии
6 вакансий
DevOps / Infrastructure Engineer (Middle+/Senior)
~2 254 590 ₸ оценка
DEMIAND ищет опытного DevOps/Infrastructure Engineer (Middle+/Senior), который с нуля выстроит инфраструктуру под собственную IoT-платформу и e-commerce: dev/stage/prod-окружения, IaC, CI/CD, контейнеризацию с прицелом на Kubernetes, мониторинг и алертинг. Нужны 3+ года в DevOps/SRE, уверенный Linux, Docker, Terraform/Ansible, CI/CD (GitLab CI/Jenkins/GitHub Actions), скриптинг на Bash/Python и крепкий production-опыт с PostgreSQL — репликация, бэкапы, тюнинг под высокие нагрузки. Предлагают полную удалённую занятость, выплаты дважды в месяц, оплачиваемые отпуска, ДМС после испытательного срока, бонусы и скидки на продукцию компании; зарплата обсуждается на собеседовании.
География удалёнки не уточнена
SRE
~2 254 590 ₸ оценка
VK ищет SRE для опенсорс-платформы YTsaurus — системы хранения и обработки данных на сотни петабайт с миллионами событий в секунду. Нужно автоматизировать эксплуатацию, интегрировать платформу с внутренними системами, следить за стабильностью и производительностью, разбирать инциденты на дежурствах и порой лезть в код на C++. Ждут опыта с распределёнными системами, уверенного знания Linux и сетей (TCP/IP, DNS, балансировка, ACL); плюсом будут высоконагруженные проекты и умение читать и отлаживать сложный C++.
География удалёнки не уточнена
DevOps/SRE инженер дата-платформы
~2 254 590 ₸ оценка
Нужен опытный инженер (от 5 лет в эксплуатации инфраструктуры) для платформенной команды: разворачивать и сопровождать дата-платформу в Kubernetes — Airflow, Spark, объектное хранилище, Iceberg. Основная работа — Helm-чарты, операторы, CI/CD, мониторинг и алертинг на Prometheus/Grafana, IaC на Ansible и Terraform, доступы через SSO, в том числе на on-premise. Требуется крепкий Kubernetes (от 3 лет в проде), Linux, Docker, Python для автоматизации и базовый PostgreSQL. Работа полностью удалённая, график 5/2, зарплата обсуждается индивидуально.
География удалёнки не уточнена
Middle+/Senior DevOps Engineer
~2 254 590 ₸ оценка
Нужен опытный DevOps-инженер в игровую команду Stark Games: поддерживать и развивать инфраструктуру проектов в GCP, Selectel, Hetzner и Proxmox, вести CI/CD на Jenkins и автоматизировать всё через Terraform и Ansible. Ключевые требования — уверенный продакшн-опыт с Linux, Docker и Kubernetes, знание сетей, Nginx/HAProxy, мониторинга и скриптинг на Bash/Python. Взамен предлагают работу с современным стеком, реальное влияние на архитектуру и инфраструктуру, сильную команду и участие в on-call.
География удалёнки не уточнена
DevOps-инженер
~2 254 590 ₸ оценка
Ищем DevOps-инженера с опытом от 7 лет поддерживать и развивать инфраструктуру крупного Big Data-решения на высоконагруженных распределённых системах. Нужны уверенные знания Linux, Kubernetes, Kafka, Cassandra, Hadoop, Greenplum и Ansible, Docker и CI/CD, плюс автоматизация и написание API на Python и bash. Работа удалённая, полная занятость, официальное оформление по ТК РФ, но только с территории России.
География удалёнки не уточнена
DevOps/MLOps инженер AI-платформы (LLM/VLM, GPU, RAG)
~2 254 590 ₸ оценка
Нужен инженер, который возьмёт на себя инфраструктуру AI-платформы: поднимет серверный, контейнерный и GPU-контур, настроит CI/CD, мониторинг и хранение для LLM/VLM и транскрибации. Ждём опыт DevOps от 3–5 лет, уверенный Python/Bash, Docker, Prometheus/Grafana/Loki/OpenTelemetry и понимание LLM-инференса, RAG и vector databases. Предлагают формат офис/гибрид/удалёнка, ДМС, соцпакет и работу в банковском масштабе.
География удалёнки не уточнена