Senior SRE
Финтех-продукт (карта с мобильным приложением, 3 региона, ~300k пользователей, 500+ RPS) ищет Senior SRE, который возьмёт на себя надёжность: SLI/SLO, мониторинг и алертинг, capacity planning, observability и disaster recovery. Нужны 3+ года в SRE/DevOps/Infrastructure, production-опыт с AWS, Kubernetes и Terraform, Grafana, Zabbix, Prometheus, CloudWatch, понимание Linux и распределённых систем, а также свободный русский и английский от B2. Работа с инцидентами и RCA, участие в нагрузочных тестах и аудитах; плюсом — multi-region опыт и финтех с PCI DSS.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
Мы создаём цифровой финансовый продукт, который меняет подход к кредитованию: карту без процентов и годового обслуживания, полностью управляемую через мобильное приложение. Продукт работает в трёх регионах, обслуживает около 300 000 пользователей и выдерживает нагрузку более 500 RPS. Мы ищем Senior SRE, который возьмёт на себя ответственность за процессы Monitoring & Event Management и Availability & Capacity Management. В этой роли важно не просто реагировать на инциденты, а выстраивать системную надёжность: прогнозировать нагрузку, определять измеримые цели по доступности, развивать observability и превращать выводы из сбоев в устойчивые изменения. Ключевые зоны ответственности • Availability & Capacity Management: доступность, производительность, прогнозирование нагрузки и достаточность ресурсов. • Monitoring & Event Management: качество мониторинга, событий, алертов и процессов реакции. • Observability: метрики, логи, трассировки, дашборды и диагностическая готовность систем. • Reliability governance: SLI/SLO, анализ инцидентов, disaster recovery и системные улучшения.
- Сформировать SLI/SLO для критичных пользовательских сценариев совместно с бизнесом и техническими командами и внедрить контроль их соблюдения.
- Развивать мониторинг на базе Grafana, Prometheus, Zabbix и CloudWatch; проектировать информативные дашборды, улучшать алерты и снижать шум событий.
- Развивать централизованные логи в CloudWatch Logs и распределённую трассировку: расширять применение OpenTelemetry и оценивать использование AWS X-Ray.
- Прогнозировать нагрузку и потребность в ресурсах, выявлять узкие места и формировать рекомендации по масштабированию.
- Участвовать в нагрузочных испытаниях вместе с отдельным специалистом и использовать результаты для Capacity Management.
- Подключаться к production-инцидентам как технический эксперт, при необходимости координировать восстановление и регулярно проводить RCA.
- Обеспечивать выполнение корректирующих действий по итогам RCA и превращать выводы из инцидентов в устойчивые изменения систем и процессов.
- Отвечать за disaster recovery: определять и согласовывать RTO/RPO, контролировать резервное копирование, проводить тесты восстановления и проверять сценарии отказа AWS-региона.
- Контролировать доступность внешних систем, самостоятельно взаимодействовать с поддержкой поставщиков, координировать устранение сбоев и контролировать выполнение SLA.
- Участвовать во внутренних аудитах, учитывать требования регуляторов и обеспечивать корректную работу с персональными данными.
- Что для нас важно
- Не менее трёх лет опыта в роли SRE, DevOps или Infrastructure Engineer и готовность работать на уровне Senior.
- Практический опыт построения и развития процессов Monitoring & Event Management, Availability & Capacity Management и observability.
- Опыт определения SLI/SLO и внедрения измеримых целей надёжности.
- Уверенная работа с AWS, Kubernetes и Terraform в production-среде.
- Практический опыт администрирования и настройки Grafana и Zabbix; понимание Prometheus и CloudWatch.
- Понимание метрик, логов и распределённой трассировки, а также умение выстраивать диагностику сложных сбоев.
- Глубокое понимание Linux, сетевых протоколов и принципов работы распределённых систем.
- Опыт incident response, RCA и контроля выполнения корректирующих действий.
- Способность создавать поддерживаемые инструменты автоматизации, скрипты и интеграции; конкретный язык программирования не принципиален.
- Практическое владение инструментами, в том числе AI, для написания и ревью кода, анализа логов и инцидентов, подготовки RCA, runbook и работы с инфраструктурой — с обязательной проверкой результатов перед применением в production.
- Свободный русский и английский не ниже B2: предстоит регулярно общаться с мексиканскими коллегами, партнёрами и вендорами.
- Будет плюсом
- Опыт эксплуатации multi-region инфраструктуры и подготовки сценариев регионального отказа.
- Опыт мониторинга мобильных приложений и внешних финансовых интеграций.
- Практический опыт внедрения OpenTelemetry или AWS X-Ray.
- Опыт работы в финтехе и понимание требований PCI DSS.
- Опыт взаимодействия с регуляторами и участия в технических аудитах.
Стек и инструменты
Зарплата не указана — оценили по рынку
На основе 88 похожих вакансий за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как DevOps-инженера — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Finstar Financial Group
15 активных вакансий в компании
DevOps - инженер
~1 557 620 ₸ оценка
Нужен DevOps-инженер в финтех-команду: поднимать и сопровождать виртуальные машины и Kubernetes-кластер, строить CI/CD в GitLab, писать Helm-чарты и Ansible-плейбуки, следить за мониторингом (Zabbix, Prometheus, Grafana) и деплоить приложения. Ключевые требования — опыт от 2–3 лет, уверенное администрирование Windows Server и IIS, работа с Docker, Nginx, PowerShell, Terraform/Ansible, MS SQL Server, а также понимание безопасного деплоя (SAST/DAST/SCA, OWASP Top 10, hardening). Предлагают наставничество, план индивидуального развития, конкурентную зарплату и ДМС с первого дня; ждут указания ожидаемого дохода.
География удалёнки не уточнена
DevOps-инженер
~2 456 159 ₸ оценка
Поддержка и развитие облачной инфраструктуры в AWS и Kubernetes, автоматизация через Terraform, Ansible и Helm, CI/CD на GitLab CI и Argo CD. Нужен сильный опыт с AWS, Kubernetes, Linux, сетями и скриптами на Bash/Python/Go, английский B1. Предлагают стабильный проект, оклад с годовыми бонусами и минимум бюрократии.
География удалёнки не уточнена
DevOps-инженер
~1 557 620 ₸ оценка
Ищут DevOps-инженера для миграции кредитной платформы в AWS. Нужно проектировать и эксплуатировать инфраструктуру: AWS, EKS, Terraform, Helm, CI/CD, мониторинг, логирование, безопасность, PostgreSQL/Redis/Kafka. Предлагают работу над production-ready платформой в тесной связке с разработкой, QA и аналитиками.
География удалёнки не уточнена
Senior QA Automation Engineer
~1 092 650 ₸ оценка
Ищем Senior QA Automation Engineer для финтех-продукта. Нужно будет автоматизировать тестирование мобильного приложения на Flutter (Python + Appium), проверять API и микросервисы, работать с БД и очередями. Требуется опыт от 5 лет в тестировании микросервисов и уверенное знание Python. Предлагают работу в команде с современным стеком и влиянием на качество продукта.
География удалёнки не уточнена
Похожие вакансии
6 вакансий
DevOps / Infrastructure Engineer (Middle+/Senior)
~2 456 159 ₸ оценка
DEMIAND ищет опытного DevOps/Infrastructure Engineer (Middle+/Senior), который с нуля выстроит инфраструктуру под собственную IoT-платформу и e-commerce: dev/stage/prod-окружения, IaC, CI/CD, контейнеризацию с прицелом на Kubernetes, мониторинг и алертинг. Нужны 3+ года в DevOps/SRE, уверенный Linux, Docker, Terraform/Ansible, CI/CD (GitLab CI/Jenkins/GitHub Actions), скриптинг на Bash/Python и крепкий production-опыт с PostgreSQL — репликация, бэкапы, тюнинг под высокие нагрузки. Предлагают полную удалённую занятость, выплаты дважды в месяц, оплачиваемые отпуска, ДМС после испытательного срока, бонусы и скидки на продукцию компании; зарплата обсуждается на собеседовании.
География удалёнки не уточнена
SRE
~2 456 159 ₸ оценка
VK ищет SRE для опенсорс-платформы YTsaurus — системы хранения и обработки данных на сотни петабайт с миллионами событий в секунду. Нужно автоматизировать эксплуатацию, интегрировать платформу с внутренними системами, следить за стабильностью и производительностью, разбирать инциденты на дежурствах и порой лезть в код на C++. Ждут опыта с распределёнными системами, уверенного знания Linux и сетей (TCP/IP, DNS, балансировка, ACL); плюсом будут высоконагруженные проекты и умение читать и отлаживать сложный C++.
География удалёнки не уточнена
DevOps/SRE инженер дата-платформы
~2 456 159 ₸ оценка
Нужен опытный инженер (от 5 лет в эксплуатации инфраструктуры) для платформенной команды: разворачивать и сопровождать дата-платформу в Kubernetes — Airflow, Spark, объектное хранилище, Iceberg. Основная работа — Helm-чарты, операторы, CI/CD, мониторинг и алертинг на Prometheus/Grafana, IaC на Ansible и Terraform, доступы через SSO, в том числе на on-premise. Требуется крепкий Kubernetes (от 3 лет в проде), Linux, Docker, Python для автоматизации и базовый PostgreSQL. Работа полностью удалённая, график 5/2, зарплата обсуждается индивидуально.
География удалёнки не уточнена
Middle+/Senior DevOps Engineer
~2 456 159 ₸ оценка
Нужен опытный DevOps-инженер в игровую команду Stark Games: поддерживать и развивать инфраструктуру проектов в GCP, Selectel, Hetzner и Proxmox, вести CI/CD на Jenkins и автоматизировать всё через Terraform и Ansible. Ключевые требования — уверенный продакшн-опыт с Linux, Docker и Kubernetes, знание сетей, Nginx/HAProxy, мониторинга и скриптинг на Bash/Python. Взамен предлагают работу с современным стеком, реальное влияние на архитектуру и инфраструктуру, сильную команду и участие в on-call.
География удалёнки не уточнена
DevOps-инженер
~2 456 159 ₸ оценка
Ищем DevOps-инженера с опытом от 7 лет поддерживать и развивать инфраструктуру крупного Big Data-решения на высоконагруженных распределённых системах. Нужны уверенные знания Linux, Kubernetes, Kafka, Cassandra, Hadoop, Greenplum и Ansible, Docker и CI/CD, плюс автоматизация и написание API на Python и bash. Работа удалённая, полная занятость, официальное оформление по ТК РФ, но только с территории России.
География удалёнки не уточнена
DevOps/MLOps инженер AI-платформы (LLM/VLM, GPU, RAG)
~2 456 159 ₸ оценка
Нужен инженер, который возьмёт на себя инфраструктуру AI-платформы: поднимет серверный, контейнерный и GPU-контур, настроит CI/CD, мониторинг и хранение для LLM/VLM и транскрибации. Ждём опыт DevOps от 3–5 лет, уверенный Python/Bash, Docker, Prometheus/Grafana/Loki/OpenTelemetry и понимание LLM-инференса, RAG и vector databases. Предлагают формат офис/гибрид/удалёнка, ДМС, соцпакет и работу в банковском масштабе.
География удалёнки не уточнена