Технический лидер SRE
Ищем Lead SRE для управления надежностью сервисов и оптимизации их производительности. Важны навыки в SRE-практиках, опыт работы с Kubernetes и Linux, а также умение проводить code review и менторить команды.
Зарплата не указана — оценили по рынку
На основе 49 похожих вакансий за 90 дней.
Что предстоит делать
Навыки: SQL. Квалификация: Lead. Специализации: Разработчик приложений. **Чем предстоит заниматься:** - управление надежностью сервисов: проектирование, внедрение и поддержка SLO/SLI, error budget, координация процесса соблюдения SLO, управление использованием Error Budget; - мониторинг и алертинг: разработка метрик, алертов, дашбордов, ранбуков (и их регулярный анализ/рефакторинг); - capacity planning: прогнозирование нагрузки и планирование ресурсов; - performance optimization: выявление и устранение bottleneck, оптимизация производительности; - incident & problem management: участие в устранении инцидентов (роль Incident Commander), расследование причин (RCA); ревью postmortems, разработка и внедрение corrective actions, при необходимости - заведение проблем и контроль их решения; - повышение отказоустойчивости: улучшение observability (логи, трейсы, метрики: обогащение, добавление, ревизия...); - ревью DRP, участие в качестве координатора в DRT, поддержание DRP в актуальном состоянии; автоматизация: устранение рутины - IaC (Terraform/Ansible) и Python/Go/Bash; - менторство и обучение: проведение внутренних воркшопов для команд разработки по темам надёжности, observability, помощь в развитии навыков SRE у других инженеров, code review внутри команды; - активное участие в разработке модели здоровья продукта и quality gates. **Что мы ждем от кандидата:** - экспертиза и практический опыт в SRE-практиках: глубокое понимание SLO/SLI, error budget, toil reduction, automation first... умение применять это практически для обеспечения надежности сервисов; - умение проводить code review для оценки готовности к выходу в production новых функций и сервисов с точки зрения надёжности, наблюдаемости и эффективности, понимание, как изменения в коде влияют на смежные системы и общую стабильность платформы; - практический опыт построения и внедрения quality gates в CI/CD процесс для управления рисками при развертывании: для предотвращения попадания нестабильных изменений в production; - эксперт в эксплуатации Linux, включая диагностику на уровне ядра (процессы, память, сеть); глубокие знания и понимание того, как работают сети на уровнях L2-L7; - опыт работы с Kubernetes и понимание его internal'ов для диагностики сложных проблем. Дополнительно: - системное мышление и умение анализировать сложные failure-сценарии, выявлять корневые причины, находить способы их устранения; - опыт написания и ревью технической документации (runbooks, postmortems...); - опыт коммуникации с разработчиками и бизнесом (объяснение trade-offs между reliability и feature dev).
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Cloud.ru
13 активных вакансий в компании
Reliability & Performance QA Engineer
~921 375 ₸ оценка
Ищем QA-инженера для тестирования производительности и надежности облачной платформы. Нужно проектировать нагрузочные тесты, автоматизировать их и проводить Chaos-тестирование. Требуется опыт с нагрузочными инструментами, Docker, Kubernetes, Linux и Python.
Senior Fullstack QA (IaaS Terraform)
~921 375 ₸ оценка
Вакансия связана с обеспечением качества продукта Terraform: автоматизированное и ручное тестирование, покрытие тестами провайдера, работа с API. Требуется опыт тестирования и знание Terraform. Предполагается работа в команде, контроль задач для других команд.
Python Backend Developer (Middle)
~1 246 875 ₸ оценка
Backend-разработчик на Python для облачной платформы. Задачи: проектирование архитектуры, оптимизация производительности, внедрение CI/CD, создание сервисов для AI и ML. Требуется опыт в Python и облачных технологиях.
Application Security Аналитик (AI)
~1 646 844 ₸ оценка
Специалист по безопасности ИИ-решений: анализировать угрозы и уязвимости AI-агентов/LLM/GenAI, разрабатывать требования безопасной разработки, моделировать угрозы и контролировать их устранение. Требуются знания OWASP, MITRE ATT@CK, DevSecOps, опыт поиска уязвимостей в веб-приложениях. Плюсом — опыт Bug Bounty и чтение кода.
Похожие вакансии
6 вакансийИнфраструктурный Team Lead (Linux, Ansible, PHP)
~3 759 294 ₸ оценка
Ищем Infrastructure Team Lead для управления инфраструктурой на bare-metal серверах (Hetzner и др.) без облаков. Нужно руководить командой из 2 ops-инженеров, планировать спринты, отвечать за безопасность, автоматизацию (Ansible, GitLab CI/CD, Docker) и поддержку легаси на PHP. Требуется 5+ лет опыта в Linux-администрировании и подтвержденный лидерский опыт.
Ведущий DevOps инженер
~3 759 294 ₸ оценка
Ищем ведущего DevOps-инженера для управления инфраструктурой и CI/CD процессами глобального SaaS-продукта. Вы будете руководить распределенной командой, внедрять SRE-практики и обеспечивать высокую доступность сервисов. Требуется опыт в DevOps, облачных технологиях и управлении командой.
Ведущий DevOps инженер
~3 759 294 ₸ оценка
Ищем ведущего инженера для управления инфраструктурой и автоматизацией на AWS. Вы будете отвечать за CI/CD, Terraform и наблюдаемость, а также руководить проектами от миграций до поддержки. Требуется опыт с облачными технологиями и лидерские качества.
Ведущий инженер по эксплуатации инфраструктуры NVIDIA Cloud Partner
Руководство и развитие операций для облачной инфраструктуры NVIDIA Cloud Partner. Задачи включают создание и поддержку крупномасштабных GPU-ускоренных сред, разработку автоматизации, мониторинга и операционных фреймворков, а также взаимодействие с командами партнеров для обеспечения надежной и масштабируемой работы.
Инженер по автоматизации облачной инфраструктуры
Вакансия инженера по автоматизации облачной инфраструктуры. Задачи: разработка инструментов автоматизации, API и интеграций для мультиоблачных сред, поддержка жизненного цикла ИТ. Требуется опыт в DevOps, облачных технологиях и автоматизации.
Ведущий DevOps инженер
Ищем ведущего DevOps-инженера для управления инфраструктурой и автоматизации процессов в облачной среде с 400+ виртуальными машинами. Нужен опыт с Linux, Kubernetes, Docker и облачными платформами, а также свободный польский и английский. Роль предполагает лидерство и ответственность за CI/CD и мониторинг.