Перейти к содержимому
Cloud.ru
C
Cloud.ru
Москва
35 активна · проверена 8 часов назад

SR-инженер уровня Senior/TechLead

Мы ищем опытного SR-инженера, который поможет сделать наши продукты надежными и предсказуемыми. Если вы разбираетесь в SRE-практиках и умеете управлять инцидентами, а также хотите делиться знаниями с командой, откликайтесь на вакансию!

senior ~2 504 700 ₸
Вакансия опубликована 278 дней назад. Может быть уже неактуальна — рекомендуем уточнить статус у работодателя перед откликом.
salary intelligence

Зарплата не указана — оценили по рынку

На основе 99 похожих вакансий за 90 дней.

оценка p25–p75
1 627 500 – 3 326 363 ₸
медиана: 2 504 700 ₸
Хотите увидеть распределение по грейдам и городам? Зарплаты DevOps Калькулятор зарплат
Вакансии в Telegram-канале
Свежие вакансии Каждый день
Подписаться
??%
Match Score
Войдите и создайте резюме
Войти
описание

Что предстоит делать

Навыки: SQL. Квалификация: Senior. Специализации: Инженер по доступности сервисов. Мы привлекаем амбициозных профессионалов по всей России, чтобы вместе решать прорывные задачи и создавать инновации. Нас уже более 1700 человек Мы растем и нам нужен SR-инженер уровня Senior/TechLead, который поможет нам сделать наши продукты надежными; который понимает, что надежность - это не только uptime, но и предсказуемость, удовлетворенность наших пользователей, душевное спокойствие инженеров и постоянная работа над процессами. Если ты знаешь, как превратить SLO/SLI в работающую систему, а не просто красивые графики; умеешь предсказывать проблемы до того, как они станут инцидентами; уверен, что главное - довольные пользователи; можешь объяснить, почему error budget важнее \"фичи, которую надо запилить к утру\", понимаешь, что \"починить сейчас\" и \"сделать, чтобы больше не ломалось\" - это разные вещи; и для тебя incident/problem management — это процесс, а не героизм - то откликайся! **На этой позиции тебе предстоит:** - управление надежностью сервисов: проектирование, внедрение и поддержка SLO/SLI, error budget, координация процесса соблюдения SLO, управление использованием Error Budget; - мониторинг и алертинг: разработка метрик, алертов, дашбордов, ранбуков (и их регулярный анализ/рефакторинг); - capacity planning: прогнозирование нагрузки и планирование ресурсов; - performance optimization: выявление и устранение bottleneck, оптимизация производительности; - incident & problem management: участие в устранении инцидентов (роль Incident Commander), расследование причин (RCA); ревью postmortems, разработка и внедрение corrective actions, при необходимости - заведение проблем и контроль их решения; - повышение отказоустойчивости: улучшение observability (логи, трейсы, метрики: обогащение, добавление, ревизия...); - ревью DRP, участие в качестве координатора в DRT, поддержание DRP в актуальном состоянии; - автоматизация: устранение рутины - IaC (Terraform/Ansible) и Python/Go/Bash; - менторство и обучение: проведение внутренних воркшопов для команд разработки по темам надёжности, observability, помощь в развитии навыков SRE у других инженеров. **Что мы ждем от кандидата:** - экспертиза и практический опыт в SRE-практиках: глубокое понимание SLO/SLI, error budget, toil reduction, automation first... умение применять это практически для обеспечения надежности сервисов; - умение проводить code review для оценки готовности к выходу в production новых функций и сервисов с точки зрения надёжности, наблюдаемости и эффективности, понимание, как изменения в коде влияют на смежные системы и общую стабильность платформы; - практический опыт построения и внедрения quality gates в CI/CD процесс для управления рисками при развертывании: для предотвращения попадания нестабильных изменений в production; - эксперт в эксплуатации Linux, включая диагностику на уровне ядра (процессы, память, сеть); - глубокие знания и понимание того, как работают сети на уровнях L2-L7; - опыт работы с Kubernetes и понимание его internal'ов для диагностики сложных проблем. Было бы неплохо иметь: - системное мышление и умение анализировать сложные failure-сценарии, выявлять корневые причины, находить способы их устранения; - опыт написания и ревью технической документации (runbooks, postmortems...); - опыт коммуникации с разработчиками и бизнесом (объяснение trade-offs между reliability и feature dev).

Поделиться

Подходит ли вам эта вакансия?

Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть

Создать аккаунт PDF-парсинг резюме за 2 минуты

Ещё в Cloud.ru

13 активных вакансий в компании

1 нед. назад

Reliability & Performance QA Engineer

~924 000 ₸ оценка

Ищем QA-инженера для тестирования производительности и надежности облачной платформы. Нужно проектировать нагрузочные тесты, автоматизировать их и проводить Chaos-тестирование. Требуется опыт с нагрузочными инструментами, Docker, Kubernetes, Linux и Python.

QA Performance Reliability +10
middle удал. hh
1 нед. назад

Senior Fullstack QA (IaaS Terraform)

~924 000 ₸ оценка

Вакансия связана с обеспечением качества продукта Terraform: автоматизированное и ручное тестирование, покрытие тестами провайдера, работа с API. Требуется опыт тестирования и знание Terraform. Предполагается работа в команде, контроль задач для других команд.

Terraform QA тестирование +1
middle cr
1 нед. назад

Python Backend Developer (Middle)

~1 246 875 ₸ оценка

Backend-разработчик на Python для облачной платформы. Задачи: проектирование архитектуры, оптимизация производительности, внедрение CI/CD, создание сервисов для AI и ML. Требуется опыт в Python и облачных технологиях.

backend python cloud +3
middle cr
2 нед. назад

Application Security Аналитик (AI)

~1 646 844 ₸ оценка

Специалист по безопасности ИИ-решений: анализировать угрозы и уязвимости AI-агентов/LLM/GenAI, разрабатывать требования безопасной разработки, моделировать угрозы и контролировать их устранение. Требуются знания OWASP, MITRE ATT@CK, DevSecOps, опыт поиска уязвимостей в веб-приложениях. Плюсом — опыт Bug Bounty и чтение кода.

AI LLM GenAI +17
middle удал. hh

Похожие вакансии

6 вакансий
S
Sigma Software Group
1 д. назад

Инженер по инфраструктуре (DevOps)

~2 504 700 ₸ оценка

Инженер по инфраструктуре будет отвечать за масштабируемость, надежность и оптимизацию облачных затрат высоконагруженной платформы кибербезопасности. Требуется опыт работы с GCP, Kubernetes и Terraform, а также взаимодействие с командами разработки и продуктов.

GCP Kubernetes Terraform +5
senior cr
First Crypto Exchange LLC
F
First Crypto Exchange LLC
2 д. назад

Инженер платформы и безопасности

~2 504 700 ₸ оценка по стеку

Криптобиржа в Дубае ищет инженера платформы и безопасности, который будет отвечать за производственную инфраструктуру, Kubernetes, автоматизацию и мониторинг безопасности. Требуется сильный опыт с Kubernetes, Terraform, GitOps и AWS, а также знание стандартов аудита. Предлагают гибридный формат, высокую автономию и конкурентоспособную зарплату.

Kubernetes Terraform Terragrunt +7
senior Дубай dj
АО «Казтелепорт»
А
АО «Казтелепорт»
3 д. назад

Инженер по виртуализации

~2 504 700 ₸ оценка по стеку

Инженер по виртуализации в IT-компании: проектирование и администрирование облачных платформ (OpenStack, VMware, Ceph). Требуется опыт от 3 лет с Linux и виртуализацией, знание скриптов Bash. Компания предлагает стабильную работу, обучение и карьерный рост.

OpenStack KVM VMware +6
senior Алматы hh
C
Concentrix
1 д. назад

DevOps инженер (Azure DevOps Server и Services)

~3 794 848 – ~5 692 500 ₸ (8 333 – 12 500 USD)

DevOps-инженер будет проектировать и поддерживать Azure DevOps решения, включая CI/CD и гибридные среды, для крупных корпоративных и государственных клиентов. Основные задачи — миграции, устранение проблем и консультирование. Требуется свободный шведский и английский.

Azure DevOps CI/CD hybrid environments +3
senior cr
I
Inviso
1 д. назад

Applied AI Engineer

~3 794 848 – ~5 692 500 ₸ (8 333 – 12 500 USD)

Вакансия предполагает развертывание и эксплуатацию AI-решений в продакшене, с фокусом на надежность, оценку, производительность и безопасность. Требуется сотрудничество с командами для создания производственных AI-возможностей на корпоративной платформе.

AI production reliability +3
senior cr
A
Appliscale
2 д. назад

DevOps инженер (платформа аналитики Databricks)

~3 163 160 – ~3 406 480 ₸ (26 000 – 28 000 PLN)

Ищем DevOps-инженера для работы с аналитической платформой на Databricks. Нужно проектировать и поддерживать инфраструктуру AWS с Terraform, автоматизировать процессы CI/CD и мигрировать старые компоненты. Требуется опыт с облачными технологиями и командная работа.

DevOps Databricks AWS +3
senior cr