SRE (Site Reliability Engineer)
Яндекс ищет SRE в команду инфраструктуры основного веб-поиска и поиска по картинкам — системы, которая держит десятки миллионов RPS и петабайты горячих данных. Предстоит автоматизировать приёмку и выкатку релизов, развивать инструменты наблюдаемости (распределённый трейсинг, анализ инцидентов) и улучшать процессы координации аварий, в том числе с использованием LLM. Нужны уверенный Linux, понимание TCP/IP и распределённых отказоустойчивых сервисов, подходы IaC и хорошее владение Python или Go; плюсом — системный язык (в идеале C++), знание SRE-принципов и умение разбирать coredumps.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
Поиск — первый и ключевой сервис Яндекса. За много лет из простой поисковой программы он развился в высоконагруженную и нетривиальную систему. Поиск большой: им пользуются сотни миллионов пользователей, сотни тысяч ядер обрабатывают миллиарды запросов в сутки, а некоторые микросервисы держат десятки миллионов RPS, обрабатывая петабайты горячих данных. Такой масштаб и критичность накладывает серьёзные требования на надёжность. Наша команда работает над всей инфраструктурой основного веб-поиска и поиска по картинкам. Мы ищем SRE, способных внедрять современные SRE-подходы и процессы. Роль SRE — одна из ключевых в продукте. Какие задачи вас ждут Автоматизация непрерывной поставки Вы будете разрабатывать и улучшать механизмы автоматической приёмки и выкатки релизов, минимизируя участие сервисных команд. Это позволит одновременно как повысить надёжность, так и соптимизировать time to market различных внедрений. Разработка инструментов наблюдаемости У Поиска из-за большого масштаба много специфичных инструментов для обеспечения наблюдаемости на всех стадиях. Это распределённый трейсинг, инструментарий для анализа инцидентов и так далее. Вам предстоит как использовать эти инструменты, так и развивать их. Улучшение процессов координации инцидентов С появлением LLM можно автоматизировать и упростить значительную часть координации инцидентов. Вы будете улучшать процессы починки аварий, упрощать дебаг сложных инцидентов и ускорять починку. Мы ждём, что вы • Работали с системами мониторинга и управления конфигурациями • Уверенно владеете Linux, имеете крепкую ментальную модель разных подсистем • Понимаете принципы работы TCP/IP и умеете диагностировать сетевые проблемы • Разбираетесь в построении распределённых и отказоустойчивых веб-сервисов • Знакомы с подходами Infrastructure as Code • На хорошем уровне владеете Python или Go Будет плюсом, если вы • Разрабатывали на системном языке программирования (в идеале C++) • Читали SRE book, понимаете принципы SRE • Понимаете принципы работы очередей и распределённых систем • Умеете анализировать coredumps • Уверенно владеете современными подходами к AI в разработке и поддержке
Стек и инструменты
Зарплата не указана — оценили по рынку
На основе 74 похожих вакансий за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как DevOps-инженера — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Яндекс
13 активных вакансий в компании
Ревьюер по программированию 1С
~600 000 – 1 066 000 ₸ оценка
Проверка студенческих работ по программированию 1С: нужно давать обратную связь, опираясь на гайды и чек-листы. Требуется опыт в 1С от 3 лет уровня Middle+, умение работать с Git и ИИ-агентами. Удалённая частичная занятость (10–15 часов в неделю) с возможностью совмещать, бесплатное обучение и сертификаты.
География удалёнки не уточнена
Go-разработчик платёжного ядра
~1 599 000 – 2 802 750 ₸ оценка
Команда Яндекс Pay ищет бэкенд-разработчика на Go для ядра платёжной платформы: микросервис транзакций, интеграции с процессингами и event-driven обработка через transactional outbox. Нужен сильный опыт с Go и PostgreSQL, понимание консистентности, идемпотентности и паттернов вроде Saga и CQRS. Работа над системами, где ошибка стоит реальных денег, с современным стеком наблюдаемости и переходом от монолита и Python-бэкенда к Go-микросервисам.
География удалёнки не уточнена
Фронтенд-разработчик
Разработка фронтенда для Яндекс Документов: сложная бизнес-логика, визуальные компоненты на Canvas, оптимизация производительности. Нужны отличное знание TypeScript/JavaScript, алгоритмическое мышление, опыт с React или Node.js. Предлагают сильную команду, интересные задачи, гибкий график, ДМС и премии раз в полгода.
География удалёнки не уточнена
Фронтенд-разработчик
Разработка и улучшение Яндекс Документов — одного из сервисов Яндекс 360. Нужен сильный фронтенд-разработчик с отличным знанием TypeScript/JavaScript, опытом React или Node.js и развитым алгоритмическим мышлением. Предлагают сложные задачи, работу в сильной команде, гибкий график и ДМС.
География удалёнки не уточнена
Похожие вакансии
6 вакансий
DevOps / Infrastructure Engineer (Middle+/Senior)
~2 254 590 ₸ оценка
DEMIAND ищет опытного DevOps/Infrastructure Engineer (Middle+/Senior), который с нуля выстроит инфраструктуру под собственную IoT-платформу и e-commerce: dev/stage/prod-окружения, IaC, CI/CD, контейнеризацию с прицелом на Kubernetes, мониторинг и алертинг. Нужны 3+ года в DevOps/SRE, уверенный Linux, Docker, Terraform/Ansible, CI/CD (GitLab CI/Jenkins/GitHub Actions), скриптинг на Bash/Python и крепкий production-опыт с PostgreSQL — репликация, бэкапы, тюнинг под высокие нагрузки. Предлагают полную удалённую занятость, выплаты дважды в месяц, оплачиваемые отпуска, ДМС после испытательного срока, бонусы и скидки на продукцию компании; зарплата обсуждается на собеседовании.
География удалёнки не уточнена
SRE
~2 254 590 ₸ оценка
VK ищет SRE для опенсорс-платформы YTsaurus — системы хранения и обработки данных на сотни петабайт с миллионами событий в секунду. Нужно автоматизировать эксплуатацию, интегрировать платформу с внутренними системами, следить за стабильностью и производительностью, разбирать инциденты на дежурствах и порой лезть в код на C++. Ждут опыта с распределёнными системами, уверенного знания Linux и сетей (TCP/IP, DNS, балансировка, ACL); плюсом будут высоконагруженные проекты и умение читать и отлаживать сложный C++.
География удалёнки не уточнена
DevOps-инженер со знанием C++
~1 557 620 ₸ оценка
Адаптация и поддержка сборки большого кросс-платформенного C++ проекта под новые компиляторы и архитектуры, расследование сбоев сборки в CI. Требуются уверенный C++, глубокое знание CMake и Linux, опыт скриптинга. Предлагают выбор офиса, гибрида или удалёнки, ДМС, белую зарплату и оформление в штат.
География удалёнки не уточнена
DevOps/SRE инженер дата-платформы
~2 254 590 ₸ оценка
Нужен опытный инженер (от 5 лет в эксплуатации инфраструктуры) для платформенной команды: разворачивать и сопровождать дата-платформу в Kubernetes — Airflow, Spark, объектное хранилище, Iceberg. Основная работа — Helm-чарты, операторы, CI/CD, мониторинг и алертинг на Prometheus/Grafana, IaC на Ansible и Terraform, доступы через SSO, в том числе на on-premise. Требуется крепкий Kubernetes (от 3 лет в проде), Linux, Docker, Python для автоматизации и базовый PostgreSQL. Работа полностью удалённая, график 5/2, зарплата обсуждается индивидуально.
География удалёнки не уточнена
Junior Infrastructure / Operations Engineer
~1 199 250 ₸ оценка
Junior-инженер инфраструктуры в удалённую команду: следить за состоянием сервисов и кластеров Kubernetes, разбирать алерты и логи, помогать диагностировать инциденты и деплоить изменения через GitLab CI/CD. Нужна крепкая база по Linux, сетям и Git, плюсом — Docker, Kubernetes, Grafana/Prometheus, Ansible/Terraform; глубокий опыт не требуется. Предлагают удалёнку, график 5/2, ноутбук, оплату больничных и скидку на английский.
География удалёнки не уточнена
Middle+/Senior DevOps Engineer
~2 254 590 ₸ оценка
Нужен опытный DevOps-инженер в игровую команду Stark Games: поддерживать и развивать инфраструктуру проектов в GCP, Selectel, Hetzner и Proxmox, вести CI/CD на Jenkins и автоматизировать всё через Terraform и Ansible. Ключевые требования — уверенный продакшн-опыт с Linux, Docker и Kubernetes, знание сетей, Nginx/HAProxy, мониторинга и скриптинг на Bash/Python. Взамен предлагают работу с современным стеком, реальное влияние на архитектуру и инфраструктуру, сильную команду и участие в on-call.
География удалёнки не уточнена