Перейти к содержимому

DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB

Нужен DevOps/SRE-инженер для эксплуатации высоконагруженной SIEM-платформы, в первую очередь ClickHouse и MariaDB: кластеры, репликация, производительность, backup/restore и disaster recovery. Важны глубокое понимание production-БД, Linux, мониторинга и автоматизации. Предлагают постоянную занятость и работу с критичной инфраструктурой.

География удалёнки не уточнена

Уточните у работодателя, из каких стран можно работать.

senior удалённо ~2 475 110 ₸

Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.

описание

Что предстоит делать

DevOps / SRE-инженер с экспертизой ClickHouse и MariaDB Привет! Меня зовут Эля, я HR компании «Амбрелла». Мы — аккредитованная IT-компания в сфере информационной безопасности. Развиваем высоконагруженную SIEM-платформу для сбора, хранения и обработки событий ИБ. Сейчас ищем DevOps / SRE-инженера уровня Middle+/Senior с глубокой практической экспертизой по ClickHouse и уверенным опытом эксплуатации MariaDB. Основной фокус роли — промышленная эксплуатация ClickHouse: кластеры, репликация, шардирование, производительность, хранение больших объёмов данных, backup/restore, мониторинг, безопасность и безопасное проведение изменений в production. Вторая важная зона — MariaDB: эксплуатация, репликация, отказоустойчивость, Galera Cluster, backup/restore, disaster recovery, performance tuning и миграция с master-master-репликации на более надёжную кластерную архитектуру. Нам нужен инженер, который умеет не просто «поднять базу», а безопасно эксплуатировать production-инфраструктуру с критически важными данными: проверять гипотезы на стендах, оценивать риски, готовить rollback-план, участвовать в расследовании инцидентов и фиксировать результаты в документации. Чем предстоит заниматься: ClickHouse: — Администрировать продуктивные и тестовые кластеры ClickHouse; — Контролировать состояние шардов, реплик, Distributed-таблиц и ReplicatedMergeTree-таблиц; — Диагностировать replication queue, merges, mutations, inserts, деградацию запросов и проблемы с дисковой подсистемой; — Анализировать системные таблицы ClickHouse и состояние кластера; — Участвовать в изменении топологии кластера: добавление шардов, реплик, серверов, изменение Distributed-таблиц; — Планировать горизонтальное масштабирование ClickHouse-кластера; — Оптимизировать схемы данных, партиционирование, ключи сортировки, TTL, индексы, storage policy и настройки сервера; — Работать с хранением данных: локальные диски, LUN, DAS, hot / warm storage, S3-совместимое хранилище; — Прорабатывать дедупликацию данных, повышение уровня сжатия и механизм токенизации / full text search по событиям; — Настраивать и сопровождать ClickHouse Keeper / ZooKeeper; — Настраивать TLS/SSL для клиентских подключений и межсерверного взаимодействия; — Разрабатывать и проверять backup/restore и disaster recovery; — Настраивать мониторинг, алерты и дашборды по ClickHouse; — Готовить Ansible playbooks / roles, runbook’и, инструкции, чек-листы и технические отчёты. MariaDB: — Администрировать продуктивные и тестовые инсталляции MariaDB; — контролировать состояние серверов, репликации, соединений, транзакций, блокировок и фоновых процессов; — Настраивать и сопровождать репликацию: master-slave, master-master, GTID-based replication; — Диагностировать replication lag, ошибки SQL thread / IO thread, рассинхронизацию данных и конфликты при master-master-схемах; — Участвовать в миграции MariaDB с master-master-репликации на Galera Cluster; — Настраивать, сопровождать и диагностировать Galera Cluster; — Прорабатывать HA-архитектуру MariaDB: failover, fencing, VIP / proxy layer, split-brain-риски; — Разрабатывать и проверять disaster recovery-сценарии, RPO / RTO и восстановимость резервных копий; — Анализировать производительность: slow queries, EXPLAIN, индексы, locks, deadlocks, buffer pool, connection pool, disk IO; — Оптимизировать конфигурацию MariaDB с учётом нагрузки, объёма данных, RAM, CPU, дисковой подсистемы и сети; — Настраивать TLS/SSL для клиентских подключений и репликации; — Настраивать мониторинг, алерты, дашборды и runbook’и по MariaDB. Production, автоматизация и взаимодействие: — Участвовать в расследовании production-инцидентов, связанных с ClickHouse, MariaDB, Linux, сетью или дисковой подсистемой; — Анализировать метрики, логи, системные таблицы, состояние репликации, блокировки, диски, сеть и конфигурации; — Формулировать технические гипотезы, проверять их и отделять первопричину от сопутствующих факторов; — Готовить технические выводы по итогам инцидентов и участвовать в postmortem-разборах; — Разворачивать тестовые стенды ClickHouse и MariaDB для проверки архитектурных решений; — Проверять обновления, изменение топологии, расширение хранилища, storage policy и параметры ClickHouse / MariaDB до применения в production; — Автоматизировать типовые операции через Ansible / Bash / Python / Terraform или аналогичные инструменты; — Взаимодействовать с заказчиками, объяснять технические риски понятным языком, предлагать решения и лидировать технические обсуждения. Обязательные требования: — Практический опыт промышленной эксплуатации ClickHouse; — Понимание архитектуры ClickHouse: shards, replicas, Distributed tables, ReplicatedMergeTree, MergeTree family; — Опыт диагностики replication queue, merges, mutations, insert/select latency, деградации запросов и проблем с дисковой подсистемой; — Понимание партиционирования, ключей сортировки, TTL, storage policies, disks, volumes, data skipping indexes; — Опыт изменения топологии ClickHouse-кластера или глубокое понимание порядка и рисков таких изменений; — Опыт настройки TLS/SSL для ClickHouse; — Опыт эксплуатации MariaDB в продуктивной или близкой к продуктивной среде; — Понимание MariaDB, InnoDB, транзакций, индексов, блокировок, deadlocks, isolation levels; — Опыт настройки и диагностики репликации MariaDB; — Понимание GTID, binary logs, relay logs, replication lag, failover и рисков master-master-репликации; — Опыт настройки backup/restore MariaDB и проверки восстановимости резервных копий; —Опыт диагностики производительности MariaDB: slow query log, EXPLAIN, индексы, locks, buffer pool, disk IO; — Опыт эксплуатации Linux-серверов; — Понимание влияния CPU, RAM, disk IO, network и filesystem на работу ClickHouse и MariaDB; — Опыт настройки мониторинга и алертов для ClickHouse, MariaDB и инфраструктуры; — Опыт работы с Prometheus, Grafana, Zabbix или аналогичными системами мониторинга; — Опыт автоматизации через Ansible, Bash, Python или аналогичные инструменты; — Умение аккуратно проводить изменения в production: план работ, оценка рисков, rollback-план, проверка результата; — Умение писать техническую документацию: инструкции, runbook’и, чек-листы, postmortem-отчёты. Желательные требования: — Опыт или уверенное понимание Galera Cluster; — Опыт эксплуатации ClickHouse и MariaDB в составе SIEM, SOC, log management, observability, telemetry или других высоконагруженных систем; — Опыт работы с большими объёмами данных: десятки или сотни ТБ; — Опыт работы с ClickHouse Keeper или ZooKeeper; — Опыт эксплуатации ClickHouse / MariaDB на bare metal; — Опыт работы с LUN, DAS, локальными дисковыми массивами и S3-совместимыми объектными хранилищами; — Опыт нагрузочного тестирования ClickHouse и MariaDB; — Опыт построения процедур disaster recovery; — Опыт подготовки архитектурных и эксплуатационных документов для заказчиков; — Опыт работы с ProxySQL, MaxScale, HAProxy, Keepalived, Pacemaker / Corosync или аналогичными решениями; — Опыт проведения регламентных работ с минимальным downtime; — Опыт аудита продуктивных инсталляций у заказчиков. Что важно в кандидате: — Инженерная аккуратность и понимание рисков production-среды; — Умение сначала проверять гипотезы на стенде, а не сразу применять изменения в production; — Способность разбираться в сложных инцидентах на стыке приложения, БД, Linux, сети и дисковой подсистемы; — Клиентоориентированность и зрелая коммуникация; — Дисциплина: приходить на встречи вовремя, готовиться к ним, выполнять договорённости и заранее предупреждать о рисках; — Способность лидировать технические встречи, фиксировать решения и следующие шаги; — Готовность документировать решения и передавать знания команде.

условия

Что предлагаем

Постоянная занятость;
Работа с продуктивной, тестовой и лабораторной инфраструктурой;
Взаимодействие с командой эксплуатации, инженерами SIEM, разработчиками, архитекторами и техническими представителями заказчика;
Участие в планировании изменений, разборе инцидентов и развитии архитектуры хранения данных.
Всегда рады новым талантам и новым успехам наших сотрудников!
навыки

Стек и инструменты

salary intelligence

Зарплата не указана — оценили по рынку

На основе 82 похожих вакансий за 90 дней.

оценка p25–p75
1 652 300 – 3 557 475 ₸
медиана: 2 475 110 ₸
Хотите увидеть распределение по грейдам и городам? Зарплаты DevOps Калькулятор зарплат

Сколько платят вам?

Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как DevOps-инженера — так появится зарплата, которую платят на деле.

Без имени и компании. Отдельные ответы не публикуются.
Вакансии в Telegram-канале
Свежие вакансии Каждый день
Подписаться
??%
Match Score
Войдите и создайте резюме
Войти
Поделиться

Подходит ли вам эта вакансия?

Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть

Создать аккаунт PDF-парсинг резюме за 2 минуты

Ещё в Амбрелла - Защита Информационных Систем

3 активные вакансии в компании

2 нед. назад

Rust-разработчик (ядро потоковой обработки событий SIEM)

~1 528 215 ₸ оценка

Ищем опытного Rust-разработчика для создания ядра потоковой обработки событий SIEM. Нужно разрабатывать движок правил реального времени, работать с stateful-обработкой, Kafka и оптимизацией производительности. Предлагают удалённую работу в аккредитованной IT-компании.

Rust SIEM stream processing +7

География удалёнки не уточнена

senior удал. hh
2 нед. назад

Golang Developer

~1 599 000 – 2 802 750 ₸ оценка

Ищем опытного Go-разработчика для развития SIEM-продукта: нужно будет проектировать и оптимизировать высоконагруженные сервисы обработки телеметрии (NetFlow, IPFIX, Syslog) под Linux. Требуются глубокие знания Go, конкурентности, профилирования и сетевых технологий. Предлагают удалённую работу в аккредитованной IT-компании в сфере информационной безопасности.

Go Linux SIEM +7

География удалёнки не уточнена

senior удал. hh

Похожие вакансии

6 вакансий
DEMIAND
D
DEMIAND
5 ч. назад

DevOps / Infrastructure Engineer (Middle+/Senior)

~2 475 110 ₸ оценка

DEMIAND ищет опытного DevOps/Infrastructure Engineer (Middle+/Senior), который с нуля выстроит инфраструктуру под собственную IoT-платформу и e-commerce: dev/stage/prod-окружения, IaC, CI/CD, контейнеризацию с прицелом на Kubernetes, мониторинг и алертинг. Нужны 3+ года в DevOps/SRE, уверенный Linux, Docker, Terraform/Ansible, CI/CD (GitLab CI/Jenkins/GitHub Actions), скриптинг на Bash/Python и крепкий production-опыт с PostgreSQL — репликация, бэкапы, тюнинг под высокие нагрузки. Предлагают полную удалённую занятость, выплаты дважды в месяц, оплачиваемые отпуска, ДМС после испытательного срока, бонусы и скидки на продукцию компании; зарплата обсуждается на собеседовании.

DevOps SRE Linux +22

География удалёнки не уточнена

senior удал. hh
Miractal
M
Miractal
8 ч. назад

DevOps/SRE инженер дата-платформы

~2 475 110 ₸ оценка

Нужен опытный инженер (от 5 лет в эксплуатации инфраструктуры) для платформенной команды: разворачивать и сопровождать дата-платформу в Kubernetes — Airflow, Spark, объектное хранилище, Iceberg. Основная работа — Helm-чарты, операторы, CI/CD, мониторинг и алертинг на Prometheus/Grafana, IaC на Ansible и Terraform, доступы через SSO, в том числе на on-premise. Требуется крепкий Kubernetes (от 3 лет в проде), Linux, Docker, Python для автоматизации и базовый PostgreSQL. Работа полностью удалённая, график 5/2, зарплата обсуждается индивидуально.

Kubernetes Helm операторы Kubernetes +22

География удалёнки не уточнена

senior удал. hh
Stark Games
S
Stark Games
9 ч. назад

Middle+/Senior DevOps Engineer

~2 475 110 ₸ оценка

Нужен опытный DevOps-инженер в игровую команду Stark Games: поддерживать и развивать инфраструктуру проектов в GCP, Selectel, Hetzner и Proxmox, вести CI/CD на Jenkins и автоматизировать всё через Terraform и Ansible. Ключевые требования — уверенный продакшн-опыт с Linux, Docker и Kubernetes, знание сетей, Nginx/HAProxy, мониторинга и скриптинг на Bash/Python. Взамен предлагают работу с современным стеком, реальное влияние на архитектуру и инфраструктуру, сильную команду и участие в on-call.

Linux Docker Kubernetes +26

География удалёнки не уточнена

senior удал. hh
Amex Development
A
Amex Development
10 ч. назад

DevOps-инженер

~2 475 110 ₸ оценка

Ищем DevOps-инженера с опытом от 7 лет поддерживать и развивать инфраструктуру крупного Big Data-решения на высоконагруженных распределённых системах. Нужны уверенные знания Linux, Kubernetes, Kafka, Cassandra, Hadoop, Greenplum и Ansible, Docker и CI/CD, плюс автоматизация и написание API на Python и bash. Работа удалённая, полная занятость, официальное оформление по ТК РФ, но только с территории России.

DevOps Linux Ubuntu +19

География удалёнки не уточнена

senior удал. hh
ББР Банк
Б
ББР Банк
11 ч. назад

DevOps/MLOps инженер AI-платформы (LLM/VLM, GPU, RAG)

~2 475 110 ₸ оценка

Нужен инженер, который возьмёт на себя инфраструктуру AI-платформы: поднимет серверный, контейнерный и GPU-контур, настроит CI/CD, мониторинг и хранение для LLM/VLM и транскрибации. Ждём опыт DevOps от 3–5 лет, уверенный Python/Bash, Docker, Prometheus/Grafana/Loki/OpenTelemetry и понимание LLM-инференса, RAG и vector databases. Предлагают формат офис/гибрид/удалёнка, ДМС, соцпакет и работу в банковском масштабе.

Python Bash Docker +19

География удалёнки не уточнена

senior удал. hh
Banks Soft Systems
B
Banks Soft Systems
12 ч. назад

Ведущий DevOps специалист

~2 475 110 ₸ оценка

Banks Soft Systems ищет Ведущего DevOps специалиста на удалённый проект сроком 3 месяца. Предстоит строить и поддерживать CI/CD, автоматизировать развёртывание инфраструктуры, настраивать мониторинг, бэкапы и отказоустойчивость, работать в связке с архитекторами и разработчиками. Ждут опыт в DevOps от 5 лет, глубокое знание Linux, Docker/Kubernetes/Helm, Ansible, Kafka, Grafana и CI-инструментов (Jenkins, GitLab CI). Предлагают оформление по ТК РФ, удалёнку, расширенный ДМС, бесплатный английский и технику для работы.

DevOps CI/CD Linux +12

География удалёнки не уточнена

senior удал. hh