Перейти к содержимому
S
Sigma Software
Львів
5

Старший Data Engineer (Databricks, PySpark)

Старший Data Engineer для миграции аналитической платформы с BigQuery на Databricks в международной компании. Нужен опыт с PySpark, Databricks, Delta Lake и облачными технологиями. Предлагается работа над сложными проектами, участие в архитектурных решениях и развитие в Data Engineering.

География удалёнки не уточнена

Уточните у работодателя, из каких стран можно работать.

senior удалённо ~1 988 505 ₸
Вакансия опубликована 45 дней назад. Может быть уже неактуальна — рекомендуем уточнить статус у работодателя перед откликом.

Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.

Языки: English · Upper-Intermediate
описание

Что предстоит делать

<p>Вы — Senior Data Engineer, увлеченный созданием масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и внесите вклад в модернизацию аналитической экосистемы enterprise-уровня в сфере retail.<br>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупномасштабной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.<br>В Sigma Software мы создаем возможности для непрерывного обучения, технологического роста и значимого инженерного влияния, работая над сложными международными проектами.</p><p><strong>ЗАКАЗЧИК</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность за счет продвинутой аналитики, автоматизации и интеллектуальных стратегий ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>ПРОЕКТ</strong></p><p>Проект сосредоточен на стратегической миграции крупномасштабной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.<br>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Описание вакансии</strong></p><ul><li>Участвовать в миграции крупномасштабной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных, обрабатывающие большие объемы розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Квалификация</strong></p><ul><li>5+ лет профессионального опыта в роли Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и создания современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или аналогичными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Способность эффективно работать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностный профиль</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><p>________________________________________________________________________________</p><p>Вы — Senior Data Engineer, увлеченный построением масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и участвуйте в модернизации аналитической экосистемы enterprise-уровня в сфере retail.</p><p>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.</p><p>В Sigma Software мы создаем возможности для непрерывного обучения, профессионального развития и значимого влияния на инженерные решения во время работы над сложными международными проектами.</p><p><strong>Заказчик</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность благодаря продвинутой аналитике, автоматизации и интеллектуальным стратегиям ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>Проект</strong></p><p>Проект сосредоточен на стратегической миграции крупной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.</p><p>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Обязанности</strong></p><ul><li>Участвовать в миграции крупной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных для обработки больших объемов розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать повышению надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Требования</strong></p><ul><li>5+ лет профессионального опыта на позиции Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и построения современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или подобными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Умение эффективно сотрудничать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностные качества</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><div><a href="https://jobs.dou.ua/companies/sigma-software/vacancies/369285/#reply-btn-id">Откликнуться на вакансию</a></div>

навыки

Стек и инструменты

salary intelligence

Зарплата не указана — оценили по рынку

На основе 107 похожих вакансий за 90 дней.

оценка p25–p75
1 349 400 – 3 154 525 ₸
медиана: 1 988 505 ₸
Хотите увидеть распределение по грейдам и городам? Зарплаты Data/ML Калькулятор зарплат

Сколько платят вам?

Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как Data/ML-специалиста — так появится зарплата, которую платят на деле.

Без имени и компании. Отдельные ответы не публикуются.
Вакансии в Telegram-канале
Свежие вакансии Каждый день
Подписаться
??%
Match Score
Войдите и создайте резюме
Войти
Поделиться

Подходит ли вам эта вакансия?

Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть

Создать аккаунт PDF-парсинг резюме за 2 минуты

Ещё в Sigma Software

14 активных вакансий в компании

1 д. назад

Principal Java Developer

~2 760 053 ₸ оценка

Sigma Software ищет Principal Java Developer для создания безопасных крупномасштабных цифровых платформ в госсекторе. Нужен опытный инженер с 6+ годами опыта в Java, Spring Boot, микросервисах, Kafka, облачных платформах и участием в presales. Роль включает архитектуру, техническое лидерство, работу с клиентами и запуск проектов.

Java Spring Spring Boot +13

География удалёнки не уточнена

lead удал. dou
1 д. назад

Test Engineer

~519 000 – 1 038 000 ₸ оценка

Ищем Test Engineer для проекта Enterprise Heat — умные климатические решения для дома. Нужно вручную тестировать новую функциональность, вести тест-документацию, работать с баг-трекингом и тесно взаимодействовать с международной командой. Требуется 3+ года опыта в ручном тестировании, английский Upper-Intermediate и свободный украинский. Предлагают работу над масштабным продуктом в сфере IoT и embedded.

Manual Testing QA SDLC +8

География удалёнки не уточнена

middle удал. dou
2 д. назад

Старший/Ведущий DevOps инженер

~3 598 645 ₸ оценка по стеку

Проект по модернизации защищённой инфраструктуры для государственных платформ. Нужен опытный DevOps-инженер, который возьмёт на себя технические решения и будет строить Kubernetes-платформы в облаке с упором на безопасность, Infrastructure as Code и GitOps. Требуется 5+ лет опыта, глубокое знание Kubernetes, Terraform, AWS/Azure и английский Upper-Intermediate. Предлагают работу над значимыми публичными проектами в международной команде.

Kubernetes Terraform AWS +13

География удалёнки не уточнена

lead удал. dou
4 д. назад

Старший Test Engineer

~1 038 000 ₸ оценка

Ищем Senior Test Engineer в проект умных климатических решений для дома. Нужно 5+ лет ручного тестирования, знание SDLC, Agile/Scrum, TestRail/Zephyr и английский Upper-Intermediate. Предлагают работу над крупной новой функциональностью в международной команде.

Manual QA SDLC Agile +11

География удалёнки не уточнена

senior удал. dou

Похожие вакансии

6 вакансий
Salesteq
S
Salesteq
7 ч. назад

Старший инженер по AI-агентам (co-founder level)

~1 988 505 ₸ оценка

Нужен сильный инженер уровня co-founder для построения автономных AI-агентов, которые ведут продажи и сервис автомобилей в дилерских сетях BMW, MINI, Ford, Hyundai и Mercedes-Benz. Предстоит владеть agent runtime целиком: оркестрация, память, интеграции с дилерскими системами, evals и трейсы, архитектурные решения с основателями. Требуется опыт построения AI-систем с нуля, мышление распределёнными системами, работа с LLM как компонентом, контроль стоимости и латентности. Предлагают полную удалёнку, фиксированную зарплату и долю в компании, плоскую иерархию, без митингов и политики, релизы каждую неделю.

AI agents LLM distributed systems +7

География удалёнки не уточнена

senior удал. dj
М
Мамаева Ирина Анатольевна
12 ч. назад

Инженер по алгоритмам наведения и обучения траекториям / RL - Engineer — Trajectory Learning & Guidance

~1 988 505 ₸ оценка

Разработка алгоритмов роевого перехвата БПЛА: обучение мультиагентных RL-политик, графовые нейросети для координации перехватчиков, перенос моделей из симуляции на реальное железо. Нужен опыт 5+ лет в multi-agent systems или swarm robotics, глубокое знание MARL и уверенный Python (PyTorch, JAX, Ray/RLlib) плюс C++. Предлагают удалённую работу, оформление по ТК РФ, современное оборудование и участие в НИОКР по БПЛА и ИИ.

Python PyTorch JAX +19

География удалёнки не уточнена

senior удал. hh
Туту
Т
Туту
12 ч. назад

Python разработчик в команду AI поддержки

~1 988 505 ₸ оценка

Туту ищет Python-разработчика в команду AI поддержки, которая делает ИИ-инструменты для контакт-центра: суфлеры, LLM-ботов и будущих ИИ-агентов. Нужен опыт на Python от 3 лет, FastAPI от года и практика запуска production-решений на LLM, включая RAG, prompt engineering и работу с локальными моделями. Предлагают гибкий формат — офис, гибрид или полная удалёнка, двухнедельные спринты и работу в кросс-функциональной команде.

Python FastAPI LLM +14

География удалёнки не уточнена

senior удал. hh
P
PFP Agency
16 ч. назад

Senior Python Backend розробник (AI/LLM)

~1 988 505 ₸ оценка

Ищем Senior Python Backend разработчика с фокусом на AI/LLM для B2C-приложения в сфере HealthTech/FitnessTech. Нужно проектировать AI-архитектуру, интегрировать LLM (GPT, Gemini, Claude, Llama), настраивать контекст, tool calling, evals и guardrails, оптимизировать latency и стоимость. Требуется 5+ лет в backend-разработке, 2+ года с AI/LLM, глубокое знание Python и FastAPI, опыт запуска AI-функций в production. Предлагают full-time удалённо с гибким графиком, прямую работу с CEO и рост до Lead AI Engineer.

Python FastAPI LangGraph +9

География удалёнки не уточнена

senior удал. dou
N
ncube
19 ч. назад

Старший AI/ML инженер

~1 988 505 ₸ оценка

Ищем старшего AI/ML инженера в новую R&D-команду международной некоммерческой организации, которая развивает технологическую платформу для программ здравоохранения в Африке. Нужно проектировать и выводить в продакшн решения на базе LLM, RAG и агентных систем, а также классический ML для предотвращения рисков и мошенничества. Требуется 5+ лет опыта, сильный Python и SQL, английский Upper-Intermediate. Предлагают удалённую работу, гибкий график, медстраховку и оплачиваемые отпуска.

Python LLM GenAI +12

География удалёнки не уточнена

senior удал. dou
N-iX
N
N-iX
19 ч. назад

MLOps инженер

~1 988 505 ₸ оценка по стеку

Нужен MLOps-инженер для крупного телеком-оператора Азербайджана: строить и автоматизировать пайплайны на Amazon SageMaker и MLflow, разворачивать LLM/SLM через Bedrock, вести AgentOps/LLMOps и голосовые STT/TTS-пайплайны на GPU. Требуется 4+ года опыта в MLOps/DataOps, уверенный Python, Terraform/AWS CDK, Kubernetes и понимание безопасности данных (PII, токенизация). Предлагают удалёнку, конкурентную зарплату, менторство и обучение.

MLOps Amazon SageMaker Amazon Bedrock +21

География удалёнки не уточнена

senior удал. dou