Перейти к содержимому

Старший Data Engineer (Databricks, PySpark)

Старший Data Engineer для миграции аналитической платформы с BigQuery на Databricks в международной компании. Нужен опыт с PySpark, Databricks, Delta Lake и облачными технологиями. Предлагается работа над сложными проектами, участие в архитектурных решениях и развитие в Data Engineering.

senior удалённо ~2 893 968 ₸
Языки: English · Upper-Intermediate
salary intelligence

Зарплата не указана — оценили по рынку

На основе 405 похожих вакансий за 90 дней.

оценка p25–p75
1 750 000 – 3 577 997 ₸
медиана: 2 893 968 ₸
Хотите увидеть распределение по грейдам и городам? Зарплаты Data/ML Калькулятор зарплат
Вакансии в Telegram-канале
Свежие вакансии Каждый день
Подписаться
??%
Match Score
Войдите и создайте резюме
Войти
описание

Что предстоит делать

<p>Вы — Senior Data Engineer, увлеченный созданием масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и внесите вклад в модернизацию аналитической экосистемы enterprise-уровня в сфере retail.<br>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупномасштабной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.<br>В Sigma Software мы создаем возможности для непрерывного обучения, технологического роста и значимого инженерного влияния, работая над сложными международными проектами.</p><p><strong>ЗАКАЗЧИК</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность за счет продвинутой аналитики, автоматизации и интеллектуальных стратегий ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>ПРОЕКТ</strong></p><p>Проект сосредоточен на стратегической миграции крупномасштабной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.<br>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Описание вакансии</strong></p><ul><li>Участвовать в миграции крупномасштабной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных, обрабатывающие большие объемы розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Квалификация</strong></p><ul><li>5+ лет профессионального опыта в роли Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и создания современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или аналогичными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Способность эффективно работать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностный профиль</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><p>________________________________________________________________________________</p><p>Вы — Senior Data Engineer, увлеченный построением масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и участвуйте в модернизации аналитической экосистемы enterprise-уровня в сфере retail.</p><p>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.</p><p>В Sigma Software мы создаем возможности для непрерывного обучения, профессионального развития и значимого влияния на инженерные решения во время работы над сложными международными проектами.</p><p><strong>Заказчик</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность благодаря продвинутой аналитике, автоматизации и интеллектуальным стратегиям ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>Проект</strong></p><p>Проект сосредоточен на стратегической миграции крупной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.</p><p>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Обязанности</strong></p><ul><li>Участвовать в миграции крупной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных для обработки больших объемов розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать повышению надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Требования</strong></p><ul><li>5+ лет профессионального опыта на позиции Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и построения современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или подобными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Умение эффективно сотрудничать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностные качества</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><div><a href="https://jobs.dou.ua/companies/sigma-software/vacancies/369285/#reply-btn-id">Откликнуться на вакансию</a></div>

навыки

Стек и инструменты

Поделиться

Подходит ли вам эта вакансия?

Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть

Создать аккаунт PDF-парсинг резюме за 2 минуты

Ещё в Sigma Software

10 активных вакансий в компании

6 д. назад

Старший Java разработчик

Разработка и поддержка высоконагруженной платёжной платформы на Java и Spring Boot в микросервисной архитектуре. Требуется 5+ лет опыта, знание MySQL, Kafka и английского на уровне C1. Предлагают гибридный график в Варшаве и работу в международной iGaming-компании.

Java Spring Boot MySQL +5
senior Варшава dou
1 нед. назад

Middle Full Stack разработчик

~932 160 – 1 864 320 ₸ оценка

Ищем Middle Full Stack разработчика для международного проекта в фармацевтической сфере. Нужно разрабатывать веб-платформу для работы с научными моделями, используя TypeScript, React, Next.js, Node.js, NestJS и другие современные технологии. Требуется опыт от 3 лет, знание микросервисов и английский на уровне Upper-Intermediate.

TypeScript React Next.js +9
middle удал. dou
1 нед. назад

Machine Learning Intern

Ищем мотивированного стажёра в область машинного обучения для работы с современными AI-технологиями, включая Generative AI и LLM. Требуются базовые знания Python, понимание основ ML и опыт с pet-проектами. Предлагают практический опыт, обучение у опытных инженеров и работу в удалённом формате.

Machine Learning AI Generative AI +7
intern удал. dou
1 нед. назад

Интеграционный менеджер (AI-платформа для ритейла)

Компания Sigma Software ищет интеграционного менеджера для проекта по AI-платформе ценообразования для крупных ритейлеров. Вы будете отвечать за технические интеграции с системами клиентов, поддержку качества данных и координацию онбординга. Требуется опыт в интеграциях или data engineering, уверенный SQL и английский на уровне Upper-Intermediate.

Integration SQL Data Engineering +3
middle удал. dou

Похожие вакансии

6 вакансий
МАГНИТ, Розничная сеть
М
МАГНИТ, Розничная сеть
6 ч. назад

Разработчик AI/ Разработчик LLM

~2 683 750 – 3 633 120 ₸ оценка

Вакансия для опытного AI-инженера (3+ лет) — нужно проектировать и развивать LLM-интерфейс к аналитическим данным, строить мульти-шаговых агентов с tool-use и выводить сервисы в прод. Требуются глубокие знания LLM, RAG, SQL и опыт оптимизации latency и стоимости. Работа предполагает взаимодействие с аналитикой и бизнесом.

LLM AI Engineering RAG +13
senior удал. hh
V
Vira Games
11 ч. назад

AI Agent Engineer (Talent Pool)

~2 683 750 – 3 633 120 ₸ оценка

Vira Games — ігрова компанія, що розробляє мобільні ігри, шукає AI-інженера для свого Talent Pool. Роль передбачає створення мультиагентних систем для автоматизації розробки ігор: агентів, які генерують код, арт та виконують задачі в Unity. Потрібен досвід з Unity, C#, Python, LLM та AI-агентами. Компанія пропонує повністю віддалену роботу, бенефіти та вплив на бізнес.

Unity C# Python +6
senior удал. dou
P
Piogroup Software
13 ч. назад

AWS Platform & Data Engineer

~2 683 750 – 3 633 120 ₸ оценка

Ищем опытного инженера для создания облачной платформы на AWS для GenAI-проекта. Нужно проектировать архитектуру, автоматизировать инфраструктуру через Terraform, настраивать безопасность и управлять данными. Требуется глубокое знание AWS (Landing Zones, IAM, SCP) и опыт интеграции данных.

AWS Terraform Data Engineering +4
senior удал. dou
Inventive Retail Group
I
Inventive Retail Group
14 ч. назад

Аналитик performance-маркетинга

~2 683 750 – 3 633 120 ₸ оценка

Аналитик performance-маркетинга в Inventive Retail Group: анализировать эффективность рекламы, оптимизировать бюджеты, проводить A/B-тесты и работать с командой маркетинга. Нужен опыт от 3 лет, уверенный SQL и Python, знание метрик и систем аналитики. Предлагают гибридный формат, ДМС и скидки в магазинах компании.

performance-маркетинг аналитика SQL +8
senior удал. hh
A
Adaptiq
14 ч. назад

Старший AI инженер

~2 683 750 – 3 633 120 ₸ оценка

Старший AI-инженер будет проектировать и внедрять production-системы на базе LLM и автономных агентов для морской аналитической платформы. Нужен опыт 7+ лет в разработке, минимум 1.5 года в AI, Python и облачные технологии. Работа полностью удаленная, с конкурентной оплатой и 20 днями отпуска.

AI LLM RAG +7
senior удал. dou
I
ISsoft Ukraine
14 ч. назад

Инженер данных (Databricks)

Ищем опытного инженера данных для поддержки и развития системы управления клиентами страховой компании. Основной стек: Databricks, SQL, Python, Azure. Требуется 3+ года опыта в data engineering. Предлагают удаленную работу, обучение и гибкий график.

Databricks Unity Catalog Delta Lake +4
senior удал. dou