Старший Data Engineer (Databricks, PySpark)
Старший Data Engineer для миграции аналитической платформы с BigQuery на Databricks в международной компании. Нужен опыт с PySpark, Databricks, Delta Lake и облачными технологиями. Предлагается работа над сложными проектами, участие в архитектурных решениях и развитие в Data Engineering.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
<p>Вы — Senior Data Engineer, увлеченный созданием масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и внесите вклад в модернизацию аналитической экосистемы enterprise-уровня в сфере retail.<br>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупномасштабной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.<br>В Sigma Software мы создаем возможности для непрерывного обучения, технологического роста и значимого инженерного влияния, работая над сложными международными проектами.</p><p><strong>ЗАКАЗЧИК</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность за счет продвинутой аналитики, автоматизации и интеллектуальных стратегий ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>ПРОЕКТ</strong></p><p>Проект сосредоточен на стратегической миграции крупномасштабной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.<br>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Описание вакансии</strong></p><ul><li>Участвовать в миграции крупномасштабной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных, обрабатывающие большие объемы розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Квалификация</strong></p><ul><li>5+ лет профессионального опыта в роли Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и создания современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или аналогичными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Способность эффективно работать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностный профиль</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><p>________________________________________________________________________________</p><p>Вы — Senior Data Engineer, увлеченный построением масштабируемых высокопроизводительных платформ данных и работой с современными Lakehouse-технологиями? Присоединяйтесь к Data Engineering Center of Excellence в Sigma Software и участвуйте в модернизации аналитической экосистемы enterprise-уровня в сфере retail.</p><p>Мы ищем Senior-специалиста с глубокой экспертизой в Databricks, PySpark и cloud data engineering для участия в миграции крупной аналитической платформы с BigQuery на Databricks. Вы будете сотрудничать с международными командами, участвовать в архитектурных решениях и помогать создавать надежные и масштабируемые решения для работы с данными.</p><p>В Sigma Software мы создаем возможности для непрерывного обучения, профессионального развития и значимого влияния на инженерные решения во время работы над сложными международными проектами.</p><p><strong>Заказчик</strong></p><p>Наш заказчик — ведущая компания в сфере retail technology, специализирующаяся на AI-решениях для оптимизации ценообразования для enterprise-ритейлеров. Компания помогает бизнесу повышать прибыльность и конкурентоспособность благодаря продвинутой аналитике, автоматизации и интеллектуальным стратегиям ценообразования. Их платформа сочетает business intelligence со сложными алгоритмами для поддержки решений по ценообразованию, основанных на данных, в глобальных розничных организациях.</p><p><strong>Проект</strong></p><p>Проект сосредоточен на стратегической миграции крупной аналитической платформы с устаревшей экосистемы BigQuery на современную архитектуру Databricks Lakehouse. Платформа обрабатывает большие объемы розничных данных, machine learning workloads, аналитические конвейеры и специфичную для заказчика бизнес-логику.</p><p>В рамках инициативы по модернизации инженерная команда внедряет масштабируемую обработку на основе Spark, архитектуру Delta Lake, медальонные слои данных и современные практики управления. Роль предоставляет возможность работать с распределенными системами обработки данных, оптимизировать крупномасштабные нагрузки и вносить вклад в развитие корпоративной платформы данных.</p><p>Ключевые технологии: Databricks, Apache Spark, PySpark, Delta Lake, Python, SQL, Airflow, GCP, CI/CD, Unity Catalog</p><p><strong>Обязанности</strong></p><ul><li>Участвовать в миграции крупной аналитической платформы с BigQuery на Databricks</li><li>Проектировать и внедрять масштабируемые Lakehouse-архитектуры с использованием Databricks и Delta Lake</li><li>Анализировать существующие ETL / ELT workloads и определять подходы к миграции</li><li>Разрабатывать и оптимизировать конвейеры данных для обработки больших объемов розничных и аналитических данных</li><li>Внедрять стратегии инкрементальной обработки и масштабируемые фреймворки трансформации</li><li>Создавать и поддерживать решения для обработки данных на основе Spark с использованием PySpark</li><li>Проектировать и поддерживать слои медальонной архитектуры, включая Bronze, Silver и Gold</li><li>Внедрять лучшие практики управления данными и безопасности с использованием Unity Catalog</li><li>Сотрудничать с командами Data Science, Analytics, Product и Customer Engineering</li><li>Участвовать в архитектурных обсуждениях и проектировании технических решений</li><li>Разрабатывать переиспользуемые компоненты платформы данных и инженерные стандарты</li><li>Проводить code reviews и способствовать повышению надежности и поддерживаемости платформы</li><li>Устранять неполадки и оптимизировать сложные SQL и Spark workloads</li><li>Поддерживать production-развертывания и мероприятия по модернизации платформы</li></ul><p><strong>Требования</strong></p><ul><li>5+ лет профессионального опыта на позиции Data Engineer</li><li>Сильные навыки программирования на Python и продвинутый SQL</li><li>Практический коммерческий опыт работы с Databricks</li><li>Глубокие знания Apache Spark, преимущественно PySpark</li><li>Опыт проектирования и построения современных облачных платформ данных</li><li>Опыт разработки ETL / ELT конвейеров и решений для крупномасштабной обработки данных</li><li>Практический опыт работы с Delta Lake</li><li>Опыт работы со Spark Declarative Pipelines</li><li>Опыт мониторинга кластеров, анализа метрик и оптимизации производительности</li><li>Глубокое понимание архитектур распределенной обработки данных</li><li>Понимание концепций хранилищ данных и размерного моделирования</li><li>Опыт работы с Airflow или подобными инструментами оркестрации</li><li>Опыт оптимизации сложных аналитических SQL workloads</li><li>Опыт внедрения практик CI / CD для платформ data engineering</li><li>Сильные навыки устранения неполадок и оптимизации производительности</li><li>Умение эффективно сотрудничать в кросс-функциональных международных командах</li><li>Уровень английского — Upper-Intermediate или выше</li></ul><p><strong>Будет плюсом</strong></p><ul><li>Опыт работы с облачными сервисами GCP</li><li>Опыт работы с облачными платформами AWS или Azure</li><li>Опыт в сферах розничной аналитики или оптимизации ценообразования</li><li>Опыт поддержки machine learning или AI-связанных нагрузок данных</li><li>Опыт модернизации платформ и инициатив по облачной миграции</li></ul><p><strong>Личностные качества</strong></p><ul><li>Сильное аналитическое мышление и подход к решению проблем</li><li>Проактивный подход и нацеленность на результат</li><li>Способность работать как самостоятельно, так и в команде</li><li>Хорошие коммуникативные навыки и навыки взаимодействия с заинтересованными сторонами</li><li>Увлеченность масштабируемым data engineering и современными платформами данных</li><li>Интерес к непрерывному обучению и технологическим инновациям</li></ul><div><a href="https://jobs.dou.ua/companies/sigma-software/vacancies/369285/#reply-btn-id">Откликнуться на вакансию</a></div>
Стек и инструменты
Зарплата не указана — оценили по рынку
На основе 107 похожих вакансий за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как Data/ML-специалиста — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Sigma Software
14 активных вакансий в компании
Principal Java Developer
~2 760 053 ₸ оценка
Sigma Software ищет Principal Java Developer для создания безопасных крупномасштабных цифровых платформ в госсекторе. Нужен опытный инженер с 6+ годами опыта в Java, Spring Boot, микросервисах, Kafka, облачных платформах и участием в presales. Роль включает архитектуру, техническое лидерство, работу с клиентами и запуск проектов.
География удалёнки не уточнена
Test Engineer
~519 000 – 1 038 000 ₸ оценка
Ищем Test Engineer для проекта Enterprise Heat — умные климатические решения для дома. Нужно вручную тестировать новую функциональность, вести тест-документацию, работать с баг-трекингом и тесно взаимодействовать с международной командой. Требуется 3+ года опыта в ручном тестировании, английский Upper-Intermediate и свободный украинский. Предлагают работу над масштабным продуктом в сфере IoT и embedded.
География удалёнки не уточнена
Старший/Ведущий DevOps инженер
~3 598 645 ₸ оценка по стеку
Проект по модернизации защищённой инфраструктуры для государственных платформ. Нужен опытный DevOps-инженер, который возьмёт на себя технические решения и будет строить Kubernetes-платформы в облаке с упором на безопасность, Infrastructure as Code и GitOps. Требуется 5+ лет опыта, глубокое знание Kubernetes, Terraform, AWS/Azure и английский Upper-Intermediate. Предлагают работу над значимыми публичными проектами в международной команде.
География удалёнки не уточнена
Старший Test Engineer
~1 038 000 ₸ оценка
Ищем Senior Test Engineer в проект умных климатических решений для дома. Нужно 5+ лет ручного тестирования, знание SDLC, Agile/Scrum, TestRail/Zephyr и английский Upper-Intermediate. Предлагают работу над крупной новой функциональностью в международной команде.
География удалёнки не уточнена
Похожие вакансии
6 вакансийСтарший инженер по AI-агентам (co-founder level)
~1 988 505 ₸ оценка
Нужен сильный инженер уровня co-founder для построения автономных AI-агентов, которые ведут продажи и сервис автомобилей в дилерских сетях BMW, MINI, Ford, Hyundai и Mercedes-Benz. Предстоит владеть agent runtime целиком: оркестрация, память, интеграции с дилерскими системами, evals и трейсы, архитектурные решения с основателями. Требуется опыт построения AI-систем с нуля, мышление распределёнными системами, работа с LLM как компонентом, контроль стоимости и латентности. Предлагают полную удалёнку, фиксированную зарплату и долю в компании, плоскую иерархию, без митингов и политики, релизы каждую неделю.
География удалёнки не уточнена
Инженер по алгоритмам наведения и обучения траекториям / RL - Engineer — Trajectory Learning & Guidance
~1 988 505 ₸ оценка
Разработка алгоритмов роевого перехвата БПЛА: обучение мультиагентных RL-политик, графовые нейросети для координации перехватчиков, перенос моделей из симуляции на реальное железо. Нужен опыт 5+ лет в multi-agent systems или swarm robotics, глубокое знание MARL и уверенный Python (PyTorch, JAX, Ray/RLlib) плюс C++. Предлагают удалённую работу, оформление по ТК РФ, современное оборудование и участие в НИОКР по БПЛА и ИИ.
География удалёнки не уточнена
Python разработчик в команду AI поддержки
~1 988 505 ₸ оценка
Туту ищет Python-разработчика в команду AI поддержки, которая делает ИИ-инструменты для контакт-центра: суфлеры, LLM-ботов и будущих ИИ-агентов. Нужен опыт на Python от 3 лет, FastAPI от года и практика запуска production-решений на LLM, включая RAG, prompt engineering и работу с локальными моделями. Предлагают гибкий формат — офис, гибрид или полная удалёнка, двухнедельные спринты и работу в кросс-функциональной команде.
География удалёнки не уточнена
Senior Python Backend розробник (AI/LLM)
~1 988 505 ₸ оценка
Ищем Senior Python Backend разработчика с фокусом на AI/LLM для B2C-приложения в сфере HealthTech/FitnessTech. Нужно проектировать AI-архитектуру, интегрировать LLM (GPT, Gemini, Claude, Llama), настраивать контекст, tool calling, evals и guardrails, оптимизировать latency и стоимость. Требуется 5+ лет в backend-разработке, 2+ года с AI/LLM, глубокое знание Python и FastAPI, опыт запуска AI-функций в production. Предлагают full-time удалённо с гибким графиком, прямую работу с CEO и рост до Lead AI Engineer.
География удалёнки не уточнена
Старший AI/ML инженер
~1 988 505 ₸ оценка
Ищем старшего AI/ML инженера в новую R&D-команду международной некоммерческой организации, которая развивает технологическую платформу для программ здравоохранения в Африке. Нужно проектировать и выводить в продакшн решения на базе LLM, RAG и агентных систем, а также классический ML для предотвращения рисков и мошенничества. Требуется 5+ лет опыта, сильный Python и SQL, английский Upper-Intermediate. Предлагают удалённую работу, гибкий график, медстраховку и оплачиваемые отпуска.
География удалёнки не уточнена
MLOps инженер
~1 988 505 ₸ оценка по стеку
Нужен MLOps-инженер для крупного телеком-оператора Азербайджана: строить и автоматизировать пайплайны на Amazon SageMaker и MLflow, разворачивать LLM/SLM через Bedrock, вести AgentOps/LLMOps и голосовые STT/TTS-пайплайны на GPU. Требуется 4+ года опыта в MLOps/DataOps, уверенный Python, Terraform/AWS CDK, Kubernetes и понимание безопасности данных (PII, токенизация). Предлагают удалёнку, конкурентную зарплату, менторство и обучение.
География удалёнки не уточнена