Старший Databricks Data Engineer
Крупная IT-компания AgileEngine ищет Senior Data Engineer для модернизации хранилища данных в Databricks Lakehouse. Вы будете строить пайплайны на PySpark и Delta Lake, работать с потоковыми данными и внедрять управление данными. Требуется 4+ года опыта в data-инженерии, уверенный Spark и SQL, а также английский на уровне Upper-Intermediate. Предлагают удалённую работу, гибкий график и конкурентную зарплату в USD.
Зарплата не указана — оценили по рынку
На основе 113 похожих вакансий за 90 дней.
Что предстоит делать
<p>Привет! AgileEngine — компания из списка Inc. 5000, которая создает отмеченное наградами программное обеспечение для брендов из списка Fortune 500 и стартапов-первопроходцев в более чем 17 отраслях. Мы входим в число лидеров в таких областях, как разработка приложений и AI/ML, а наша культура, ориентированная на людей, принесла нам множество наград «Лучшее место для работы».</p> <p><strong>Почему стоит присоединиться к нам</strong><br>Если вы ищете место, где можно расти, оказывать влияние и работать с людьми, которым не все равно, мы будем рады познакомиться с вами! :)</p> <p><strong>О роли</strong><br>Мы ищем опытного <strong>Senior Databricks Data Engineer</strong>, который поможет модернизировать 15-летнее хранилище данных в управляемое Databricks Lakehouse. Вы будете создавать пакетные и потоковые конвейеры с помощью PySpark и Delta Lake, следуя медальонной архитектуре на уровнях bronze, silver и gold. Эта роль также предполагает использование AI-инструментов, таких как Claude и GitHub Copilot, для ускорения разработки.</p> <p><strong>Чем вы будете заниматься</strong><br>● Проектировать, создавать и эксплуатировать пакетные и потоковые конвейеры данных на Databricks с использованием PySpark, Delta Lake и Databricks Workflows.<br>● Моделировать и поддерживать медальонную (bronze/silver/gold) архитектуру, обслуживающую потребителей аналитики, отчетности и машинного обучения.<br>● Мигрировать устаревшие ETL и рабочие нагрузки хранилищ данных в Lakehouse с подтвержденным паритетом данных и минимальными сбоями в работе бизнеса.<br>● Использовать Claude или Github Copilot как ускоритель разработки: генерировать каркас кода, писать и проверять тесты, создавать документацию и прототипы решений.<br>● Писать чистый, хорошо протестированный код на Python и SQL; поддерживать высокие стандарты посредством проверки кода и документации.<br>● Оптимизировать Spark-задачи и Delta-таблицы для производительности и стоимости, включая партиционирование, кластеризацию, кэширование и выбор размера кластера.<br>● Внедрять контроль качества данных, происхождения и управления с помощью Unity Catalog и автоматизированных проверок валидации.<br>● Отлаживать, устранять неполадки и решать проблемы сбоев конвейеров, дефектов данных и инцидентов в продакшене.<br>● Участвовать в Agile или продукто-ориентированных практиках поставки, включая планирование спринтов и ретроспективы.<br>● Сотрудничать с DevOps, платформенными и аналитическими инженерами по вопросам наблюдаемости, безопасности и лучших практик соответствия требованиям.</p> <p><strong>Обязательные требования</strong><br>● <strong>4+ года профессионального опыта</strong> в инженерии данных с непосредственным опытом работы с <strong>Apache Spark</strong> и облачными архитектурами данных.<br>● Сильный практический опыт создания конвейеров данных с помощью <strong>Databricks</strong>, <strong>Apache Spark (PySpark)</strong> и <strong>Delta Lake</strong>.<br>● Продвинутые <strong>SQL</strong> и <strong>Python</strong>, с сильными навыками моделирования данных в различных измерениях и паттернах Lakehouse.<br>● Опыт потоковой загрузки с использованием <strong>Structured Streaming</strong>, <strong>Auto Loader</strong>, <strong>Kafka</strong> или <strong>Event Hubs</strong>.<br>● Опыт оркестрации рабочих процессов (<strong>Databricks Workflows</strong>, <strong>Airflow</strong> или <strong>Azure Data Factory</strong>).<br>● Опыт миграции устаревших платформ, модернизации ETL или управления гигиеной данных при переносе старых систем.<br>● Отличные навыки решения проблем, сотрудничества и коммуникации, включая наставничество младших инженеров и объяснение концепций данных нетехническим заинтересованным сторонам.<br>● Знакомство с <strong>Unity Catalog</strong>, управлением данными, контролем доступа и обработкой PII.<br>● Опыт работы с <strong>dbt</strong> или эквивалентным фреймворком трансформации.<br>● Знакомство со стандартами безопасного кодирования и отраслевыми лучшими практиками безопасности.<br>● Опыт поставки производственных платформ данных в масштабе.<br>● Уровень английского Upper-intermediate.</p> <p><strong>Желательно</strong><br>● Опыт работы с Infrastructure as Code (IaC) с использованием <strong>Terraform</strong> и CI/CD с использованием <strong>Azure DevOps</strong>.<br>● Опыт работы с реляционными базами данных (особенно <strong>PostgreSQL</strong>) и концепциями хранения данных.<br>● Знакомство с инструментами логирования и мониторинга (например, Dynatrace, CloudWatch, системные таблицы Databricks).<br>● Предпочтителен опыт работы в Agile или командной среде разработки.</p> <p><strong>Преимущества и бонусы</strong><br><span style="color: #EC9301;">● </span>Профессиональный рост: ускорьте свой профессиональный путь с помощью наставничества, TechTalks и персонализированных карт роста<br><span style="color: #EC9301;">● </span>Конкурентоспособная компенсация: мы соответствуем вашим постоянно растущим навыкам, таланту и вкладу конкурентоспособной компенсацией в USD и бюджетами на образование, фитнес и командные мероприятия<br><span style="color: #EC9301;">● </span>Выбор интересных проектов: присоединяйтесь к проектам с разработкой современных решений и клиентами высшего уровня, включая предприятия из списка Fortune 500 и ведущие продуктовые бренды<br><span style="color: #EC9301;">● </span>Гибкий график: настройте свой график для оптимального баланса между работой и личной жизнью, имея возможность работать из дома и приходить в офис — что делает вас счастливее и продуктивнее.</p> <p><strong>Познакомьтесь с нашим процессом найма</strong><br><strong>Асинхронный этап</strong> — Автоматизированный трек в вашем темпе, который помогает нам двигаться быстрее и давать вам более быструю обратную связь:<br>● Короткая онлайн-форма для подтверждения основных требований<br>● Оценка навыков на <nobr>30–60</nobr> минут<br>● <nobr>5-минутное</nobr> вступительное видео<br><strong>Синхронный этап</strong> — Живые интервью<br>● Техническое интервью с нашей инженерной командой (назначается в удобное для вас время)<br>● Финальное интервью с вашими будущими коллегами<br><strong>Если все совпало — вы получите оффер!</strong></p> <div> <a href="https://jobs.dou.ua/companies/agileengine/vacancies/371472/#reply-btn-id">Відгукнутись на вакансію</a> </div>
Стек и инструменты
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в AgileEngine
10 активных вакансий в компании
Middle Data Engineer
~2 011 917 ₸ оценка
Ищем Middle Data Engineer для модернизации хранилища данных в Databricks Lakehouse. Нужно строить пайплайны на PySpark и Delta Lake, работать с потоковыми данными и мигрировать легаси-ETL. Требуется 3+ года опыта, знание Spark, SQL, Python, Databricks. Предлагают удаленную работу, гибкий график и конкурентную зарплату в USD.
Продуктовый архитектор
~1 488 245 ₸ оценка
Компания AgileEngine ищет продуктового архитектора с опытом 6+ лет, который будет проектировать архитектуру продуктов, внедрять лучшие практики и работать с продуктовой командой. Требуются PHP, MySQL, JavaScript и знание TestRail. Предлагают удаленную работу, гибкий график и оплату в долларах.
Full Stack разработчик (LLM)
~1 291 638 ₸ оценка
Full Stack разработчик в AgileEngine: создание AI-функций на базе LLM, разработка React-компонентов и Python-бэкенда. Требуется опыт с LLM, React и Python от 1 года. Компания предлагает удаленную работу, гибкий график и конкурентную оплату в USD.
Старший инженер по качеству
~1 217 250 ₸ оценка
AgileEngine ищет старшего инженера по качеству для интеграции тестирования в процесс разработки. Вы будете создавать автоматизированные тесты, оптимизировать стратегию тестирования и использовать AI-инструменты. Требуется 4+ года опыта и уверенный английский.
Похожие вакансии
6 вакансий
Портфельный Аналитик
~2 891 204 ₸ оценка
Финтех-компания WIAM ищет опытного портфельного аналитика для работы с кредитными продуктами на международных рынках. Нужно анализировать метрики риска, оптимизировать портфель и взаимодействовать с Data Science командой. Требуется 3+ года опыта, уверенный SQL и базовый Python. Предлагают удаленку или гибрид в Москве.
Старший Data Scientist
~2 891 204 ₸ оценка по стеку
Ищем опытного Data Scientist для работы с клиентами над AI/ML проектами на AWS. Нужно будет самостоятельно вести проекты от анализа данных до продакшена, выбирать подходящие технические решения (классический ML, GenAI, RAG и др.) и внедрять их. Требуется 5+ лет опыта, сильный Python, PyTorch/TensorFlow, AWS SageMaker и Bedrock. Компания предлагает международную среду, оплату сертификаций и обучение.
AWS AI Solution Architect
~2 891 204 ₸ оценка по стеку
Проектируете и внедряете ИИ-решения на AWS: агентные системы, RAG, интеграции с корпоративными сервисами. Нужен опыт с Amazon Bedrock, LangGraph/LangChain и 3+ года в AI/ML. Предлагают долгосрочный контракт, удаленку или работу в Канаде, обучение и карьерный рост.
Ведущий аналитик больших данных
~2 891 204 ₸ оценка
Ведущий аналитик больших данных в IT-компании, занимающейся мониторингом молодёжной среды. Нужно координировать сбор и очистку данных, писать сложные SQL-запросы, внедрять продвинутые методы анализа, обучать аналитиков. Требуется опыт от 4 лет, знание SQL, Python и статистики. Предлагают удалённый/гибридный формат, официальное трудоустройство и развитие за счёт компании.
Старший инженер машинного обучения (LLM)
Ищем старшего инженера машинного обучения с опытом работы с большими языковыми моделями. Требуется знание Python, машинного обучения и Docker. Предлагается удаленная работа в международной компании deepsense.ai.
Аналитик данных
Ищем старшего аналитика данных для работы с Python, pandas и NumPy. Компания Link Group предлагает удаленный формат работы. Задачи будут связаны с обработкой и анализом данных.