Инженер данных (Data Engineer)
Ищем опытного инженера данных для разработки платформы патентной аналитики. Нужно строить пайплайны для больших объёмов данных, использовать Lakehouse-архитектуру и инструменты вроде Spark, Databricks и Kafka. Требуется 4+ года опыта, знание Python и SQL, а также английский на уровне Upper-Intermediate. Компания предлагает гибкий график, оплачиваемый отпуск и образовательный бюджет.
Зарплата не указана — оценили по рынку
На основе 426 похожих вакансий за 90 дней.
Что предстоит делать
<p><strong>О проекте:<br></strong>Это передовое программное обеспечение для патентной аналитики, разработанное для трансформации подхода к оценке объектов интеллектуальной собственности. Интегрируя высококачественные наборы патентных данных с научно обоснованными метриками, оно внедряет подход к оценке патентов, основанный на данных, бросая вызов традиционным субъективным методам, широко используемым в отрасли. Платформа позволяет пользователям получать более глубокое понимание качества патентов, технологической значимости и конкурентного позиционирования, обеспечивая более объективную основу для стратегических решений в области инноваций и управления интеллектуальной собственностью.<strong><br></strong></p><p><strong>Технологический стек: </strong>Python, SQL Server, AWS, Spark (Databricks), Kafka.</p><p><strong>Каким требованиям должен соответствовать кандидат:</strong></p><ul><li>Опыт от 4 лет в создании и оптимизации крупномасштабных платформ данных в облачных средах (AWS/Azure)</li><li>Знание Python и SQL для аналитических задач</li><li>Знакомство с современными Lakehouse / стриминговыми архитектурами и инструментами, такими как Databricks, Kafka, Spark</li><li>Способность преобразовывать бизнес-требования в отказоустойчивые масштабируемые решения для работы с данными и наставлять коллег через код-ревью и продвижение лучших практик</li><li>Уровень английского Upper-Intermediate или выше для эффективного общения в команде</li></ul><p><strong>Желательные навыки:</strong></p><ul><li>Опыт работы с поисковыми технологиями (Elasticsearch, Solr) и сложными моделями данных для IP или судебных разбирательств</li><li>Практический опыт работы с внешними источниками патентных данных (DocDB, Espacenet, USPTO)</li><li>Pandas / PySpark для исследовательского анализа и быстрого прототипирования</li><li>Знание Delta Share, версионирования продуктов данных и фреймворков управления данными</li></ul><p><strong>Обязанности:</strong></p><ul><li>Создание и поддержка конвейеров данных для обработки больших объемов структурированных и неструктурированных данных как в пакетном режиме, так и в реальном времени</li><li>Использование паттернов Lakehouse для объединения возможностей озера данных и хранилища данных для ML-фич и аналитики</li><li>Проектирование API со встроенным отслеживанием происхождения данных (lineage) и контролем доступа для использования в различных бизнес-подразделениях</li><li>Применение практик DataOps для автоматизации тестирования, развертывания, мониторинга и управления жизненным циклом</li><li>Продвижение чистого кода, код-ревью и A/B-тестирования для повышения качества продуктов данных</li><li>Тесное взаимодействие с ML-инженерами, разработчиками и экспертами в предметной области для уточнения требований и решения технических задач</li><li>Отслеживание новых инструментов и трендов в области инженерии данных для улучшения производительности, масштабируемости и опыта разработчиков</li></ul><p><b>Программа льгот:</b></p><ul><li>Оплачиваемый отпуск, оплачиваемые больничные, 10 государственных праздников, дополнительные выходные дни</li><li>Образовательный бюджет и поддержка в получении сертификатов/посещении конференций и т.д.</li><li>Уроки английского языка</li></ul><p><b>Комфортные условия работы:</b></p><ul><li>Гибкий график работы</li><li>Программа амортизации или предоставление необходимого оборудования</li></ul> <div> <a href="https://jobs.dou.ua/companies/binary-studio/vacancies/305811/#reply-btn-id">Відгукнутись на вакансію</a> </div>
Стек и инструменты
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Binary Studio
2 активные вакансии в компании
Full-stack разработчик (Node.js, React)
Ищем full-stack разработчика с опытом 2+ года для работы над медицинской платформой для ортопедической диагностики. Нужно знать Node.js, TypeScript, NestJS, React.js, Next.js, PostgreSQL и Prisma. Предлагают гибкий график, оплачиваемый отпуск, обучение и карьерный рост.
Похожие вакансии
6 вакансийСтарший Data Engineer
~2 641 000 – 3 664 122 ₸ оценка
Ищем старшего Data Engineer с опытом 6+ лет для работы над объединением платформы данных в компании, создающей SaaS-решения для брокеров и торговых фирм. Нужно проектировать и поддерживать пайплайны на PySpark, SQL и Databricks, внедрять CDC, работать с Medallion Architecture и Terraform. Предлагают удалённую работу, медстраховку, 25 дней отпуска и оплату обучения.
Старший Data Engineer
~2 641 000 – 3 664 122 ₸ оценка
Старший Data Engineer для разработки платформы приема и нормализации больших объемов данных для юридической сферы. Нужен сильный Python, опыт с Spark, Kubernetes, Airflow и проектированием надежных ETL-пайплайнов. Компания предлагает удаленную работу, гибкий график и хороший соцпакет.
Старший инженер данных (Kafka, Flink, AWS)
Ищем старшего инженера данных для разработки облачной платформы обработки телеметрии. Нужен опыт с Kafka, Flink, Java, Python, SQL, а также с AWS и Kubernetes. Предлагают удаленную работу, обучение и страховку.
Senior AI Engineer
~2 641 000 – 3 664 122 ₸ оценка
Вакансия для специалиста по AI, который будет проектировать и внедрять решения на основе больших языковых моделей и генеративного ИИ. Требуется опыт работы с LLM и генеративным ИИ, а также умение работать в команде. Предлагается удаленная работа, преимущественно во Франции.
MLOps инженер
~2 641 000 – 3 664 122 ₸ оценка
Ищем MLOps инженера для работы над AI-решениями в крупной американской компании. Вы будете проектировать и внедрять MLOps-архитектуру для моделей компьютерного зрения, автоматизировать пайплайны обучения и развертывания, работать с Python, PyTorch/TensorFlow, Docker, Kubernetes и GCP. Предлагают удаленную работу, конкурентную зарплату и хороший соцпакет.
Старший Data Engineer
~2 641 000 – 3 664 122 ₸ оценка
Ищем старшего инженера данных для создания автоматизированной платформы отчетности и аналитики для платежной компании. Нужно проектировать и строить ELT-пайплайны, интегрируя данные из платежных процессоров, CRM и ERP в облачное хранилище (Snowflake), автоматизировать финансовую отчетность и строить модели данных. Требуется 5+ лет опыта, экспертный SQL, опыт с dbt и оркестраторами. Предлагается полностью удаленная работа, гибкий график и стабильный доход.