Инженер данных (Data Engineer)
Ищем опытного инженера данных для разработки платформы патентной аналитики. Нужно строить пайплайны для больших объёмов данных, использовать Lakehouse-архитектуру и инструменты вроде Spark, Databricks и Kafka. Требуется 4+ года опыта, знание Python и SQL, а также английский на уровне Upper-Intermediate. Компания предлагает гибкий график, оплачиваемый отпуск и образовательный бюджет.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
<p><strong>О проекте:<br></strong>Это передовое программное обеспечение для патентной аналитики, разработанное для трансформации подхода к оценке объектов интеллектуальной собственности. Интегрируя высококачественные наборы патентных данных с научно обоснованными метриками, оно внедряет подход к оценке патентов, основанный на данных, бросая вызов традиционным субъективным методам, широко используемым в отрасли. Платформа позволяет пользователям получать более глубокое понимание качества патентов, технологической значимости и конкурентного позиционирования, обеспечивая более объективную основу для стратегических решений в области инноваций и управления интеллектуальной собственностью.<strong><br></strong></p><p><strong>Технологический стек: </strong>Python, SQL Server, AWS, Spark (Databricks), Kafka.</p><p><strong>Каким требованиям должен соответствовать кандидат:</strong></p><ul><li>Опыт от 4 лет в создании и оптимизации крупномасштабных платформ данных в облачных средах (AWS/Azure)</li><li>Знание Python и SQL для аналитических задач</li><li>Знакомство с современными Lakehouse / стриминговыми архитектурами и инструментами, такими как Databricks, Kafka, Spark</li><li>Способность преобразовывать бизнес-требования в отказоустойчивые масштабируемые решения для работы с данными и наставлять коллег через код-ревью и продвижение лучших практик</li><li>Уровень английского Upper-Intermediate или выше для эффективного общения в команде</li></ul><p><strong>Желательные навыки:</strong></p><ul><li>Опыт работы с поисковыми технологиями (Elasticsearch, Solr) и сложными моделями данных для IP или судебных разбирательств</li><li>Практический опыт работы с внешними источниками патентных данных (DocDB, Espacenet, USPTO)</li><li>Pandas / PySpark для исследовательского анализа и быстрого прототипирования</li><li>Знание Delta Share, версионирования продуктов данных и фреймворков управления данными</li></ul><p><strong>Обязанности:</strong></p><ul><li>Создание и поддержка конвейеров данных для обработки больших объемов структурированных и неструктурированных данных как в пакетном режиме, так и в реальном времени</li><li>Использование паттернов Lakehouse для объединения возможностей озера данных и хранилища данных для ML-фич и аналитики</li><li>Проектирование API со встроенным отслеживанием происхождения данных (lineage) и контролем доступа для использования в различных бизнес-подразделениях</li><li>Применение практик DataOps для автоматизации тестирования, развертывания, мониторинга и управления жизненным циклом</li><li>Продвижение чистого кода, код-ревью и A/B-тестирования для повышения качества продуктов данных</li><li>Тесное взаимодействие с ML-инженерами, разработчиками и экспертами в предметной области для уточнения требований и решения технических задач</li><li>Отслеживание новых инструментов и трендов в области инженерии данных для улучшения производительности, масштабируемости и опыта разработчиков</li></ul><p><b>Программа льгот:</b></p><ul><li>Оплачиваемый отпуск, оплачиваемые больничные, 10 государственных праздников, дополнительные выходные дни</li><li>Образовательный бюджет и поддержка в получении сертификатов/посещении конференций и т.д.</li><li>Уроки английского языка</li></ul><p><b>Комфортные условия работы:</b></p><ul><li>Гибкий график работы</li><li>Программа амортизации или предоставление необходимого оборудования</li></ul> <div> <a href="https://jobs.dou.ua/companies/binary-studio/vacancies/305811/#reply-btn-id">Відгукнутись на вакансію</a> </div>
Стек и инструменты
Зарплата не указана — оценили по рынку
На основе 104 похожих вакансий за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как Data/ML-специалиста — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Binary Studio
2 активные вакансии в компании
Fullstack разработчик (TypeScript, React, Node.js)
Актуальность уточняется
~975 000 ₸ оценка по стеку
Fullstack разработчик для HealthTech платформы в Великобритании. Нужно 2+ года опыта с TypeScript, React, Node.js и SQL. Работа над мобильным опытом и e-commerce. Предлагают удалённую работу, оплачиваемый отпуск и образовательный бюджет.
География удалёнки не уточнена
Похожие вакансии
6 вакансий
Python-разработчик AI-агентов
~2 043 187 ₸ оценка
Разработка AI-агентов для аналитической платформы DSA: проектирование агентов на естественном языке, создание MCP-сервера для ClickHouse, оптимизация запросов и оценка качества моделей. Требуется 3+ года коммерческой разработки на Python, опыт с LLM API, ClickHouse и PostgreSQL. Предлагают удалённую работу или офис, оформление по ТК РФ и возможность влиять на архитектуру AI-решений с нуля.
География удалёнки не уточнена
Инженер / Архитектор NVIDIA AI Enterprise
~2 043 187 ₸ оценка по стеку
Нужен инженер или архитектор для внедрения и эксплуатации платформы NVIDIA AI Enterprise: развёртывание на GPU-серверах, в VMware и облаках, запуск генеративных AI-сервисов (NIM, RAG, агенты) и MLOps. Требуется 5+ лет в ML/MLOps (для архитектора 8+), уверенный Kubernetes, Linux, VMware и Python. Работа полностью удалённая, full-time, с возможностью командировок за рубеж.
География удалёнки не уточнена
NLP инженер-консультант
~2 043 187 ₸ оценка по стеку
Valkyria — украинская оборонная IT-компания, разрабатывающая AI-решения для DefTech. Ищем NLP-инженера-консультанта для создания моделей классификации, NER, извлечения информации и суммаризации на многоязычных текстах, включая шумные источники и радиоперехваты. Нужен опыт в MilTech/Defense, 3+ года в NLP/ML, сильный Python (PyTorch, Hugging Face, spaCy) и английский Upper-Intermediate. Предлагают работу над критичными для обороны задачами, гибкий формат и конкурентную оплату.
География удалёнки не уточнена
LLM инженер-консультант
~2 043 187 ₸ оценка по стеку
Valkyria — оборонная IT-компания из Украины, разрабатывающая AI-решения для DefTech. Нужен LLM-инженер-консультант для создания систем на базе больших языковых моделей: RAG-пайплайны, агенты, извлечение структурированной информации, файнтюнинг open-source LLM и деплой в защищённых on-premise и air-gapped средах. Требуется опыт в MilTech/Defense, 3+ года в ML/NLP, 1+ год с LLM, сильный Python, PyTorch, Hugging Face, опыт с RAG и файнтюнингом (LoRA/QLoRA, SFT), английский Upper-Intermediate. Предлагают работу над mission-critical оборонными технологиями, гибкий формат и конкурентную оплату.
География удалёнки не уточнена
Старший ML Platform/Ops инженер
~2 043 187 ₸ оценка по стеку
Preply ищет старшего ML Platform/Ops инженера для построения надёжных ML-пайплайнов и инфраструктуры. Нужен опыт 5+ лет в продакшн-ML, Python, SQL, Airflow, Kubernetes, облака (GCP/AWS), Terraform, а также знакомство с LLM и GenAI. Предлагают конкурентный пакет с equity, бюджет на обучение и возможность влиять на будущее образования в глобальном масштабе.
География удалёнки не уточнена
AI Engineer (Agentic Systems)
~2 043 187 ₸ оценка по стеку
Andersen ищет AI-инженера для проекта глобальной финтех- и трейдинговой платформы. Нужно проектировать и запускать LLM-агентов в продакшене, строить MCP-серверы, RAG и управление памятью, а также настраивать оценку и мониторинг агентов. Требуется 6+ лет опыта в IT, глубокое знание Amazon Bedrock или Azure AI Foundry, агентных фреймворков и английский от Upper-Intermediate. Предлагают полностью удалённую работу, бонусы до 1000 EUR в месяц, обучение и компенсацию сертификаций.
География удалёнки не уточнена