Middle ML Engineer TTS
Sasha AI ищет инженера по синтезу речи (TTS) для дообучения и оптимизации голосовых AI-агентов. Нужен опыт в ML от 1 года, уверенный Python/PyTorch, LoRA/QLoRA, работа с данными и инференсом. Предлагают работу над продуктом, который звучит в тысячах звонков, GPU, небольшую команду и возможность вырасти до senior.
География удалёнки не уточнена
Уточните у работодателя, из каких стран можно работать.
Отклик отправляется на сайте источника. Регистрация в Taylor для перехода не нужна.
Что предстоит делать
Добрый день! Мы — Sasha AI, пионеры в разработке голосовых AI-агентов. Наша платформа позволяет запустить искусственный интеллект, который общается с клиентами по телефону и приносит выручку без операторов. Мы выросли в 5 раз за год, а наша цель на 2026-й — оборот 400 млн ₽. Наша маленькая цель: сделать передовую AI-технологию простой, окупаемой и доступной каждому крупному бизнесу. Наша большая цель — за 10 лет построить монополиста, ассоциирующегося с искусственным интеллектом в России. Голос — первое, что слышит клиент. Если синтез звучит роботом, неправильно ставит ударение или отвечает с задержкой, человек кладёт трубку. Мы ищем инженера, который возьмёт на себя синтез речи в нашем каскаде STT → LLM → TTS: от данных и дообучения до быстрого инференса и мониторинга в продакшене.
- Дообучать современные TTS-модели под русскую диалоговую речь, в первую очередь LLM-based, LoRA/QLoRA, full fine-tuning, выравнивание по предпочтениям (DPO) для естественности звучания.
- Строить пайплайны данных для обучения:
- сбор аудио из реальных звонков и студийных записей;
- очистка, сегментация, выравнивание текста и аудио;
- фильтрация по качеству, автоматическая разметка.
- Развивать фронтенд синтеза: нормализация текста (числа, даты, адреса, телефоны), ударения и омографы, G2P.
- Оптимизировать инференс: квантизация, стриминговый синтез, минимальное время до первого звука, высокая плотность потоков на GPU (vLLM, ONNX, TensorRT).
- Встраивать TTS в каскад: стыковка с LLM (формат ответа, стриминг по токенам), обработка перебиваний, адаптация к телефонному каналу (8 кГц, G.711/Opus).
- Строить наблюдаемость синтеза в продакшене: трейсинг через OpenTelemetry, метрики latency и RTF в Prometheus, дашборды в Grafana, отлов деградаций.
- Выстраивать оценку качества:
- MOS/CMOS-тесты;
- автоматические метрики (UTMOS, CER через ASR, speaker similarity);
- регрессионные прогоны;
- связь с доходимостью разговоров.
- Создавать новые голоса и адаптировать синтез под клиентов (voice cloning).
Что ждём от вас
- Коммерческий опыт от 1 года в ML и дообученные модели, доведённые до продакшена.
- Опыт дообучения трансформерных или LLM-моделей: LoRA/QLoRA, SFT, желательно DPO.
- Уверенный Python, PyTorch, Hugging Face (Transformers, PEFT).
- Опыт квантизации и оптимизации моделей под ограниченные ресурсы и низкую задержку.
- Умение собирать и валидировать датасеты для обучения.
- Понимание, как устроен голосовой каскад STT–LLM–TTS и где в нём теряется время.
- Опыт с Docker, CI/CD, развёртыванием и мониторингом ML-сервисов.
- Желание глубоко погрузиться в синтез речи.
- Будет плюсом
- Опыт работы с TTS-моделями: обучение, дообучение или интеграция в продукт.
- Понимание нейрокодеков (EnCodec, DAC, SNAC, Mimi) и вокодеров (HiFi-GAN, Vocos).
- Базовые знания цифровой обработки сигналов: спектрограммы, mel, частота дискретизации.
- C++ для оптимизации критичных по производительности компонентов, опыт потоковой обработки данных.
- Опыт с Airflow, ClickHouse, Kafka для работы с большими объёмами аудио и метаданных.
- Сильная математическая или физическая база.
Что предлагаем
Стек и инструменты
Зарплата ниже рынка
На 40% ниже медианы Data/ML по 59 вакансиям за 90 дней.
Сколько платят вам?
Вакансии показывают, что обещают работодатели. Анонимно расскажите, сколько получаете вы как Data/ML-специалиста — так появится зарплата, которую платят на деле.
Подходит ли вам эта вакансия?
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения с этой вакансией, подсветим сильные стороны и что стоит подтянуть
Ещё в Sasha AI
2 активные вакансии в компании
ML-инженер (TTS / синтез речи)
~3 606 625 ₸ оценка
Sasha AI ищет ML-инженера, который возглавит направление TTS и будет отвечать за синтез русской речи в телефонных AI-агентах: собственная модель, стриминг, низкая latency, voice cloning и оценка качества по продуктовым метрикам. Нужен опыт от 5 лет в ML (из них 3+ года в TTS/генерации речи), продакшен-модели под нагрузкой, знание нейрокодеков, flow matching и диффузионных подходов, оптимизации инференса на GPU и менторства. Предлагают роль технического лидера с влиянием на архитектуру и продукт, ресурсы для экспериментов и возможность собрать свою команду.
География удалёнки не уточнена
Похожие вакансии
6 вакансий
Data Engineer / Дата инженер / Разработчик API
Нужен Python-инженер данных: разрабатывать API к витринам отчётности, строить и рефакторить пайплайны ETL/ELT, работать с MS SQL, MySQL и PostgreSQL, брокерами сообщений и автоматическим тестированием данных. Основные требования — уверенный SQL, опыт работы с БД и API из Python, плюсом будут RabbitMQ/Kafka/NATS и Docker. Предлагают официальное трудоустройство с полным соцпакетом, наставника на старте, обучение и корпоративную инфраструктуру с фитнесом и SPA.
География удалёнки не уточнена
Инженер
Компания ищет инженера для end-to-end разработки AI-продуктов: код, тесты, интеграции, деплой и демо, а также развитие harness с Claude Code/Codex, автотестами и eval-гейтами в CI. Нужны несколько лет продовой разработки, опыт работы через Claude Code/Codex и вайбкодинг. Предлагают удалёнку, гибкий график, работу напрямую с собственником и оплачиваемое тестовое.
География удалёнки не уточнена
Специалист по аналитике
Аналитик логистических процессов в SUNLIGHT: сбор и обработка данных, расчёт KPI, автоматизация отчётности, анализ складских и транспортных показателей. Нужны опыт от 2 лет, Excel с Power Query, SQL, инструменты визуализации; 1С будет плюсом. Предлагают оформление по ТК РФ, график 5/2, гибрид или удалёнку, ДМС через 6 месяцев.
География удалёнки не уточнена
Аналитик данных
~1 359 150 ₸ оценка
Команда кроссдоменной аналитики ищет аналитика данных, который будет строить оценку качества ML-моделей: разрабатывать дашборды и регулярную отчётность, развивать дерево продуктовых метрик и вести аналитику от поиска источников до отчёта в BI. Нужны уверенные SQL и Python для анализа данных, опыт визуализации в BI, работы с git, Airflow и аналитическими БД. Плюсом будет опыт работы с ML-моделями; работа предполагает тесное взаимодействие с DS-командой и продактами.
География удалёнки не уточнена
Консультант-аналитик SAP BO WEBI
~1 359 150 ₸ оценка
ДКС ищет консультанта-аналитика SAP BO WEBI для сбора требований, разработки аналитических отчётов и поддержки пользователей. Нужен опыт работы с SAP BI/BW/BO/WEBI, чтения ABAP и программирования на VBA/Excel. Предлагают официальное трудоустройство по ТК РФ, полный соцпакет, ДМС, премии и обучение языкам.
География удалёнки не уточнена
Data Engineer
~1 359 150 ₸ оценка
Команда больших данных ищет инженера данных для развития платформы: строить и оптимизировать ETL/ELT-процессы, batch- и streaming-пайплайны, модели данных и хранилище, следить за качеством данных и мониторингом. Нужны уверенные Python и SQL, опыт со Spark, ClickHouse, Hadoop, Kafka, Greenplum, S3, Airflow, Docker/K8s, Linux и Git. Работать можно гибридно или удалённо по договорённости с руководителем.
География удалёнки не уточнена