IT вакансии в Казахстане
Ищите вакансии и переходите к работодателю без регистрации.
В каталоге 7 872 вакансии из 11 источников
Backend-разработчик платформы инференса ML-моделей
~1 513 800 – 2 746 063 ₸ оценка
Разработка и оптимизация высоконагруженной платформы для инференса ML-моделей на GPU. Требуется опыт от 4 лет в Go или Java/Kotlin, знание Kubernetes и распределённых систем. Предлагается работа в Ozon над инфраструктурой, обслуживающей миллионы пользователей.
Инженер по оптимизации инференса ML-моделей
~1 133 050 ₸ оценка
Вакансия для специалиста по оптимизации инференса ML-моделей. Задачи: исследование и внедрение методов ускорения работы моделей, интеграция и тестирование улучшений в производственной среде. Требуется опыт в ML и оптимизации производительности.
MLOps-инженер
~2 180 480 ₸ оценка
Заниматься платформой для безопасной и надёжной поставки LLM/RAG/агентных решений в production: AI Gateway, инференс, RAG, Agent Runtime, CI/CD и observability. Нужен опыт с GenAI/ML-платформами, Kubernetes, Python, векторными хранилищами и LLM-инференсом. Предлагают работу над GenAIOps-платформой и внедрение современных подходов.
Ведущий ML инженер
~3 129 813 ₸ оценка
Нужен ведущий ML-инженер для продакшн-инференса крупных LLM до 1T параметров: оптимизация распределённого инференса, работа с GPU-кластерами, улучшение latency, throughput, cost и stability. Роль hands-on с техническим лидированием NLP/CV направлений.
MLOps-инженер
~1 133 050 ₸ оценка
Нужен MLOps-инженер в направление модерации Trust & Safety Wildberries — строить и автоматизировать пайплайны обучения и деплоя ML-моделей, развивать Python-сервисы вокруг Nvidia Triton и держать SLA инференс-контура на нагрузке в сотни тысяч RPS. Ждут сильный бэкенд на Python (FastAPI, asyncio, gRPC, Kafka), опыт с Triton или другим model serving, MLOps-платформами вроде ClearML/MLflow/Kubeflow и Kubernetes. Формат — гибрид или удалёнка, работа с DS-командами и масштабирование контура на весь отдел.
MLOps (Инженер LLM-инфраструктуры)
~1 133 050 ₸ оценка
Инженер AI Platform для проектирования и эксплуатации инфраструктуры инференса LLM. Нужен продовый опыт ML/LLM-сервисов, Python, Docker, vLLM/Triton и мониторинг. Предлагают удалёнку или офис в Москве/Калининграде, полную занятость и ДМС.
Зарегистрируйтесь и загрузите резюме — посчитаем % совпадения и пришлём подборку на email
DevOps инженер (Self-hosted AI inference platform)
Актуальность уточняется
~2 005 112 ₸ оценка
Ищем опытного DevOps/SRE инженера для создания и поддержки self-hosted платформы инференса LLM на GPU NVIDIA H100. Нужно 5+ лет опыта с продакшн Kubernetes, опыт с GPU в Kubernetes, сильные навыки Linux и мониторинга. Работа удаленная, распределенная команда, проект на базе Германии, предпочтительно кандидаты из Западной Украины.
Инженер по инфраструктуре LLM / MLOps-инженер
~2 180 480 ₸ оценка
Нужен инженер, который развернёт и будет эксплуатировать корпоративный LLM-сервис в закрытом контуре: серверы инференса vLLM/SGLang на GPU, шлюз LiteLLM с правами доступа и квотами, мониторинг Prometheus/Grafana, а также RAG-слой над кодом и документацией. Ждут реального опыта вывода моделей в прод с пользователями и дежурством, уверенного Linux/Docker/CUDA, инфраструктуры как кода и Python для автоматизации, плюс осторожность с утечками секретов и персональных данных. Предлагают удалёнку, график 5/2, мощный ноутбук, оплату больничных и скидку на английский; зарплата обсуждается по итогам интервью.
Инженер по платформе LLM / AI-сервисам (Platform & LLM Application Engineer)
~2 180 480 ₸ оценка
Нужен опытный Python-инженер в команду, которая держит production-платформу для хостинга LLM и делает прикладные AI-продукты вроде AI Code Assistant и AI Chat. Работа сразу на двух фронтах: платформа (GPU-кластер на Nvidia, высоконагруженный инференс, балансировка запросов, observability, SLA) и продукт (пайплайны с tool/function calling, интеграции с API и legacy-системами, R&D-прототипы). Ждут 5+ лет в Python, крепкий backend с FastAPI, очередями и асинхронностью, плюс практику с vLLM, SGLang и оптимизацией latency/throughput на GPU. Взамен — конкурентная зарплата, гибрид или полная удалёнка, ДМС со стоматологией и страхование семьи, премии за публикации и патентов.
DevOps-инженер (ML/LLM/CV)
Нужен DevOps/SRE/Infra-инженер от 2 лет опыта, который будет строить и поддерживать инфраструктуру для ML-сервисов: облака, Kubernetes, Terraform, CI/CD, GPU-кластеры и MLOps-пайплайны. Важно уверенно владеть Docker, Kubernetes, Terraform, CI/CD, писать скрипты на Bash/Python и понимать, как сопровождать ML-модели от обучения до мониторинга. Работа полностью удалённая, в команде сильных инженеров, на проектах федерального уровня с LLM и CV-инференсом.
MLOps-инженер ИИ-платформы и агентской платформы
~1 133 050 ₸ оценка
Развивать ИИ-платформу «Детского мира»: LLM-гейтвей, RAG, агентные сценарии и собственный инференс на GPU. Нужен MLOps-инженер с production-опытом ML, уверенным Python, Docker/Kubernetes, CI/CD, Kafka/RabbitMQ и пониманием оценки качества LLM и AI-агентов. Предлагают официальное оформление по ТК РФ, гибрид/удалёнку, ДМС, технику и годовой бонус.
Go · Senior · удалённо USD
На основе 20 вакансий за 90 дней
Senior Python Backend Developer (MWS AI)
~1 475 600 ₸ оценка
Нужен сильный Python-бэкендер (опыт от 5 лет) на ключевые и самые нагруженные части платформы AI-агентов: оркестратор диалога на LangGraph, мульти-агентные сценарии, память агентов, RAG-поиск в Milvus и рантайм на Kafka. Требуются экспертный Python с asyncio/FastAPI, опыт высоконагруженных отказоустойчивых сервисов, микросервисы с Kafka и PostgreSQL, а также живой интерес к агентным фреймворкам, MCP и инференсу LLM. Предлагают гибкий график с возможностью полностью удалённой работы по РФ, ДМС с первой недели, сильную команду и обучение за счёт компании.
Подпишись на Telegram
Получай свежие вакансии первым. Никакого спама.
Руководитель отдела ИИ-платформы
~1 603 675 ₸ оценка
Нужен руководитель отдела ИИ-платформы «Детского мира»: развивать платформу с LLM-гейтвеем, RAG, агентными сценариями и своим GPU-инференсом, а также собрать и вести команду из backend-, MLOps- и CV-инженеров (до 5–7 человек). Ждут 4–5+ лет инженерной практики на Python/в ML-инженерии, 1–2 года лидерства, опыт архитектуры и эксплуатации сервисов (SLO, метрики, инциденты). Предлагают оформление по ТК РФ в IT-аккредитованную компанию, оклад плюс годовой бонус, гибрид или удалёнку для кандидатов из РФ, ДМС и внутреннее обучение.
ML инженер по обнаружению движений
Актуальность уточняется
~2 180 480 ₸ оценка
Ищем ML инженера для разработки моделей распознавания упражнений по данным IMU-сенсоров и запуска инференса прямо на мобильных устройствах. Нужен опыт около 5 лет с PyTorch, глубокое обучение на временных рядах и умение работать с ансамблями и edge-ограничениями. Предлагают гибкий график, оплачиваемое обучение и карьерный рост.
ML/DL инженер (Middle/Middle+)
Актуальность уточняется
Удалённая позиция ML/DL инженера уровня Middle/Middle+ (20–40 часов в неделю) для работы над VLM-распознаванием документов и видео, а также LLM-агентами с RAG и tool calling. Нужны от 3 лет коммерческого опыта с Python и PyTorch, понимание трансформеров и мультимодальных архитектур, уверенная работа с HuggingFace, обучение и оптимизация инференса VLM/LLM, Linux и Docker. Предлагают гибкий график, проект с выходом на мировой рынок, сильную команду, почасовую ставку с бонусами и премиями, оплату конференций и поездок.
DevOps/MLOps инженер AI-платформы (LLM/VLM, GPU, RAG)
~2 005 112 ₸ оценка
Нужен инженер, который возьмёт на себя инфраструктуру AI-платформы: поднимет серверный, контейнерный и GPU-контур, настроит CI/CD, мониторинг и хранение для LLM/VLM и транскрибации. Ждём опыт DevOps от 3–5 лет, уверенный Python/Bash, Docker, Prometheus/Grafana/Loki/OpenTelemetry и понимание LLM-инференса, RAG и vector databases. Предлагают формат офис/гибрид/удалёнка, ДМС, соцпакет и работу в банковском масштабе.
ML-инженер (TTS / синтез речи)
~3 129 813 ₸ оценка
Sasha AI ищет ML-инженера, который возглавит направление TTS и будет отвечать за синтез русской речи в телефонных AI-агентах: собственная модель, стриминг, низкая latency, voice cloning и оценка качества по продуктовым метрикам. Нужен опыт от 5 лет в ML (из них 3+ года в TTS/генерации речи), продакшен-модели под нагрузкой, знание нейрокодеков, flow matching и диффузионных подходов, оптимизации инференса на GPU и менторства. Предлагают роль технического лидера с влиянием на архитектуру и продукт, ресурсы для экспериментов и возможность собрать свою команду.
Технический лидер направления Computer Vision
Нужен технический лидер направления Computer Vision для государственной системы видеомониторинга и видеоаналитики: будет проектировать архитектуру AI-решений, вести команду CV-инженеров, делать code review и принимать ключевые технические решения. Ключевые требования — сильный опыт в Computer Vision и Video Analytics, production AI-системы, Python/PyTorch/OpenCV, RTSP, GStreamer, NVIDIA DeepStream, TensorRT, а также Docker и Kubernetes. Предлагают техническое лидерство в масштабном проекте, современный стек (GPU-инференс, Multimodal AI), сильную команду, конкурентную зарплату и полную занятость в офисе в Астане.
Middle ML Engineer TTS
Sasha AI ищет инженера по синтезу речи (TTS) для дообучения и оптимизации голосовых AI-агентов. Нужен опыт в ML от 1 года, уверенный Python/PyTorch, LoRA/QLoRA, работа с данными и инференсом. Предлагают работу над продуктом, который звучит в тысячах звонков, GPU, небольшую команду и возможность вырасти до senior.
Senior C++ разработчик (Core)
Актуальность уточняется
~1 218 870 – 2 284 200 ₸ оценка
Разработка core-сервисов и высоконагруженной распределённой системы видеоаналитики на современном C++ (17+): обработка видеопотоков, инференс нейросетей на CPU/GPU, SDK и системы сборки/деплоя. Нужны сильный C++, многопоточность, Linux, Git и английский для чтения документации; плюсом — опыт с FFmpeg/GStreamer, TensorRT/OpenVINO и k8s. Предлагают ДМС со стоматологией, гибкое начало дня, офис в центре города и культуру People First.
ML инженер
~2 180 480 ₸ оценка
Команде Эвотора нужен ML-инженер, который будет строить мультиагентные AI-системы и продвинутые RAG-пайплайны на базе открытых LLM для автоматизации поддержки, продаж и внутренних процессов. Ждут сильного Python и PyTorch, опыт production RAG, файнтюнинга моделей (LoRA/QLoRA, DPO), агентной оркестрации (LangGraph, AutoGen, CrewAI) и оптимизации инференса (vLLM, SGLang). Предлагают удаленку, оформление по ТК РФ, белую зарплату (обсуждается индивидуально), ДМС, рабочую технику и работу в аккредитованной IT-компании.
Computer Vision Engineer
Ищем Computer Vision Engineer в AI Parking — платформу автоматизации парковок. Нужно развивать модели распознавания номеров и видеонаблюдения за людьми, работать с PyTorch и OpenCV, оптимизировать инференс. Требуется сильный Python и опыт в CV, желательно знание ANPR/OCR. Предлагают гибридный формат в Алматы, зарплату до 1 000 000 KZT и технику от компании.
Python · Middle · удалённо USD
На основе 19 вакансий за 90 дней
AI/ML Engineer в направление «Интеллектуальные решения»
Актуальность уточняется
~2 180 480 ₸ оценка по стеку
Ищем ML/AI-инженера для разработки и вывода в прод LLM-решений: RAG-пайплайны, агентная логика, оптимизация инференса на собственном GPU-кластере. Нужен уверенный Python и 3+ года в ML/AI, опыт с LLM, векторным поиском и оценкой качества. Предлагают работу на своём железе, сильную команду и влияние на архитектурные решения.
Старший Data Scientist в команду Авито Путешествия
Актуальность уточняется
~2 180 480 ₸ оценка
Авито.Путешествия ищет Data Scientist в команду динамического ценообразования: строить ML-системы для промо, скидок и прогнозирования спроса — от постановки задачи до продакшена, с A/B-экспериментами и каузальным инференсом. Нужны 4+ года в Data Science, уверенный Python (sklearn, бустинги, pytorch), сложный SQL, опыт продуктивизации моделей через Docker, Git и CI/CD и понимание экономики маркетплейсов. Предлагают влияние на бизнес, сильную команду и аналитическую культуру, ДМС, бюджет на обучение и работу удалённо или в офисе у метро «Белорусская» в Москве.