институт исследования нейросетей и робототехники

Инженер-программист по разработке решений на базе языковых моделей (LLM Engineer)

Мы создаём прикладные продукты на базе больших языковых моделей (LLM) для узких задач в медицине, автоматизации, робототехнике и других отраслях. Наши решения — это программы-функции, чат-боты, ассистенты и агенты, которые решают конкретны…

институт исследования нейросетей и робототехники · На сервисе с: 23.09.26 10:19

до 120k ₽РоссияХабаровскОфис

-О проекте:

Мы создаём прикладные продукты на базе больших языковых моделей (LLM) для узких задач в медицине, автоматизации, робототехнике и других отраслях. Наши решения — это программы-функции, чат-боты, ассистенты и агенты, которые решают конкретные бизнес-задачи. Мы развертываем собственные серверы с открытыми LLM и активно экспериментируем с новыми моделями.

-Обязанности:

1.Разработка прикладных решений на базе LLM: чат-боты, голосовые ассистенты, агенты, программные функции (function calling, tool use).

2.Развертывание и поддержка собственных серверов с LLM (Llama, Mistral, Qwen, DeepSeek и др.) на GPU-оборудовании.

3.Построение RAG-пайплайнов: подготовка данных, эмбеддинги, векторные базы, поиск и генерация ответов.

4.Интеграция LLM в микросервисы (FastAPI), CRM, медицинские системы, системы автоматизации и робототехнические комплексы.

5.Prompt engineering, fine-tuning (LoRA, QLoRA), оценка качества и безопасности моделей.

6.Оптимизация inference: квантизация, vLLM, TGI, llama.cpp, TensorRT-LLM.

7.Работа с медицинскими и персональными данными с соблюдением требований конфиденциальности.

-Требования:

1.Опыт программирования на Python от 2 лет.

2.Практический опыт работы с LLM: OpenAI API, Hugging Face, LangChain, LlamaIndex или аналоги.

3.Понимание архитектуры Transformer, RAG, агентов, function calling.

4.Опыт развертывания LLM на собственных серверах (Linux, Docker, GPU).

5.Знание FastAPI, REST API, асинхронного программирования.

6.Опыт работы с векторными БД (Qdrant, Chroma, FAISS, Milvus).

7.Понимание методов fine-tuning и оценки моделей.

-Будет преимуществом:

1.Опыт в медицине (обработка медицинских текстов, NLP), автоматизации, робототехнике.

2.Знание Kubernetes, CI/CD, MLOps/LLMOps.

3.Опыт с мультимодальными моделями.

4.Английский язык для чтения технической документации и научных статей.

-Условия:

*Современный офис и оборудованная лаборатория.

*Доступ к GPU-серверам и необходимым инструментам.

*Работа над технически сложными и высоко инновационными проектами.

*Возможность влиять на архитектуру продуктов и принимать инженерные решения.

*Профессиональный рост: обучение, эксперименты с новыми моделями и оптимизацией.

Похожие вакансии AI инженер

hh.ru
Зарплата не указанаРоссияМоскваОфис

Мы формируем ядро команды, которая создает с нуля экосистему интеллектуальных агентов для автоматизации бизнес-процессов. Нам нужен универсальный специалист, способный вести фичи от проектирования базы данных до реализации сложного интерактивного интерфейса.

Наша цель - разработка готовых решений «под ключ». Вы будете работать на стыке бэкенда, машинного обучения и фронтенда, напрямую влияя на то, как тысячи сотрудников банка взаимодействуют с новыми инструментами оптимизации.

Обязанности

В твои задачи будет входить:

  • end-to-end разработка компонентов
  • прототипирование агентов
  • интеграция ML-моделей в приложение
  • техническая поддержка
  • быстрые фиксы.

Требования

От кандидата мы ожидаем:

  • образование высшее
  • опыт коммерческой fullstack-разработки от 4 лет
  • уверенное владение Python, опыт работы с классическими фреймворками (FastAPI, Django или Flask).
  • глубокое понимание PostgreSQL (индексы, оптимизация запросов, транзакции)
  • сильные знания нативного JavaScript (обязательно) и современного TypeScript, опыт работы с одним из популярных фреймворков (React, Vue.js или Angular)
  • практический опыт интеграции с внешними сервисами по API (REST, gRPC) и навыки проектирования собственных эндпоинтов
  • понимание принципов UI/UX для создания удобных внутренних инструментов.

Будет большим плюсом:

  • опыт создания AI-агентов и использования их в работе
  • опыт работы с PyTorch, TensorFlow или другими библиотеками ML (как минимум - умение интегрировать модели в продакшен
  • опыт работы в банковской сфере, финтехе или крупных энтерпрайз-проектах
  • знание Docker, Kubernetes и основ инфраструктуры для деплоя fullstack-приложений.

Условия

Мы предлагаем:

  • офис по адресу ш Варшавское (Бизнес-центр Чайка Плаза)
  • гибридный формат работы
  • ежегодный пересмотр зарплаты
  • корпоративный спортзал и зоны отдыха
  • более 400 образовательных программ СберУниверситета для профессионального и карьерного развития
  • программа адаптации и помощь руководителя на старте (для Junior позиций)
  • расширенный ДМС, льготное страхование для семьи и корпоративная пенсионная программа
  • гибкий дисконт по ипотечному кредиту, равный 1/3 ключевой ставки ЦБ
  • подписка СберПрайм с возможностью совместного использования на трёх близких
  • вознаграждение за рекомендацию друзей в команду Сбера.
hh.ru
народный банк казахстана. it

Middle AI Engineer

народный банк казахстана. itНа сервисе с: 24.09.26 16:44
Зарплата не указанаКазахстанАлматыОфис

Halyk Банк – это мощная экосистема, где технологии сочетаются с ценностями.
Мы гордимся более чем 14 000 работниками, которые делают нас лучшим местом работы. Мы предоставляем услуги во всех сегментах финансового рынка: банковском, страховом, лизинговом и т.д.
Мы стремимся стать ведущим цифровым банком, внедряя инновации и предоставляя возможности для роста и развития.
Мы ищем талантливых специалистов, готовых развиваться вместе с нами!

Обязанности:

  • Разработка и внедрение LLM/VLM-решений для бизнес-задач компании;
  • Проектирование и построение RAG-пайплайнов для работы с корпоративными данными Разработка и оптимизация мульти-агентных систем на базе LangGraph и LangChain Настройка и обслуживание инференс-серверов (vLLM, TGI, TensorRT-LLM) Fine-tuning моделей (LoRA, QLoRA, RLHF, DPO) под специфические задачи;
  • Разработка REST API на FastAPI для интеграции ML-сервисов в продукт;
  • Контейнеризация и деплой ML-сервисов с помощью Docker и Kubernetes;
  • Оптимизация производительности моделей: квантизация, батчинг, управление GPU-памятью;
  • Проектирование и поддержка векторных баз данных для хранения эмбеддингов;
  • Написание и поддержка автоматических тестов для ML-пайплайнов;
  • Мониторинг качества моделей в продакшене (LangSmith, OpenTelemetry);
  • Проведение бенчмарков и A/B-тестов для сравнения моделей и подходов;
  • Работа с GPU-инфраструктурой: настройка multi-GPU, распределённое обучение
  • Подготовка и очистка данных для обучения и оценки моделей;
  • Исследование и внедрение новых моделей, техник и фреймворков;
  • Написание технической документации и ADR (Architecture Decision Records);
  • Участие в код-ревью и менторинг младших специалистов;
  • Взаимодействие с продуктовой командой для определения требований и приоритетов;
  • Оптимизация стоимости облачной GPU-инфраструктуры;
  • Обеспечение безопасности и надёжности ML-сервисов в продакшене.

Требования:

  • Python;
  • Python 3.10+ (async/await, type hints, dataclasses). SOLID, Clean Architecture, DI. pytest + mocks, Ruff/Black/MyPy, Poetry/uv, Git & CI/CD;
  • LLM / VLM
  • Transformer (attention, KV-cache).
    Модели: GPT-4, LLaMA 3, Mistral, Qwen, LLaVA, GPT-4o.
    Fine-tuning: LoRA/QLoRA, PEFT, RLHF, DPO.
    Prompting: CoT, ReAct, Few-shot. Evaluation: LLM-as-judge, perplexity. Tokenization (tiktoken);
  • LangChain & LangGraph
    LangChain (LCEL, Agents, Tools, Memory), LangGraph (multi-agent graphs), RAG-пайплайны, Vector DB (Chroma, Pinecone, Qdrant, pgvector), LangSmith;
  • Инференс
    vLLM (PagedAttention, continuous batching), Quantization (GPTQ, AWQ, GGUF), Serving (vLLM, TGI, TensorRT-LLM), OpenAI-compatible API.
    PyTorch & DL
    PyTorch, Hugging Face (Transformers, PEFT, TRL), Distributed (DDP, FSDP, DeepSpeed), BF16/FP16.
    GPU & Инфраструктура
    NVIDIA (H100, A100, RTX 4090), multi-GPU parallelism, Cloud (AWS/GCP/RunPod), мониторинг nvidia-smi;
  • Backend
    FastAPI, Pydantic v2, async (asyncio, httpx), WebSockets/SSE, JWT.
    DevOps
    Docker (GPU), Docker Compose, Kubernetes basics, GitHub Actions, Prometheus/Grafana;
  • Хранилища
    PostgreSQL + pgvector, Redis, S3, Vector DBs, Kafka/RabbitMQ.
    Nice to Have
    CrewAI, AutoGen, MLflow/W&B, Airflow, Streamlit/Gradio.
  • Уровни опыта:
    Junior: Python, PyTorch, LangChain, Docker
    Middle: Fine-tuning, RAG, vLLM, FastAPI, LangGraph
    Senior: Архитектура, distributed training, MLOps
    Lead: Стратегия, оптимизация затрат, лидерство
    Soft Skills: Аналитическое мышление, техническая коммуникация, быстрое обучение, English B2+, Agile.

Условия:

  • Заработная плата и бонусы: конкурентоспособная оплата труда благодаря системе грейдирования, премии ко Дню Независимости и годовой бонус.
  • Социальный пакет: ДМС и страхование жизни, мобильная связь и скидки от партнеров.
  • Отпуск и отдых: 26 дней отпуска с возможностью взять дополнительные дни при наступлении важных событий.
  • Бонусы за рекомендации.
  • Рабочие условия: льготные условия на паркинг, свободный стиль одежды (smart casual).
  • Обучение и развитие: тренинги, вебинары и доступ к корпоративной библиотеке, четкая система карьерного роста.
  • Корпоративная культура: открытая и дружеская рабочая атмосфера, спортивные турниры и активная корпоративная жизнь.
  • Инициативы и проекты: возможность участия в социальных проектах, реализация идей в новых проектах группы «Halyk» с использованием современных digital-инструментов.
  • Команда: творческая и поддерживающая команда для реализации ваших идей.
  • Присоединяйтесь к нам и становитесь частью команды «Halyk»!
hh.ru
software country (тоо балхаш системс)

Senior Python Developer (AI-First / AWS Serverless)

software country (тоо балхаш системс)На сервисе с: 24.09.26 13:59
Зарплата не указанаСербияУдалёнка

We have 30 years of expertise in designing and building custom software systems. We provide software development services focusing on complex high-load applications, AI and BI solutions, and mobile apps.

This is a remote position open to candidates working from any location exсept Russia and Belarus.

Working hours: Central European Time (CET/CEST).

We are looking for an experienced Software Engineer with strong hands-on experience in Python, Java, AWS Lambda and AI Agents for a leading European cloud-first SaaS platform for CFOs, trusted by over 6,500 companies worldwide. Our system unifies data from hundreds of ERPs into a single source of truth and uses AI agents to automate financial close, planning, and audit processes.

Responsibilities

  • Develop and maintain the API for a customer-facing financial data collection product.
  • Manage AI agents (Claude Code, Codex): write prompts, review agent output, keep instructions up to date.
  • Take full End-to-End ownership of quality: write tests and independently verify features in deployed environments.
  • As the project evolves — gradually take on frontend tasks (our preferred stack is Angular, with some React) as part of the transition to a full-stack model.

Required Qualifications

  • 6+ years of commercial experience with Python 3.12 (FastAPI, Pydantic v2).
  • OR strong experience in Java / .NET with a genuine desire to transition to Python for server-side development (we will provide support and time for cross-training).
  • Experience with AWS Serverless (Lambda, DynamoDB single-table design, EventBridge, SQS/SNS, S3).
  • Real hands-on experience using AI agents for code generation in a production environment.
  • Testing and quality stack: pytest (with DynamoDB Local), uv, Ruff, mypy.
  • Understanding of IaC (Terraform) and CI/CD (GitHub Actions).
  • Understanding of Event-driven and multi-tenant SaaS architecture patterns.
  • English level - B2+

What we offer

  • Collaboration via a B2B contract with payments in USD or EUR, depending on your preference, or through a labor contract if you are based in Georgia, Serbia, or Kazakhstan.
  • Flexible work schedule.
  • Possibility to work remotely.
  • Opportunities for professional growth.
  • A company laptop to ensure a comfortable and efficient work setup.

HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.