
Привет! Это команда Внутренних сервисов.
ozon tech · На сервисе с: 25.09.26 17:38
Привет! Это команда Внутренних сервисов.
Мы развиваем систему интеллектуального распознавания документов, которой пользуются внутренние сервисы компании. Система уже работает в проде и распознаёт 30+ видов документов.
Сейчас мы ищем Senior ML-инженера, который будет развивать существующий ML-продукт: улучшать качество распознавания и извлечения информации из документов, дообучать LLM под конкретные задачи и запускать новые сценарии в production.
Мы активно используем LLM — с их помощью решаем задачи, для которых раньше требовались сложные CV-пайплайны.
Наш стек
Python, PyTorch, Transformers, LLM, PostgreSQL, Redis, Kubernetes, Docker.
Вы будете
Развивать существующую систему распознавания документов и улучшать качество её работы.
Обучать и дообучать LLM под задачи распознавания, классификации, извлечения и структурирования информации из документов.
Исследовать новые подходы к применению LLM и выбирать модели и методы обучения под конкретные задачи.
Запускать ML-решения в production, анализировать их качество и улучшать существующие пайплайны.
Работать на стыке ML, NLP и Computer Vision: решать задачи обработки документов, где LLM дополняют или заменяют классические CV-подходы.
Примеры задач
Распознавание и парсинг сканов ЭТК — от паспортов до заграничных документов.
Классификация резюме и других документов.
Саммаризация документов.
Извлечение структурированной информации из неструктурированных документов с помощью LLM.
Дообучение LLM под конкретные задачи распознавания документов.
Исследование новых моделей и подходов, которые могут улучшить качество или упростить существующие решения.
Нам важно
Сильная база в Machine Learning и Deep Learning.
Практический опыт обучения и дообучения LLM.
Опыт работы с Python и современным ML-стеком.
Понимание подходов к оценке качества ML-моделей и умение анализировать результаты экспериментов.
Опыт внедрения ML-моделей в production.
Способность самостоятельно разбираться в новой задаче, выбирать подход к её решению и доводить результат до production.
Будет плюсом
Опыт работы с OCR и задачами распознавания документов.
Опыт в NLP и работе с LLM для извлечения и структурирования информации.
Опыт работы с Computer Vision.
Опыт использования LoRA, PEFT и других подходов к эффективному дообучению LLM.
HireSeeker собирает вакансии со всех площадок и присылает только релевантные. Бесплатно.