Ищем инженера для разработки MVP self-service платформы, которая в диалоге с пользователем преобразует описание задачи, примеры разговоров и базу знаний в формализованную спецификацию работающего AI-агента, автоматически тестирует и улучшает его.
Цель
Пользователь без участия разработчика должен иметь возможность:
- описать задачу и ожидаемый результат разговора;
- загрузить инструкции, транскрипты, документы или сайт;
- ответить на уточняющие вопросы системы;
- получить работающего агента;
- протестировать его в текстовых диалогах;
- запустить автоматическую симуляцию и улучшение сценария.
На первом этапе создаём текстовый движок. STT, TTS и телефония подключаются позднее поверх готового движка.
Что нужно реализовать
- ingestion инструкций, транскриптов и базы знаний;
- генерацию типизированной спецификации агента;
- runtime с управлением состоянием, переходами и tool calling;
- обработку неоднозначности, исключений и эскалации;
- текстовый sandbox для ручного тестирования;
- симулятор пользователей и диалоговых сценариев;
- автоматические evals и regression tests;
- управляемый цикл улучшения агента;
- версионирование, replay и trace/explainability.
Архитектура заранее не фиксируется. Кандидат должен предложить и обосновать модель исполнения, обеспечивающую типизированное состояние, управляемые переходы, воспроизводимость и чёткую границу между вероятностным поведением LLM и детерминированной бизнес-логикой.
Результат MVP
Работающий e2e сценарий, в котором новый пользователь загружает исходные материалы, получает агента, проверяет его на симулированных диалогах и выпускает улучшенную версию без ручной разработки.
Ожидания по опыту
- Опыт разработки production-систем на базе LLM/NLP, желательно диалоговых агентов.
- Проектирование логики диалога: цели, intents, entities/slots, состояние, уточнения и fallback-сценарии.
- Преобразование свободной речи в валидированные структурированные данные: structured outputs, schemas и normalization.
- Работа с неоднозначным, неполным и противоречивым пользовательским вводом.
- Разработка agent/workflow runtime: typed state, transitions, tool calling, persistence, replay и recovery.
- Построение RAG и grounding по документам, транскриптам и сайтам.
- Разработка evals: симуляция пользователей, автоматические оценки, regression testing и анализ ошибок.
- Сильный backend и способность самостоятельно спроектировать и довести вертикальный сценарий до работающего MVP.
Условия:
- Проектная работа,
- Независимость и самостоятельность в реализации задач, поощрение инициативы, гибкий менеджмент и отсутствие бюрократии.
- Крупный перспективный проект федерального масштаба с возможностями для профессионального развития.
- Возможность работать на полной удаленке.
- Интересные задачи и самые современные технологии.
- Зарплатные ожидания обсуждаются на собеседовании и всегда принимаются во внимание.