Python-разработчик (AI Evaluation)
Technology
1С
Москва, Россия3 нед. назадДо 29.09.2026
Описание вакансии
Ищем Python-разработчика в команду AI. Предстоит разрабатывать систему оценки качества AI-агентов: оценка агентских траекторий и достижения целей, управление и создание (в том числе автоматическое\автоматизированное) тестовых сценариев, автоматизировать сбор и обработку обратной связи, помогать делать агентные системы надежнее.
Задачи:
- Разрабатывать систему оценки качества AI-агентов
- Создавать тестовые сценарии и методики проверки
- Разрабатывать метрики качества
- Автоматизировать тестирование агентных систем
- Анализировать результаты и улучшать процессы контроля качества
- Python, Docker, агентные среды для разработки (Opencode и др.)
- Опыт коммерческой разработки на Python от 3х лет
- Опыт работы с LLM или AI-агентами
- Понимание принципов оценки качества AI-систем
- Аналитический склад мышления
- Опыт построения AI Evaluation / LLM Evaluation
- Знание CI/CD и автоматизации тестирования
Гибридный формат: 3 дня в офисе, остальные — удаленно.
Офис рядом с м. Тимирязевская (удобно добираться, есть парковка).
В офисе столовая, тренажерный зал.
Сделаем ДМС после испытательного срока.
Keywords
PythonCI / CDDockerCI/CD
Вас интересует эта вакансия?