Skip to main content

Python-разработчик (AI Evaluation)

Technology
Москва, Россия3 нед. назадДо 29.09.2026

Описание вакансии

Ищем Python-разработчика в команду AI. Предстоит разрабатывать систему оценки качества AI-агентов: оценка агентских траекторий и достижения целей, управление и создание (в том числе автоматическое\автоматизированное) тестовых сценариев, автоматизировать сбор и обработку обратной связи, помогать делать агентные системы надежнее.

Задачи:

  • Разрабатывать систему оценки качества AI-агентов
  • Создавать тестовые сценарии и методики проверки
  • Разрабатывать метрики качества
  • Автоматизировать тестирование агентных систем
  • Анализировать результаты и улучшать процессы контроля качества
Стек технологий:
  • Python, Docker, агентные среды для разработки (Opencode и др.)
Что важно:
  • Опыт коммерческой разработки на Python от 3х лет
  • Опыт работы с LLM или AI-агентами
  • Понимание принципов оценки качества AI-систем
  • Аналитический склад мышления
Будет плюсом:
  • Опыт построения AI Evaluation / LLM Evaluation
  • Знание CI/CD и автоматизации тестирования
Условия:

Гибридный формат: 3 дня в офисе, остальные — удаленно.

Офис рядом с м. Тимирязевская (удобно добираться, есть парковка).

В офисе столовая, тренажерный зал.

Сделаем ДМС после испытательного срока.

Keywords
PythonCI / CDDockerCI/CD

Вас интересует эта вакансия?