Выводы

Вы молодцы!

  1. Трассировка делает работу AI-агента наблюдаемой. Для диагностики крайне важно логировать input и output вызовов LLM.

  2. LLM-as-a-judge - один из хороших способов не допустить регресса, но он стоит денег.

  3. Централизованное управление промптами крайне удобно, но нужно грамотно выстраивать процесс изменений.

  4. Управление контекстом запросов к LLM – ключ к отсутствию галлюцинаций.

Ссылки для дальнейшего изучения

Авторы

Бочаров Филипп

Более 8 лет занимаюсь наблюдаемостью систем и рассказываю об этом на Highload++. Автор tg-канала @technosurvival

Филипп Бочаров

Дмитрий Лобач

Запустил сервис на базе Langfuse внутри МТС Web Services, которым пользуются десятки продуктов.

Дмитрий Лобач

Даниел Иванов

Архитектор в МТС Web Services.

Даниел Иванов