AI-агенты в продакшене — это больше не эксперимент, а критичная инфраструктура. Но как понять, правильно ли агент отвечает, где и почему он «галлюцинирует» и во сколько реально обходится его использование?
На воркшопе мы разберём Langfuse — open-source-инструмент наблюдаемости для AI-приложений. Покажем, как организовать централизованный мониторинг ИИ-агентов и прямо на месте сделаем демоагента наблюдаемым. Участники научатся трассировать вызовы LLM, собирать метрики, оценивать качество ответов и выполнять диагностику агентов так же, как и обычных продовых сервисов и приложений. Минимум слайдов, максимум практики: реальный агент, реальный продподход и живое инструментирование вместе с аудиторией.
Бэкенд-разработчик, Специалист по данным / Специалист по машинному обучению, DevOps-инженер
Средний
CPO Платформы Надёжности в МТС Web Services. Член программного комитета HighLoad++, ментор.
Занимается CMDB, ITSM и Observability, пишет статьи на Хабр и в тг-канал «техновыживание».