Тэг
мультиагентные системы
Как я создал винный бенчмарк OenoBench для LLM с помощью агентов
Опыт создания винного бенчмарка OenoBench на 3266 вопросов с помощью LLM: сбор данных, агентный аудит, ошибки генерации и результаты эвала 16 моделей.
Читать далееИмперия алгоритмов: как двести ИИ-агентов самостоятельно построили цифровое общество
Разбираем масштабный эксперимент SwarmWorld, в котором 200 нейросетевых агентов без помощи человека сформировали разделение труда, написали код и построили защитную инфраструктуру.
Читать далееКак я заставил ИИ-агентов работать на результат: опыт настройки начальника AI-офиса
Опыт настройки мультиагентной системы Claude Code: почему вежливые нейросети выдают брак и как жесткий промпт руководителя меняет систему приёмки результатов.
Читать далееКак заставить ИИ-движок соблюдать непрописанные правила: опыт D&D-бота
Разбираю архитектурный подход к созданию ИИ-мастера для настольных ролевых игр. Рассказываю, как связка из мультиагентной системы LLM-судей и детерминированного кода позволяет обрабатывать любую импровизацию игроков без составления бесконечных сводов правил.
Читать далее







