💢 Персональные агенты хранят предпочтения и историю задач между сессиями,…
💢 Персональные агенты хранят предпочтения и историю задач между сессиями, но систематически никто не проверял: улучшаются ли они реально от накопленного опыта или это просто выглядит так. PAST-Bench проверяет это напрямую — 26 сценариев, 204 эпизода, один и тот же агент прогоняется с включённой и выключенной памятью в идентичных условиях.
Результат по семи моделям: улучшение реальное, но неравномерное. Самое интересное — авторы проверяли не только сам факт прироста, но и то, идёт ли он через правильный путь (сохранение → извлечение → обновление опыта). Оказалось, агенты с одинаковым итоговым приростом могут кардинально различаться — один реально учится через память, другой просто угадывает лучше по случайным причинам, а на выходе выглядит одинаково.
➡️ На основе находок авторы сделали Hermes+ с пятью точечными доработками агентного цикла — повышает прирост и даёт понятные доказательства правильного пути обучения.
Хорошее дополнение к теме Memora от Microsoft: построить архитектуру памяти — одно, доказать, что агент реально ею правильно пользуется — совсем другое.
❓ Важнее, чтобы агент учился «правильно», или хватает того, что результат просто становится лучше со временем?
Похожие записи
Оцените материал:
Похожие записи
Роскомнадзор предупредил о возможной блокировке WhatsApp* Сегодня многие российские пользователи…
29.11.2025
Удобный сервис для работы с PDF Наткнулись на интересный инструмент…
14.09.2025
Вышел лёгкий браузер для ИИ-агентов — Lightpanda Инструмент создан специально…
09.08.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
