Headroom режет токены для вайбкодинга Для тяжёлых агентных сессий появился…
Headroom режет токены для вайбкодинга
Для тяжёлых агентных сессий появился Headroom — инструмент, который сжимает выводы тулов, файлы, логи и историю диалога перед отправкой в LLM.
Заявляют экономию токенов на 60–95%. В тестах кодовая база и поиск по коду сжимались на 92% без просадки качества: на GSM8K точность не изменилась, а на TruthfulQA даже выросла на 3%. Если модели нужен оригинал, она может запросить его через механизм CCR.
Headroom можно использовать как:
— библиотеку для Python/TypeScript
— прокси через headroom proxy
— обёртку для агентов: claude, codex, cursor
— MCP-сервер
Внутри — 6 алгоритмов сжатия: от SmartCrusher для JSON до CodeCompressor для AST пяти языков и Kompress-base на Hugging Face. Есть кросс-агентная память и команда headroom learn, которая находит неудачные сессии и прописывает правки в CLAUDE.md.
Забрать.
Похоже, долгие агентные сессии начинают спасать не только контекстом побольше, но и нормальной уборкой перед отправкой в модель.
#полезное

Похожие записи
Оцените материал:
Похожие записи
Сегодня в Госдуму приедет министр цифровизации Максут Шадаев, а после депутаты в третьем чтении рассмотрят штрафы за поиск экстремистского контента
01.08.2025
Память Crucial LPCAMM2 теперь работает со скоростью 8533 MT/s при объёме 64 Гбайта
01.10.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
