Архив рубрики ~Коротко из Telegram~

Исследование Google: как «Ох!» и «Подожди-ка» удваивают точность LLM У…

Исследование Google: как «Ох!» и «Подожди-ка» удваивают точность LLM У…

Исследование Google: как «Ох!» и «Подожди-ка» удваивают точность LLM

У Google вышла неожиданно сильная и почти философская работа о том, что мы вообще называем «рассуждением» в больших языковых моделях.

Ключевая идея:
Reinforcement Learning учит модель не думать дольше, а думать коллективнее — через симуляцию внутреннего диалога.

Если вы замечали, что «думающая» модель:
• задаёт себе вопросы,
• сомневается,
• делает паузы,
• пересобирает позицию,

— то это не побочный эффект. Google утверждает: именно эта структура и есть механизм рассуждения.

Как они это проверили
1. Нашли конкретный нейронный признак, связанный с:
• удивлением,
• осознанием,
• сменой перспективы.
Он стабильно активируется в начале фраз вроде:
«О!», «Подожди-ка», «Ага, значит…»
2. Затем этот признак:
усилили во время генерации,
подавили,
• и сравнили результаты
(эксперимент на DeepSeek-R1-Llama-8B).
3. Результаты на сложных задачах комбинаторной арифметики:
• базовая модель — 27.1%
• с усилением «диалогового маркера» — 54.8%
• с подавлением — 23.8%

Эффект статистически значим и чётко выделяется на фоне других нейронных признаков. Более того, рост этого маркера коррелирует с улучшением стратегического мышления, а не просто с болтливостью.

Вывод (не самый удобный)

LLM, похоже, не столько рассуждают, сколько разыгрывают внутренний совет персонажей: сомневающийся, проверяющий, уточняющий, переосмысливающий.

И да — из этого следует практический, слегка ироничный вывод:
возможно, стоит попробовать в промпте что-то вроде

Используй больше “ах”, “точно”, “ага” — и пересобирай выводы

Исследование: arxiv.org/pdf/2601.10825

Текст "oh, wow." на розовом фоне, минималистичный дизайн.

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Состояние дел с программами-вымогателями в 2026 году: выплаты падают, но уровень шифрования растет. Архив рубрики ~Лента новостей~ Что останется от облаков, когда инфраструктурой займутся агенты Архив рубрики ~Лента новостей~ «МТС Линк» научил ИИ-ассистента автоматически составлять список задач после встреч Архив рубрики ~Лента новостей~ «Узкое место» в пространственной биологии: почему модели ИИ терпят неудачу при работе со сложными тканями и что на самом деле помогает это исправить. Архив рубрики ~Лента новостей~ Новые промты от Google и GPT (#5 выпуск) — возможно, вы искали именно их🤔 Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Лента новостей~ Как мы «приручали» ИИ в WMS Новости робототехники Один ролик вместо четырёх часов переобучения Чтобы научить робота новой… Новости робототехники Роботы начнут чинить спутники — SpaceX запустила на орбиту беспилотник… Архив рубрики ~Лента новостей~ Каждый микробиом рассказывает изменчивую, поддающуюся вычислению историю. Архив рубрики ~Лента новостей~ Пользователи DeepSeek рассказали о баге, из-за которого чат-бот присылает фрагменты из переписок с другими пользователями Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами Архив рубрики ~Лента новостей~ Состояние дел с программами-вымогателями в 2026 году: выплаты падают, но уровень шифрования растет. Архив рубрики ~Лента новостей~ Что останется от облаков, когда инфраструктурой займутся агенты Архив рубрики ~Лента новостей~ «МТС Линк» научил ИИ-ассистента автоматически составлять список задач после встреч Архив рубрики ~Лента новостей~ «Узкое место» в пространственной биологии: почему модели ИИ терпят неудачу при работе со сложными тканями и что на самом деле помогает это исправить. Архив рубрики ~Лента новостей~ Новые промты от Google и GPT (#5 выпуск) — возможно, вы искали именно их🤔 Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Лента новостей~ Как мы «приручали» ИИ в WMS Новости робототехники Один ролик вместо четырёх часов переобучения Чтобы научить робота новой… Новости робототехники Роботы начнут чинить спутники — SpaceX запустила на орбиту беспилотник… Архив рубрики ~Лента новостей~ Каждый микробиом рассказывает изменчивую, поддающуюся вычислению историю. Архив рубрики ~Лента новостей~ Пользователи DeepSeek рассказали о баге, из-за которого чат-бот присылает фрагменты из переписок с другими пользователями Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами

Оставить комментарий