Архив рубрики ~Лента новостей~

Умнее, а не сложнее: как неуверенность в себе ИИ способствует достижению максимальной производительности

Умнее, а не сложнее: как неуверенность в себе ИИ способствует достижению максимальной производительности

«Глубокое мышление с уверенностью» — более разумный способ масштабировать задачи рассуждения без траты огромного количества вычислений

Делиться

6c20055bc34afa54f2d694781b2d1389

Введение

Большие языковые модели (LLM) всё чаще решают сложные задачи на рассуждение, такие как задачи математических олимпиад, научные вопросы и ответы и многошаговые логические головоломки [3,8]. Но действительно ли они хороши? Да, хороши, но сейчас они требуют очень больших вычислительных затрат и неэффективны на этапе тестирования [5,6]. Чтобы решить эту проблему, исследователи Meta AI разработали решение под названием « DeepConf », также известное как « Глубокое мышление с уверенностью» [1].

Существует проблема, известная как самосогласованность при голосовании большинством голосов.

Уверен, вам интересно, как эта задача выглядит на практике. Представьте себе класс из 100 учеников. Вы дали им сложную олимпиадную задачу и час на её решение. В конце вы можете собрать все ответы и проголосовать — ответы, набравшие наибольшее количество голосов, «побеждают».

Именно так работает проблема самосогласованности с большинством в LLM[2,3]. Вместо одного решения модель рассматривает сотни путей рассуждения (например, 512 различных пошаговых решений), а затем выбирает наиболее частый ответ.

В математическом тесте AIME 2025 один проход Qwen3–8B (называемый pass@1) даёт точность около 68% ; это как если бы был получен один ответ от одного ученика. Но если сгенерировать 512 трассировок рассуждений на каждый вопрос (называемых conf@512) и взять ответ большинства, то точность возрастает до 82% [1,4].

Звучит здорово, правда? Загвоздка в том, что эти дополнительные 511 трасс генерируют почти 100 миллионов дополнительных токенов, и увеличение трасс не всегда помогает; производительность остаётся прежней, а иногда даже падает, когда в голосовании доминируют некачественные решения[1,7,8]. Другими словами, если ученики угадывают случайным образом, то голосование класса не отражает лучшего мыслителя в классе[1].

Источник: towardsdatascience.com

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Коротко из Telegram~ Сэм Альтман заявил, что мы уже живём в сингулярности. В… Архив рубрики ~Коротко из Telegram~ 😮 OpenAI добавила голосовой режим в Codex. Теперь можно вслух ставить… Архив рубрики ~Коротко из Telegram~ Anthropic выпустила Claude Opus 5 Новая модель почти догнала Fable… Архив рубрики ~Коротко из Telegram~ Любую картинку теперь можно разобрать на промпт. Расширение PromptCard анализирует изображения… Архив рубрики ~Коротко из Telegram~ У Seedance появился новый конкурент — FLUX 3. Black Forest… Архив рубрики ~Коротко из Telegram~ Создатель Twitter Джек Дорси запустил локальное пространство для совместной работы… Архив рубрики ~Коротко из Telegram~ ☺️ Для ChatGPT и Codex собрали библиотеку полезных сценариев. На сайте… Архив рубрики ~Коротко из Telegram~ Первая скрепка уже звенит «Проблема скрепок» – это мысленный эксперимент о… Архив рубрики ~Коротко из Telegram~ 👩‍🎨 Китайцы выкатили нового убийцу Nano Banana — Qwen-Image-3.0 . Новая модель… Архив рубрики ~Коротко из Telegram~ Новость из Telegram 27.07.2026 09:28 Архив рубрики ~Коротко из Telegram~ Зои Хитциг, которая ушла из OpenAI в феврале, опубликовала в… Архив рубрики ~Коротко из Telegram~ ✴️ В Higgsfield появился Pinterest для нейровидео. В разделе Community собрали работы других… Архив рубрики ~Коротко из Telegram~ 🤖 Пока весь мир обсуждает новые ИИ-модели, появляется и другая… Архив рубрики ~Коротко из Telegram~ Neuralink — ПАРАЛИЗОВАННЫЕ ПАЦИЕНТЫ УПРАВЛЯЮТ ИНВАЛИДНЫМИ КАЛЯСКАМИ СИЛОЙ МЫСЛИ 🧠♿️… Архив рубрики ~Коротко из Telegram~ Сэм Альтман заявил, что мы уже живём в сингулярности. В… Архив рубрики ~Коротко из Telegram~ 😮 OpenAI добавила голосовой режим в Codex. Теперь можно вслух ставить… Архив рубрики ~Коротко из Telegram~ Anthropic выпустила Claude Opus 5 Новая модель почти догнала Fable… Архив рубрики ~Коротко из Telegram~ Любую картинку теперь можно разобрать на промпт. Расширение PromptCard анализирует изображения… Архив рубрики ~Коротко из Telegram~ У Seedance появился новый конкурент — FLUX 3. Black Forest… Архив рубрики ~Коротко из Telegram~ Создатель Twitter Джек Дорси запустил локальное пространство для совместной работы… Архив рубрики ~Коротко из Telegram~ ☺️ Для ChatGPT и Codex собрали библиотеку полезных сценариев. На сайте… Архив рубрики ~Коротко из Telegram~ Первая скрепка уже звенит «Проблема скрепок» – это мысленный эксперимент о… Архив рубрики ~Коротко из Telegram~ 👩‍🎨 Китайцы выкатили нового убийцу Nano Banana — Qwen-Image-3.0 . Новая модель… Архив рубрики ~Коротко из Telegram~ Новость из Telegram 27.07.2026 09:28 Архив рубрики ~Коротко из Telegram~ Зои Хитциг, которая ушла из OpenAI в феврале, опубликовала в… Архив рубрики ~Коротко из Telegram~ ✴️ В Higgsfield появился Pinterest для нейровидео. В разделе Community собрали работы других… Архив рубрики ~Коротко из Telegram~ 🤖 Пока весь мир обсуждает новые ИИ-модели, появляется и другая… Архив рубрики ~Коротко из Telegram~ Neuralink — ПАРАЛИЗОВАННЫЕ ПАЦИЕНТЫ УПРАВЛЯЮТ ИНВАЛИДНЫМИ КАЛЯСКАМИ СИЛОЙ МЫСЛИ 🧠♿️…