Архив рубрики ~Коротко из Telegram~

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки» Исследователи из MIT…

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки» Исследователи из MIT…

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки»

Исследователи из MIT предложили способ, который заставляет модели честно признавать неуверенность.

Проблема:

— ИИ часто отвечает уверенно, даже когда ошибается
— классическое обучение награждает за результат, а не за честность

Что сделали:

— ввели штраф за разницу между
— заявленной уверенностью
— и реальной точностью

Результат:

— модели начинают говорить «не уверен»
— ошибка калибровки упала на ~90%

Вывод:

раньше ИИ учился выглядеть правым,
теперь — понимать, когда он может ошибаться.

Это шаг от «всезнающего ассистента» к инструменту, которому можно доверять именно потому, что он умеет сомневаться.

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Приоритеты и принципы эффективной оценки сторонними организациями | OpenAI Архив рубрики ~Лента новостей~ «Гравитон» готовит к выпуску мини-ПК Д14И на собственной плате «Ухта-3» Архив рубрики ~Лента новостей~ Elsevier и LG AI Research интегрируют специфические для химии технологии искусственного интеллекта в свои исследования. Архив рубрики ~Лента новостей~ Как повысить прозрачность в экосистеме искусственного интеллекта вашего предприятия Архив рубрики ~Лента новостей~ Anthropic выпустила Claude Opus 5.5: разбор новой флагманской модели для кода и ИИ-агентов Новости робототехники Новые роботы уже на подходе — Сбер покажет их в… Архив рубрики ~Лента новостей~ Кодирование ускорилось в разы, а проекты – нет. Куда пропал выигрыш? Архив рубрики ~Лента новостей~ Все, что вы не знали о киберпанке — как появился, что с ним стало и наконец — что он такое на самом деле. Часть 1 Архив рубрики ~Лента новостей~ Живодеров, Кощеев и Поганкин. Как появились неблагозвучные и обидные фамилии Архив рубрики ~Лента новостей~ Как Google Authenticator работает без интернета? Новости робототехники «Старлинк не нужен» – враг использует Авито, ВК и Мах для ударов по России Новости робототехники Новая стратегия расширения Waymo: подростки Архив рубрики ~Лента новостей~ Консультативная группа по математике и искусственному интеллекту | OpenAI Архив рубрики ~Лента новостей~ «Ростелеком Контакт-центр» внедрил ITFB EasyDoc для автоматизации массового найма Архив рубрики ~Лента новостей~ Приоритеты и принципы эффективной оценки сторонними организациями | OpenAI Архив рубрики ~Лента новостей~ «Гравитон» готовит к выпуску мини-ПК Д14И на собственной плате «Ухта-3» Архив рубрики ~Лента новостей~ Elsevier и LG AI Research интегрируют специфические для химии технологии искусственного интеллекта в свои исследования. Архив рубрики ~Лента новостей~ Как повысить прозрачность в экосистеме искусственного интеллекта вашего предприятия Архив рубрики ~Лента новостей~ Anthropic выпустила Claude Opus 5.5: разбор новой флагманской модели для кода и ИИ-агентов Новости робототехники Новые роботы уже на подходе — Сбер покажет их в… Архив рубрики ~Лента новостей~ Кодирование ускорилось в разы, а проекты – нет. Куда пропал выигрыш? Архив рубрики ~Лента новостей~ Все, что вы не знали о киберпанке — как появился, что с ним стало и наконец — что он такое на самом деле. Часть 1 Архив рубрики ~Лента новостей~ Живодеров, Кощеев и Поганкин. Как появились неблагозвучные и обидные фамилии Архив рубрики ~Лента новостей~ Как Google Authenticator работает без интернета? Новости робототехники «Старлинк не нужен» – враг использует Авито, ВК и Мах для ударов по России Новости робототехники Новая стратегия расширения Waymo: подростки Архив рубрики ~Лента новостей~ Консультативная группа по математике и искусственному интеллекту | OpenAI Архив рубрики ~Лента новостей~ «Ростелеком Контакт-центр» внедрил ITFB EasyDoc для автоматизации массового найма