ИИ научили сомневаться: MIT снижает «самоуверенные ошибки» Исследователи из MIT…
ИИ научили сомневаться: MIT снижает «самоуверенные ошибки»
Исследователи из MIT предложили способ, который заставляет модели честно признавать неуверенность.
Проблема:
— ИИ часто отвечает уверенно, даже когда ошибается
— классическое обучение награждает за результат, а не за честность
Что сделали:
— ввели штраф за разницу между
— заявленной уверенностью
— и реальной точностью
Результат:
— модели начинают говорить «не уверен»
— ошибка калибровки упала на ~90%
Вывод:
раньше ИИ учился выглядеть правым,
теперь — понимать, когда он может ошибаться.
Это шаг от «всезнающего ассистента» к инструменту, которому можно доверять именно потому, что он умеет сомневаться.
Похожие записи
Оцените материал:
Похожие записи
IPO Anthropic: Сколько просят? Когда на биржу выходит компания из…
22.09.2026
Яндекс возвращается в гонку за суверенность (спойлер: никуда и не…
22.09.2026
Атлант подрезал гранты Все десятые нам продавали идею предпринимателя с…
22.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
