ИИ учат сомневаться: MIT снижает «самоуверенные ошибки» на 90% Исследователи…
ИИ учат сомневаться: MIT снижает «самоуверенные ошибки» на 90%
Исследователи из MIT предложили метод, который заставляет модели предупреждать о своей неуверенности.
Проблема:
— ИИ часто отвечает уверенно, даже когда ошибается
— классическое обучение поощряет только правильный результат, а не честность
Что изменили:
— ввели штраф за разрыв между
— заявленной уверенностью
— и реальной точностью
Результат:
— модели начинают говорить «не уверен»
— ошибка калибровки снизилась на ~90%
Смысл:
раньше ИИ учился выглядеть правым,
теперь — оценивать собственную правоту.
Это сдвиг от «всезнайки» к инструменту, который умеет признавать границы своих знаний.
Похожие записи
- Исследователи Meta обучили модель ИИ с 8 миллиардами итераций достичь уровня Claude Opus 4.5 — без непомерных затрат, связанных с освоением новых технологий.
- Исследователи Висконсинского университета в Мэдисоне близки к разработке кардиостимулятора, который…
- Исследователи с помощью ИИ обнаружили в Zoom уязвимость, которая позволяла участникам звонка получить контроль над устройствами других пользователей
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
