Архив рубрики ~Коротко из Telegram~

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки» Исследователи из MIT…

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки» Исследователи из MIT…

ИИ научили сомневаться: MIT снижает «самоуверенные ошибки»

Исследователи из MIT предложили способ, который заставляет модели честно признавать неуверенность.

Проблема:

— ИИ часто отвечает уверенно, даже когда ошибается
— классическое обучение награждает за результат, а не за честность

Что сделали:

— ввели штраф за разницу между
— заявленной уверенностью
— и реальной точностью

Результат:

— модели начинают говорить «не уверен»
— ошибка калибровки упала на ~90%

Вывод:

раньше ИИ учился выглядеть правым,
теперь — понимать, когда он может ошибаться.

Это шаг от «всезнающего ассистента» к инструменту, которому можно доверять именно потому, что он умеет сомневаться.

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ MarathonMemBench — бенчмарк нового типа для тестирования памяти вашего LLM-агента Архив рубрики ~Лента новостей~ Как я строю Maxoria — платформу, которая помогает бизнесу принимать решения точнее Архив рубрики ~Лента новостей~ Как NTT DATA AIVista преодолевает последний этап внедрения агентного ИИ для корпоративных агентов Архив рубрики ~Лента новостей~ DocGen: как я сделал AI-ассистента для системного аналитика Архив рубрики ~Лента новостей~ Число подтвержденных жертв лихорадки Эбола в Конго превысило полторы тысячи. За неделю она унесла жизни почти 500 человек Новости робототехники GAM Enterprises будет производить редукторы Schaeffler PSC Архив рубрики ~Лента новостей~ Браузер заблокировал сайт банка или сервиса: как вернуть доступ Архив рубрики ~Лента новостей~ Как Opus 5 и GPT-5.6 Sol «представят» себе мир «Властелина колец»: сооснователь OpenAI и исследователь Anthropic Андрей Карпатый предложил новый тест моделей на литературных 3D-симуляциях Архив рубрики ~Лента новостей~ Прекратите строить графики для всего подряд: когда GraphRAG действительно превосходит Vector RAG Архив рубрики ~Лента новостей~ OWASP LLM10: Unbounded Consumption. Тестируем современные языковые модели на ресурсоёмких промптах Архив рубрики ~Лента новостей~ Не все герои носят плащи. Некоторые носят патчкорды Архив рубрики ~Лента новостей~ В преддверии выхода Pixel 11 запасы Pixel 9 распродаются. Новости робототехники Партнеры Avnet и Weston Robot запустят платформу проверки периферийного искусственного интеллекта Архив рубрики ~Лента новостей~ Reddit стремится снизить значимость «кармы» для новичков, переходя на инструменты модерации с использованием искусственного интеллекта. Архив рубрики ~Лента новостей~ MarathonMemBench — бенчмарк нового типа для тестирования памяти вашего LLM-агента Архив рубрики ~Лента новостей~ Как я строю Maxoria — платформу, которая помогает бизнесу принимать решения точнее Архив рубрики ~Лента новостей~ Как NTT DATA AIVista преодолевает последний этап внедрения агентного ИИ для корпоративных агентов Архив рубрики ~Лента новостей~ DocGen: как я сделал AI-ассистента для системного аналитика Архив рубрики ~Лента новостей~ Число подтвержденных жертв лихорадки Эбола в Конго превысило полторы тысячи. За неделю она унесла жизни почти 500 человек Новости робототехники GAM Enterprises будет производить редукторы Schaeffler PSC Архив рубрики ~Лента новостей~ Браузер заблокировал сайт банка или сервиса: как вернуть доступ Архив рубрики ~Лента новостей~ Как Opus 5 и GPT-5.6 Sol «представят» себе мир «Властелина колец»: сооснователь OpenAI и исследователь Anthropic Андрей Карпатый предложил новый тест моделей на литературных 3D-симуляциях Архив рубрики ~Лента новостей~ Прекратите строить графики для всего подряд: когда GraphRAG действительно превосходит Vector RAG Архив рубрики ~Лента новостей~ OWASP LLM10: Unbounded Consumption. Тестируем современные языковые модели на ресурсоёмких промптах Архив рубрики ~Лента новостей~ Не все герои носят плащи. Некоторые носят патчкорды Архив рубрики ~Лента новостей~ В преддверии выхода Pixel 11 запасы Pixel 9 распродаются. Новости робототехники Партнеры Avnet и Weston Robot запустят платформу проверки периферийного искусственного интеллекта Архив рубрики ~Лента новостей~ Reddit стремится снизить значимость «кармы» для новичков, переходя на инструменты модерации с использованием искусственного интеллекта.

Оставить комментарий