ИИ не может стать разумным, пока не сможет использовать ошибку как источник новых знаний
ИИ исправляет ошибку, а человек вписывает ее в свой опыт и что это говорит об ограничениях современных ИИ
Современные ИИ используют разные формы обратной связи: функцию потерь (loss), вознаграждение и ошибку предсказания вознаграждения (reward prediction error) в обучении с подкреплением (RL), а также человеческие оценки (RLHF). Но на фундаментальном уровне все эти сигналы работают в рамках одной и той же схеме числовой оптимизации. Независимо от того, называется ли сигнал «потерей» или «вознаграждением», он служит входом для алгоритма, который изменяет параметры модели так, чтобы лучше достигать заранее заданной цели. Система не переживает качественного перехода в состояние «удовлетворения» или мук совести за совершенную ошибку, после того как она обнаружена, как человек, она лишь становится эффективнее в оптимизации внешне заданной функции.
>>
Источник: habr.com
Похожие записи
Оцените материал:
Похожие записи
Пузырь генеративного ИИ: почему крах неизбежен и чем это грозит экономике
08.09.2026
Meta устанавливает цену на Muse Voice Transcribe в размере 0,18 доллара в час, с возможностью записи разговоров в реальном времени для более чем 20 говорящих: выгодное предложение для крупных предприятий?
08.09.2026
Новый вид пауков из Скалистых гор поселился в 500 километрах к востоку от ближайших родственников. Он живет в хвойных лесах штата Айдахо
08.09.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
