Архив рубрики ~Коротко из Telegram~

«Не выдумывай!» — и почему эта фраза почти не работает…

«Не выдумывай!» — и почему эта фраза почти не работает…
File 1946

«Не выдумывай!» — и почему эта фраза почти не работает

Классическая попытка бороться с галлюцинациями: дописать в конце промпта "только проверенные факты, не придумывай". И это… почти не работает. Модель не хранит где-то отдельный переключатель "режим выдумывания" — она не осознаёт разницу между "я точно знаю" и "я генерирую правдоподобное продолжение". Просьба "не выдумывай" адресована процессу, которого модель не может просто взять и выключить по команде.

Как работают команды:

✳️ "Не выдумывай" / "не галлюцинируй" — слишком абстрактно, модель не имеет чёткого критерия, что под этим понимается. Такая инструкция может немного изменить поведение, но не обеспечивает надёжного контроля фактов.
✳️ "Будь точным" / "только факты" — могут повысить вероятность осторожного ответа или отказа от догадки. Но они не создают у модели нового источника знаний и не гарантируют, что ответ действительно будет точным.
✳️"Ты уверен?" — вопрос часто запускает не независимую проверку, а ещё одну генерацию, которая может сохранить исходную ошибку.

Что работает лучше (не идеально, но заметно):

"Если не уверен — скажи, что не уверен, вместо того чтобы гадать" — явно разрешает модели признать незнание, вместо того чтобы по умолчанию выдавать самый правдоподобный ответ
"Опирайся только на текст, который я предоставил, не добавляй факты из общих знаний" — работает, когда у тебя есть источник (документ, статья) — сильно сужает пространство, откуда модель может "додумывать"
"Если это не входит в предоставленные данные — явно укажи это" — заставляет модель разделять "нашёл в тексте" и "предполагаю"
"Перечисли, в каких частях ответа ты менее уверен" — не устраняет галлюцинации, но помогает их обнаружить постфактум

Единственный по-настоящему надёжный способ — не про формулировку промпта вообще. Это подключение поиска в интернете или предоставление источника, на который модель может опираться, вместо того чтобы просить её быть честнее с самой собой. Фраза в промпте снижает вероятность, но не гарантирует отсутствие ошибки — для фактов, цифр, цитат всё равно нужна отдельная проверка.

🟣Теги: #промптинг #лайфхаки_ии

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Исследователи Salesforce добились того, что ИИ-агент стал выполнять 93% задач в браузере, не затрагивая саму модель. Архив рубрики ~Лента новостей~ 70-летний пенсионер выпустил 445 книг с помощью ChatGPT. Но тут интересно не это Архив рубрики ~Полезное~ Google показала, как перестать генерировать кривые интерфейсы — вышел подробный… Архив рубрики ~Полезное~ Превращаем любого ИИ-агента в автономного исследователя — спецы из AlphaXiv… Архив рубрики ~Полезное~ free-coding-models: найдите самую быструю бесплатную модель для кодинга за секунды… Архив рубрики ~Лента новостей~ В Болгарии нашли перстень-печатку византийской женщины. Видимо, она жила в XIV веке Архив рубрики ~Лента новостей~ AI-агент в терминале: какие разрешения ему можно давать Новости робототехники Китай запустил первый в мире роботизированный центр ухода за пожилыми Архив рубрики ~Лента новостей~ «Глазный» шпион: Циклоп Блинк возвращается с расширенными возможностями. Новости робототехники Компания Waymo возобновила работу в Сан-Антонио спустя 5 месяцев после проблем, вызванных наводнением. Архив рубрики ~Лента новостей~ Как связать использование ИИ с бизнес-ценностью | OpenAI Архив рубрики ~Лента новостей~ CommuniGate Pro и «Безант» упростили переход с Microsoft Exchange на российскую почту Архив рубрики ~Лента новостей~ Возможно, Великобритания пересматривает свои планы в отношении специалистов по искусственному интеллекту, которых ей так не хватало на работе. Архив рубрики ~Лента новостей~ Как быстро нейросети узнают об изменениях на рынке Архив рубрики ~Лента новостей~ Исследователи Salesforce добились того, что ИИ-агент стал выполнять 93% задач в браузере, не затрагивая саму модель. Архив рубрики ~Лента новостей~ 70-летний пенсионер выпустил 445 книг с помощью ChatGPT. Но тут интересно не это Архив рубрики ~Полезное~ Google показала, как перестать генерировать кривые интерфейсы — вышел подробный… Архив рубрики ~Полезное~ Превращаем любого ИИ-агента в автономного исследователя — спецы из AlphaXiv… Архив рубрики ~Полезное~ free-coding-models: найдите самую быструю бесплатную модель для кодинга за секунды… Архив рубрики ~Лента новостей~ В Болгарии нашли перстень-печатку византийской женщины. Видимо, она жила в XIV веке Архив рубрики ~Лента новостей~ AI-агент в терминале: какие разрешения ему можно давать Новости робототехники Китай запустил первый в мире роботизированный центр ухода за пожилыми Архив рубрики ~Лента новостей~ «Глазный» шпион: Циклоп Блинк возвращается с расширенными возможностями. Новости робототехники Компания Waymo возобновила работу в Сан-Антонио спустя 5 месяцев после проблем, вызванных наводнением. Архив рубрики ~Лента новостей~ Как связать использование ИИ с бизнес-ценностью | OpenAI Архив рубрики ~Лента новостей~ CommuniGate Pro и «Безант» упростили переход с Microsoft Exchange на российскую почту Архив рубрики ~Лента новостей~ Возможно, Великобритания пересматривает свои планы в отношении специалистов по искусственному интеллекту, которых ей так не хватало на работе. Архив рубрики ~Лента новостей~ Как быстро нейросети узнают об изменениях на рынке

Оставить комментарий