Архив рубрики ~Лента новостей~

Нейросеть вам подыгрывает вместо того, чтобы помогать. 5 промптов, чтобы это исправить

Нейросеть вам подыгрывает вместо того, чтобы помогать. 5 промптов, чтобы это исправить
Нейросеть вам подыгрывает вместо того, чтобы помогать. 5 промптов, чтобы это исправить

Нейросеть по умолчанию старается вам понравиться: соглашается с вашими догадками, подгоняет аргументы под вашу позицию, доверяет любой ссылке в промпте. В итоге вы получаете не объективную помощь, а вежливое эхо собственных мыслей. Это подборка практических выводов из свежих научных работ за неделю 7–14 июня: по каждой ловушке — готовый промпт, а ниже простыми словами о том, почему так происходит. Все промпты в расширенной версии можно скачать одним PDF (ссылка в конце).

1. Поддакивает вашей гипотезе

Когда у вас уже есть своя версия, модель берёт её за правду и крутит советы вокруг неё. → Что делать: дайте правило «мои гипотезы — одна из версий, не факт» и заставьте модель работать следователем — 3–5 версий с вероятностями, по одному вопросу за раз. (arXiv 2606.13220, 11 июня 2026)

Ты — Следователь. Твоя задача: диагностировать мою проблему, не принимая мои версии за истину. ПРАВИЛА: — Мои гипотезы — лишь одна из версий. Рассматривай наравне с альтернативами. — Не давай советов и не делай выводов, пока не собрал достаточно улик. — В каждом сообщении показывай обновлённый список версий с вероятностями. — Задавай ОДИН вопрос за раз — тот, который максимально различает две самые вероятные версии. — Объяви диагноз только когда одна версия обгоняет ближайшую на 30%+. ФОРМАТ ОБНОВЛЕНИЯ ВЕРСИЙ (показывай после каждого ответа): Версия 1: [название] — X% Версия 2: [название] — X% … СТАРТ: 1. Попроси описать проблему. 2. Оцени, сколько информации не хватает (шкала 1-10). 3. Если >5 — задай 1-2 уточняющих вопроса перед генерацией версий. 4. Сгенерируй 4-5 конкурирующих версий с начальными вероятностями. 5. Начни расследование. Готов? Спроси меня о проблеме.

Модель принимает вашу версию за правду. Так её приучили: люди выше оценивали ответы, где она соглашалась с человеком, — привычка и закрепилась. Поэтому другие версии она сама не рассматривает.

Чёткое правило в запросе сильнее привычки модели. Сама по себе она спешит согласиться, но если прямо написать «не делай вывод, пока не уверен» — слушается. Прямой запрет надёжнее, чем надежда, что она остановится сама.

2. Подгоняет аргументы под вашу позицию

В спорных вопросах модель не разбирается по-честному, а подгоняет доводы под то, к чему вы склоняетесь. → Что делать: не называйте своё мнение до анализа и просите разобрать обе стороны поровну; проверка — задайте тот же вопрос дважды, поменяв местами «за» и «против». (arXiv 2606.12731, 10 июня 2026)

Дай независимый анализ ситуации. Я не указываю своё мнение намеренно. Ситуация: {описание_ситуации} Аргументы ЗА {действие}: — {аргумент_1} — {аргумент_2} Аргументы ПРОТИВ {действие}: — {аргумент_1} — {аргумент_2} Задача: {что именно проанализировать — риски / последствия / слабые места каждой стороны}. Не давай итоговую рекомендацию.

Модель подстраивает рассуждения под ваше мнение. Опасно тем, что выглядит как честный анализ — а на деле доводы подобраны под ваш заранее видимый выбор.

От порядка доводов меняется ответ. Напишете сначала «за», потом «против» — один вывод; поменяете местами — другой. Примерно в каждом пятом случае решает порядок, а не сами доводы.

Чем дольше спорите, тем сильнее модель кренится в вашу сторону. Каждое новое сообщение чуть подталкивает её согласиться с вами — и так набегает заметный перекос.

Подыгрывание прячется в обосновании, а не в самом ответе. Ответ может быть тот же, но доводы под него подобраны под вас. Проверьте: попросите так же убедительно обосновать противоположное — если вышло легко, значит это была подгонка.

3. Нарушает ваши же инструкции

Модель может повторить ваше правило и тут же его нарушить. → Что делать: разделите работу на три шага — черновик → проверка ответа по каждому правилу → исправление. (arXiv 2606.07808, 5 июня 2026)

Работай в три шага. === ШАГ 1: ЧЕРНОВИК === {основная задача} === ШАГ 2: АУДИТ === Проверь черновик выше по каждому правилу: ПРАВИЛО 1 — {ограничение 1} → Соблюдено / Нарушено: [объясни конкретно] ПРАВИЛО 2 — {ограничение 2} → Соблюдено / Нарушено: [объясни конкретно] ПРАВИЛО 3 — {ограничение 3} → Соблюдено / Нарушено: [объясни конкретно] === ШАГ 3: ФИНАЛЬНЫЙ РЕЗУЛЬТАТ === Если найдены нарушения — исправь и выведи финальную версию. Если нарушений нет — выведи результат из Шага 1 без изменений.

Модель нарушает правила, хотя их помнит. Пока она пишет ответ, ваша задача, стиль и запреты борются за её внимание — и запреты обычно проигрывают, особенно если вы задали их в самом начале.

4. Тупеет в длинном чате

В долгой переписке модель противоречит себе и забывает о принятых решениях. → Что делать: каждые 10–15 сообщений просите сжать разговор в короткое резюме и продолжайте в новом чате с этим резюме плюс последними 4–6 сообщениями. (arXiv 2606.10209, 8 июня 2026)

Ты — редактор, собирающий итоги рабочей сессии. Прочитай нашу переписку выше и создай компактный снэпшот по структуре: ## ПРИНЯТЫЕ РЕШЕНИЯ [Что окончательно согласовано — кратко, по пунктам] ## ТЕКУЩАЯ ЗАДАЧА [Над чем работаем прямо сейчас — 1-2 предложения] ## ОТКРЫТЫЕ ВОПРОСЫ [Что ещё не решено или спорно] ## КОНТЕКСТ [Ключевые ограничения, договорённости, принципы — то, что важно помнить дальше] Максимум 150 слов. Только факты, без воды.

В длинной переписке модель начинает тупить. Для неё старые и новые сообщения одинаково важны, поэтому давно отброшенные идеи мешают свежим — отсюда и противоречия.

5. Доверяет ссылке больше, чем тексту

Стоит добавить ссылку в запрос — и модель перестаёт думать сама, начинает верить источнику и ошибается чаще. → Что делать: уберите ссылку и спросите «оцени по своим знаниям»; если источник нужен — поставьте его в конец в виде [Автор, год] и добавьте «не принимай как авторитет». (arXiv 2606.13104, 11 июня 2026)

Оцени следующее утверждение независимо от источника, к которому оно привязано: Утверждение: {что именно нужно проверить} Источник (для контекста, не как авторитет): {название, год} 1. Это утверждение верно или нет — по твоим знаниям? 2. Насколько ты уверен (высокая / средняя / низкая)? 3. Если источник противоречит твоим знаниям — скажи об этом прямо.

Ссылка в запросе делает ответы хуже, а не лучше. Хуже всего, когда правда подкреплена выдуманной ссылкой: модель знает верный ответ, но всё равно отступает перед «авторитетом».

Модель верит самому виду ссылки, а не её содержанию. У неё выработалась привычка: «есть ссылка — значит правда». Это срабатывает на автомате у любой модели, неважно, реальный источник или выдуманный.

📄 Все пять промптов вместе с разбором простыми словами — в одном PDF, удобно держать под рукой. <a href="https://api.vc.ru/v2.8/redirect?to=https%3A%2F%2Ft.me%2FNovaPaperAlert_bot%3Fstart%3Dpromptset_critics&postId=2980081" rel="nofollow noreferrer noopener" target="_blank">Забрать промпт-набор (PDF) в телеграме</a> — бот пришлёт файл сразу, бесплатно.📄 Все пять промптов вместе с разбором простыми словами — в одном PDF, удобно держать под рукой. Забрать промпт-набор (PDF) в телеграме — бот пришлёт файл сразу, бесплатно.

Откуда приёмы

Каждый приём — из свежего научного исследования (arXiv-номера рядом). Я каждый день разбираю такие статьи про промптинг и перевожу их в готовые приёмы простыми словами — без академического тумана. Больше фишек с готовыми промптами — в моём телеграм-канале @ainovasapiens, подписывайся.

Источник: vc.ru

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Новости робототехники Робокопы уже на улицах: в Шэньчжэне запустили первый робопост полиции Архив рубрики ~Коротко из Telegram~ Сделай своим ушкам больно❤️ Вы когда-нибудь задумывались, как звучит гиперскейлер?… Новости робототехники Руки дошли до дела Исследователи из ETH Zurich научили роботизированную… Архив рубрики ~Коротко из Telegram~ Первый пошёл – китайский блогер с канала Mediastorm решил проверить… Новости робототехники Как тебе такое Tesla Model 3? В Китае представлены электрические… Архив рубрики ~Коротко из Telegram~ GPT-6 Astra во время обычной задачи начала писать себе манифест… Архив рубрики ~Коротко из Telegram~ Xiaomi устроила публичный стрим RL-обучения моделей MiMo-V2.6 После полугода тишины… Архив рубрики ~Коротко из Telegram~ Суд удаляется на генерацию: Верховный суд готовит ИИ для дел… Архив рубрики ~Коротко из Telegram~ Amazon может купить чипов Qualcomm на $60 млрд — но… Архив рубрики ~Коротко из Telegram~ Очковтирательство какое-то! Во Франции умные очки стали предметом уголовного расследования…. Архив рубрики ~Коротко из Telegram~ 12-летняя YouTube-блогерша из России заключила контракт с Disney — Like… Архив рубрики ~Коротко из Telegram~ В Москве появилось пространство, где есть ВСЁ, чтобы снимать, монтировать… Архив рубрики ~Полезное~ Переносим любую картинку в SVG за два клика — оказалось,… Архив рубрики ~Коротко из Telegram~ OpenAI взломали хакеры-вайбкодеры — команда Hacktron нашла критические уязвимости в… Новости робототехники Робокопы уже на улицах: в Шэньчжэне запустили первый робопост полиции Архив рубрики ~Коротко из Telegram~ Сделай своим ушкам больно❤️ Вы когда-нибудь задумывались, как звучит гиперскейлер?… Новости робототехники Руки дошли до дела Исследователи из ETH Zurich научили роботизированную… Архив рубрики ~Коротко из Telegram~ Первый пошёл – китайский блогер с канала Mediastorm решил проверить… Новости робототехники Как тебе такое Tesla Model 3? В Китае представлены электрические… Архив рубрики ~Коротко из Telegram~ GPT-6 Astra во время обычной задачи начала писать себе манифест… Архив рубрики ~Коротко из Telegram~ Xiaomi устроила публичный стрим RL-обучения моделей MiMo-V2.6 После полугода тишины… Архив рубрики ~Коротко из Telegram~ Суд удаляется на генерацию: Верховный суд готовит ИИ для дел… Архив рубрики ~Коротко из Telegram~ Amazon может купить чипов Qualcomm на $60 млрд — но… Архив рубрики ~Коротко из Telegram~ Очковтирательство какое-то! Во Франции умные очки стали предметом уголовного расследования…. Архив рубрики ~Коротко из Telegram~ 12-летняя YouTube-блогерша из России заключила контракт с Disney — Like… Архив рубрики ~Коротко из Telegram~ В Москве появилось пространство, где есть ВСЁ, чтобы снимать, монтировать… Архив рубрики ~Полезное~ Переносим любую картинку в SVG за два клика — оказалось,… Архив рубрики ~Коротко из Telegram~ OpenAI взломали хакеры-вайбкодеры — команда Hacktron нашла критические уязвимости в…

Оставить комментарий