Почему нейросеть рисует сток и как это исправить: формула промпта из шести блоков
Меня зовут Тай, я снимаю кино нейросетями и веду об этом Telegram-канал. Чаще всего новички в AI-картинках жалуются не на то, что «не получается». Получается. Красиво. Только не то, что они хотели.
Пишешь «рыбак на причале» и получаешь открытку ко Дню рыбака. Пишешь «красивая женщина в кафе» и получаешь рекламу крема. Ниже разберу, почему так происходит, и дам формулу, которая возвращает режиссуру тебе. Все примеры сделаны в одной модели, меняется только промпт. Это была Gemini 2.5 Flash Image: 2 октября 2026 Google её закрыл, на смену пришла Gemini 3.1 Flash Image. В другой модели картинки выйдут другими, но логика та же.
Три слова — и режиссёр уже не ты
Даю модели три слова: «рыбак на причале».
Получаю закат, силуэт и чаек. Красиво, но это кадр из тысячи открыток.
Что произошло. Нейросеть не умеет оставлять пустоты. Всё, чего ты не сказал, она решает сама и тянется к знакомым клише. Рыбак на причале? Закат, туман или лодки, чаще всего закат. «Среднее» у современных моделей давно красивое, поэтому кажется, что всё хорошо. Но решения принимала модель. Ты был зрителем, которому повезло.
Формула: шесть вопросов вместо трёх слов
Тот же рыбак, та же модель. Теперь на каждый вопрос, на который раньше отвечала она, отвечаю я.
Тот же рыбак. Режиссёр — я1. Кто в кадре «Пожилой, седая борода, жёлтый дождевик». Без деталей получишь человека-шаблон. Одна яркая вещь в одежде даёт глазу точку, куда смотреть.
2. Что делает «Чинит сеть». Человек, который просто стоит, — стоковое фото. Человек, который что-то делает, — уже история.
3. Где и когда. «Северная деревня, туман, раннее утро». Время суток и погода задают настроение дешевле любых эпитетов.
4. Камера «Средний план по пояс, 85 мм, малая глубина резкости». Язык фотографа для модели — ориентир, а не настройка. «85 мм» подсказывает портретную перспективу без искажений, «24 мм» — широкий угол и совсем другое кино. Размытый фон проси отдельными словами.
5. Свет «Мягкий рассеянный, холодные тона». Свет — это эмоция. Не выберешь сам — модель выберет за тебя, и чаще всего это будет «золотой час».
6. Стиль «Документальное фото, плёночное зерно». Ответ на вопрос «как это снято». Без него модель уходит в глянцевый рекламный лоск.
Собранный промпт:
На русском:
Сгенерируй изображение: пожилой рыбак с седой бородой в жёлтом дождевике чинит рыболовную сеть и смотрит в сторону моря. Деревянный причал в северной деревне, туман, раннее утро. Средний план по пояс, руки и сеть в кадре, объектив 85 мм, малая глубина резкости, мягко размытый фон. Мягкий рассеянный свет, холодные тона. Документальная фотография, плёночное зерно.
In English:
Generate an image: Elderly fisherman with a grey beard in a yellow raincoat mending a fishing net, looking toward the sea. Wooden pier in a northern village, fog, early morning. Medium shot from the waist up, hands and net in frame, 85mm lens, shallow depth of field, softly blurred background. Soft diffused light, cold tones. Documentary photograph, film grain.
Зачем два языка. У разных генераторов точнее то русский, то английский, это зависит от модели. Поэтому я даю обе версии: прогони обе в своём генераторе и оставь ту, что лучше держит детали. Как проверить это честно, расскажу в упражнении в конце.
Теперь честно посмотри на кадр. Почти всё модель выполнила. А «смотрит в сторону моря» проигнорировала: рыбак смотрит на сеть. Формула не гарантирует, что модель выполнит всё, она даёт тебе список, по которому видно, что именно не сработало. Чинится это точечной правкой исходника в режиме редактирования:
На русском:
Сохрани всё остальное без изменений. Поверни голову рыбака к морю, взгляд направлен за правый край кадра.
In English:
Keep everything else unchanged. Turn the fisherman’s head toward the sea, his gaze directed past the right edge of the frame.
Одна правка: голова к морю, остальное на местеЭту правку я делал уже в Gemini 3.1 Flash Image, загрузив исходный кадр. Лицо, руки и сеть остались прежними, повернулась только голова.
Пугает шесть блоков? Начни с трёх: кто, где, камера. Остальное добавляй по одному и смотри, что меняется.
Пять слов, которые делают из людей манекены
С портретами беда та же, только заметнее. Пишу «красивая женщина в кафе, идеальная безупречная кожа, ультрадетализация, 8k, студийный свет».
Всё идеально. Именно поэтому не верюПолучаю ровно то, что заказал: гладкую кожу, ровный свет и ретушь. На практике такой набор слов уводит портрет в рекламный глянец. Я сам выдал модели бриф на рекламу крема.
Что меняю:
1. Убираю «perfect», «flawless», «8k», «ultra detailed». Они не делают кадр качественнее. «8k» не задаёт разрешение, его выбирают в настройках генератора, а «ultra detailed» в портретах нередко усиливает ретушь.
2. Добавляю фактуру кожи: поры, лёгкие веснушки. Если модель нарисует наждачку вместо кожи, убери поры и оставь только «без бьюти-ретуши».
3. «Снято на телефон», лёгкий шум. Такие кадры глаз видит каждый день и считает честными.
4. Взгляд в окно, а не в камеру. Люди в кафе редко позируют.
5. Свет из окна. Мягкий, с одной стороны, как в реальной комнате.
Живой человек. Ни одного perfect в промптеНа русском:
Сгенерируй изображение: случайный снимок женщины чуть за 30 в маленьком кафе, смотрит в окно, слегка растрёпанные волосы, видны поры кожи, лёгкие веснушки, естественные несовершенства, серый свитер, мягкий свет из окна, снято на телефон, лёгкий шум, будничная атмосфера
In English:
Generate an image: Candid photo of a woman in her early 30s in a small cafe, looking out the window, slightly messy hair, visible skin pores, light freckles, natural imperfections, grey sweater, soft window light, shot on a phone, slight noise, everyday atmosphere
Три правила, которые экономят дубли
Включи создание картинки. В универсальном ассистенте сначала выбери режим создания изображения, потом начинай запрос с команды «Сгенерируй изображение:». После ответа проверь, что это сгенерированный кадр, а не чужое фото из поиска.
Одна правка — один дубль. Не меняй свет, фон и позу разом, иначе не поймёшь, что сработало. Если нужно сохранить лицо и позу, загрузи прошлый кадр в режим редактирования и перечисли, что нельзя менять. Исходник уменьшает дрейф, но не отменяет его, поэтому после каждого дубля снова проверь лицо, руки и одежду. В новой генерации без исходника лицо почти наверняка поплывёт.
Проверяй мелочи. Руки, направление взгляда, надписи на фоне, серьги и пуговицы. Тридцать секунд проверки экономят один неловкий разговор с заказчиком.
Упражнение на один вечер
Возьми одну свою сцену и пройди по шести вопросам. В одной модели и одном формате сделай по три дубля русского и английского промпта. Для каждого отметь, какие блоки модель выполнила, а какие проигнорировала. Так ты увидишь, на каком языке твой генератор понимает тебя точнее, и какие блоки он теряет чаще всего.
Зачем всё это
Заказчик платит не за «красиво». За «красиво» он и сам в нейросеть сходит. Он платит за управляемый результат под свой бриф. Промпт не читает мысли, но сокращает путь от «примерно так» до нужного кадра.
В Telegram-канале @tairantino я показываю и удачные кадры, и те, где модель опять решила стать режиссёром. Если нужен разбор без волшебных кнопок — заходи.
Источник: vc.ru
Похожие записи
Оцените материал:
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
