Паспорт генерации изображения
Промт генерации изображения
Dark neon 'underside of progress' scene, cyberpunk workshop at night, wide cinematic shot. On a scarred wooden workbench lies a long strip of perforated punch tape, flat on the surface, running the full width of the frame. Two heavy mechanical reader heads are clamped onto the tape far apart from one another: the near head lit cold teal-cyan, the distant head glowing warm amber. Both haul the tape in opposite directions, and midway between them the tape has buckled and torn open along its perforations. Every object rests physically on the bench, weighted down and supported - nothing floats or hovers. Around them a cluttered bench: hand tools, coiled cables, a cooling fan, dim indicator lights, dust and fine metal shavings. Deep shadow, volumetric haze, warm amber and cyan color palette, shallow depth of field, cinematic film still on 35mm, intricately detailed. The tape and every surface are completely blank - no writing of any kind.
Промт - это задание для модели, и выполняет она его буквально: вместе со всем, что попало туда не нарочно.
Промт - это текст, которым человек объясняет нейросети, что от неё нужно. Вопрос в одну строку, просьба, инструкция на две страницы - всё это промт. Слово пришло из английского prompt, «подсказка», и прижилось без перевода; пишут и «промт», и «промпт», разницы нет.
Определение простое, и обычно на нём всё и заканчивается. Дальше начинается то, чего не найти в подборках «10 правил идеального промта»: модель исполняет написанное буквально. Не то, что вы имели в виду. То, что написали.
Ниже - как это выглядит, когда ломается по-настоящему. С замером до и после.
Чем промт отличается от поискового запроса
Главная путаница достаётся тем, кто пришёл к нейросети из поисковика. В поиске вы называете тему, а движок ищет страницы, где эта тема есть. Набрали «рецепт борща» - получили страницы про борщ, написанные людьми.
Модель не ищет ничего. Она собирает ответ прямо сейчас, опираясь только на ваш текст. Поэтому «рецепт борща» для неё звучит как «сочини что-нибудь похожее на рецепт борща» - и вы получаете усреднённое нечто без единого источника.
Разница простая. В поиске называют тему. В промте описывают результат: для кого, какого объёма, что внутри обязательно и чего быть не должно.
Отсюда вторая вещь, которую полезно знать сразу: промт у модели обычно не один. Кроме того, что вы печатаете в окошке, есть системный промт - постоянная инструкция, которая подставляется к каждому запросу и задаёт правила игры. Вся история ниже - про него.
Точка А: конвейер, который начал сочинять
Дома у меня работает конвейер, который пишет черновики текстов локальной моделью. Устроен незамысловато: модель получает постоянную инструкцию про голос и структуру - тот самый системный промт, я зову его «уставом», - короткий бриф конкретного текста и блок фактического сырья. Правило жёсткое: факты берутся только из сырья.
И в какой-то момент в готовых черновиках полезли детали, которых в сырье не было вовсе.
«Метрики рапортовали "чисто"» - при том, что никаких метрик в той истории не существовало. «Скормил ему логи» - хотя разгадка пришла из сопоставления двух номеров, и логи никто не открывал. Финал слово в слово повторил дежурную формулу, хотя устав прямо требует каждый раз новую.
Реакция была предсказуемой: выдумывает, значит надо запретить строже. Добавить «НЕ», закрутить гайки.
Запрет и указание в одном файле
Прежде чем дописывать запреты, стоило прочитать устав целиком. Запрет на выдумки там уже стоял. А рядом с ним - прямые указания делать ровно то, за что модель собирались ругать.
В разделе о структуре: «Показать ловушку: все приборы рапортуют "чисто", а не работает».
В разделе о живых интонациях, ниже: «Технический регистр вместо бытового: "метрики рапортовали", не "приборы рапортовали"».
Каждая формулировка по отдельности разумна. Вместе они требуют написать фразу «метрики рапортовали "чисто"» - независимо от того, были ли в истории метрики. Что модель и сделала.
Второе противоречие лежало в том же файле. Один раздел абстрактно запрещал сводить финал к дежурным формулам. Другой, ниже, диктовал готовое предложение про роль ИИ. Черновик закончился почти дословно им.
Проверил догадку: убрал готовую формулу, перегенерировал тот же текст на том же сырье. Модель взяла соседнюю - «ИИ здесь выступил в роли зеркала». Это слово тоже стоит под запретом в одном разделе, но в другом, выше, та же мысль подана утвердительно. Взято было оттуда, где утверждение, а не оттуда, где запрет.
Вот механика, ради которой стоило разбираться: запрет, живущий только в тексте инструкции, перебивается любым утверждением рядом.
Точка Б: три правки, ноль выдумок
Починка оказалась скучнее, чем понимание.
- Один источник фактов, названный явно. В головной раздел добавлено: нельзя добавлять инструменты, логи, метрики, числа и шаги, которых нет в сырье. Приёмы стиля переведены из обязательств в возможности - применяются только там, где под них есть материал.
- Условные формулировки вместо безусловных. Было «покажи ловушку». Стало: «если в сырье есть проверки, рапортующие "чисто" - покажи ловушку; если таких проверок нет - не изобретай их».
- Критичные запреты вынесены наружу. Их проверяет отдельный скрипт: читает готовый текст и не пускает дальше, если находит запрещённые маркеры. Инструкция просит, скрипт не пускает.
Замер после правок: из семи маркеров выдуманных деталей осталось ноль. Финалы стали описывать конкретное действие вместо метафоры.
Между точками А и Б не прибавилось ни одного «магического слова». Убавилось противоречий.
Можно ли поручить промт самой нейросети
Можно, и это разумно - с оговоркой, которая следует прямо из этой истории.
Черновик инструкции модель пишет отлично. Опишите словами, что хотите получить, и попросите развернуть это в подробное задание: пара ваших фраз превратится в структурированный текст, который будет лучше того, что большинство пишет руками.
Дальше начинается неприятное. Чем длиннее промт, тем больше в нём разделов, а мой устав сломался именно на том, что два далёких друг от друга правила вместе потребовали выдумки. Сгенерированное задание даёт эту болезнь в удвоенном размере: оно длинное, гладкое, и противоречия в нём не бросаются в глаза - каждое предложение по отдельности звучит здраво.
Так что связка выходит такая: модель пишет черновик задания, автор читает его целиком и своими глазами.
А вот на что модель годится безусловно - читать готовый промт. В этой истории она отработала как измерительный прибор: безошибочно показала, что в задании написано на самом деле, а не что имелось в виду. Ту же способность можно развернуть себе на пользу - отдать ей свою инструкцию и попросить найти места, где два правила требуют разного. Чужой текст она читает буквальнее автора именно потому, что не знает, что автор имел в виду.
Ошибка была не в исполнителе
Промт часто принимают за заклинание: подобрать правильные слова, и модель наконец поймёт замысел. Отсюда и бесконечные подборки «лучших промтов» - их листают в надежде, что нужное слово найдётся там.
Силой сами по себе слова не обладают. Промт работает как техническое задание: каждая формулировка закрывает какую-то неоднозначность, а если не закрывает - выбор делает модель, и берёт она вариант, сформулированный конкретнее.
Практический вывод отсюда один, и он неудобный. Если ответ раз за разом получается не тот, читать надо не чужие советы, а собственный промт. Целиком, вместе с теми разделами, которые лежат далеко друг от друга и в сумме требуют от модели начать врать.
