# Промптинг

Раздел справки Строфи целиком, статьи в порядке чтения. Источник: https://strophe.app/docs/product/prompting

# Из чего состоит хороший промпт

> Универсальный порядок описания сцены, который понимают все модели каталога, и чем подробный промпт отличается от короткого.

Источник: https://strophe.app/docs/product/prompting/how-to-write
Обновлено: 2026-08-07

Промпт — это текст, который вы подаёте на вход блока генерации. Модель получает его ровно в том виде, в каком вы написали: ничего не дописывается и не переводится по дороге. Поэтому результат почти целиком зависит от того, насколько точно вы описали желаемое.

## Порядок описания

Официальные руководства всех крупных моделей — Google, ByteDance, Kuaishou, OpenAI — сходятся на одной последовательности. Она и есть основа:

**субъект → действие → окружение → свет и настроение → камера → стиль**

Не обязательно заполнять всё. Для предметной съёмки не нужно действие, для абстрактного фона не нужен субъект. Но если элемент важен, он должен стоять на своём месте — модели читают промпт последовательно и первым частям доверяют больше.

Пишите связными предложениями, а не перечнем через запятую. Это не стилистическая придирка: руководство Seedream прямо приводит перечисление как пример плохого промпта, и на остальных моделях каталога оно работает не лучше.

Плохо:

```
girl, parasol, tree-lined path, oil painting
```

Хорошо:

```
A girl in a lavish dress walking under a parasol along a tree-lined path,
in the style of a Monet oil painting.
```

## Конкретика важнее красивых слов

Разница между «фэнтезийные доспехи» и «изысканные эльфийские латы с гравировкой из серебряной фольги, высоким воротником и наплечниками в форме соколиных крыльев» — это разница между случайным результатом и тем, что вы задумали. Прилагательные общего смысла («красивый», «атмосферный», «качественный») модель почти не использует: они не сужают выбор.

Полезно называть назначение изображения, когда оно есть. «Сделай логотип для премиального минималистичного бренда ухода за кожей» даёт заметно лучший результат, чем «сделай логотип», — модель подбирает композицию и типографику под задачу, а не рисует абстрактную эмблему.

## Подробное описание работает как промпт

Если у вас уже есть изображение, которое хочется повторить или взять за образец, самый надёжный путь — описать его подробно, а не пересказать в двух словах. Топовые модели следуют длинному описанию довольно точно.

На этом же построено быстрое действие «Описать детально» у блока изображения: оно разбирает изображение и выдаёт развёрнутое описание, которое можно подать любой модели как промпт.

## Параметры — не часть промпта

Соотношение сторон, разрешение, длительность видео и стилевые пресеты задаются в самом блоке генерации, а не словами в тексте. Строка «16:9, 4K, 10 секунд» внутри промпта не изменит настройки блока, зато займёт внимание модели и может сбить композицию.

## Сколько писать

Единого ответа нет, и это главное различие между моделями. Одни модели выигрывают от максимальной плотности описания, другие от неё теряют детали. Подробнее — в статье [Почему один и тот же промпт работает по-разному](https://strophe.app/docs/product/prompting/model-differences).

---

# На каком языке писать промпт

> Почему тело промпта стоит писать по-английски, как оставить внутри него русский текст и что происходит с русской речью в видеомоделях.

Источник: https://strophe.app/docs/product/prompting/language
Обновлено: 2026-08-07

Промпт уходит в модель без перевода — в том виде, в каком вы его написали. Модели каталога обучены преимущественно на английских описаниях, поэтому английский промпт даёт более предсказуемый результат, чем тот же смысл по-русски.

## Тело промпта — по-английски

Это относится к описательной части: субъект, действие, окружение, свет, камера, стиль. Русский промпт чаще всего тоже сработает, но заметно хуже отражает нюансы — редкие термины, названия техник и материалов, устойчивые формулировки киноязыка.

Литературности от английского не требуется: модель читает описание, а не текст. Достаточно точных существительных и глаголов — что в кадре, что происходит, как снято.

## Какой текст не нужно переводить на английский

Из правила есть важное исключение. Всё, что должно быть **видно на изображении** или **прозвучать в видео**, остаётся на своём языке, прямо внутри английского промпта. Если перевести русскую вывеску на английский, модель нарисует английские буквы.

```
A morning street in an old town, a small bakery with a hand-painted wooden
sign above the entrance reading "Пекарня", soft low sunlight.
```

Язык надписи полезно называть явно, а сам текст — брать в кавычки. У Seedream двойные кавычки прямо предписаны руководством как способ отметить текст для отрисовки.

## Речь в видео: у моделей разные возможности

Здесь единого правила нет, и разница существенная: модель может озвучить реплику не на том языке, никак об этом не предупредив.

**Seedance 2.0 и 2.5** поддерживают произвольный язык реплики: язык называется явно, и модель озвучивает текст на нём. У версии 2.5 многоязычность заявлена отдельной возможностью — больше десяти языков нативно.

**Veo 3.1** официально проверен только на английском. Другие языки могут сработать, но результат нестабилен.

**Kling 3.0, 2.6 и 2.5 Turbo** синтезируют речь только на китайском, английском, японском, корейском и испанском. Реплику на любом другом языке модель **переводит на английский** — русский диалог на Kling получить нельзя.

Если в видео нужна русская речь, выбирайте Seedance. Ролик с репликой не на том языке — это успешная генерация, кредиты за неё спишутся, поэтому выбирать модель стоит до запуска, а не после.

## Кириллица на изображении

Насколько аккуратно модель нарисует русские буквы, зависит от модели и в официальных руководствах не описано. Лучше всего с типографикой справляются Nano Banana Pro и Seedream — с них и стоит начинать, если надпись важна. Подробнее — в статье [Надписи на изображении](https://strophe.app/docs/product/prompting/text-in-result).

---

# Надписи на изображении

> Как попросить модель нарисовать конкретный текст, какие модели делают это точнее других и почему у каждого свой способ отметить надпись.

Источник: https://strophe.app/docs/product/prompting/text-in-result
Обновлено: 2026-08-02

Текст на изображении — постер, вывеска, обложка, логотип с названием — модели рисуют как графику, а не набирают шрифтом. Поэтому надпись нужно отметить в промпте так, чтобы модель поняла: это буквы, которые должны появиться в кадре дословно.

## Общее правило

Заключите текст в кавычки и скажите, где он находится. Так надпись отделяется от описания сцены.

```
Design a poster for a jazz festival with the title "Ночь в городе" printed
across the top in bold condensed lettering.
```

Чем короче надпись, тем выше шанс, что она выйдет без ошибок. Длинные фразы, мелкий текст и абзацы модели искажают почти всегда.

## Различия между моделями

**Seedream** — двойные кавычки предписаны официальным руководством именно для этого случая. Это самый надёжный способ в этой модели.

**Nano Banana Pro и Nano Banana 2** аккуратно рисуют типографику, включая сложные композиции. Руководство Google советует приём в два шага: сначала определиться с точной формулировкой текста, а потом просить изображение уже с ней. Nano Banana Pro — сильнейшая модель каталога по части шрифтов и вёрстки.

**GPT Image 2** официально признаёт, что точность размещения и чёткость текста у него хромают. Если надпись — главное в задаче, возьмите другую модель.

**Nano Banana 2 Lite** не рассчитана на сложные задачи и работает только в 1K — для типографики не лучший выбор.

## Кириллица

Отдельного упоминания в руководствах вендоров русские буквы не получают, поэтому гарантий нет. На практике лучше всего справляются Nano Banana Pro и Seedream. Текст надписи всегда пишется по-русски прямо внутри английского промпта — переводить его не нужно, иначе в кадре появятся английские слова. Подробнее — в статье [На каком языке писать промпт](https://strophe.app/docs/product/prompting/language).

## Если буквы вышли с ошибками

Это обычное дело даже у сильных моделей. Что помогает:

- Сократить надпись. Одно-два слова выходят точнее фразы.
- Повторить генерацию: результат от запуска к запуску различается.
- Указать характер шрифта словами — «bold condensed sans-serif», «hand-painted serif».
- Взять готовое изображение и попросить исправить только текст, оставив остальное неизменным. Как формулировать такую правку — в статье [Промпт для правки готового изображения](https://strophe.app/docs/product/prompting/editing).

---

# Промпт для правки готового изображения

> Чем инструкция редактирования отличается от описания изображения, почему нужно называть неизменное и как указать модели место правки.

Источник: https://strophe.app/docs/product/prompting/editing
Обновлено: 2026-08-07

Подключённое изображение модель может использовать двояко: как исходник, который надо поправить, и как образец стиля или персонажа для нового изображения. Роль задаёт промпт. Эта статья — про первый случай: когда изображение правят. Тогда промпт перестаёт быть описанием изображения и становится инструкцией, что именно изменить, — описывать заново всю сцену не нужно, модель видит её сама. Про образцы и референсы — статья [Несколько изображений на входе](https://strophe.app/docs/product/prompting/references).

## Назовите цель правки и то, что остаётся

Модели «плывут» по всему, чего вы не назвали явно: меняется поза, выражение лица, свет, фон. Поэтому в промпте редактирования две обязательные части — что изменить и что оставить как есть.

```
Add matching silver earrings and a necklace to the woman, keeping her pose,
expression, hairstyle and the background unchanged.
```

Руководства Seedream и Google требуют этого одинаково. Чем важнее сохранить исходник, тем подробнее список неизменного.

## Без местоимений

«Убери это», «поменяй его цвет», «сделай ту штуку слева поменьше» — модель не понимает, о чём речь. Называйте объект: «убери шляпу», «поменяй цвет дивана на тёмно-зелёный».

Глаголы лучше брать прямые и однозначные: add, remove, replace, transform, dress, turn into.

## Одна правка за раз

Четыре изменения в одном предложении модель выполняет частично — что-то теряется. Если правок несколько, запускайте их последовательно, каждый раз подавая на вход результат предыдущего шага.

## Указание места

Некоторые модели понимают пометки прямо на входном изображении. Seedream официально поддерживает стрелки, рамки, обводки и цветные области: «поставь телевизор туда, где красная область, а диван — где синяя». Seedream 5.0 Pro заточен под такую работу отдельно.

У GPT Image маска работает иначе: она подсказывает область, но не задаёт её точную геометрию, и модель может выйти за контур. Если на вход подано несколько изображений, маска применяется к первому.

## Когда правка не выходит

Если модель упорно меняет то, что вы просили не трогать, чаще всего помогает не более сильная формулировка, а смена подхода: описать желаемый результат целиком и сгенерировать заново, взяв исходник как референс. Про подачу нескольких изображений — в статье [Несколько изображений на входе](https://strophe.app/docs/product/prompting/references).

---

# Несколько изображений на входе

> Как адресовать референсы в промпте по их порядку, сколько изображений имеет смысл подавать и почему заполнять лимит до отказа вредно.

Источник: https://strophe.app/docs/product/prompting/references
Обновлено: 2026-08-07

Когда на вход блока подано несколько изображений, модель должна понять, какую роль играет каждое: откуда взять человека, откуда одежду, откуда стиль. Само по себе это из изображений не следует — роли задаёт промпт. Что вообще принимают на вход разные модели, собрано в статье [Что подавать на вход генерации](https://strophe.app/docs/product/generation/inputs-and-references).

## Адресация по порядку

Изображения нумеруются в том порядке, в каком подключены к блоку. В промпте на них ссылаются по номеру:

```
Replace the subject in Image 1 with the subject from Image 2, keeping the
lighting and background of Image 1.
```

Порядок соединений и есть порядок референсов. Номера самих соединений в интерфейсе не подписаны — рядом со входом виден только счётчик подключённых изображений. Поэтому, если результат перепутал источники, надёжнее всего отключить входы и подключить их заново в нужной последовательности. Как устроены соединения, разобрано в статье [Соединения между блоками](https://strophe.app/docs/product/canvas/connections).

## Больше референсов не значит лучше

Ниже — рекомендации из руководств самих разработчиков моделей, а не пределы Строфи: сколько изображений примет конкретный блок, показывает счётчик рядом со входом. Почти везде рекомендуемое число заметно ниже технического максимума:

| Модель                 | Пределы                                                  |
| ---------------------- | -------------------------------------------------------- |
| Nano Banana Pro        | до 6 объектов, до 5 персонажей, до 3 стилевых референсов |
| Nano Banana 2          | до 10 объектов, до 4 персонажей                          |
| Nano Banana 2 Lite     | до 14 объектов, консистентность персонажа не поддержана  |
| Nano Banana            | лучше всего с тремя изображениями                        |
| Seedream               | до 14 (Seedream 5.0 Pro — до 10)                         |
| Veo 3.1                | до 3                                                     |
| Grok Imagine           | до 3 при редактировании                                  |
| Seedance 2.0 Reference | до 9 изображений и 3 роликов                             |
| Seedance 2.5 Reference | до 30 изображений, 10 роликов и 10 звуковых отрывков     |

Руководство Seedance прямо предупреждает: если забить лимит до отказа, модель перестаёт понимать приоритеты. Для Seedance 2.0 там же назван рекомендованный набор — четыре-пять материалов: одно-два изображения персонажа, одна сцена, одно видео с нужным движением камеры, одна звуковая дорожка.

У Seedance 2.5 рекомендации даны не по числу файлов, а по числу героев: до восьми, если герой задан изображением, и до пяти, если голосом или роликом. Дальше доходит и до двенадцати, но стабильность падает и попытку приходится повторять. Ролики и звуковые отрывки, с которых снимается образец, лучше держать в пределах пяти-десяти секунд — на длинных модель сбивается.

## Консистентность персонажа

Чтобы персонаж не менялся от кадра к кадру, дайте отдельный портрет крупным планом с нейтральным выражением и отдельный снимок в полный рост, а самый важный референс поставьте в промпте первым.

Разворотные листы персонажа — набор ракурсов на одном изображении — для Seedance 2.0 противопоказаны: модель принимает разные ракурсы за разных людей и может нарисовать в кадре двойника. Seedance 2.5 их принимает, но с оговоркой: до пяти героев одинаково работают и один ракурс, и несколько, а если героев больше — надёжнее по одному ракурсу на изображение, чем несколько ракурсов на одном. Остальное про описание движения и кадра — в статье [Промпт для видео](https://strophe.app/docs/product/prompting/video).

## Привязку пишут в промпте, а не на изображении

Подписать имя героя прямо поверх его изображения и дальше ссылаться на это имя в тексте — приём, который не работает: модель путает героев и рисует лишних. Связь «кто есть кто» задаётся только текстом промпта, по номерам входов.

Когда героев несколько, перечислите соответствия по одному, списком:

```
Images 1-2 are Character 1 and correspond to Audio 1;
Images 3-4 are Character 2 and correspond to Audio 2.
```

И скажите, что именно берётся с каждого материала: «Refer to Image 1 for lighting and filters», «Refer to the action of casting the spell in Video 1». Если материал сам по себе точен, пересказывать его содержание словами не нужно — достаточно сослаться и добавить, что порядок должен совпасть с исходником.

## Стиль отдельно от содержания

Если один референс задаёт содержание, а другой — манеру рисунка, скажите это прямо: «Apply the style of Image 2 to the scene in Image 1». Без такого указания модель смешает оба источника.

---

# Промпт для видео

> Чем описание движения отличается от описания изображения, как раскладывать сцену на кадры, что писать про камеру и звук и где модели расходятся сильнее всего.

Источник: https://strophe.app/docs/product/prompting/video
Обновлено: 2026-08-07

В видео к описанию кадра добавляется развитие во времени: что происходит, в каком порядке и как при этом ведёт себя камера. Обычно достаточно порядка событий; точные секунды понимают не все модели — об этом ниже. Промпт, который хорошо работает для изображения, для видео обычно недостаточен — он описывает состояние, а не изменение.

## Что добавить к описанию сцены

**Движение субъекта.** Не «человек идёт», а что именно и как: какой частью тела, с какой скоростью, с каким усилием. «Медленно поднимает руку», «резко поворачивает голову».

**Поведение камеры.** Стоит неподвижно, следует за героем, наезжает, отъезжает, облетает. Термины киноязыка модели понимают: medium shot, close-up, slow push-in, tracking shot, fixed shot.

**Развитие во времени.** Что в начале, что в середине, чем заканчивается.

**Звук**, если модель его генерирует: реплики, звуковые эффекты, фоновая среда.

## Раскадровка вместо прозы

Сложную сцену лучше разложить на кадры, а не описывать сплошным текстом. Формат понимают и Seedance 2.0, и Kling 3.0:

```
Shot 1, wide shot of a truck driver at dawn, cinematic handheld.
Shot 2, macro shot of hands on the steering wheel.
Shot 3, close-up of a weathered photograph on the passenger seat.
```

Одно движение камеры на кадр. Наезд, отъезд и панорама одновременно ломают стабильность изображения.

Seedance 2.5 понимает и второй способ разметки — по времени. Годятся интервалы (`0-3 seconds… 3-7 seconds…`), отдельные моменты («быстрый переход влево на пятой секунде») и относительные указания («через три секунды после того, как он замер»). Шаг разметки — целая секунда, доли модель не различает.

Два правила при разметке по времени. Интервалы идут подряд, без пропусков: дыра вида «0–3 с… 5–6 с» сбивает модель. И на каждый интервал приходится столько событий, сколько в него реально помещается — пустой интервал модель заполнит отсебятиной, переполненный нарежет лишними склейками или выбросит часть задуманного. Для частых повторяющихся движений разметка по времени не годится вовсе: «мотает головой три раза в секунду» не отрабатывается.

## Раскадровка на входе: лист или ключевые кадры

Раскадровку можно не описывать словами, а подать изображением. Seedance 2.5 Reference различает два способа, и строгость у них разная.

**Лист с раскадровкой** — несколько клеток на одном изображении. Модель читает его как общий план сюжета, а не как точный образец: композиция и детали кадров в результате будут своими. Годится до пятнадцати клеток, и лучше работает простой линейный набросок — без заливки, без подписей поверх изображения.

**Ключевые кадры** — каждый кадр отдельным изображением, поданным по порядку. Здесь совпадение с исходниками заметно строже. В промпте это открывается прямой фразой:

```
Use Images 1 to 7 in order as keyframes.
```

Если важно, чтобы кадр в результате действительно совпал с задуманным, выбирайте второй способ.

## Держите сцену выполнимой

Всё, что вы описали, должно уместиться в выбранную длительность. Сюжет на минуту, втиснутый в пять секунд, превращается в мельтешение. Плавные непрерывные движения выходят лучше резких: спринт, прыжки и кувырки моделям даются плохо.

Точное количество предметов и людей модели не удерживают — «десять щенков» превратятся в неопределённое количество. Сложная физика тоже: отскок мяча, траектория броска.

## Эмоция через физику

Абстракции вроде «грустная девушка» модель понимает слабо. Описывайте телом: опущенная голова, подрагивающие плечи, покрасневшие глаза, пальцы теребят край одежды.

## Где модели расходятся

**Точное время.** Kling 3.0 понимает указания вида «на четвёртой секунде» и «в последние три секунды» — они есть в примерах официального руководства. Seedance 2.0 от жёстких секунд наоборот плывёт: там работают только номера кадров, а ритм лучше оставить модели. Seedance 2.5 это различие снял — руководство прямо противопоставляет версии и разрешает разметку по целым секундам.

**Подробность движения.** Seedance 2.0 просит разбирать действие по частям тела, с амплитудой и скоростью. Seedance 2.5 просит обратного: общее описание («несколько подходов с высоким подъёмом колена», «обе стороны сходятся в ближнем бою»), а подробно — только два-три запоминающихся движения. Расписывать там каждое одинаково дотошно вредно.

**Плотность.** Kling 3.0 рассчитан на длинные подробные режиссёрские описания. Kling 2.6 и 2.5 Turbo — наоборот, на простые слова и короткие конструкции. Это разные требования у одного бренда, и версия здесь важнее названия.

**Люди в кадре.** Модерация Seedance часто отклоняет референсы с людьми. Для видео с реальными людьми надёжнее Kling 3.0.

## Речь

Реплики привязываются к персонажу. У Kling 3.0 — прямо в тексте:

```
Mom (softly, in a surprised tone): I didn't expect this at all.
```

У Veo 3.1 — с именем и ремаркой, реплика в кавычках. У Seedance 2.0 для реплик отведены фигурные скобки, а для субтитров — отдельные скобки, и язык реплики называется явно.

В примерах руководства Seedance 2.5 реплика написана иначе — простой строкой с именем говорящего: `Dialogue (elderly woman): "Fly safe, my child."`. При этом официальный навык ByteDance для 2.5 прежний набор скобок сохраняет, то есть работают оба способа. Скобки размечают тип содержимого — реплику, музыку, звуковой эффект, — а именованная строка удобнее, когда говорящих несколько.

Языки речи у моделей разные, и это единственное место, где ошибка не видна до конца генерации. Подробности — в статье [На каком языке писать промпт](https://strophe.app/docs/product/prompting/language).

## Незаказанные субтитры и логотипы

Видеомодели дорисовывают то, чего не просили: субтитры под репликой, логотип чужой платформы, вотермарку. Полностью это не отключается, но вероятность снижают три вещи, и руководство Seedance перечисляет их вместе:

- прямой запрет в промпте — `no subtitles`, `do not generate a watermark`, `do not generate a logo`. Это тот случай, когда отрицание работает лучше положительной формулировки;
- чистые входные материалы: если на референсе есть текст и он не нужен, уберите его заранее отдельной генерацией;
- горизонтальный кадр — в вертикальном субтитры появляются заметно чаще. Если формат позволяет, снимайте горизонтально и обрежьте потом.

У Seedance 2.5 запрет распространяется и на звук: `no BGM`, `no audio`, `only environmental sounds and action sounds` — документированные формулировки.

## Продление и склейка

Продлевают и склеивают ролики сами модели, а не Строфи: у части видео-моделей есть вариант, который принимает готовый ролик и дописывает продолжение. При продлении качество накапливает искажения: после нескольких итераций лица идут пятнами. Стык кадров даёт заметный рывок.

Сколько роликов принимает вход, зависит от версии: Seedance 2.0 Reference — три клипа общей длительностью до пятнадцати секунд, и это же её предел на склейку. Seedance 2.5 Reference принимает до десяти клипов и до тридцати секунд суммарно; отдельного предела именно на склейку её руководство не называет.

---

# Промпт для аудио

> Чем промпт для музыки отличается от промпта для озвучки, как описывать голос и звуковую сцену и зачем аудио на входе нужна ссылка в тексте промпта.

Источник: https://strophe.app/docs/product/prompting/audio
Обновлено: 2026-08-04

Аудио-модели решают две разные задачи. Одни пишут музыку — инструментал или трек с вокалом. Другие собирают звуковую сцену целиком: реплики персонажей, фоновые шумы, эффекты и музыку одним куском. Промпт для этих задач устроен по-разному, и текст, написанный под одну, на другой даст не тот результат. Какая модель что умеет, видно в каталоге — состав каталога меняется, приёмы ниже остаются.

## Промпт для музыки

Музыкальной модели нужно описание самой музыки, а не сюжета или изображения, под которое она пойдёт. Работает набор из пяти вещей: жанр, настроение, инструменты, темп и характер вокала.

```
An energetic electronic dance track with soaring synth leads, punchy
four-on-the-floor kick drums and a catchy female vocal hook. 128 BPM.
```

Темп можно задавать числом в BPM или словами — «slow ballad», «fast tempo». Вокал описывается так же прямо: «male vocals», «female soprano», «rap». Если вокал не нужен, это лучше сказать явно.

Голоса реальных исполнителей модель воспроизводить отказывается — запрос «спой голосом такого-то» отклоняется фильтром.

Язык вокала называйте в промпте явно. У каждой модели свой список заявленных языков — у Lyria 3 это английский, немецкий, испанский, французский, хинди, японский, корейский и португальский, — но списком дело не ограничивается: русский вокал она поёт, хотя в заявленных языках его нет.

## Промпт для звуковой сцены

Модель звуковой сцены читает промпт как короткий сценарий. Сильный промпт называет обстановку, вводит каждого говорящего с описанием голоса и подачи, а потом даёт саму реплику.

```
Inside a huge football stadium, with the deafening roar of tens of thousands
of fans in the background. The commentator (middle-aged male, British accent,
rich penetrating voice, extremely exhilarated) shouts: "OH, HE SCORES!"
```

Что стоит задать про каждый голос: пол, примерный возраст, акцент, тембр, эмоцию и темп речи. Чем конкретнее описание, тем меньше модель выбирает наугад.

Музыка и звуковые эффекты описываются в том же тексте обычными словами — отдельных полей для них нет. Один непрерывный фоновый слой плюс несколько точных эффектов работают лучше, чем десяток разных звуков подряд.

Скорость речи, громкость и высота тона — параметры блока, а не часть промпта. Писать их словами в текст не нужно.

## Аудио на входе — это образец голоса

Аудио, подключённое к блоку генерации звука, — это образец голоса: модель повторит его звучание в своей озвучке. Сколько записей принимает модель, показывает сам блок; у Seed Audio 1.0 их до трёх.

Само подключение файла ничего не значит — на образец надо сослаться в тексте промпта. У Seed Audio 1.0 ссылка выглядит как `@Audio1`, `@Audio2`, `@Audio3`, и номер соответствует порядку соединений: первый подключённый файл — `@Audio1`.

```
Dex (smooth warm confident broadcaster voice, voiced by @Audio1), relaxed
and amused, says: "Alright, what exactly did you do?"
```

Промпт без такой ссылки — самая частая ошибка с этой моделью: файл подключён, в тексте о нём ни слова, и озвучка приходит чужим голосом либо генерация обрывается ошибкой.

## Каким должен быть образец голоса

Требования к записи жёсткие, и модель отклоняет то, что им не соответствует:

- не длиннее 30 секунд;
- ровно один голос — второй говорящий на записи делает её непригодной;
- без музыки и с минимумом фонового шума;
- одна эмоция и один тембр на всю запись;
- ровный уровень записи, естественный темп речи.

Если модель отказалась брать запись, дело почти всегда в этом: в файле музыка, несколько голосов или шумный фон.

## Чего аудио на входе не делает

Это не референс стиля. Музыкальный отрывок, подключённый в надежде «сделай похоже по звучанию», задачу не решает: входа для образца музыкального стиля у аудио-моделей нет, стиль задаётся только словами в промпте.

Подключённая к Seed Audio 1.0 запись используется ещё и для работы с готовым звуком — продлить фрагмент, склеить два фрагмента, заменить реплику, сохранив голос и звучание помещения. Всё это тоже задаётся текстом промпта со ссылкой `@Audio1`.

## Изображение вместо аудио

Аудио-модели принимают на вход и изображение. Музыкальной модели изображение задаёт настроение и тему будущего трека — так работает Lyria 3. Модели звуковой сцены она подсказывает характер озвучки: у Seed Audio 1.0 в этом режиме в промпте оставляют только текст, который нужно произнести.

Изображение и аудио одновременно Seed Audio 1.0 не принимает — что-то одно.

---

# Почему один и тот же промпт работает по-разному

> Главное расхождение между моделями — насколько плотно писать, а также сильные и слабые стороны основных моделей каталога.

Источник: https://strophe.app/docs/product/prompting/model-differences
Обновлено: 2026-08-07

Универсальный каркас промпта общий для всех моделей, а вот требования к тому, насколько плотно его заполнять, у моделей разные — иногда противоположные. Промпт, отточенный под одну модель, на другой может дать результат заметно хуже.

## Главное различие — плотность

**Любят подробность.** Nano Banana, Seedance, Kling 3.0, Veo. Здесь длинное детальное описание выигрывает: чем больше вы задали, тем меньше модель додумывает.

**Любят краткость.** Seedream. Официальное руководство ставит предел в 600 английских слов и предупреждает, что нагромождение украшений размывает внимание и детали выпадают. Сложную сцену со многими требованиями описывать можно и нужно — но простыми словами, без пышности.

**Любят простоту.** Kling 2.6 и 2.5 Turbo: простые слова, короткие предложения.

Обратите внимание, что Kling попал сразу в две группы. Версия модели меняет правила сильнее, чем разница между вендорами.

## Сильные стороны моделей

**Nano Banana Pro** — сложный визуальный дизайн, точная типографика, лучшее знание мира, до 4K. Первый выбор, когда в кадре важен текст или нужна выверенная композиция.

**Nano Banana 2** — универсал с хорошим балансом цены и качества, надёжный рендер текста, 4K.

**Nano Banana 2 Lite** — только 1K, не рассчитана на несколько референсов и многошаговое редактирование. Для простых задач.

**Seedream** — образовательный контент: формулы, схемы, инфографика, техническая иллюстрация. Понимает язык фотографии: тип плёнки, объектив, диафрагму, характер света. Умеет серии — набор иконок, раскадровку, брендбук: достаточно попросить «a series» или «a set» либо назвать количество.

**GPT Image 2** — ровный универсал, но с официально признанными слабостями: точность размещения и чёткость текста, консистентность повторяющегося персонажа между генерациями, сложные layout-чувствительные композиции. Прозрачный фон не поддерживает.

**Kling 3.0** — видео с людьми, мультикадровые сцены, нативный звук, длительность от трёх до пятнадцати секунд.

**Seedance 2.0** — видео по нескольким референсам, произвольный язык реплик, тонкий контроль движения.

**Seedance 2.5** — ролик до тридцати секунд одним куском, до пятидесяти материалов на входе, речь больше чем на десяти языках. Разметку сцены по секундам, ключевые кадры и раскадровку листом понимает только эта версия.

**Veo 3.1** — кинематографичность, звук, интерполяция между первым и последним кадром, продление ролика.

**Lyria 3** — музыка, инструментальная или с вокалом. Промпт описывает жанр, настроение, инструменты и темп.

**Seed Audio 1.0** — озвучка и звуковые сцены: реплики персонажей, эффекты и фоновая музыка одним куском. Умеет повторить голос с приложенного образца.

## Как выбирать

Если задача про текст в кадре — Nano Banana Pro или Seedream. Если про схему или инфографику — Seedream. Если про видео с русской речью — Seedance. Если про видео с людьми — Kling 3.0. Если про музыку — Lyria 3, а если про озвучку и звуковую сцену — Seed Audio 1.0; как писать промпт для обеих, разобрано в статье [Промпт для аудио](https://strophe.app/docs/product/prompting/audio).

Полный список моделей с ценами и возможностями — в статье [Каталог моделей](https://strophe.app/docs/product/generation/model-catalog).

---

# Что в промпте не работает

> Приёмы из Stable Diffusion и Midjourney, которые в Строфи не действуют, и привычные формулировки, которые вредят результату.

Источник: https://strophe.app/docs/product/prompting/antipatterns
Обновлено: 2026-08-07

Часть приёмов, привычных по другим генераторам, здесь не просто бесполезна — она ухудшает результат, потому что занимает внимание модели ничего не значащим текстом.

## Перечисление через запятую

Тег-стиль, принятый в Stable Diffusion и Midjourney, для моделей каталога — антипаттерн. Руководство Seedream приводит его как пример плохого промпта явным образом. Пишите предложениями.

## Веса и служебные флаги

Конструкции вида `(detailed face:1.4)`, `[background:0.5]` и флаги вроде `--ar 16:9`, `--v 6`, `--style raw` в Строфи не поддерживаются. Модель получит их как обычный текст и попытается осмыслить. Соотношение сторон и прочие настройки задаются параметрами блока.

## Слова-заклинания качества

`masterpiece`, `best quality`, `8k`, `ultra realistic`, `highly detailed`, `trending on artstation` — наследие моделей прошлого поколения. Современные модели и без них выдают максимальное качество, а место в промпте эти слова занимают.

Если нужен конкретный визуальный характер, называйте его предметно: тип плёнки, объектив, схему света, художественную технику.

## Отрицания в лоб

«Без машин» модель понимает плохо: упоминание машин повышает вероятность, что они появятся. Google рекомендует формулировать через положительное описание — говорить, что в кадре есть, а не чего в нём нет: «пустая улица ранним утром, чистый асфальт, длинные тени».

Исключение — технический мусор и звук. Незаказанные субтитры, вотермарки и логотипы чужих платформ в видео убираются именно прямым запретом, и руководство Seedance это предписывает. У Seedance 2.5 к ним добавлен звук: `no BGM`, `no audio`, `only environmental sounds` — документированные формулировки. Что ещё снижает вероятность незаказанных субтитров — в статье [Промпт для видео](https://strophe.app/docs/product/prompting/video).

## Параметры словами

Разрешение, длительность, соотношение сторон и номер сида внутри текста промпта ни на что не влияют. Это настройки блока.

## Слишком много референсов

Заполнять лимит входных изображений до отказа вредно: модель перестаёт понимать, что важнее. Подробнее — в статье [Несколько изображений на входе](https://strophe.app/docs/product/prompting/references).

## Разворотные листы персонажа для видео

Изображение с несколькими ракурсами одного героя Seedance 2.0 читает как нескольких разных людей — в кадре появляются двойники. Подавайте отдельные снимки. Seedance 2.5 разворотные листы принимает; оговорки собраны в статье [Несколько изображений на входе](https://strophe.app/docs/product/prompting/references).

## Сценарий целиком вместо промпта

Полный текст сценария со всеми репликами и ремарками модель не отрабатывает: она теряет приоритеты и путает персонажей. Разложите замысел на кадры — как в статье [Промпт для видео](https://strophe.app/docs/product/prompting/video).