Как написать промт для ИИ, чтобы человек встал в позу на четвереньках

Нейросети для генерации изображений не всегда понимают человеческие описания поз буквально. Русскоязычное словосочетание «поза раком» модели часто либо игнорируют, либо искажают. Чтобы получить предсказуемый результат — человека, стоящего на четвереньках, — промт нужно строить на точных английских описаниях положения тела. Ниже разобрано, как это сделать.

Ключевая идея

Генераторы изображений обучались преимущественно на англоязычных подписях к картинкам. Поэтому позу следует описывать английскими ключевыми словами: on all fours, kneeling pose, hands and knees on the floor — и дополнять деталями.

Почему прямой перевод не работает

Слово «раком» при машинном переводе даёт «cancer» или «crab» — модель начнёт генерировать крабов или совершенно посторонние образы, а контент-фильтры могут заблокировать запрос. Та же проблема возникает с большинством разговорных обозначений поз. Решение — нейтральное анатомическое описание.

Рабочие формулировки позы

Английский вариант Что получится Точность
on all fours Человек опирается на ладони и колени Высокая
hands and knees on the floor Явное указание опор — меньше ошибок с конечностями Очень высокая
kneeling, leaning forward on hands Коленная поза с наклоном вперёд Средняя
quadruped pose Редкая формулировка, работает нестабильно Низкая

Структура идеального промта

Формула: Субъект → Поза → Ракурс → Окружение → Стиль

  1. Субъект — кто изображён: «a young woman», «an athlete».
  2. Поза — «on all fours, hands and knees on the floor, back straight».
  3. Ракурс — «side view» (вид сбоку показывает позу чётче всего), «full body shot».
  4. Окружение — «in a gym», «on a yoga mat».
  5. Стиль — «photorealistic», «anime style», «3D render».

Готовый пример промта

Full body shot of a woman on all fours, hands and knees on a yoga mat, back straight, side view, bright studio lighting, photorealistic, detailed anatomy

Перевод: «Человек в полный рост, стоит на четвереньках, ладони и колени на коврике для йоги, спина прямая, вид сбоку, яркое студийное освещение, фотореализм, детальная анатомия».

Частые ошибки и их исправление

✘ Ошибка

Писать русский разговорный вариант позы напрямую — модель переведёт его дословно.

✔ Решение

Опираться на английские ключевые слова и указывать точки опоры тела (hands, knees).

✘ Ошибка

Не задавать ракурс — модель показывает позу спереди, и её не видно.

✔ Решение

Добавлять «side view» и «full body», чтобы положение тела читалось однозначно.

Если поза всё равно получается криво

Даже с правильным промтом сложные позы нейросети воспроизводят с дефектами — лишние конечности, неестественные суставы. Помогают следующие приёмы:

  • ControlNet и OpenPose (в Stable Diffusion) — поза задаётся референсным скелетом, а не текстом. Это самый надёжный способ.
  • Референсное изображение — img2img или функция image prompt позволяет передать положение тела картинкой.
  • Негативные промты — добавить «extra limbs, deformed hands, bad anatomy» в негативный список.
  • Упрощение композиции — одна фигура на нейтральном фоне позируется значительно точнее, чем сцена с несколькими людьми.

Итог

Задача сводится к трём шагам: заменить разговорное русское выражение английским «on all fours, hands and knees on the floor», добавить ракурс «side view, full body», а при необходимости идеальной точности — использовать OpenPose или референсную картинку вместо чисто текстового описания.