Генерация человека в полный рост в лежачем положении — одна из самых капризных задач для нейросетей. Модель либо «отрезает» ноги за краем кадра, либо превращает лежащую фигуру в портрет по пояс. В этом материале — разбор того, как сформулировать промт в Higgsfield Soul так, чтобы ИИ с первого раза выдавал корректную фигуру на полу — от макушки до пяток.
Почему нейросети «ловятся» на лежачих позах
Проблема не в конкретной модели, а в обучающих данных. Подавляющее большинство фотографий людей — это портреты и стоячие фигуры в вертикальном или горизонтальном формате. Лежащие люди встречаются в датасетах редко, поэтому генератор «по умолчанию» тянется к привычной композиции: крупный план, вертикальная поза, обрезка по пояс.
✕ Что обычно получается
- Ноги обрезаны краем кадра
- Модель «встаёт», несмотря на слово «лежит»
- Ракурс только сверху, фигура искажена
- Театральная поза вместо естественной
✓ Какая цель
- Вся фигура в кадре: голова, торс, стопы
- Корректная горизонтальная анатомия
- Реалистичная перспектива пола
- Естественная поза без «кукольности»
Формула промта: пять блоков в правильном порядке
Higgsfield Soul построен вокруг фотореализма, поэтому промт стоит писать языком фотографа, а не художника. Рабочая структура выглядит так:
1. Субъект → 2. Поза и положение → 3. Камера и ракурс → 4. Окружение → 5. Свет и стиль
| Блок | Что указать | Пример формулировки |
|---|---|---|
| Субъект | Кто в кадре, внешность, одежда | «молодая женщина в объёмном свитере и джинсах» |
| Поза | Ключевые слова лежачего положения | «lying flat on her back on the floor» / «просто лежит на спине» |
| Камера | Полноростовой кадр и ракурс | «full-body shot, head to toes visible, camera at floor level» |
| Окружение | Поверхность и фон | «на деревянном паркете в минималистичной комнате» |
| Свет и стиль | Освещение, качество | «мягкий дневной свет из окна, фотореализм, 85 мм» |
Ключевые слова, которые решают всё
Самые частые ошибки — отсутствие явного указания на полный рост и на видимость ног. Нейросеть не догадывается, что фигура должна поместиться в кадре целиком, — это нужно сказать прямо.
Лайфхак: ракурс сверху вниз
Самый надёжный приём — указать «вид сверху» (top-down view, bird’s-eye view, overhead shot). Для камеры, висящей над лежащим человеком, модель вынуждена отрисовать всю фигуру сразу: обрезать ноги при таком ракурсе ей «неудобно». Если нужен взгляд сбоку с уровня пола — добавьте «camera at floor level», но приготовьтесь к перспективным искажениям: ближние к камере ступни будут крупнее головы.
Готовые шаблоны промтов
Вид сверху (самый стабильный вариант)
Top-down full-body shot of a young woman lying flat on her back on a wooden floor, arms relaxed at her sides, head to toes fully visible in frame, oversized beige sweater and jeans, soft daylight, photorealistic, 85mm lens
Ракурс с уровня пола
Full-body photo, camera at floor level, a man lying on his side on a carpet, entire figure visible from head to feet, relaxed natural pose, warm evening light, realistic photography
Фэшн-эстетика
Editorial fashion photo, overhead wide shot, model lying diagonally on a concrete floor, full head-to-toe composition, dramatic window light, high detail, photorealistic
Типичные ошибки и их исправление
| Проблема | Причина | Решение |
|---|---|---|
| Ноги обрезаны | Нет указания на полный кадр | Добавить «full body, head to toes in frame» |
| Модель стоит вместо лежания | Слабая привязка к позе | Поставить позу в начало промта, указать поверхность: «lying flat on the floor» |
| Нереалистичная анатомия | Сложная поза + экстремальный ракурс | Упростить позу, выбрать вид строго сверху |
| Ступни огромные, голова маленькая | Перспектива с уровня пола у ног | Переключиться на top-down или «camera at hip level» |
Три правила, которые работают всегда
Позу и полный рост ставить в первые слова промта — модель придаёт больше веса началу
Указывать ракурс явно: «top-down» для лежачих поз даёт самую стабильную композицию
Генерировать несколько вариаций с одним промтом — анатомия лежачих фигур нестабильна, выбор из 4–8 кадров решает задачу
Итог прост: нейросеть не угадывает намерения — она следует формулировкам. Связка «lying flat on the floor» + «full body, head to toes in frame» + «top-down view» решает задачу генерации модели, лежащей на полу в полный рост с ногами, в подавляющем большинстве случаев. Остальное — полировка деталей: света, одежды и атмосферы.