
Цели урока
- Понять, как ИИ-модели интерпретируют сложные текстовые промпты.
- Оценить способность ИИ создавать когерентные и динамичные "невозможные миры".
- Сравнить возможности разных версий ИИ в сохранении деталей и физики в сложных сценах.
- Узнать о важности одной генерации (one-shot generation) без пост-обработки.
О чём урок
Добро пожаловать в урок по оценке возможностей ИИ в создании видео на примере сложных сцен. В этом уроке мы рассмотрим, как различные версии ИИ-модели справляются с реализацией концепции "невозможного мира" по одному и тому же текстовому описанию. Мы сравним две версии модели, Seedance 2.5 и Seedance 2.0, чтобы наглядно продемонстрировать прогресс в технологии AI-фильммейкинга. Для этого теста был использован следующий промпт, описывающий сложный и динамичный сценарий: Результат от Seedance 2.5 демонстрирует впечатляющую способность ИИ к созданию сложного и последовательного видеоряда. Модель успешно справилась с множеством требований промпта: Главный персонаж: Девочка-школьница с рыжими волосами и ранцем сохраняет свою идентичность и внешний вид на протяжении всего видео, даже при экстремальных поворотах камеры. Динамическая среда: Город представлен как "разрушенный гравитацией" с парящими и перевернутыми зданиями, что создает ощущение постоянно меняющегося и невозможного мира. Освещение: "Золотой час" реализован с помощью объемного золотистого света, придающего сцене особую атмосферу. Элементы окружения: Модель генерирует реалистичные детали, такие как разлетающиеся голуби, прохожие и даже работающие шестеренки внутри часовой башни. Сложные движения камеры: ИИ поддерживает когерентность сцены при сложных вращениях камеры, что является серьезным вызовом для большинства 3D-пайплайнов, не говоря уже о видеомоделях. Выполнение задачи: Девочка успешно передает сообщение пожилой женщине, находящейся на крыше, что завершает сюжетную линию промпта. При сравнении с Seedance 2.0, недостатки предыдущей версии становятся очевидными. Хотя она пытается реализовать ту же концепцию, результат значительно уступает: Персонажи и объекты: Внешний вид персонажей и объектов менее стабилен и детализирован. Они могут деформироваться или терять свои характеристики. Гравитация и физика: Эффект "разрушенной гравитации" выглядит менее убедительно, объекты могут просто искажаться, а не подчиняться новой, нарушенной физике. Динамика мира: Отсутствует ощущение "живого" мира с объемным светом, динамикой голубей или работающими механизмами. Когерентность: Сцена менее последовательна, элементы могут появляться или исчезать, а движение камеры вызывает значительные искажения, разрушающие иллюзию.
План урока
- Разбор "Невозможного мира"
- Seedance 2.5: Детализация и когерентность
- Seedance 2.0: Ограничения предыдущей версии
- Практические советы
- Итоги
Урок входит в полный доступ. Полный текст и видео открываются после оплаты. Первые уроки каждого курса бесплатны.