РАЗБОР ВИДЕО-ГЕНЕРАЦИЙ (Wan2.2-TI2V-5B, локально, ComfyUI) Сделано вручную: кадры извлечены через ffmpeg (каждый N-й кадр), просмотрены визуально. ════════════════════════════════════════════════════════ ПОПЫТКА 1 — "Гонка" (image-to-video от картинки v2) ════════════════════════════════════════════════════════ ПРОМПТ (англ., отправлен модели): "Camera rapidly pushes forward flying toward the lime-green robotic hare as it bursts triumphantly closer into frame, victorious dynamic motion, front paws pumping the air in celebration. Fireworks burst and sparkle across the night sky above, celebrating the winner's appearance. The small mechanical tortoise continues slowly walking in the background. Dynamic fast camera push-in, cinematic motion, bright stadium lights, vivid saturated colors." Параметры: 512x512, 69 кадров, 16 fps (~4.3 сек), стартовый кадр — картинка v2. ЧТО ПОЛУЧИЛОСЬ (по кадрам 1 / 4 / 7 из 7 сэмплов): - Кадр 1: заяц прыгает/влетает в кадр, черепаха маленькая на заднем плане, светлое небо, фейерверки только начинают вспыхивать. Похоже на старт ролика. - Кадр 4: камера ощутимо ближе — заяц занимает почти весь кадр, фон уже фиолетово-синий от фейерверков, сильный motion blur на конечностях. - Кадр 7: камера вплотную к зайцу, экстремальный крупный план, всё в движении. СООТВЕТСТВИЕ ПРОМПТУ: + Camera push-in — ДА, реально и убедительно отработано. + Fireworks — ДА, на всех кадрах, нарастают к финалу. + Dynamic motion — ДА, явный motion blur, ощущение скорости. - Tortoise "continues walking in background" — почти нет, черепаха видна только в 1-м кадре и почти сразу пропадает из кадра (камера её обгоняет). - Внешний вид зайца и стиль сцены значительно разошлись с исходной картинкой v2 (сменился дизайн робота, дневное небо вместо ночного стадиона) — модель при image-to-video использовала исходный кадр скорее как слабую подсказку, чем как жёсткую точку старта. ВЫВОД: частичный успех. Движение камеры и фейерверки отработаны хорошо, но точное сохранение персонажа/сцены из стартового кадра — нет. ════════════════════════════════════════════════════════ ПОПЫТКА 2 — "Заяц на пьедестале" (text-to-video, без стартового кадра) ════════════════════════════════════════════════════════ ПРОМПТ (англ., отправлен модели): "A sleek lime-green glowing robotic hare figure standing on a small illuminated rotating pedestal display, like a premium trophy or product showcase, soft dramatic studio lighting from below and behind, dark near-black background, the figure and pedestal slowly rotate a full 360 degrees, elegant soft glow highlights on the metallic surface, seamless smooth loop, cinematic, minimal, high quality." Параметры: запрошено 512x512 (по факту получилось 1024x1024), 49 кадров, 16 fps (~3 сек). ЧТО ПОЛУЧИЛОСЬ (по кадрам 1 / 4 / 7 из 7 сэмплов): Кадры 1, 4 и 7 ВИЗУАЛЬНО ИДЕНТИЧНЫ. Фигура зайца статична, ракурс не меняется ни на градус, никакого вращения. По сути получен один статичный кадр, продублированный на всю длину ролика. СООТВЕТСТВИЕ ПРОМПТУ: + Внешний вид, освещение, композиция — хорошие, красивая картинка сама по себе. - "Slowly rotate a full 360 degrees" — ПОЛНОСТЬЮ ПРОИГНОРИРОВАНО. - "Seamless smooth loop" — технически да (статика зациклится без склеек), но не в том смысле, который был нужен. ВЫВОД: провал по главному требованию промпта. Модель нарисовала красивую неподвижную сцену вместо анимации. Это подтверждает наблюдение с картинками: Wan2.2-TI2V-5B (в этой локальной конфигурации) ненадёжно передаёт явные инструкции по движению камеры/объекта, когда сцена простая и нет стартового кадра с уже заданной динамикой — то есть если конечно, что должно двигаться, не задано существующим движением в кадре, модель по умолчанию скатывается в статику. ════════════════════════════════════════════════════════ ОБЩИЙ ИТОГ ПО ВИДЕО ════════════════════════════════════════════════════════ 1. Технически (по времени и памяти) видео на 12ГБ VRAM генерируется только при жёстком урезании (512x512, ~50-70 кадров, CLIP на CPU) — иначе уходит в подкачку памяти и превращается в часы вместо минут. 2. Даже при удачной технической конфигурации результат непредсказуем: одна генерация дала реальное, убедительное движение камеры; вторая — полностью проигнорировала требование движения. 3. На каждую генерацию нужно закладывать 15-20+ минут и быть готовым, что придётся переделывать — как с картинками, только дороже по времени. 4. Практический вывод: для сценариев, где движение — ключевое требование (как вращение на пьедестале), надёжнее либо начинать с кадра, где движение уже частично заложено (как сработало с гонкой), либо не полагаться на локальное видео этого класса без бюджета на повторы.