wan-2-7видеогенерация Wan 2.7

agentspace-so/runcomfy-agent-skills

Флагманская текст-в-видео модель Wan-AI через RunComfy CLI: клипы 2–15 секунд в 720p с управлением движением и настройкой длительности.

Установка

npx -y skills add agentspace-so/runcomfy-agent-skills --skill wan-2-7 --agent claude-code

Wan 2.7 — Pro Pack на RunComfy

Флагманская видеомодель Wan 2.7 от Wan-AI — с мультиреференсным кондиционированием и синхронизацией губ через аудио — на RunComfy Model API.

runcomfy.com

npx skills add agentspace-so/runcomfy-skills --skill wan-2-7 -g

Когда выбирать эту модель

ЗадачаИспользуйте
Синхронизация губ под вашу аудиодорожкуWan 2.7 (audio_url)
Мультиреференсное тонкое управление движениемWan 2.7
Плавные переходы, точная физика движенияWan 2.7
Лучшая модель по слепому голосованиюHappyHorse 1.0
Мультимодальный кинематограф с image+video+audio + генерацией голоса в одном проходеSeedance 2.0 Pro
Кинематографическое редактирование движения на существующих материалахKling Video O1
Ультрабыстрая итерацияLTX 2

Требования

  1. RunComfy CLI — npm i -g @runcomfy/cli
  2. Аккаунт RunComfy — runcomfy login (device-code через браузер)
  3. CI/контейнеры — RUNCOMFY_TOKEN=<token>

Эндпоинт и схема

wan-ai/wan-2-7/text-to-video

ПолеТипОбязательноПо умолчаниюПримечания
promptstringдаДо ~5000 символов / ~1500 токенов
audio_urlstringнетWAV/MP3, 3–30с, ≤15МБ. Управляет синхронизацией губ. Без него — автогенерация фоновой музыки.
aspect_ratioenumнет16:916:9, 9:16, 1:1, 4:3, 3:4
resolutionenumнет1080p720p или 1080p
durationenumнет52–15 секунд (целые)
negative_promptstringнетДо 500 символов. Конкретные вещи для исключения.
enable_prompt_expansionboolнетtrueАвторасширение коротких промптов. Отключите для буквального контроля.
seedintнет0..2³¹-1. Для вариантов с одним seed.

Вызов

По умолчанию (5с, 1080p, 16:9, с расширением промпта)

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{"prompt": "промпт пользователя"}' \
  --output-dir /абсолютный/путь

Синхронизация губ под вашу аудиодорожку

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{
    "prompt": "Medium close-up of the spokesperson, warm key light, locked tripod, slight breathing motion.",
    "audio_url": "https://.../voiceover.mp3",
    "duration": 12,
    "aspect_ratio": "9:16"
  }' \
  --output-dir /абсолютный/путь

Буквальный контроль (без авторасширения)

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{
    "prompt": "точно то, что нужно",
    "enable_prompt_expansion": false,
    "negative_prompt": "no subtitles, no flicker, no distorted hands"
  }' \
  --output-dir /абсолютный/путь

Советы по промптингу

Камера + движение обычным языком. «Slow dolly in», «locked tripod, low angle», «handheld follow», «crane move from above». Ставьте план на первое место.

Одно основное действие на клип. Не нагромождайте конкурирующие действия. Выберите один бит.

Используйте negative_prompt для конкретных проблем. Хорошо: «no subtitles, no watermark, no flicker». Плохо (расплывчато): «no bad lighting».

Расширение промпта включено по умолчанию. Короткие промпты авторасширяются. Для строгих брендовых текстов — отключайте через enable_prompt_expansion: false.

Спецификации аудио важны. audio_url должен быть 3–30с, ≤15МБ, WAV/MP3. Файлы вне диапазона отклоняются. Совпадайте длину аудио с длительностью клипа.

Антипаттерны: статичные описания (движение будет размытым); расплывчатые отрицания; аудио вне спецификации; промпты >5000 символов.

Сильные стороны

СценарийПочему Wan 2.7
Синхронизированная реклама с кастомной озвучкойaudio_url принимает вашу дорожку
Варианты дублирования на разных языкахТот же промпт, разный audio_url для каждого языка
Мультиреференсное управление движениемДо 5 референсных медиа (image / video / voice)
Плавные переходы + физика движенияСильные праймеры физически-осознанного движения
Чистый вывод с negative_promptЦелевое исключение проблем

Ограничения

  • Максимальная длительность 15с — для более длинных нарративов сшивайте несколько вызовов
  • Нет нативного 4K — потолок 1080p
  • Только 5 задокументированных соотношений сторон
  • Аудио: 3–30с, ≤15МБ, только WAV/MP3
  • Максимум 5 референсных медиа (image + video + voice вместе)
  • Для генерации голоса в одном проходе (без отдельной аудиодорожки) — используйте Seedance 2.0 Pro

Коды выхода

КодЗначение
0успех
64неверные аргументы CLI
65неверный JSON / несоответствие схемы
69ошибка сервера (5xx)
75таймаут / 429
77не авторизован

Из того же репозитория

video-editредактирование видео через RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки видео между тремя моделями RunComfy: Wan 2.7 для ресайла, HappyHorse для стилизации, Seedance для lip-sync. Выбор модели по задаче.
11177.5k установок
image-editредактирование изображений RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки изображений между четырьмя моделями RunComfy: пакетные правки, замена фона, сохранение идентичности или точные правки через Flux Kontext.
11177.1k установок
image-to-videoанимация изображений в видео
agentspace-so/runcomfy-agent-skills
Маршрутизатор image-to-video на RunComfy: выбирает модель по намерению пользователя — анимация персонажей, сцен или реалистичное движение.
11177k установок
flux-kontextточное редактирование фото Flux Kontext
agentspace-so/runcomfy-agent-skills
Оборачивает Flux 1 Kontext Pro от Black Forest Labs через RunComfy API для локального редактирования изображений с высокой точностью сохранения деталей.
11176.8k установок
happyhorse-1-0генерация видео HappyHorse
agentspace-so/runcomfy-agent-skills
Оборачивает HappyHorse 1.0 — текст-в-видео модель, лидирующую на Artificial Analysis Video Benchmark — через RunComfy CLI для генерации высококачественного видео.
11176.7k установок
nano-banana-2генерация фото Gemini Flash
agentspace-so/runcomfy-agent-skills
Обёртка Google Gemini 3.1 Flash Image Preview через inference.sh CLI: до 4 изображений за раз, создание и редактирование с паттернами промптов для стабильных результатов.
11176.5k установок