Главная · Скиллы · seedance-v2

seedance-v2Seedance 2.0 — кинематографичное видео

agentspace-so/runcomfy-agent-skills

ByteDance Seedance 2.0 Pro генерирует 4–15 секунд кино с синхронизированным аудио нативно. Поддерживает текст-в-видео и изображение-в-видео на RunComfy.

Установка

npx -y skills add agentspace-so/runcomfy-agent-skills --skill seedance-v2 --agent claude-code

Seedance 2.0 Pro — Pro Pack на RunComfy

Seedance 2.0 Pro от ByteDance — мультимодальный кинематографический генератор видео со встроенным синхронизированным аудио — на RunComfy Model API.

runcomfy.com

npx skills add agentspace-so/runcomfy-skills --skill seedance-v2 -g

Когда выбирать эту модель

Уникальная сила Seedance 2.0 Pro — мультимодальный кинематографический короткий метр: соединяет изображения персонажей + видео-сцены + референсное аудио в один связный план. Выбирайте, когда важна точность передачи идентичности / сцены и нужна нативная синхронизация губ.

ЗадачаИспользуйте
Синхронизированный спикер / диалогная рекламаSeedance 2.0 Pro
Мультимодальные референсы (image + video + audio)Seedance 2.0 Pro
Брендовый нарратив на нескольких языкахSeedance 2.0 Pro
Лучшее качество по слепому голосованиюHappyHorse 1.0
Синхронизация губ с вашей собственной дорожкойWan 2.7 (audio_url)
Редактирование движения на существующих материалахKling Video O1
Ультрабыстрая итерацияLTX 2

Требования

  1. RunComfy CLI — npm i -g @runcomfy/cli
  2. Аккаунт RunComfy — runcomfy login (device-code через браузер)
  3. CI/контейнеры — RUNCOMFY_TOKEN=<token>

Эндпоинт и схема

bytedance/seedance-v2/pro

ПолеТипОбязательноПо умолчаниюПримечания
promptstringдаCN ≤500 символов ИЛИ EN ≤1000 слов
image_urlarrayнет[]0–9 референсов (JPEG/PNG/WebP/BMP/TIFF/GIF)
video_urlarrayнет[]0–3 клипа (MP4/MOV), 2–15с каждый
audio_urlarrayнет[]0–3 аудио-референса (WAV/MP3), 2–15с, <15МБ
aspect_ratioenumнетadaptiveadaptive, 16:9, 9:16, 4:3, 3:4, 1:1, 21:9
durationintнет54–15 секунд (целые)
resolutionenumнет720p480p или 720p
generate_audioboolнетtrueСинхронизированная речь / SFX / музыка в одном проходе
seedintнетВоспроизводимость

Вызов

По умолчанию (только текст, 5с, 720p с аудио)

runcomfy run bytedance/seedance-v2/pro \
  --input '{"prompt": "промпт пользователя"}' \
  --output-dir /абсолютный/путь

Синхронизированная реклама с референсом персонажа

runcomfy run bytedance/seedance-v2/pro \
  --input '{
    "prompt": "Medium close-up. The woman explains today'\''s special in a warm friendly tone, slow push-in, soft window light, gentle cafe ambience.",
    "image_url": ["https://.../barista-headshot.jpg"],
    "duration": 8,
    "aspect_ratio": "9:16"
  }' \
  --output-dir /абсолютный/путь

Мультимодально (image + video + audio)

runcomfy run bytedance/seedance-v2/pro \
  --input '{
    "prompt": "Subject from image 1 walks through the café from video 1, voice tone matches audio 1.",
    "image_url": ["https://.../subject.jpg"],
    "video_url": ["https://.../cafe-locked-shot.mp4"],
    "audio_url": ["https://.../voice-ref.mp3"]
  }' \
  --output-dir /абсолютный/путь

Советы по промптингу

Разделение image и text. Стабильная идентичность (лицо, костюм, логотип) → в image_url. Эволюционирующий нарратив (действие, настроение, свет) → в prompt. Описывать лицо словами — напрасная трата токенов.

Камера + движение обычным языком. «Medium close-up», «slow push-in», «handheld follow», «locked-off wide» — всё работает. Комбинируйте: "Medium close-up. Slow push-in over 3 seconds. Handheld, slight breathing motion."

Аудиорежиссура при generate_audio: true. Указывайте тон: "warm friendly conversational", "calm instructional". Для фона: "gentle cafe chatter, distant traffic, no foreground music".

Спецификации референсных медиа. Видео 2–15с; аудио ≤15МБ и 2–15с. Файлы вне диапазона отклоняются.

Антипаттерны: смешение разных эстетик (акварель + фотореализм); противоречивые стилевые указания; описание стабильной идентичности словами вместо image_url; запрос клипов >15с.

Сильные стороны

СценарийПочему Seedance 2.0 Pro
Спикер / диалогная рекламаНативная синхронизация губ без отдельного TTS
Брендовые нарративы на нескольких языкахРеференсы удерживают идентичность; текст меняется
Кинематографический превизГрамматика съёмочного плана + мультимодальные референсы
Рекламные материалы с референсной музыкой / VOАудиореференсы задают тон голоса без привязки к губам
Воспроизводимое тестирование вариантовSeed + фиксированная схема

Ограничения

  • Длительность 4–15с — более длинные нарративы разбивайте на несколько вызовов
  • Потолок разрешения 720p на этом эндпоинте
  • Референсные медиа должны быть 2–15с; аудио <15МБ
  • Качество синхронизации губ зависит от чёткости промпта — не гарантировано идеальное во всех условиях

Коды выхода

КодЗначение
0успех
64неверные аргументы CLI
65неверный JSON / несоответствие схемы
69ошибка сервера (5xx)
75таймаут / 429
77не авторизован

Из того же репозитория

video-editредактирование видео через RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки видео между тремя моделями RunComfy: Wan 2.7 для ресайла, HappyHorse для стилизации, Seedance для lip-sync. Выбор модели по задаче.
11177.5k установок
image-editредактирование изображений RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки изображений между четырьмя моделями RunComfy: пакетные правки, замена фона, сохранение идентичности или точные правки через Flux Kontext.
11177.1k установок
image-to-videoанимация изображений в видео
agentspace-so/runcomfy-agent-skills
Маршрутизатор image-to-video на RunComfy: выбирает модель по намерению пользователя — анимация персонажей, сцен или реалистичное движение.
11177k установок
flux-kontextточное редактирование фото Flux Kontext
agentspace-so/runcomfy-agent-skills
Оборачивает Flux 1 Kontext Pro от Black Forest Labs через RunComfy API для локального редактирования изображений с высокой точностью сохранения деталей.
11176.8k установок
happyhorse-1-0генерация видео HappyHorse
agentspace-so/runcomfy-agent-skills
Оборачивает HappyHorse 1.0 — текст-в-видео модель, лидирующую на Artificial Analysis Video Benchmark — через RunComfy CLI для генерации высококачественного видео.
11176.7k установок
nano-banana-2генерация фото Gemini Flash
agentspace-so/runcomfy-agent-skills
Обёртка Google Gemini 3.1 Flash Image Preview через inference.sh CLI: до 4 изображений за раз, создание и редактирование с паттернами промптов для стабильных результатов.
11176.5k установок