kling-3-0видеогенерация Kling 3.0

doany-ai/skills

6 endpoints Kling 3.0 в одном скилле: Standard, Pro и 4K тиры в режимах текст-в-видео и изображение-в-видео через RunComfy CLI.

Установка

npx -y skills add doany-ai/skills --skill kling-3-0 --agent claude-code

Kling 3.0 — Pro Pack на RunComfy

Kling 3.0 — третье поколение кинематографической видеомодели Kuaishou Technology. Многоплановое видео с синхронизированным нативным аудио, консистентной идентичностью персонажей между планами и физически осознанным движением.

runcomfy.com

npx skills add agentspace-so/runcomfy-agent-skills --skill kling-3-0 -g

Что такое Kling 3.0

Kling 3.0 — V3-поколение Kling. Поддерживает клипы до 15 секунд, нативный 4K на тарифе 4K и унифицированную систему мультипромптных сегментов для нескольких отдельных сцен с управляемыми переходами в одной генерации. Выпускается в трёх тарифах рендеринга, каждый доступен в режимах text-to-video и image-to-video:

  • Standard — самый дешёвый, до 1080p. Для быстрых итераций, превью, A/B-вариантов, социальных коротких
  • Pro — наивысшая точность на 1080p. Для героических 1080p-клипов с приоритетом реализма движения и сохранения идентичности
  • 4K — нативный вывод 3840×2160. Для брендовых фильмов, большеэкранных кинематографических последовательностей и готовых мастеров в нативном разрешении

6 эндпоинтов Kling 3.0

ЭндпоинтРазрешениеЦена (без аудио)Цена (с аудио)
kling/kling-3.0/standard/text-to-videoдо 1080p$0.084/с$0.126/с
kling/kling-3.0/standard/image-to-videoдо 1080p$0.084/с$0.126/с
kling/kling-3.0/pro/text-to-video1080p$0.112/с$0.168/с
kling/kling-3.0/pro/image-to-video1080p$0.112/с$0.168/с
kling/kling-3.0/4k/text-to-video3840×2160$0.42/с$0.42/с
kling/kling-3.0/4k/image-to-video3840×2160$0.42/с$0.42/с

Тариф 4K одинаково стоит независимо от аудио. Standard и Pro берут ~50% больше за секунду при включённом аудио.

Выбор тарифа Kling 3.0

  • Черновики, превью, социальные короткие, A/B-варианты: Kling 3.0 Standard. Самый дешёвый.
  • Героические 1080p-клипы, рекламные материалы, говорящие головы: Kling V3.0 Pro. ~33% дороже Standard, заметно лучше движение и удержание идентичности.
  • Брендовые фильмы 4K, большеэкранные кинематографические, готовые мастера: Kling V3.0 4K. Нативный 3840×2160. Фиксированная ставка $0.42/с — примерно в 5 раз дороже Standard.

Выбор режима: t2v — только промпт, Kling 3.0 генерирует внешний вид с нуля. i2v — промпт + исходное изображение, Kling 3.0 анимирует его.

Требования

  1. RunComfy CLI — npm i -g @runcomfy/cli
  2. Аккаунт RunComfy — runcomfy login
  3. CI/контейнеры — RUNCOMFY_TOKEN=<token>
  4. Для i2v: публично доступный URL исходного изображения (HTTPS, JPEG/PNG/WebP)

Схема входных данных (общая для всех 6 эндпоинтов)

ПолеТипОбязательноПо умолчаниюПримечания
promptstringдаОписание сцены, движения, камеры. Многосегментные промпты через нумерацию планов.
image_urlstringда (только i2v)HTTPS URL исходного изображения. JPEG/PNG/WebP.
tail_image_urlstringнет (только i2v)Опциональное конечное изображение для управляемого перехода начало→конец
negative_promptstringнетЭлементы для исключения из вывода
durationintнет53–15 секунд на генерацию
aspect_ratioenumнет16:916:9, 9:16, 1:1, 4:3, 3:4, 21:9
cfg_scalefloatнет0.5Сила следования промпту. Выше = строже. 0.7–0.9 для стилизованного; 0.3–0.4 для естественного движения.
generate_audioboolнетfalseСинхронизированное аудио в одном проходе. +стоимость на Standard/Pro; фиксированная на 4K.
seedintнетВоспроизводимость

Вызов каждого эндпоинта

Standard t2v — самый дешёвый черновик 1080p

runcomfy run kling/kling-3.0/standard/text-to-video \
  --input '{"prompt": "промпт", "duration": 5, "aspect_ratio": "16:9"}' \
  --output-dir /абсолютный/путь

Standard i2v — анимировать статичное изображение

runcomfy run kling/kling-3.0/standard/image-to-video \
  --input '{"prompt": "описание движения", "image_url": "https://.../source.jpg", "duration": 5}' \
  --output-dir /абсолютный/путь

Pro t2v — наивысшая точность 1080p

runcomfy run kling/kling-3.0/pro/text-to-video \
  --input '{"prompt": "промпт", "duration": 8, "aspect_ratio": "16:9", "generate_audio": true}' \
  --output-dir /абсолютный/путь

Pro i2v — героическая анимация с исходным изображением

runcomfy run kling/kling-3.0/pro/image-to-video \
  --input '{"prompt": "описание движения", "image_url": "https://.../subject.jpg", "duration": 8, "generate_audio": true}' \
  --output-dir /абсолютный/путь

4K t2v — нативный 4K кинематографический

runcomfy run kling/kling-3.0/4k/text-to-video \
  --input '{"prompt": "промпт", "duration": 10, "aspect_ratio": "16:9", "generate_audio": true}' \
  --output-dir /абсолютный/путь

4K i2v — 4K-анимация референсного изображения

runcomfy run kling/kling-3.0/4k/image-to-video \
  --input '{"prompt": "описание движения", "image_url": "https://.../source-4k.jpg", "duration": 10, "generate_audio": true}' \
  --output-dir /абсолютный/путь

Советы по промптингу Kling 3.0

Начинайте с языка движения и камеры. «Wide shot, slow push-in», «tracking shot, low angle», «handheld follow» — Kling 3.0 читает их как реальные директивы. Ставьте на первое место.

Многоплановая съёмка в одной генерации. Нумеруйте планы: «Shot 1: wide of the cafe at dusk. Shot 2: medium close-up of the barista. Shot 3: tight on the espresso pour.» Kling 3.0 сохранит идентичность (лицо, гардероб, реквизит) между планами.

Якоря идентичности для i2v. Переформулируйте что должно оставаться стабильным: «preserve the subject's face, pose, and clothing; only the camera moves and the background changes.»

tail_image_url для управляемых концовок. Для Kling 3.0 i2v передайте конечное изображение для фиксации финального кадра. Kling 3.0 интерполирует движение от источника к финалу.

generate_audio: true для диалога в одном проходе. Описывайте ожидаемое аудио: «warm friendly tone, English voiceover» или «city ambience, distant traffic, no dialogue».

Антипаттерны: конфликтующие стилевые cues; запрос >15с (→ 422); соотношения сторон вне поддерживаемых; для 4K — агрессивный многоплановый нарратив без предварительной проверки на Standard (~$6.30 за генерацию).

Сильные стороны

СценарийЛучший эндпоинт Kling 3.0
Кинематографические брендовые истории 1080p с консистентными персонажамиKling V3.0 Pro (t2v или i2v)
Нативные 4K-героические фильмы и большеэкранный кинематографKling V3.0 4K (t2v или i2v)
Дешёвая итерация, социальные короткие, A/B-вариантыKling 3.0 Standard t2v
Анимация брендовых ассетов, продуктовых фото, персонажного артаKling 3.0 Standard i2v или Pro i2v
Многоплановая реклама с синхронизированным диалогом в одном проходеKling V3.0 Pro с generate_audio: true
Премиальные готовые мастера 4K с нативным аудиоKling V3.0 4K с generate_audio: true

FAQ

Максимальная длительность? 15 секунд на генерацию на всех тарифах.

Поддерживается ли многоплановая съёмка в одной генерации? Да. Нумеруйте планы («Shot 1:», «Shot 2:» и т.д.) — Kling 3.0 сохранит идентичность персонажей.

Поддерживает ли Kling 3.0 i2v конечное изображение? Да. tail_image_url фиксирует финальный кадр.

Отличия от Kling 2.x? Более сильное многоплановое сохранение идентичности, максимальная длительность 15с (против 10с у 2.x), нативный 4K, унифицированный мультипромптный сегментный ввод на всех тарифах.

Ограничения

  • Максимум 15 секунд на вызов на каждом тарифе
  • Максимум 6 непрерывных планов в одной генерации 4K
  • i2v требует публично доступного HTTPS URL изображения
  • Соотношения сторон фиксированы (только 6 поддерживаемых значений)
  • Выходные файлы 4K большие — планируйте диск и пропускную способность

Коды выхода

КодЗначение
0генерация успешна
64неверные аргументы CLI
65неверный JSON / несоответствие схемы
69ошибка сервера (5xx)
75таймаут / 429
77не авторизован

Из того же репозитория

relightизменение освещения на фото
doany-ai/skills
Маршрутизирует на Qwen Edit 2509 relight LoRA для точного контроля освещения на снимках без пересъёмки. Промпты на естественном языке для световых инструкций.
82.5k установок
image-outpaintingрасширение границ изображения
doany-ai/skills
Outpainting: превращает квадратный пост в 16:9 для YouTube или обрезанный портрет в полноформатное фото. Маршрутизирует по нужному RunComfy endpoint.
82.5k установок
face-swapзамена лица на фото и видео
doany-ai/skills
Маршрутизирует задачи face swap между пятью моделями RunComfy: одиночные фото, видео, несколько лиц или batch-обработка с точным сохранением идентичности.
82.5k установок
controlnet-poseуправление позой через ControlNet
doany-ai/skills
Маршрутизирует генерацию с контролем позы: перенос движения на видео, скелетная генерация изображений или повторное освещение через ControlNet.
82.4k установок
runcomfy-cliCLI для AI медиапайплайнов RunComfy
doany-ai/skills
Единый CLI для сотен RunComfy моделей: мост между Claude и AI медиапайплайнами для изображений, видео и аудио без управления отдельными API.
82.4k установок
nano-banana-2генерация фото Gemini Flash
doany-ai/skills
Обёртка Google Gemini 3.1 Flash Image Preview через inference.sh CLI: до 4 изображений за раз, создание и редактирование с паттернами промптов для стабильных результатов.
82.3k установок