Главная · Скиллы · gpt-image-edit

gpt-image-editредактирование фото GPT Image 2

agentspace-so/runcomfy-agent-skills

GPT Image 2 edit endpoint от OpenAI через RunComfy CLI. Отличается пониманием инструкций на естественном языке и точным inpainting при сохранении стиля.

Установка

npx -y skills add agentspace-so/runcomfy-agent-skills --skill gpt-image-edit --agent claude-code

GPT Image Edit — Pro Pack на RunComfy

OpenAI GPT Image 2 — эндпоинт /edit (ChatGPT Images 2.0 image-to-image) на RunComfy Model API. Лучший в классе по сохранению идентичности при целевых правках и перезаписи встроенного текста в любой письменности (латиница, кана, CJK, кириллица, арабский).

runcomfy.com

npx skills add agentspace-so/runcomfy-skills --skill gpt-image-edit -g

Когда выбирать эту модель

ЗадачаИспользуйте
Редактирование многоязычного / встроенного текста в изображенииGPT Image Edit
Сохранение идентичности в вариантах заголовков на разных языкахGPT Image Edit
Layout-точное редактирование (перенос заголовка, замена CTA и т.д.)GPT Image Edit
До 10 референсных изображенийGPT Image Edit
Пакетная обработка до 20 изображений согласованноNano Banana Edit
Одиночная точная локальная правка с приоритетом точности источникаFlux Kontext
Генерация с нуля через GPT Image 2скилл gpt-image-2

Требования

  1. RunComfy CLI — npm i -g @runcomfy/cli
  2. Аккаунт RunComfy — runcomfy login (device-code через браузер)
  3. CI/контейнеры — RUNCOMFY_TOKEN=<token>

Эндпоинт и схема

openai/gpt-image-2/edit

ПолеТипОбязательноПо умолчаниюПримечания
promptstringдаИнструкция по правке. Начинайте с сохранения, заканчивайте изменением.
imagesstring[]даДо 10 публично доступных HTTPS URL. Первый — основной; остальные — вспомогательные.
sizeenumнетautoauto (сохраняет соотношение), 1024_1024, 1024_1536, 1536_1024. Только эти.

size=auto сохраняет соотношение входного изображения — настоятельно рекомендуется, если правка явно не меняет кадрирование.

Вызов

Правка с сохранением (одиночный референс)

runcomfy run openai/gpt-image-2/edit \
  --input '{
    "prompt": "Keep the person'\''s face, pose, and brand mark unchanged. Replace the background with a soft warm-grey studio sweep and a gentle floor shadow.",
    "images": ["https://.../portrait.jpg"]
  }' \
  --output-dir /абсолютный/путь

Перезапись многоязычного текста

runcomfy run openai/gpt-image-2/edit \
  --input '{
    "prompt": "Keep the photograph, layout, and brand mark exactly as in the input. Replace only the in-image headline. The new headline reads \"今日のおすすめ\" in bold Japanese kana, same position and font weight as before.",
    "images": ["https://.../poster-en.jpg"]
  }' \
  --output-dir /абсолютный/путь

Мультиреференсная композиция

runcomfy run openai/gpt-image-2/edit \
  --input '{
    "prompt": "Compose subject from image 1 into the room from image 2. Match the lighting and color palette of image 2. Keep image 1 subject identity (face, pose, clothing) unchanged.",
    "images": ["https://.../subject.jpg", "https://.../room.jpg"]
  }' \
  --output-dir /абсолютный/путь

Советы по промптингу

Сначала цели сохранения. Всегда: "Keep [face / pose / clothing / brand / framing] unchanged." Затем — изменение. Модель соблюдает то, что указано в начале.

Для многоязычного текста — цитируйте символы, называйте письменность. "the headline reads \"コーヒー\" in bold Japanese kana", "the label says \"АРОМА\" in Cyrillic, white on black", "the right-margin caption reads \"تخفيض\" in Arabic right-to-left". Не перефразируйте — цитируйте.

Направленный язык для пространственных правок. "move the headline from top-right to bottom-center", "remove the leftmost object only", "replace the watermark in the bottom-right corner".

Нумерация мультиреференсов. При передаче нескольких images ссылайтесь по номеру: "subject from image 1, lighting from image 2, color palette from image 3".

Антипаттерны: длинные составные инструкции; отсутствие целей сохранения; перефразирование встроенного текста вместо цитирования; size вне 3 фиксированных значений + auto.

Сильные стороны

СценарийПочему GPT Image Edit
Многоязычная локализация рекламыОдин исходный ассет → варианты заголовков на разных языках
Брендо-безопасные замены заголовков / CTALayout-точность + язык сохранения удерживают остальное стабильным
Мультиреференсная композицияНумерованные референсы направляют cues корректно
Layout-точное перемещение элементовНаправленный язык («top-right to bottom-center») соблюдается
Сохранение идентичности при правках вывесокЛучший в классе для сохранения лица / бренда при целевых правках

Ограничения

  • size: 3 фиксированных значения + auto — всё остальное → 422
  • images: до 10
  • Длинные составные промпты дрейфуют — разбивайте на несколько проходов
  • Для пакетной согласованности многих SKU лучше подходит Nano Banana Edit (до 20)

Коды выхода

КодЗначение
0успех
64неверные аргументы CLI
65неверный JSON / несоответствие схемы
69ошибка сервера (5xx)
75таймаут / 429
77не авторизован

Из того же репозитория

video-editредактирование видео через RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки видео между тремя моделями RunComfy: Wan 2.7 для ресайла, HappyHorse для стилизации, Seedance для lip-sync. Выбор модели по задаче.
11177.5k установок
image-editредактирование изображений RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки изображений между четырьмя моделями RunComfy: пакетные правки, замена фона, сохранение идентичности или точные правки через Flux Kontext.
11177.1k установок
image-to-videoанимация изображений в видео
agentspace-so/runcomfy-agent-skills
Маршрутизатор image-to-video на RunComfy: выбирает модель по намерению пользователя — анимация персонажей, сцен или реалистичное движение.
11177k установок
flux-kontextточное редактирование фото Flux Kontext
agentspace-so/runcomfy-agent-skills
Оборачивает Flux 1 Kontext Pro от Black Forest Labs через RunComfy API для локального редактирования изображений с высокой точностью сохранения деталей.
11176.8k установок
happyhorse-1-0генерация видео HappyHorse
agentspace-so/runcomfy-agent-skills
Оборачивает HappyHorse 1.0 — текст-в-видео модель, лидирующую на Artificial Analysis Video Benchmark — через RunComfy CLI для генерации высококачественного видео.
11176.7k установок
nano-banana-2генерация фото Gemini Flash
agentspace-so/runcomfy-agent-skills
Обёртка Google Gemini 3.1 Flash Image Preview через inference.sh CLI: до 4 изображений за раз, создание и редактирование с паттернами промптов для стабильных результатов.
11176.5k установок