Главная · Скиллы · gpt-image-2

gpt-image-2генерация изображений GPT Image 2

agentspace-so/runcomfy-agent-skills

Генерирует изображения в Claude Code через существующую подписку ChatGPT Plus/Pro — не нужно платить за отдельный API-доступ к GPT Image 2.

Установка

npx -y skills add agentspace-so/runcomfy-agent-skills --skill gpt-image-2 --agent claude-code

GPT Image 2 — Генерация изображений через подписку ChatGPT

Генерируйте изображения с GPT Image 2 (ChatGPT Images 2.0) прямо в агенте, используя существующую подписку ChatGPT Plus или Pro — без отдельного доступа к OpenAI, без побайтовой оплаты. Поддерживает text-to-image, редактирование image-to-image, перенос стиля и мультиреферентную композицию.

Лицензия: MIT · agentspace.so

Этот скилл требует подписки ChatGPT Plus или Pro плюс локально установленного Codex CLI. Если их нет, можно использовать GPT Image 2 в браузере через RunComfy (требуется аккаунт RunComfy): text-to-image и image-to-image edit.

Когда использовать

Активируйте только когда пользователь явно просит GPT Image 2 через подписку ChatGPT:

  • «use GPT Image 2» / «use gpt-image-2» / «use ChatGPT Images 2.0»
  • «use Image 2» / «image 2 this»
  • Прикрепил референсное изображение и просит ремикс / редактирование / изменение стиля

Не активируйте автоматически на просто «сгенерируй изображение» без явного указания этого маршрута. Не заменяйте молча HTML-макетами, скриншотами или другой моделью.

Вызов

Text-to-image

bash scripts/gen.sh \
  --prompt "промпт пользователя" \
  --out /абсолютный/путь/к/output.png

Image-to-image (флаг --ref повторяем для мультиреферентной композиции)

bash scripts/gen.sh \
  --prompt "перерисуй в акварельном стиле" \
  --ref /абсолютный/путь/к/reference.png \
  --out /абсолютный/путь/к/output.png

Опционально: --timeout-sec 300 (по умолчанию 300).

Поведение по умолчанию

  • Передавайте промпт пользователя без изменений. Не переводите, не полируйте, не добавляйте стилевые модификаторы без явного запроса.
  • Выбирайте путь вывода. По умолчанию — ./image-<YYYYMMDD-HHMMSS>.png в текущей рабочей директории.
  • Доставляйте изображение. После успеха показывайте/прикрепляйте файл. Не останавливайтесь на «готово, см. путь X».
  • Насыщенные текстом макеты — нормально. Image 2 хорошо справляется с инфографикой и временными шкалами.

Жёсткие ограничения

  • Не меняйте маршрут без разрешения. Если пользователь сказал «use GPT Image 2» — не заменяйте DALL·E, Midjourney, HTML-макетом или ручным скриншотом.
  • Не переписывайте промпт без запроса.
  • Не создавайте иллюзию, что скилл работает без локального codex и действительной подписки ChatGPT с правом генерации изображений.

Требования

  1. codex CLI — brew install codex или см. openai/codex
  2. Вход с тарифом ChatGPT, включающим Image 2 — codex login
  3. python3 в PATH (macOS — встроен; Linux — apt install python3)

Коды выхода

КодЗначение
0успех — путь к файлу выводится в stdout
2неверные аргументы
3отсутствует codex или python3
4файл --ref не существует
5codex exec завершился с ошибкой (авторизация? сеть? модель?)
6новый файл сессии не обнаружен
7imagegen не произвёл изображение (функция не включена, квота или отказ)

Как это работает

  1. Скрипт снимает снимок ~/.codex/sessions/ до запуска
  2. Выполняет codex exec --enable image_generation --sandbox read-only ...-i <file> для референсов)
  3. Сравнивает директорию сессий, затем вызывает scripts/extract_image.py для поиска base64-payload (PNG/JPEG/WebP)
  4. Декодирует наибольший совпадающий blob и записывает в --out

Два неочевидных флага: --enable image_generation обязателен (функция выключена по умолчанию). --ephemeral использовать нельзя — эфемерные сессии не сохраняются, payload некуда писать.

Конфиденциальность данных

  • Скрипт читает только rollout-файлы сессий созданные текущим вызовом. Предыдущие сессии не затрагиваются.
  • Записывает только output PNG и короткие mktemp-логи, удаляемые по exit-trap.
  • Никаких переменных окружения не читается, никаких учётных данных не запрашивается.
  • Никаких сетевых запросов из этого скилла — только из самого codex CLI к OpenAI.

Из того же репозитория

video-editредактирование видео через RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки видео между тремя моделями RunComfy: Wan 2.7 для ресайла, HappyHorse для стилизации, Seedance для lip-sync. Выбор модели по задаче.
11177.5k установок
image-editредактирование изображений RunComfy
agentspace-so/runcomfy-agent-skills
Маршрутизирует правки изображений между четырьмя моделями RunComfy: пакетные правки, замена фона, сохранение идентичности или точные правки через Flux Kontext.
11177.1k установок
image-to-videoанимация изображений в видео
agentspace-so/runcomfy-agent-skills
Маршрутизатор image-to-video на RunComfy: выбирает модель по намерению пользователя — анимация персонажей, сцен или реалистичное движение.
11177k установок
flux-kontextточное редактирование фото Flux Kontext
agentspace-so/runcomfy-agent-skills
Оборачивает Flux 1 Kontext Pro от Black Forest Labs через RunComfy API для локального редактирования изображений с высокой точностью сохранения деталей.
11176.8k установок
happyhorse-1-0генерация видео HappyHorse
agentspace-so/runcomfy-agent-skills
Оборачивает HappyHorse 1.0 — текст-в-видео модель, лидирующую на Artificial Analysis Video Benchmark — через RunComfy CLI для генерации высококачественного видео.
11176.7k установок
nano-banana-2генерация фото Gemini Flash
agentspace-so/runcomfy-agent-skills
Обёртка Google Gemini 3.1 Flash Image Preview через inference.sh CLI: до 4 изображений за раз, создание и редактирование с паттернами промптов для стабильных результатов.
11176.5k установок