GPT Image 2 w Codex, Claude Code i innych agentach AI do programowania
Pozwól Codex, Claude Code lub innemu agentowi tworzyć obrazy GPT Image 2 twoim kluczem API, z promptem, który pyta przed każdym płatnym żądaniem.
Czytaj jako MarkdownAgent AI do programowania, taki jak Codex czy Claude Code, może generować obrazy GPT Image 2, wywołując API bezpośrednio. Umieść klucz API w zmiennej środowiskowej, daj agentowi poniższy prompt, a zbuduje żądanie, pokaże ci je, wyśle po twojej zgodzie, będzie odpytywał zadanie i zapisze obrazy w twoim projekcie. Żadna wtyczka nie jest potrzebna: agent, który potrafi uruchomić polecenie powłoki lub krótki skrypt, może wywołać API.
SeedRouter nie udostępnia serwera MCP ani gotowego skilla. Prompt z tego poradnika to cała integracja. Możesz zapisać go jako instrukcję wielokrotnego użytku w dowolnym agencie, z którego korzystasz.
Czego agent potrzebuje, zanim zacznie?
Trzech rzeczy:
- Klucza API w środowisku. Utwórz go na stronie kluczy API i wyeksportuj w powłoce, w której działa agent. Agent czyta go stamtąd; nigdy nie powinien prosić cię o wklejenie klucza.
- Dostępu do sieci. Agent wywołuje
https://api.seedrouter.ai, więc jego piaskownica musi na potrzeby tego zadania zezwalać na żądania wychodzące. - Kredytów. Żądania są opłacane z twojego salda, więc przed pierwszym uruchomieniem doładuj konto.
export SEEDROUTER_API_KEY="your-key"Jaki prompt dać agentowi?
Wklej go na początku zadania, a potem uzupełnij cel w nawiasach kwadratowych. Prompt wymienia dokładnie te pola, które przyjmuje API, więc agent nie wymyśla parametrów, i każe agentowi zatrzymać się po twoją zgodę, zanim cokolwiek zostanie naliczone:
Use the SeedRouter API to generate a gpt-image-2 image for me.
Security: read SEEDROUTER_API_KEY from my local environment. Never ask me to paste it and never expose it in code, prompts, logs, or output.
Goal:
- Use case: [product / social / concept art / UI mockup]
- Subject and style: [subject, composition, lighting, style]
- Size: [auto | 1024x1024 | 1536x1024 | 1024x1536 | WIDTHxHEIGHT]
- Quality: [auto | low | medium | high]
- Number of images: [1-10]
- Acceptance criteria: [e.g. no text in the image, consistent product, clean background]
Request fields this endpoint accepts, and nothing else:
model (required, "gpt-image-2"), prompt (required, up to 32000 chars),
n (1-10, default 1), size (default auto; a custom WIDTHxHEIGHT must have
both sides divisible by 16, neither edge over 3840, total pixels between
655360 and 8294400, and keep a ratio between
1:3 and 3:1), quality (auto|low|medium|high, default auto),
background (auto|opaque|transparent, default auto; transparent requires
output_format png), output_format (png|jpeg, default png),
output_compression (0-100, default 100, jpeg only),
moderation (auto|low, default auto), user (your own identifier).
For editing use /v1/images/generations with images: [{image_url: "https://..."}]
(up to 16) and optional mask: {image_url: "https://..."}. Mask requires images.
Inputs must be URLs, not base64 or multipart files. stream and partial_images
are not supported because delivery is asynchronous.
Before any paid request, show me the model id, the exact request body and the
estimated cost, then wait for my explicit approval.
After approval:
1. POST https://api.seedrouter.ai/v1/images/generations with the body above and
an Authorization: Bearer $SEEDROUTER_API_KEY header.
2. Save the task id from the response "id" field. The response is
{"id": "...", "status": "processing"} — the image is not in it.
3. Poll https://api.seedrouter.ai/v1/tasks/{task_id} with the same header every
5-10 seconds until status is "completed" or "failed". Do not retry forever;
if you stop waiting, preserve the task id and report that it is still pending.
A polling timeout is not a failed task. Never submit a duplicate just to check status.
4. On success, download every URL in output.data[].url, return the local paths,
the task id, and the parameters used. The response carries no cost field.
5. On failure, keep the task id, explain the reason and what to change, and do
not retry without my approval. A task that ends failed is not charged.Krok zatwierdzenia jest najważniejszy. Agent, który ponawia próby na własną rękę, może wysłać to samo płatne żądanie kilka razy. Zostaw tę instrukcję nawet wtedy, gdy już ufasz konfiguracji.
Jak używać GPT Image 2 w Codex?
Otwórz Codex w swoim projekcie i wklej prompt z uzupełnionym celem. Aby używać go wielokrotnie, dodaj prompt do pliku AGENTS.md projektu, czyli pliku z instrukcjami, który Codex czyta dla repozytorium, pod nagłówkiem w rodzaju „Generating images”. Wtedy wystarczy prośba typu „zrób główny obraz na stronę cennika”, a Codex wykona zapisane kroki.
Jeśli Codex działa w piaskownicy bez dostępu do sieci, nie dotrze do API. Zanim poprosisz o generowanie, zezwól na dostęp do sieci w tej sesji.
Jak używać GPT Image 2 w Claude Code?
Ten sam prompt działa w Claude Code. Aby używać go wielokrotnie, zapisz go w pliku CLAUDE.md projektu albo jako skill: folder z plikiem SKILL.md, którego instrukcje zawierają prompt. Claude Code wczyta go wtedy, gdy poprosisz o obraz. Upewnij się, że SEEDROUTER_API_KEY jest wyeksportowany w terminalu, z którego uruchamiasz Claude Code.
Jak wygląda dobre uruchomienie agenta?
- Opisujesz obraz i miejsce, w którym ma się znaleźć.
- Agent pokazuje ID modelu, dokładną treść żądania i szacowany koszt, po czym czeka.
- Zatwierdzasz. Agent wysyła żądanie raz i podaje ID zadania.
- Odpytuje, aż zadanie się zakończy, pobiera obrazy do projektu i podaje ścieżki plików.
Jeśli uruchomienie zatrzyma się w połowie, ID zadania nadal jest ważne. Poproś agenta, żeby wznowił odpytywanie tego ID, zamiast generować ponownie; drugie wysłanie to drugie obciążenie. Zadanie, które kończy się niepowodzeniem, nie jest rozliczane.
Najczęstsze pytania
Czy SeedRouter ma serwer MCP albo skill dla GPT Image 2?
Nie. Integracją jest samo API, a powyższy prompt daje agentowi wszystko, czego potrzebuje, żeby je wywołać. Jeśli chcesz używać go wielokrotnie, zapisz prompt jako skill lub plik z instrukcjami we własnym agencie.
Czy agent może edytować istniejące obrazy w moim projekcie?
Tak, jeśli obrazy są dostępne pod publicznymi adresami HTTPS. API przyjmuje obrazy referencyjne i maski jako adresy URL, a nie pliki lokalne, więc najpierw je prześlij albo powiedz agentowi, gdzie są hostowane.
Którego modelu powinien używać agent?
gpt-image-2 dla jednej stałej ceny za każdy dostarczony obraz albo gpt-image-2-official, żeby płacić za tokeny raportowane przez każdy render. Aby przełączyć, zmień model w prompcie. Aktualne ceny są na stronie modelu.
Człowiek zostaje w pętli
Daj agentowi klucz przez środowisko, pola przez prompt, a ostatnie słowo przez krok zatwierdzenia. To połączenie pozwala Codex czy Claude Code tworzyć obrazy w twoim projekcie bez niespodziewanych obciążeń. Dokumentacja GPT Image 2 API zawiera każde pole, jeśli chcesz rozbudować prompt.



