ByteDance hat Seedream 5.0 Pro am 8. Juli 2026 veröffentlicht. Das Unternehmen positioniert das Modell für dichte visuelle Layouts, räumlich kontrollierte Bearbeitungen, fotografische Texturen und native mehrsprachige Generierung. Der offizielle Launch-Beitrag weist außerdem darauf hin, dass die Darstellung feiner Texte und die Konsistenz bei Bearbeitungen auf Pixelebene noch verbessert werden können. Daher muss jedes Produktionsbild weiterhin überprüft werden.
Du kannst das Modell über die spezielle Seedream-5.0-Pro-API-Seite auf GPT Proto ausführen.

Die Seedream-5.0-Pro-Prompt-Formel
Für ein neues Bild erstellst du den Prompt in dieser Reihenfolge:
[Asset-Typ] + [Hauptmotiv] + [Umgebung] + [Komposition]
+ [Kamera und Beleuchtung] + [Materialien und Texturen]
+ [Text im Bild] + [Einschränkungen]
Jeder Teil nimmt dem Modell eine Entscheidung ab, die es sonst selbst treffen würde.
- Asset-Typ: Porträt, Produktfoto, Poster, Infografik, UI-Mock-up oder Filmstill.
- Hauptmotiv: sichtbares Alter, Kleidung, Form, Farbe, Zustand und Handlung.
- Umgebung: ein konkreter physischer Ort, kein Stimmungswort.
- Komposition: Bildausschnitt, Kamerahöhe, Position des Motivs, Negativraum und Seitenverhältnis.
- Kamera und Beleuchtung: Objektivverhalten, Schärfentiefe, Lichtrichtung, Weichheit, Farbtemperatur und Schattenverhalten.
- Materialien und Texturen: Haut, Glas, Metall, Holz, Stoff, Lebensmittel oder Verpackungsoberfläche.
- Text im Bild: der exakte Wortlaut in Anführungszeichen, Sprache, Position und Hierarchie.
- Einschränkungen: ein oder zwei wichtige Ausschlüsse oder Details, die unverändert bleiben müssen.
Das bedeutet nicht, dass du den längstmöglichen Prompt schreiben musst. Seedream 5.0 Pro kann komplexe Briefings interpretieren, aber widersprüchliche Anweisungen konkurrieren weiterhin miteinander. Füge Details hinzu, die Mehrdeutigkeiten beseitigen, und streiche dekorative Formulierungen, die nichts verändern.
Hier ist dieselbe SaaS-Kampagnenidee in drei Detailstufen.
Schwach
Ein professionelles SaaS-Heldenbild, futuristisch und schön.
Besser
Dunkles SaaS-Heldenbild für eine Automatisierungssoftware. Rechts schwebt ein Workflow-Diagramm, links bleibt Platz für eine Überschrift. Marineblauer Hintergrund, cyanfarbene Akzente, weiche Glaspaneele, klares Enterprise-Design.
API-bereit
16:9-Heldenbild für eine SaaS-Anwendung zur Workflow-Automatisierung. Die linken 42 % als sauberen Negativraum für Überschrift und CTA freihalten. Rechts einen strukturierten Workflow aus sechs durch dünne cyanfarbene Linien verbundenen, lichtdurchlässigen Glaspaneelen darstellen. Tiefdunkler, matter marineblauer Hintergrund, dezentes Raster, zurückhaltende cyanfarbene und hell-lindgrüne Akzente. Weiches Führungslicht von oben links, geringe Reflexionen, scharfe Paneelkanten. Keine Logos, kein dekorativer Text, keine Personen.
Der dritte Prompt ist besser, weil sich das Layout überprüfen lässt. „Futuristisch“ kann nicht gemessen werden; ein linker Textbereich, der ungefähr 42 % des Bildes einnimmt, schon.

Generierungs- und Bearbeitungs-Prompts benötigen unterschiedliche Strukturen
Bei der Text-zu-Bild-Generierung beginnt man mit einem leeren Bild, daher muss der Prompt das gesamte Bild definieren. Bei der Bildbearbeitung sind bereits visuelle Informationen vorhanden. Eine vollständige Wiederholung der Szene kann deshalb unnötige Änderungen fördern.
| Modus |
Was der Prompt steuern sollte |
Ausgangsstruktur |
| Text zu Bild |
Das vollständige Zielbild |
Motiv + Szene + Komposition + Licht + Materialien |
| Bildbearbeitung |
Eine begrenzte Änderung an einem vorhandenen Bild |
Ziel + Änderung + geschützte Details + Integration |
| Bearbeitung mit mehreren Referenzen |
Die Aufgabe jedes Eingabebildes |
Bildrollen + finale Komposition + geschützte Details |
Verwende diese Vorlage für Generierungen:
Erstelle [Asset-Typ] mit [Motiv] in [Umgebung].
Ordne [Komposition] an. Verwende [Kamera und Beleuchtung].
Stelle [Materialien und Texturen] dar. Füge [exakten Text, falls erforderlich] ein.
Vermeide [ein oder zwei bestimmte unerwünschte Elemente].
Verwende diese Vorlage für Bearbeitungen:
Ändere [konkretes Ziel] in [neuen Zustand].
Behalte [Identität, Pose, Produktgeometrie, Komposition, Hintergrund oder Beleuchtung] unverändert.
Passe den bearbeiteten Bereich an [Licht, Perspektive, Textur, Körnung und Schärfentiefe] des vorhandenen Bildes an.
Verwende diese Vorlage für mehrere Referenzen:
Verwende Bild 1 für [Identität des Motivs]. Verwende Bild 2 für [Kleidung, Produkt oder Material]. Verwende Bild 3 für [Umgebung, Pose oder Beleuchtung]. Erstelle [finale Komposition]. Bewahre [wichtige Identitäts- und Designdetails].
Für API-Nutzer ist eine Abgrenzung wichtig. Die offizielle Seedream-5.0-Pro-Showcase-Seite von ByteDance demonstriert Punktauswahl, Rahmen, Skizzen, Farbreferenzen und Ebenentrennung. Der aktuelle Modellendpunkt von GPT Proto stellt für die Bildbearbeitung prompt, size, Ausgabesteuerungen und images bereit. Separate Parameter für Lasso, Begrenzungsrahmen oder Ebenenexport sind derzeit nicht verfügbar. Plane keine Integration um Oberflächensteuerungen herum, die in der API-Anfrage nicht vorhanden sind.
Seedream-5.0-Pro-Prompts für realistische Fotos
„Fotorealistisch, 8K“ definiert weder realistisches Licht noch Haut, Reflexionen oder Kameraverhalten. Ein besserer Prompt beschreibt die physikalischen Gründe, aus denen ein Foto real wirkt.
1. Natürliches Editorial-Porträt
Editorial-Umweltporträt einer Frau Anfang 40, die neben dem Fenster eines kleinen Keramikstudios steht. Schulterlanges schwarzes Haar mit einigen losen Strähnen, minimales Make-up, sichtbare Poren und feine Ausdruckslinien. Sie trägt eine verblichene indigoblaue Arbeitsjacke mit Lehmstaub an den Manschetten. Halbnahe Aufnahme auf Augenhöhe, das Motiv leicht rechts der Bildmitte. Weiches, bedecktes Fensterlicht von links aus Kamerarichtung, sanfter Schatten auf der rechten Gesichtshälfte, gedämpfte Erdtöne, geringe, aber glaubwürdige Schärfentiefe. Natürliche Hauttextur, keine Beauty-Retusche, keine glänzende Haut.
Der Prompt benennt, woher das Licht kommt und was es sichtbar machen soll. „Sichtbare Poren“ ist hilfreicher als „hochwertige Haut“.
2. Beiläufiges Smartphone-Foto
Beiläufiges Smartphone-Foto von zwei Freunden, die an einem belebten nächtlichen Straßenstand Nudeln teilen. Eine Person lacht gerade, die andere greift nach einer Schüssel. Leicht unperfekter, außermittiger Bildausschnitt, handgehaltene Kamera auf Augenhöhe, leichte Bewegungsunschärfe an der greifenden Hand, gemischtes warmes Licht des Stands und kühles Licht nahegelegener Ladenschilder. Gäste im Hintergrund bleiben erkennbar, sind aber weich unscharf. Natürliche Belichtung, mäßige Smartphone-Schärfung, realistische Stofffalten, keine Studiobeleuchtung, keine posierten Gesichtsausdrücke.
Echte Schnappschüsse enthalten kleine Unvollkommenheiten. Perfekte Symmetrie, perfekte Haut und vollkommen gleichmäßiges Licht lassen ein Bild oft weniger fotografisch wirken.
3. Kommerzielles Produktfoto
Quadratisches E-Commerce-Heldenfoto einer 250-ml-Handseifenflasche aus bernsteinfarbenem Glas auf einer geschliffenen Kalksteinplatte. Eine gerade zylindrische Flaschenform und scharfe vertikale Etikettenkanten bewahren. Das Etikett trägt den Text "FIELD SOAP" in kleinen schwarzen englischen Großbuchstaben. Dreiviertelansicht auf Flaschenhöhe, Perspektive eines 70-mm-Produktobjektivs. Großes diffuses Führungslicht von oben links, schmale weiße Reflexion am linken Glasrand, weicher Kontaktschatten nach hinten rechts. Sichtbare Flüssigkeitslinie, feine Steinkörnung, zurückhaltende Beige- und Bernsteintöne. Keine Blumen, keine schwebenden Objekte, kein zusätzlicher Text.
4. Innenraum- und Architekturfoto
Weitwinkel-Innenaufnahme eines kompakten japanischen Leseraums mit hellem Eichenregal, Wänden aus Kalkputz, einem niedrigen Leinenstuhl und einer Papier-Pendelleuchte. Kamera auf sitzender Augenhöhe im Türrahmen, gerade vertikale Architekturlinien, 24-mm-Objektiv mit kontrollierter Randverzerrung. Spätnachmittägliches Tageslicht fällt von rechts durch ein Fenster und mischt sich natürlich mit dem warmen Licht der Pendelleuchte. Realistische Größenverhältnisse, weiche Wandtextur, subtile Reflexionen auf dem Holzboden und Details außerhalb des Fensters bewahren. Keine Personen, keine übergroßen Möbel, kein extremes HDR.
5. Filmischer Mitzieher
2,39:1-filmisches Mitzieher-Foto eines Fahrradkuriers, der während der blauen Stunde eine nasse Straßenkreuzung überquert. Gesicht, Oberkörper und Fahrradrahmen des Fahrers bleiben scharf, während sich die Schaufenster in horizontaler Bewegungsunschärfe ziehen und die Radspeichen Rotationsunschärfe zeigen. Die Kamera bewegt sich seitlich mit der Geschwindigkeit des Fahrers. Kühles Umgebungslicht des Himmels, warme Reflexionen der Verkehrssignale auf dem Asphalt, leichter Regen, realistischer Sprühnebel hinter dem Hinterreifen. Tiefer Kamerawinkel, zurückhaltender Kontrast, kein eingefrorener Hintergrund, keine künstlichen Geschwindigkeitslinien.
Dieses letzte Beispiel folgt einem fotografischen Verhalten, das ByteDance in seinem Launch-Material demonstriert: Das Motiv kann scharf bleiben, während Hintergrund und Räder unterschiedliche Arten von Bewegungsunschärfe zeigen. Betrachte dies als vom Anbieter demonstrierte Fähigkeit, nicht als Garantie, dass jede Generierung den Effekt perfekt reproduziert.

Seedream-5.0-Pro-Prompts zur Fotobearbeitung
Beginne bei einer Bearbeitung mit der Benennung des Ziels. Definiere anschließend die Änderung, die geschützten Details und die Art, wie die neuen Pixel in die vorhandenen integriert werden sollen.
6. Hintergrund ersetzen, ohne die Person zu verändern
Ersetze nur den Bürohintergrund durch einen ruhigen Bahnsteig an einem bedeckten Morgen. Gesicht, Gesichtsproportionen, Ausdruck, Frisur, Körperform, Pose, Hände, Kleidung und Kamerabildausschnitt der Person unverändert lassen. Den neuen Hintergrund an das vorhandene weiche Licht auf der Person anpassen. Einen dezenten Kontaktschatten an den Füßen und eine realistische Bahnsteigperspektive hinzufügen. Identität der Person nicht verändern und keine Hautretusche anwenden.
7. Produktfarbe ändern
Den Korpus der mittleren Kaffeemaschine von glänzendem Rot in mattes Anthrazitschwarz ändern. Abmessungen, Tasten, Chromteile, Logo, Kamerawinkel, Arbeitsfläche, Hintergrund und Komposition unverändert lassen. Positionen von Glanzlichtern und Schatten bewahren, ihre Intensität jedoch an die matte Oberfläche anpassen. Netzkabel und Gegenstände rund um die Maschine nicht verändern.
8. Material ersetzen
Die weiße Kunststoffhülle der Schreibtischlampe durch helles Eschenholz mit feiner gerader Maserung und matter Öloberfläche ersetzen. Silhouette, Gelenke, Schirmdicke, Kabel, Position und warmes Licht der Lampe unverändert lassen. Die Maserung der Geometrie jedes Teils folgen lassen. Vorhandene Perspektive, Kontaktschatten, Hintergrund und Schärfentiefe bewahren.
9. Gesicht retuschieren, ohne die Identität zu verändern
Die beiden vorübergehenden Unreinheiten auf der rechten Wange entfernen und den Glanz auf der Stirn reduzieren. Exakte Gesichtsstruktur, Augenform, Nase, Lippen, Kieferlinie, Ausdruck, Hautton, Sommersprossen, Poren, feine Linien, Haare und Make-up unverändert lassen. Vorhandenes Seitenlicht und Kamerakörnung beibehalten. Nicht das gesamte Gesicht glätten, Gesichtszüge nicht umformen, Zähne nicht aufhellen und das scheinbare Alter nicht verändern.
10. Kleidung ersetzen und Pose sowie Gesicht bewahren
Den grauen Kapuzenpullover der Person durch einen strukturierten dunkelblauen Wollblazer über einem schlichten weißen Rundhalsshirt ersetzen. Gesicht, Identität, Frisur, Ausdruck, Körperproportionen, Schulter- und Armposition, Hände, Kamerabildausschnitt und Hintergrund unverändert lassen. Den Blazer der vorhandenen Pose mit natürlichen Falten folgen lassen und an Richtung sowie Qualität des ursprünglichen Fensterlichts anpassen.
11. Neu beleuchten, ohne die Komposition zu verändern
Die Beleuchtung von flachem Mittagslicht in weiches Spätnachmittagslicht ändern, das von oben rechts kommt. Ein warmes Kantenlicht auf der Person und einen langen, weichen Schatten nach links hinzufügen. Jede Person, jedes Objekt, jedes Gesichtsmerkmal, jede Farbe, Kameraposition, jeden Bildausschnitt, jedes Hintergrundelement und die Schärfentiefe unverändert lassen. Realistische Materialreflexionen bewahren und orangefarbene Hauttöne vermeiden.
12. Objekt entfernen und Hintergrund rekonstruieren
Den roten Koffer neben der Bank entfernen. Den verdeckten Boden, das Bankbein und die dahinterliegende Wand anhand der umgebenden Texturen und Perspektive rekonstruieren. Person, Bank, Schatten, Wandspuren, Kamerakörnung, Farbkorrektur und Komposition unverändert lassen. Kein Ersatzobjekt hinzufügen und den reparierten Bereich nicht weichzeichnen.

Fünf weitere kopierfertige Seedream-5.0-Pro-Promptbeispiele
Die nächsten fünf Prompts gehen über gewöhnliche Fotografie hinaus. Sie nutzen Bereiche, die ByteDance bei Seedream 5.0 Pro hervorhebt: informationsreiche Layouts, lokalisierten Text, räumliche Komposition und mehrere visuelle Referenzen.
13. Mehrsprachiges Kampagnenposter
Vertikales Poster im Format 4:5 für einen sommerlichen Nachtmarkt in einem Viertel. Tief indigoblauer Himmel, warme Papierlaternen, kleine Essensstände im unteren Drittel und sauberer Negativraum oben. Englische Hauptüberschrift "NIGHT MARKET" in kräftigen cremefarbenen Buchstaben oben mittig. Japanische Unterüberschrift "夏の夜市" direkt darunter in einem kleineren roten Textblock. Datum "18–20 JULY" unten links. Klare visuelle Hierarchie, Textur eines im Siebdruck hergestellten Posters, korrekte japanische Zeichen, kein zusätzlicher Text, keine Logos.
14. Informationsreiche Bildungsinfografik
Vertikale Bildungsinfografik im Format 9:16 mit dem Titel "HOW A HEAT PUMP MOVES HEAT". Warm elfenbeinfarbener Hintergrund mit salbeigrünen und dunkelgrauen Akzenten. Vier nummerierte Phasen von oben nach unten zeigen: Wärmeaufnahme im Außenbereich, Verdichtung des Kältemittels, Wärmeabgabe im Innenbereich und Expansion. Die Phasen mit klaren Pfeilen verbinden. Unten rechts ein kleines Vergleichsbalkendiagramm mit der Beschriftung "HEAT OUTPUT
PER UNIT OF ELECTRICITY" und den Werten 1 und 3,5 hinzufügen. Prägnante englische Beschriftungen, großzügige Abstände, einheitlicher Icon-Stil und ein klar abgetrennter Bereich für Quellenangaben am unteren Rand. Keine dekorative Fotografie.
Überprüfe vor der Veröffentlichung einer Infografik jedes erzeugte Label und jede Zahl. Das Modell kann dichte Informationen gut anordnen und trotzdem einen kleinen Übertragungsfehler machen.
15. E-Commerce-Heldenbild für eine Landingpage
16:9-Heldenbild für die E-Commerce-Startseite eines kompakten Kaffeemahlwerks für die Arbeitsplatte. Das Produkt steht rechts auf einer warmgrauen Steinoberfläche, in Dreiviertelansicht, mit mattem schwarzem Aluminiumgehäuse und durchsichtigem Glasbehälter. Die linken 45 % als freien Bereich lassen. Überschrift "GRIND WITH INTENT" oben links, nur eine Zeile. Kleineren Text "40 precise settings" darunter. Weiches gerichtetes Studiolicht von oben links, kontrollierte Metallreflexionen, gedämpfte Anthrazit- und Sandtöne, hochwertiges Editorial-Layout, keine in der Luft schwebenden Kaffeebohnen, kein zusätzlicher Text.
16. Editorial-Werbung für Lebensmittel
Vertikale Editorial-Lebensmittelwerbung im Format 4:5 für sprudelndes Yuzu-Wasser. Eine kalte Klarglasflasche steht auf hellblauen Fliesen, mit sichtbarem Kondenswasser und einem korrekten Papieretikett mit der Aufschrift "YUZU / 0 SUGAR". Eine aufgeschnittene Yuzu liegt neben der Flasche; dahinter steigt ein kleiner Spritzer auf, der physisch mit einer flachen Wasserlache verbunden ist. Hartes Morgenlicht von oben rechts erzeugt scharfe Schatten nach links. Makro-Oberflächendetails, realistische Glasbrechung, zurückhaltende Gelb- und Blautöne, keine schwebenden Früchte, kein zusätzlicher Text.
17. Kampagnenbild mit mehreren Referenzen
Bild 1 ausschließlich für Gesichtsidentität und Frisur des Models verwenden. Bild 2 ausschließlich für die rostfarbene technische Jacke und ihre Taschendetails verwenden. Bild 3 für die felsige Küstenumgebung und die bedeckte Beleuchtung verwenden. Ein Outdoor-Kampagnenfoto bis zur Taille erstellen, bei dem die Person leicht von der Kamera weg nach links blickt. Das Gesicht aus Bild 1 und die Konstruktion der Jacke aus Bild 2 bewahren, ohne ihre Farben oder Formen zu vermischen. Das Motiv an das kühle, weiche Licht und die Windrichtung aus Bild 3 anpassen. Natürliche Hauttextur, realistische Stofffalten, keine Logos, kein Text.
Dies sind kopierfertige Ausgangspunkte, keine verifizierten „besten Prompts auf X“. Ein öffentlicher Social-Media-Beitrag enthält selten jedes Referenzbild, jede Größeneinstellung, jeden fehlgeschlagenen Versuch und jeden Bearbeitungsschritt, die zum finalen Ergebnis geführt haben.

Weitere Seedream-5.0-Pro-Prompt-Ideen entdecken
Die 17 Vorlagen oben helfen dir, die Struktur von Seedream-5.0-Pro-Prompts zu verstehen. Wenn du lieber mit einem fertigen Bild beginnst, entdecke unsere Seedream-5.0-Pro-Prompt-Sammlung mit weiteren aktuellen Ideen und generierten Beispielen.
Öffne ein beliebiges Bild, um den Original-Prompt anzuzeigen, und passe Motiv, visuellen Stil, Beleuchtung, Farben, Kamerawinkel oder Komposition an dein eigenes Projekt an. Du kannst den Prompt kopieren, anpassen oder mit Seedream 5.0 Pro ein ähnliches Bild erzeugen, ohne die Anweisungen von Grund auf neu zu erstellen.
So verwendest du diese Prompts mit der Seedream-5.0-Pro-API
GPT Proto stellt die internationale BytePlus-Modell-ID dola-seedream-5-0-pro-260628 bereit. BytePlus dokumentiert die 5.0-Familie in seinem Seedream-4.0–5.0-Tutorial; GPT Proto stellt dieses Modell über seine eigene /api/v3/-Schnittstelle bereit.
Die aktuellen Anfragefelder sind unkompliziert:
| Feld |
Verwendet von |
Zweck |
prompt |
Beide Aufgaben |
Generierungs- oder Bearbeitungsanweisung |
size |
Beide Aufgaben |
Ausgabebreite und -höhe |
images |
Bildbearbeitung |
Öffentlich zugängliche URLs von Quell-/Referenzbildern |
enable_base64_output |
Beide Aufgaben |
Base64 statt einer Bild-URL zurückgeben |
enable_sync_mode |
Beide Aufgaben |
Auf das generierte Ergebnis in derselben Antwort warten |
Die Live-Modellseite nennt derzeit 0,0405 $ für ein 1K-Bild und 0,081 $ für ein 2K-Bild. Die Bildbearbeitungsaufgabe akzeptiert bis zu 10 Referenzen; die erste ist im Grundpreis der Generierung enthalten, jede weitere Referenz kostet zusätzlich 0,0027 $.
Bild mit cURL generieren
Setze enable_sync_mode auf true, um den einfachsten ersten Aufruf auszuführen. Die /api/v3/-Schnittstelle verwendet den unveränderten API-Schlüssel im Authorization-Header – stelle Bearer nicht voran.
curl --location \
'https://gptproto.com/api/v3/doubao/dola-seedream-5-0-pro-260628/text-to-image' \
--header "Authorization: $GPTPROTO_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
"prompt": "Square e-commerce hero photograph of a 250 ml amber glass hand-soap bottle on a honed limestone slab. Straight cylindrical bottle, crisp vertical label reading FIELD SOAP in black uppercase English text. Three-quarter view at bottle height, large diffused key light from upper left, narrow reflection along the glass, soft contact shadow falling back-right. Visible liquid line, fine stone grain, restrained beige and amber palette. No flowers, no extra text.",
"size": "1024x1024",
"enable_base64_output": false,
"enable_sync_mode": true
}'
Bild mit Python generieren
Diese Version gibt die vollständige JSON-Antwort aus und meldet anschließend jede URL- oder Base64-Ausgabe, die an den üblichen Stellen data.outputs oder outputs zurückgegeben wird. Die vollständige Antwort beim ersten Aufruf auszugeben ist hilfreich, da du dadurch die genaue Antwortstruktur erhältst, die für dein Konto bereitgestellt wird.
import json
import os
import requests
API_KEY = os.environ["GPTPROTO_API_KEY"]
URL = (
"https://gptproto.com/api/v3/doubao/"
"dola-seedream-5-0-pro-260628/text-to-image"
)
prompt = """Square e-commerce hero photograph of a 250 ml amber glass
hand-soap bottle on a honed limestone slab. Straight cylindrical bottle,
crisp vertical label reading 'FIELD SOAP' in black uppercase English text.
Three-quarter view at bottle height, large diffused key light from upper left,
narrow reflection along the glass, soft contact shadow falling back-right.
Visible liquid line, fine stone grain, restrained beige and amber palette.
No flowers, no extra text."""
response = requests.post(
URL,
headers={
"Authorization": API_KEY,
"Content-Type": "application/json",
},
json={
"prompt": prompt,
"size": "1024x1024",
"enable_base64_output": False,
"enable_sync_mode": True,
},
timeout=300,
)
response.raise_for_status()
payload = response.json()
print(json.dumps(payload, indent=2))
data = payload.get("data", payload)
outputs = data.get("outputs") or payload.get("outputs") or []
if outputs:
print("Generated output:", outputs[0])
else:
print("No outputs array found; inspect the JSON above for the returned field.")
Installiere die einzige Abhängigkeit mit pip install requests, exportiere deinen Schlüssel als GPTPROTO_API_KEY und führe das Skript aus.
Bild mit Referenzen bearbeiten
Die Bildbearbeitungsaufgabe ändert den Pfad und fügt ein images-Array hinzu. Jede URL muss für die API öffentlich erreichbar sein.
import json
import os
import requests
API_KEY = os.environ["GPTPROTO_API_KEY"]
URL = (
"https://gptproto.com/api/v3/doubao/"
"dola-seedream-5-0-pro-260628/image-edit"
)
response = requests.post(
URL,
headers={
"Authorization": API_KEY,
"Content-Type": "application/json",
},
json={
"images": ["https://your-cdn.example.com/source-portrait.jpg"],
"prompt": (
"Replace only the office background with a quiet railway platform "
"on an overcast morning. Keep the person's face, expression, "
"hairstyle, pose, hands, clothing, and camera crop unchanged. "
"Match the new background to the existing soft light."
),
"size": "1024x1024",
"enable_base64_output": False,
"enable_sync_mode": True,
},
timeout=300,
)
response.raise_for_status()
print(json.dumps(response.json(), indent=2))
Für Hintergrundaufgaben setze enable_sync_mode auf false. Die Anfrage gibt dann eine Vorhersage-ID zurück, und der Client muss /api/v3/predictions/{result_id}/result abfragen. Bevor du eine Polling-Implementierung veröffentlichst, führe eine Live-Anfrage aus und fixiere die genaue ID sowie die Status-, Ausgabe- und Fehlerfelder, die der aktuelle Endpunkt zurückgibt.
[BILDPLATZHALTER 7] GPT Proto-Playground oder Screenshot einer Antwort mit Prompt, Größe, erfolgreicher Antwort und generiertem Bild.
Vorgeschlagener Alternativtext: Aufruf der Seedream-5.0-Pro-API über GPT Proto mit einem strukturierten Bild-Prompt.
Du kannst andere Bildmodelle durchsuchen, ohne für jedes Modell einen separaten Schlüssel oder ein eigenes Anbieter-Guthaben anzulegen.
Häufige Probleme mit Seedream-5.0-Pro-Prompts
| Problem |
Wahrscheinliches Prompt-Problem |
Was zu ändern ist |
| Das Gesicht verändert sich während der Bearbeitung |
Die Identität wurde nicht geschützt |
Gesichtsstruktur, Ausdruck, scheinbares Alter und Hautdetails festschreiben |
| Die Haut sieht wie Plastik aus |
Der Prompt fordert allgemeine Perfektion |
Poren, feine Linien, zurückhaltenden Glanz und natürliche Textur anfordern |
| Auch der Hintergrund verändert sich |
Der Bearbeitungsbereich ist zu groß |
Ziel benennen und Hintergrund sowie Komposition als geschützt aufführen |
| Die Produktform verändert sich |
Die Geometrie ist nicht definiert |
Silhouette, Abmessungen, Etikettenkanten und Kamerawinkel bewahren |
| Das Bild sieht weiterhin nach CGI aus |
Es wurden nur Qualitätsadjektive ergänzt |
Physisches Licht, Materialverhalten, Schärfentiefe und Kameraverhalten definieren |
| Der Text ist falsch |
Wortlaut oder Hierarchie sind zu dicht |
Wortlaut kürzen; exakte Formulierung, Sprache, Position und Priorität angeben |
| Referenzen vermischen sich |
Den Eingaben wurden keine Rollen zugewiesen |
Jeder Referenz eine Aufgabe geben und angeben, was nicht gemittelt werden darf |
| Die API gibt eine Aufgabe, aber kein Bild zurück |
Die Anfrage ist asynchron |
Vorhersage-Endpunkt abfragen oder für den ersten Test enable_sync_mode: true verwenden |
Wenn ein Prompt nicht funktioniert, ändere jeweils nur eine Kategorie. Korrigiere zuerst die Komposition, dann die Identität, anschließend das Licht und zuletzt die Oberflächendetails. Wenn du nach jedem Ergebnis alle Teile neu formulierst, lässt sich nur schwer erkennen, welche Anweisung die Verbesserung verursacht hat.
Seedream-5.0-Pro-Prompt-Checkliste
Vor dem Absenden eines Generierungs-Prompts prüfen:
- Ist der Asset-Typ eindeutig?
- Ist das Motiv visuell spezifisch beschrieben?
- Definiert der Prompt Komposition und Negativraum?
- Nennt er Lichtquelle, Richtung und Schattenverhalten?
- Sind die wichtigen Materialien und Texturen beschrieben?
- Steht der Text im Bild in Anführungszeichen und sind Sprache sowie Position angegeben?
- Sind die Ausschlüsse auf wichtige Details beschränkt?
Vor dem Absenden eines Bearbeitungs-Prompts zusätzlich prüfen:
- Ist das Bearbeitungsziel eindeutig?
- Unterscheidet der Prompt zwischen Änderung und geschützten Details?
- Sind Identität, Geometrie, Pose, Komposition und Licht bei Bedarf festgeschrieben?
- Muss der neue Bereich an vorhandene Perspektive, Körnung, Reflexionen oder Schärfentiefe angepasst werden?
- Hat jedes Referenzbild genau eine ausdrückliche Rolle?
Das Wichtigste
Formuliere eine Bearbeitung nicht so, als würde das Modell ein neues Bild zeichnen. Generierungs-Prompts benötigen das vollständige Bild; Bearbeitungs-Prompts benötigen ein begrenztes Ziel, eine konkrete Änderung und eine Liste geschützter Details. Für mehr Realismus solltest du Qualitätsadjektive durch physisches Licht, Materialverhalten, Kameraposition und natürliche Textur ersetzen.
Am schnellsten validierst du die Formeln, indem du einen Prompt im Seedream-5.0-Pro-Playground ausführst, Größe und Quellbilder beibehältst und pro Versuch nur eine Prompt-Kategorie änderst. Mit demselben GPT Proto-Schlüssel kannst du anschließend andere Bildmodelle vergleichen oder auf die umfassendere GPT Proto-API-Plattform zugreifen.