Getestet am 2026-09-10Zuletzt aktualisiert: 2026-09-10

GPT Image 2 vs GPT Image 2.5 Flare bei der Bildgenerierung

Die Ergebnisse unterscheiden sich je nach Aufgabe: GPT Image 2.5 Flare hat bei Neubeleuchtung, Werbekompositionen und produktorientierten Szenen die Nase vorn, während GPT Image 2 bei strukturierten UI-Grafiken und referenzbasierten Objektbearbeitungen stärker ist. Bei Typografie, Anatomie und Kontakt, Zählaufgaben, Textersetzung und Outpainting liegen die Modelle gleichauf. Die bessere Wahl hängt daher von Ihrem Workflow ab.

GPT Image 2 im Vergleich zu GPT Image 2.5 Flare

Fakten im direkten Vergleich

MerkmalGPT Image 2GPT Image 2.5 Flare
EntwicklerOpenAIOpenAI
Verfügbarkeit auf Banana PieJetzt verfügbarJetzt verfügbar
Credits ab20 Credits25 Credits
Max. Auflösung4K4K
ReferenzbilderBis zu 8Bis zu 8

Szenario für Szenario

Derselbe Prompt. Zwei Modelle. Beurteile die Unterschiede in den unten veröffentlichten Bildern.

Produktmaterial und Beleuchtung

Hier besser: GPT Image 2.5 Flare

Beide Ergebnisse folgen dem Prompt genau, aber im rechten Bild ist der halbvolle Füllstand klarer erkennbar und die Beleuchtung von links oben deutlicher. Die leichte Verformung des Röhrchens im Inneren wiegt diese Vorteile nicht auf.

  • Genau ein transparentes, rechteckiges Parfümfläschchen ist zu sehen, ohne Text, Logo oder zusätzliche Objekte: Gleichstand. Beide Bilder zeigen ein einzelnes aufrecht stehendes, rechteckiges Fläschchen auf nassem, unbedecktem Stein, ohne sichtbare Schrift, Markenkennzeichnung, Pflanzen oder separate Requisiten.
  • Das Fläschchen ist sichtbar zur Hälfte mit bernsteinfarbener Flüssigkeit gefüllt: Rechts ist besser. Die Flüssigkeitslinie liegt rechts sehr nah an der Mitte des Fläschcheninnenraums, während das linke Fläschchen etwas mehr als halb voll wirkt.
  • Die Lichtbrechung im Glas und die Spiegelung auf dem nassen schwarzen Stein sind physikalisch stimmig: Links ist besser. Die Glaskanten, die Lichtdurchlässigkeit der bernsteinfarbenen Flüssigkeit und die passend ausgerichtete Spiegelung wirken konsistent. Rechts sind dagegen ein deutlich gebogenes Röhrchen im Inneren und stärkere optische Verzerrungen nahe dem Fläschchenboden zu sehen.
  • Die Beleuchtung von links oben erzeugt konsistente Glanzlichter und einen plausiblen Kontaktschatten: Rechts ist besser. Die Lichtrichtung von links oben wird besonders durch die hellen Glanzlichter auf der linken Seite und den fest verankert wirkenden Schatten deutlich, der sich in den dunkleren rechten Bereich erstreckt.
Verwendeter Prompt & Einstellungen

Prompt

A premium product photograph of exactly one transparent rectangular perfume bottle, half filled with amber liquid, standing upright on wet black stone. Light comes from the upper left, creating coherent refraction, a contact shadow, and one subtle reflection. No text, logo, plants, or extra objects.

GPT Image 2

Resolution: 1K · Aspect Ratio: 1:1

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 1:1

So funktioniert dieser Test

Mehrsprachige Typografie

Kommt auf die Aufgabe an

Gemessen an den Kriterien sind beide Ergebnisse praktisch identisch. Wortlaut, Reihenfolge und Farben wurden korrekt wiedergegeben, doch beide teilen die gewünschte erste Zeile sichtbar auf zwei Zeilen auf. Dadurch entstehen fünf statt genau vier Zeilen.

  • Genau vier zentrierte Textzeilen und kein zusätzlicher Text: Gleichstand. Beide Poster enthalten fünf sichtbare Textzeilen, da „MOONLIGHT MARKET“ auf „MOONLIGHT“ und „MARKET“ aufgeteilt ist. Keines enthält zusätzliche Formulierungen.
  • Exakter Text und exakte Reihenfolge: Gleichstand. Beide geben „MOONLIGHT“, „MARKET“, „月光市集“, „18 OCT“ und „RIVER HALL“ in der gewünschten Reihenfolge wieder, schaffen es jedoch nicht, „MOONLIGHT MARKET“ in einer Zeile zu halten.
  • Textfarben: Gleichstand. Beide stellen „月光市集“ in Rot und den gesamten sichtbaren englischen Text in Schwarz dar.
  • Lesbarkeit, Abstände und Ausrichtung: Gleichstand. Beide Poster zeigen eine scharfe, gut lesbare Schrift mit zentrierter Ausrichtung und insgesamt gleichmäßigen vertikalen Abständen. Ein klarer visueller Vorteil ist nicht erkennbar.
Verwendeter Prompt & Einstellungen

Prompt

Design a clean cream-colored vertical event poster. Show exactly four centered text lines and no other text: "MOONLIGHT MARKET", "月光市集", "18 OCT", and "RIVER HALL". Render "月光市集" in red and all other lines in black.

GPT Image 2

Resolution: 1K · Aspect Ratio: 2:3

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 2:3

So funktioniert dieser Test

Menschliche Anatomie und Kontakt

Kommt auf die Aufgabe an

Links erfüllt die strengen Anforderungen des Prompts an die Sichtbarkeit von Händen und Fingern besser, während rechts die Anatomie und der Kontakt beim Formen überzeugender ausfallen. Über alle Kriterien hinweg gleichen sich diese Vorteile aus.

  • Genau zwei vollständig sichtbare Hände sind vorhanden, ohne zusätzliche Hände oder Personen: Links ist besser. Beide Bilder zeigen eine Person und genau zwei Hände, doch links sind beide Hände vollständiger zu sehen. Rechts sind wesentliche Teile der Finger in oder hinter der Schale verborgen.
  • Jede Hand hat genau fünf klar unterscheidbare, natürlich geformte Finger: Links ist besser. Links lassen sich die fünf einzelnen Finger jeder Hand deutlicher nachvollziehen, während Überlagerungen und Verdeckungen die genaue Anzahl an den Händen im rechten Bild weniger eindeutig machen.
  • Finger, Gelenke und der Kontakt mit dem Ton sind anatomisch plausibel: Rechts ist besser. Der Griff von innen und außen folgt der Wand der Schale auf natürliche Weise und die Ausrichtung der Finger ist überzeugender. Links wirken mehrere Fingerspitzen zusammengedrängt oder teilweise mit dem Ton verschmolzen.
  • Tonschale, Drehscheibe und Formgebung sind klar erkennbar: Rechts ist besser. Schale und Drehscheibe sind in beiden Bildern deutlich zu sehen, doch die gegenüberliegende Position der Hände vermittelt rechts den aktiven Formvorgang klarer.
Verwendeter Prompt & Einstellungen

Prompt

A photorealistic close-up of an adult potter shaping a clay bowl on a spinning wheel. Both hands are fully visible, each with five natural fingers touching the clay. No other people or hands. Soft window light.

GPT Image 2

Resolution: 1K · Aspect Ratio: 3:4

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 3:4

So funktioniert dieser Test

Zählen und Attributzuordnung

Kommt auf die Aufgabe an

Beide Bilder erfüllen alle vier Kriterien, ohne dass ein klarer Unterschied bei der Einhaltung erkennbar ist. Objektanzahl, Zuordnung der Eigenschaften, Anordnung, Ausrichtung des Henkels und sauberer Hintergrund sind praktisch gleichwertig.

  • Objektanzahl und Platzierung: Gleichstand. Beide Bilder zeigen sichtbar genau drei rote Würfel in einer Reihe auf der linken Seite, genau zwei blaue Kugeln auf der rechten Seite und eine gelbe Tasse mittig dahinter.
  • Zuordnung von Farbe, Form und Material: Gleichstand. Beide zeigen rote Holzwürfel mit dezenter Textur, blaue transparente und reflektierende Glaskugeln sowie eine glänzende gelbe Keramiktasse.
  • Ausrichtung des Tassenhenkels: Gleichstand. Der Henkel ist in beiden Bildern deutlich auf der rechten Seite der Tasse zu sehen.
  • Keine zusätzlichen Objekte oder Texte: Gleichstand. In keinem der Bilder sind zusätzliche Objekte oder Texte sichtbar.
Verwendeter Prompt & Einstellungen

Prompt

On a matte gray table, exactly three red wooden cubes form a row on the left, exactly two blue glass spheres sit on the right, and one yellow ceramic mug stands centered behind them. The mug handle points right. No other objects or text.

GPT Image 2

Resolution: 1K · Aspect Ratio: 4:3

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 4:3

So funktioniert dieser Test

Werbekomposition

Hier besser: GPT Image 2.5 Flare

Rechts hält sich genauer an das gewünschte Layout, weil die Überschrift näher an der vorgesehenen Position direkt unter dem freien oberen Bereich sitzt. Ansonsten schneiden beide ähnlich ab und beide verletzen die Textvorgabe, da „AERO“ auf dem Schuh steht.

  • Genau ein silberner Schuh und eine orangefarbene Spur: Gleichstand. Jedes Bild zeigt einen silbernen Schuh unten rechts sowie eine orangefarbene Spur, die von unten links ins Bild führt und sich durch die Szene schlängelt.
  • Sichtbarer Text: Gleichstand. Beide geben „RUN LIGHT“ und „42 KM“ korrekt wieder, zeigen aber zusätzlich sichtbar „AERO“ auf dem Schuh. Somit erfüllt keines die Vorgabe, dass ausschließlich diese Texte sichtbar sein dürfen.
  • Freiraum oben und Platzierung der Überschrift: Rechts ist besser. Beide halten den oberen Bereich frei, doch rechts steht „RUN LIGHT“ näher an der Position direkt unter diesem reservierten Bereich. Links bleibt vor der Überschrift deutlich mehr Leerraum.
  • Sichtbarkeit und Hierarchie: Gleichstand. In beiden Bildern sind Überschrift, Plakette, Spur und der einzelne Schuh vollständig sichtbar. Beide schaffen eine klare visuelle Hierarchie, die von Überschrift und Schuh angeführt wird.
Verwendeter Prompt & Einstellungen

Prompt

Create a vertical social ad for a fictional running shoe named AERO. Keep the top 15 percent empty. Directly below it, place the headline "RUN LIGHT" in the upper-left. Show exactly one silver shoe in the lower-right, an orange trail curving from the bottom-left, and a round badge reading "42 KM". No other shoes or text.

GPT Image 2

Resolution: 1K · Aspect Ratio: 9:16

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 9:16

So funktioniert dieser Test

Strukturierte UI-Grafik

Hier besser: GPT Image 2

Links folgt dem Prompt exakt, während rechts gegen die ausdrückliche Vorgabe verstößt, keinen zusätzlichen Text zu verwenden.

  • Titel und Spalten: Gleichstand. Beide geben den exakten Titel „CHOOSE YOUR PLAN“ und genau drei Spalten mit den Bezeichnungen „STARTER“, „PRO“ und „TEAM“ wieder.
  • Zeilen: Gleichstand. Jede Spalte enthält auf beiden Seiten drei ausgerichtete Zeilen mit den Bezeichnungen „PROJECTS“, „STORAGE“ und „SUPPORT“.
  • Schaltflächen: Gleichstand. Jede Spalte enthält auf beiden Seiten genau eine blaue Schaltfläche mit der Aufschrift „SELECT“.
  • Ausrichtung und zusätzlicher Text: Links ist besser. Bei beiden sind die Spalten gleichmäßig ausgerichtet, aber rechts wurden zusätzliche Tarifdetails ergänzt: „5“, „10 GB“, „Email“, „25“, „100 GB“, „Priority“, „Unlimited“, „1 TB“ und „24/7“. Links enthält keinen zusätzlichen Text.
Verwendeter Prompt & Einstellungen

Prompt

Create a clean horizontal pricing comparison graphic titled "CHOOSE YOUR PLAN". Use exactly three equal columns labeled "STARTER", "PRO", and "TEAM". Under each column, show exactly three aligned rows labeled "PROJECTS", "STORAGE", and "SUPPORT", followed by one blue button labeled "SELECT". White background, dark navy text, no additional columns or text.

GPT Image 2

Resolution: 1K · Aspect Ratio: 16:9

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 16:9

So funktioniert dieser Test

Objektzuordnung und Bearbeitung mit sechs Referenzen

Hier besser: GPT Image 2

LINKS ist das stärkere Ergebnis, da die gewünschten zwei Zitronen sauber dargestellt werden, ohne das potenziell falsch zugeordnete Blatt im RECHTEN Bild. Außerdem bleiben die bearbeiteten Objekte etwas besser innerhalb des Bildausschnitts. Die meisten anderen gewünschten Ersetzungen sind vergleichbar gut gelungen.

  • Kriterium 1: Gleichstand. Beide Bilder zeigen sichtbar eine dunkelmarineblaue Tasse im unteren linken Bereich und eine gefaltete grün-weiß gestreifte Serviette im oberen linken Bereich. Weder die rote Tasse noch das schlichte weiße Tuch sind übrig geblieben. Da die Referenzen nicht zu sehen sind, lässt sich die exakte Übereinstimmung mit ihnen nicht beurteilen.
  • Kriterium 2: Gleichstand. Beide Bilder zeigen genau eine Orange nahe der oberen Mitte und ein senfgelbes gebundenes Notizbuch auf der rechten Seite. Eine grüne Birne oder ein blaues Notizbuch ist nicht zu sehen. Ohne die Ausgangsbilder lässt sich die exakte Übereinstimmung mit den Referenzen nicht beurteilen.
  • Kriterium 3: Links ist besser. Beide zeigen zwei Zitronen rechts von der Tasse, doch im RECHTEN Bild hat eine Zitrone ein auffälliges grünes Blatt, das dem Blatt der Orange ähnelt. Dadurch wirkt das Merkmal sichtbar dem falschen Objekt zugeordnet. LINKS bleiben beide Zitronen klar voneinander getrennt und ohne Verzierung, ohne zusätzliches Obst.
  • Kriterium 4: Links ist etwas besser. Beide bewahren eine stimmige Holztischplatte, konsistente Beleuchtung und plausible Schatten. LINKS bleibt jedoch mehr vom Notizbuch innerhalb des Bildausschnitts sichtbar, während es RECHTS am rechten Rand stärker abgeschnitten ist. Die exakte Bewahrung von Referenz 1 lässt sich nicht beurteilen, da diese Referenz nicht gezeigt wird.
Verwendeter Prompt & Einstellungen

Prompt

Use Reference 1 as the base tabletop scene. Replace the red mug with the exact dark navy-blue mug from Reference 2 in the same position and orientation. Replace the folded white towel with the exact green-and-white striped napkin from Reference 3 in the same folded area. Replace the green pear with exactly one orange from Reference 4 in the same position. Replace the blue notebook with the exact mustard-yellow hardcover notebook from Reference 5 in the same position. Add exactly the two lemons from Reference 6 to the right of the mug. Preserve the wooden table, camera, framing, wood grain, lighting, shadows, and all other spatial relationships from Reference 1. Do not copy the white product backgrounds from References 2–6, duplicate any asset, or add other objects.

GPT Image 2

Resolution: 1K · Aspect Ratio: 4:3

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 4:3

So funktioniert dieser Test

Textersetzung im Bild

Kommt auf die Aufgabe an

Beide Ergebnisse geben den gewünschten Wortlaut sauber wieder und sind visuell nahezu identisch. Keines weist einen sichtbaren Textfehler oder einen klaren Vorteil bei der Bewahrung des Originals auf.

  • Exakter Text und Entfernung des alten Textes: Gleichstand. Auf beiden Schildern steht sichtbar exakt „NIGHT OWL“, und in keinem Bild ist alter Text zu sehen.
  • Zusätzliche oder fehlerhafte Zeichen: Gleichstand. Beide Schilder enthalten ausschließlich „NIGHT OWL“, ohne zusätzliche, doppelte oder fehlerhafte Zeichen.
  • Bewahrung von Schriftart, Abständen und Perspektive: Gleichstand. Beide verwenden eine saubere serifenlose Großbuchstabenschrift, die überzeugend an der Perspektive des Schildes ausgerichtet ist. Die Übereinstimmung mit dem Original lässt sich nicht vollständig beurteilen, da das Ausgangsbild nicht gezeigt wird.
  • Bewahrung von Material, Beleuchtung und Szene: Gleichstand. Die grüne, lackierte Holzmaserung, Schatten, Lampen, Ladenfront, Pflanzen und der Gehweg wirken in beiden Bildern im Wesentlichen identisch. Ohne das Ausgangsbild lässt sich die Übereinstimmung mit dem Original nicht vollständig beurteilen.
Verwendeter Prompt & Einstellungen

Prompt

Replace only the sign text with exactly "NIGHT OWL". Preserve the original font style, spacing, perspective, sign material, lighting, and everything else.

GPT Image 2

Resolution: 1K · Aspect Ratio: 3:2

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 3:2

So funktioniert dieser Test

Kohärente Neubeleuchtung einer Szene

Hier besser: GPT Image 2.5 Flare

RECHTS setzt die stimmige Neubeleuchtung überzeugender um: Gerichtetes Sonnenlicht und konsistente Schlagschatten sind stärker ausgeprägt, statt hauptsächlich einen allgemeinen warmen Farbstich anzuwenden.

  • Warmes Licht der goldenen Stunde fällt deutlich durch das linke Fenster ein: Rechts ist besser. Helles Sonnenlicht strömt sichtbar durch das linke Fenster und erstreckt sich über Wand, Sofa, Teppich und Boden. Links ist zwar eine warme Lichtquelle vorhanden, der Raum wird jedoch weniger ausgeprägt beleuchtet.
  • Glanzlichter und Schattenrichtungen reagieren stimmig auf die neue Lichtquelle: Rechts ist besser. Die Schatten von Fensterrahmen und Pflanzen sowie die langen Schatten der Möbelbeine fallen durchgehend nach rechts. Links sind die Wandschatten plausibel, die gerichteten Schatten auf Teppich und Boden jedoch schwächer.
  • Das Ergebnis ist mehr als ein einheitlicher gelber Farbfilter: Rechts ist besser. Warme Glanzlichter werden mit klaren Sonnenlichtbändern und kühleren Schattenbereichen auf Sofa, Wand, Teppich und Boden kombiniert. Links wirkt im Vergleich gleichmäßiger bernsteinfarben.
  • Keine Möbel oder Dekorationen wurden verschoben, hinzugefügt, entfernt oder neu gestaltet: Ohne das Originalbild lässt sich dies nicht vollständig beurteilen. Die beiden Ergebnisse enthalten sichtbar dieselben wesentlichen Möbel und Dekorationen an übereinstimmenden Positionen, sodass keine Seite einen nachweisbaren Vorteil hat.
Verwendeter Prompt & Einstellungen

Prompt

Change the lighting to warm golden-hour sunlight entering from the left window. Do not move, add, remove, or redesign any object. Update highlights and shadows coherently.

GPT Image 2

Resolution: 1K · Aspect Ratio: 16:9

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 16:9

So funktioniert dieser Test

Outpainting über verschiedene Seitenverhältnisse hinweg

Kommt auf die Aufgabe an

Beide Bilder erfüllen die sichtbaren Outpainting-Anforderungen in sehr ähnlichem Maß. Die Kriterien zur Bewahrung des Originals lassen sich allein anhand dieser Ergebnisse nicht überprüfen, und keines weist einen klar sichtbaren Fehler in der Erweiterung auf.

  • 16:9-Ausgabe mit natürlichen seitlichen Inhalten: Gleichstand. Beide Ergebnisse sind Querformat-Kompositionen, bei denen sich Strand, Meer und Himmel auf beiden Seiten natürlich fortsetzen. Keines zeigt Letterboxing oder eine offensichtlich leere Seite.
  • Vollständiges Original mittig, ohne Beschneiden oder Strecken: Gleichstand. Die Hütte ist mittig platziert und ihre Proportionen wirken in beiden Bildern natürlich. Da das ursprüngliche Ausgangsbild jedoch nicht separat gezeigt wird, lassen sich die vollständige Bewahrung und das Ausbleiben von Beschneidungen nicht überprüfen.
  • Ursprüngliche Hütte, Küstenlinie und interne Komposition unverändert: Gleichstand. Die sichtbare Hütte und die Küstenlinie wirken in beiden Bildern stimmig. Ob eines der Modelle den ursprünglichen Inhalt verändert hat, lässt sich ohne das Ausgangsbild jedoch nicht beurteilen.
  • Keine sichtbaren Übergänge, gespiegelten Füllbereiche oder wiederholten Objekte: Gleichstand. Beide Erweiterungen wirken über Sand, Wellen, Horizont und Wolken hinweg durchgehend. Es sind keine klaren Übergänge, gespiegelten Muster oder duplizierten Objekte sichtbar.
Verwendeter Prompt & Einstellungen

Prompt

Expand the canvas to a 16:9 landscape by naturally continuing the beach, ocean, and sky on both sides. Keep the complete original image centered without cropping, stretching, letterboxing, or modifying it.

GPT Image 2

Resolution: 1K · Aspect Ratio: 16:9

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 16:9

So funktioniert dieser Test

Produkterhalt bei Szenenwechsel

Hier besser: GPT Image 2.5 Flare

Rechts integriert den Sneaker überzeugender in den gewünschten nassen Court in der Abenddämmerung, vor allem durch die stärkere Darstellung der nassen Oberfläche und die stimmigere Beleuchtung. Ohne das Ausgangsbild lässt sich die exakte Bewahrung des Produkts nicht überprüfen.

  • Platzierung in der Szene: Rechts schneidet besser ab. Dort ist ein nasser Basketballplatz im Freien durch sichtbare Spielfeldmarkierungen, einen Korb und einen Zaun, stehendes Wasser, leuchtende Lampen und einen orangefarbenen Dämmerungshimmel deutlicher zu erkennen. Links vermittelt die Umgebung ebenfalls, doch die Spielfeldmarkierungen und die Nässe treten weniger stark hervor.
  • Konsistenz des Sneakers: Dies lässt sich nicht vollständig beurteilen, da die ursprüngliche Sneaker-Referenz nicht gezeigt wird. Beide Ergebnisse weisen eine ähnliche Silhouette, einen niedrigen Kamerawinkel, eine mehrschichtige Sohle, eine vergleichbare Anordnung der Nähte, ein weißes, lederähnliches Obermaterial und einen gewebten Schaftrand auf. Rechts kommen jedoch deutlich sichtbare Wassertropfen auf den Materialien hinzu.
  • Geometrisches Seitenzeichen: Ohne die ursprüngliche Referenz lässt sich nicht überprüfen, ob es unverändert geblieben ist. Beide Ergebnisse zeigen ein klares, gut erkennbares schwarzes, kantiges Zeichen mit nahezu derselben verzweigten Form und Platzierung, sodass keines einen entscheidenden sichtbaren Vorteil bietet.
  • Physikalische Stimmigkeit: Rechts schneidet besser ab. Auf dem Schuh sind Wassertropfen, ein plausibler Kontaktschatten, warme Lichtakzente des Sonnenuntergangs entlang der nach rechts gerichteten Kanten sowie Reflexionen zu sehen, die mit dem hellen Sonnenuntergang und der Platzbeleuchtung übereinstimmen. Links ist die Spiegelung des Schuhs deutlicher, doch der nahezu trockene Schuh steht in einem gewissen Kontrast zur durchnässten Oberfläche.
Verwendeter Prompt & Einstellungen

Prompt

Place the sneaker on a wet outdoor basketball court at dusk. Preserve the exact sneaker shape, black geometric side mark, materials, stitching, sole geometry, and camera angle. Add physically coherent contact, reflections, and dusk lighting.

GPT Image 2

Resolution: 1K · Aspect Ratio: 1:1

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 1:1

So funktioniert dieser Test

Identitäts- und Kleidungsübertragung mit mehreren Referenzen

Verwendeter Prompt & Einstellungen

Prompt

Use the portrait in Reference 1 for the person and the isolated jacket in Reference 2 for the garment. Dress the person from Reference 1 in the exact jacket shown in Reference 2. Preserve the person's identity, face, expression, skin, hair, hands, pose, body proportions, background, framing, and lighting from Reference 1. Preserve the jacket's material, color, collar, buttons, pockets, and sleeve patch from Reference 2. Do not copy the ghost mannequin or white product background.

GPT Image 2

Resolution: 1K · Aspect Ratio: 3:4

GPT Image 2.5 Flare

Resolution: 1K · Aspect Ratio: 3:4

So funktioniert dieser Test

Kosten & Latenz

GPT Image 2 beginnt bei 20 Credits, GPT Image 2.5 Flare dagegen bei 25. Damit ist GPT Image 2 pro Generierung die Option mit dem geringeren Credit-Verbrauch. In der kleinen Latenzstichprobe dieses Durchlaufs benötigte GPT Image 2 je Szenario etwa 81 bis 190 Sekunden, während GPT Image 2.5 Flare etwa 71 bis 101 Sekunden benötigte. Diese Beobachtungen beziehen sich nur auf diesen Durchlauf und stellen keinen allgemeinen Benchmark dar.

Vergleichsmethode & Offenlegung

Für jedes Szenario verwendeten wir einen festen Prompt und führten pro Modell einen Durchlauf aus. Anschließend veröffentlichten wir die Ergebnisse unverändert. Banana Pie bietet kostenpflichtigen Zugang zu beiden Modellen.

Banana Pie bietet kostenpflichtigen Zugriff auf dieses und weitere Modelle in einem Studio. Unsere Bewertungen basieren auf Tests mit derselben Pipeline, die auch unsere Nutzer verwenden.

Selbst ausprobieren

Ausführliche Modellseiten