Der Fehler
Variante A ist ein gutes Bild. Schöner Mantel, offene Hand, auf der Tasche steht LL. Niemand im Team hätte es aufgehalten.
Der QA-Layer schon. Der Pose-Detektor konnte sein rechtes Knie nicht bestätigen, und sein rechter Oberarm kam auf das 1,61-Fache der Länge seines Unterarms. Unser Korridor für einen menschlichen Arm liegt bei 0,7 bis 1,6. Kleine Zahlen, aber genau so rutscht ein gebrochener Arm oder ein drittes Knie in eine Kampagne: Auf den ersten Blick sieht alles gut aus.
Warum Modelle das tun
Bildmodelle wissen nicht, was ein Skelett ist. Sie haben gelernt, wie Körper aussehen, Pixel für Pixel, nicht wie sie gebaut sind. Meistens reicht das. Dann verdeckt ein Mantel ein Knie, eine Tasche eine Hand, und das Modell füllt die Lücke mit etwas, das fast stimmt.
Bei Fingern, Gesichtern und Logos ist es genauso: Text und Muster werden als Formen gezeichnet, nicht buchstabiert. Ein Monogramm kann zu etwas abdriften, das nah dran ist, aber nicht Ihre Marke.
Wie wir es erkennen
Jedes Bild durchläuft dieselben Prüfungen, bevor ein Mensch es sieht: ein Pose-Skelett, ein Hand-Check (ist die Hand da und offen, wie im Prompt verlangt), Gliedmaßen-Verhältnisse, ein Gesichts-Check und ein Logo-Check am Produkt. Jede Prüfung besteht, fällt durch oder bittet einen Menschen um einen Blick.
Das Gate ist absichtlich streng. Lieber stoppen wir ein gutes Bild, als einen gebrochenen Arm zu veröffentlichen. Ein Mensch kann einen Stopp immer aufheben. Eine veröffentlichte Kampagne kann niemand zurückholen.
Was es für Sie bedeutet
Wenn Sie Bilder in großer Menge generieren, ist Ihr Engpass nicht das Erstellen, sondern das Vertrauen. Ein QA-Layer macht aus „jemand schaut sich alles an“ ein „jemand schaut sich die wenigen an, die es brauchen“.
Genau das bauen wir in jedes System ein. So arbeiten wir →