Ich nutze schon eine ganze Weile ChatGPT als Basis für meine Cover Arts.
Dabei erzähle ich der AI erstmal was über den Song und was meine Idee zum Cover Art ist. Dann erstellt ChatGPT das basierend auf meinen Angaben und ich lege final in Photoshop Hand an: Etwas Belichtung ändern hier, etwas smudgen oder aufklären da, Typographie und Branding hinzufügen, dies das.
Ich habe ChatGPT spaßeshalber mal angewiesen, mich als „Task Giver“ zu bewerten. Spannenderweise deckt sich das ziemlich gut mit dem, was menschliche Kollegen, die von mir Tasks bekommen, auch oft sagen.
„You’re a clear and decisive task giver who generally knows what result you’re aiming for, even when you deliberately leave the creative concept open. You communicate the non-negotiables precisely, while giving enough freedom to explore everything else. When something misses, you’re very good at identifying what specifically is wrong rather than merely saying you dislike it. Your biggest challenge is probably that your visual standards and continuity requirements have become precise enough that you sometimes ask for a level of control the current tools can’t reliably deliver in one attempt.“
Der letzte Satz liegt an den immer noch vorhandenen Beschränkungen der KI, sobald man Kontinuität braucht.
Beispiel: Für diese beiden Single Cover war es mir wichtig, Kontinuität zu bewahren. Die eine Single und ihr Cover berichten vom letzten Tag, die Andere vom Wiederaufbau und dem neuen Tag. Nun, der bloße Hinweis darauf, dass da eine Kontinuität sei und man da eine Story erzählen wolle, hat der KI nicht gereicht. Initial hat sie eine komplett andere Figur und einen komplett anderen Teddy eingefügt.

Es erforderte 4-5 weitere Prompts inklusive Bildausschnitte des Teddies und der Figur, bis alles richtig war.
Damit struggled KI immer noch ganz gewaltig. Sie kann sehr gut Dinge „neu“ machen, aber wenn du exakt denselben Dude oder exakt denselben Hintergrund etc. wieder willst, das ist schwer für KI. Das liegt daran, dass KI für solche Tasks eben generativ ist. Sie nimmt nicht, was bereits existiert, sie erstellt das auf Basis der vorhandenen Informationen oder eines Beispielbildes neu. Deswegen funktioniert Kontinuität auch besser, wenn man der KI ein klares, qualitativ hochwertiges Beispielbild dessen gibt, was sie erneut verwenden soll.
Anders als ein Grafiker hat ChatGPT halt nicht irgendwo maincharacter1.psd abgespeichert und kann den immer und immer wieder exakt 1:1 gleich weiterverwenden. Es muss den immer wieder neu generieren. Das funktioniert besser, wenn man ihn einfach jedes Mal, wenn man ihn wieder braucht, dem Prompt als Attachment beifügt und im Prompt dann sowas schreibt wie „Nutze den beigefügten Character für das Bild.“.


Kommentar verfassen