Anime-Fotos mit KI: Was wirklich möglich ist
Nach dem Ghibli-Trend setzen Generatoren neue Grenzen. Erfahre, was machbar ist, wie du Prompts schreibst und wie es mit dem Urheberrecht aussieht.

Auf dieser Seite
Hinter dem Trend steht auch eine Debatte, die jeden betrifft, der diese Tools nutzt: Bis zu welchem Punkt ist es legitim, ein Modell anzuweisen, die Arbeit eines anderen nachzuahmen? Weiter unten gehe ich auf beides ein: wie man ein Foto transformiert und den Prompt schreibt, und was das Gesetz dazu sagt.
So transformierst du ein Foto Schritt für Schritt #
- Öffne ChatGPT (entweder in der App oder unter chatgpt.com) oder Gemini, das mit seinem Bildgenerator dasselbe macht. Auch kostenlose Accounts funktionieren, allerdings mit einem Limit an Bildern pro Tag.
- Füge das Foto über die Schaltfläche + oder die Büroklammer hinzu.
- Schreibe einen Prompt, der die Illustration beschreibt, die du erhalten möchtest (eine Anleitung dazu findest du weiter unten), und sende ihn ab.
- Betrachte das Ergebnis und fordere Korrekturen Schritt für Schritt ein: „mehr warmes Licht“, „einfacherer Hintergrund“, „sanftere Farben“.
Wenn der Prompt explizit das Studio Ghibli nennt, kann es sein, dass er abgelehnt wird oder der Dienst dir von sich aus eine Version anbietet, die „von japanischen Animationen inspiriert“ ist, ohne Namen zu nennen. Das ist das Zeichen, dass du den Stil beschreiben musst, anstatt ihn beim Namen zu nennen.
Was passiert ist und wo die Grenze verläuft #
OpenAI hat erklärt, Anfragen im Stil eines lebenden Künstlers automatisch abzulehnen, während am Anfang Stile von Studios oder breitere Kunstströmungen erlaubt waren. Genau diese Unterscheidung hat für Unstimmigkeiten im Fall Ghibli gesorgt, da der Gründer des Studios lebt und aktiv ist; nach den Kontroversen wurden die Einschränkungen zudem ausgeweitet.
Aus rechtlicher Sicht ist die Angelegenheit nuancierter, als oft behauptet wird. Der Stil an sich ist nicht urheberrechtlich geschützt: Niemand kann Exklusivrechte auf eine Farbpalette, eine bestimmte Linienführung oder die Art und Weise beanspruchen, wie Wolken gezeichnet werden. Geschützt hingegen ist das spezifische Werk mit seinen wiedererkennbaren Elementen: Charaktere, Szenen, Kompositionen.
Die Grenze verläuft also zwischen einer allgemeinen Ästhetik und der Reproduktion von Elementen, die zu einem ganz bestimmten Werk gehören.
So schreibst du einen Prompt, der funktioniert #
Die praktische Lehre aus der ganzen Geschichte ist: Beschreiben funktioniert besser als Nennen. Einen Namen zu nennen, klappt heute oft nicht; die visuellen Elemente zu beschreiben, die dir gefallen, funktioniert immer – und zudem gibt es dir eine Kontrolle, die ein bloßer Name nicht bieten kann.
Ein guter Prompt besteht aus fünf Zutaten:
- Das Motiv und was es tut. Nicht einfach „ein Mädchen“, sondern „ein Mädchen, das mit einem Strohhut in der Hand einen Feldweg entlangläuft“.
- Die Umgebung. Ort, Jahreszeit, Tageszeit, Hintergrundelemente.
- Das Licht. Es bestimmt die Atmosphäre: warmes Licht am späten Nachmittag, bewölkter Himmel, Gegenlicht, lange Schatten.
- Die Farben. Sattes Grün und tiefes Blau, Pastelltöne, gedämpfte Farben.
- Technik und Stimmung. Aquarell, handgezeichnete Illustration mit weichen Konturen, digitale Malerei; nostalgisch, friedlich, melancholisch.
Ein Schema zum Ausfüllen, das auf Italienisch wie auf Englisch funktioniert:
Un'illustrazione di [soggetto] in [ambientazione], [ora del giorno]
con [descrizione della luce]. Palette di [colori].
Stile: [tecnica], atmosfera [aggettivo]. [Formato o inquadratura].
Auf Englisch sind die Ergebnisse oft etwas besser, da es die Sprache ist, in der fast alle Texte geschrieben wurden, mit denen die Modelle trainiert wurden. Begriffe wie hand-drawn 2D animation, soft watercolor backgrounds und warm afternoon light vermitteln bereits viel von der gewünschten Atmosphäre.
Von einem eigenen Foto ausgehen #
Generatoren, die Bilder akzeptieren, interpretieren diese neu. Das ist es, was den Trend so populär gemacht hat, und genau das erfordert die meiste Aufmerksamkeit.

In der Praxis funktionieren Fotos mit einem klar definierten Motiv, klarem Licht und einem nicht zu überladenen Hintergrund am besten. Gesichter werden neu gezeichnet, sodass sie ähnlich, aber nicht identisch aussehen; kleine Details wie Schriftzüge, Hände oder weit entfernte Elemente bleiben jedoch die Schwachstelle.

In puncto Datenschutz: Ein Foto, das du bei einem externen Dienst hochlädst, verlässt deinen Computer. Bevor du das mit Fotos von anderen Personen oder vor allem Kindern tust, halte kurz inne: Du benötigst die Zustimmung der abgebildeten Person, und die Bedingungen zur Datenverarbeitung sollten mindestens einmal gelesen werden. Fast alle Dienste erlauben es, deine Inhalte vom Training der Modelle auszuschließen, aber du musst die entsprechende Option in den Einstellungen suchen.
Was man damit machen kann #
Für den privaten Gebrauch (ein Bild für dich selbst, ein Geschenk, das Hintergrundbild des Handys) gibt es keine praktischen Probleme.
Für öffentliche oder kommerzielle Zwecke sieht die Sache anders aus, und zwar aus drei Gründen:
- Die Nutzungsbedingungen des Dienstes legen fest, was du mit den generierten Bildern machen darfst, und diese variieren von Anbieter zu Anbieter;
- der Urheberrechtsschutz für ein automatisch generiertes Bild ist in vielen Ländern umstritten, da der menschliche kreative Beitrag fehlt: In der Praxis könntest du also keine Exklusivrechte darauf beanspruchen;
- ein Bild, das auf eine geschützte Arbeit erkennbar anspielt, bleibt problematisch, egal wie es erstellt wurde.
Wenn das Ergebnis auf einem Produkt zum Verkauf oder in Werbematerialien landen soll, ist der sicherere Weg, einen Illustrator zu beauftragen – vielleicht unter Verwendung des generierten Bildes als Referenz, um ihm zu erklären, was du möchtest.
Alternativen zu ChatGPT #
Auch Google Gemini, Microsoft Copilot und Midjourney erstellen Illustrationen dieser Art, allerdings mit unterschiedlichen Regeln für Stile, die sich häufig ändern. Auf Midjourney gibt es ein Modell, das speziell für japanische Animationen entwickelt wurde; dieses aktiviert man, indem man den Parameter --niji am Ende des Prompts hinzufügt.
Es gibt auch Modelle, die lokal auf deinem Computer laufen, ganz ohne Filter. Diese schieben jedoch die Verantwortung allein auf den Nutzer: Etwas Illegales wird nicht legal, nur weil das Modell lokal installiert ist.
Häufig gestellte Fragen #
Lassen sich noch Bilder im Ghibli-Stil erstellen? #
Die gängigen Dienste lehnen Anfragen meist ab, wenn das Studio explizit genannt wird. Es funktioniert aber immer noch, die Ästhetik zu beschreiben (Handzeichnung, sanfte Farben, ländliche Landschaften, warmes Licht), und du erhältst Ergebnisse, die du viel besser kontrollieren kannst.
Welche ChatGPT-Version wird benötigt? #
Die kostenlose Version reicht aus, hat aber ein tägliches Limit für Bilder und kann bei hohem Traffic langsam sein. Abonnements erhöhen das Limit und geben dir Vorrang in der Warteschlange.
Ist der künstlerische Stil urheberrechtlich geschützt? #
Der Stil an sich – also die Technik und die Art der Linienführung – ist es nicht: Geschützt sind spezifische Werke und deren wiedererkennbare Elemente, einschließlich der Charaktere. Deshalb bleibt die Frage um generierte Bilder offen; man diskutiert eher über Ethik und die zum Training verwendeten Daten als über das einzelne Ergebnis.
Kann ich die generierten Bilder verkaufen? #
Das hängt von den Nutzungsbedingungen des jeweiligen Dienstes ab. Zudem bleibt die Frage der rechtlichen Absicherung eines Bildes ohne menschlichen kreativen Beitrag offen: In vielen Ländern kannst du möglicherweise keine Exklusivrechte darauf beanspruchen. Lies für eine kommerzielle Nutzung die Bedingungen und lass dich bei wichtigen Projekten von einem Experten beraten.
Werden meine Fotos zum Training der Modelle verwendet? #
Das hängt vom Dienst und deinen Kontoeinstellungen ab. Fast alle erlauben es, deine Inhalte vom Training auszuschließen, aber das ist selten die Standardeinstellung: Überprüfe dies, bevor du persönliche Fotos hochlädst.
Warum sehen die Gesichter nie ganz so aus wie das Original? #
Weil das Modell das Foto nicht kopiert, sondern neu interpretiert, indem es ein neues Bild basierend auf der daraus abgeleiteten visuellen Beschreibung erstellt. Ein wenig Ähnlichkeit geht immer verloren, und desto mehr sich der Stil von der Fotografie entfernt, desto größer ist der Verlust.

