↓Zum Hauptinhalt springen
Alemasone

So machst du aus Fotos Actionfiguren mit KI

Lerne, wie man Prompts für Actionfiguren im Blister schreibt, die Grenzen von Generatoren kennst und Ergebnisse als Concept Art nutzt.

7 Min. Lesezeit Aktualisiert am
Actionfigur aus Kunststoff in einer transparenten Blisterverpackung mit Zubehör auf einem Karton
Auf dieser Seite
Um ein Foto mit Hilfe von künstlicher Intelligenz in eine Actionfigur zu verwandeln, lädst du das Bild bei ChatGPT oder Gemini hoch und beschreibst drei separate Dinge: die Figur, das Zubehör und die Verpackung. Genau das macht den Unterschied zwischen einem gelungenen Ergebnis und etwas mittelmäßigem aus – viel mehr als der Generator, den du verwendest. Wenn man einfach nur allgemein nach „einer Actionfigur“ fragt, entstehen meistens verwirrende Bilder.

Der Trend ist im Frühjahr 2025 explodiert, zusammen mit dem Hype um Sammelfiguren: echte Menschen, verwandelt in Spielzeug in ihrer Verpackung, mit passendem Zubehör auf der Pappkarte angeordnet. Neben dem Spaßfaktor gibt es auch einen praktischen Nutzen: In wenigen Minuten erhältst du ein Referenzbild, das du jemandem geben kannst, der das Objekt anschließend als 3D-Modell erstellt.

Was du brauchst #

  • Ein scharfes und gut beleuchtetes Ausgangsfoto. Eine Ganzkörperaufnahme funktioniert besser als eine Nahaufnahme, da das Modell so auch die Körperhaltung und die Kleidung erkennt.
  • Einen Bildgenerator, der ein Foto akzeptiert. Die am häufigsten genutzten sind ChatGPT und Google Gemini (mit dem Modell, das alle Nano Banana nennen); beide können auch kostenlos mit einem täglichen Limit an Bildern genutzt werden. Microsoft Copilot funktioniert genauso.

Der Ablauf ist überall gleich: Öffne einen neuen Chat, hänge das Foto über die Schaltfläche + oder die Büroklammer an, füge den Prompt ein und sende ihn ab. Nach wenigen Sekunden ist das Bild fertig.

Die zwei Formate, die man nicht verwechseln darf #

Unter dem Begriff „Actionfigur“ kursieren zwei verschiedene Dinge, und je nachdem, was man fragt, fällt das Ergebnis sehr unterschiedlich aus:

  • die Figur mit Gelenken in der Blisterverpackung: realistische Proportionen, mattes Plastik, Zubehör, das neben der Spielfigur auf einer bedruckten Pappkarte angeordnet ist. Das ist das klassische Format von Actionfiguren;
  • die stilisierte Sammelfigur in der Box: großer Kopf und kleiner Körper, verschlossen in einem Karton mit Sichtfenster. Das ist das typische Sammlerformat (Funko Pop Style).

Wenn du die erste Variante willst, schreibe explizit realistische Proportionen dazu. Ansonsten neigen viele Generatoren automatisch zur stilisierten Version, da diese am häufigsten generiert wird.

Ausgangsfoto: Mann mit rotem Pullover und Kopfhörern vor einer blauen Wand
Das Foto als Basis: gut beleuchtetes Motiv, erkennbare Kleidung und ein einfacher Hintergrund

Den Prompt schreiben #

Ein guter Prompt beschreibt drei Objekte.

Die Figur. Wer ist es, wie sieht die Kleidung aus, in welcher Pose befindet sie sich und mit welchem Gesichtsausdruck? Gib an, dass es ein Plastikspielzeug und keine echte Person ist: „Actionfigur aus Kunststoff, realistische Proportionen, sichtbare Gelenke an Schultern und Knien, leicht matte Oberfläche“.

Das Zubehör. Das sind die Details, die Charakter verleihen, und meistens klappt das sehr gut: zwei oder drei Gegenstände, jeweils in einem eigenen Fach neben der Figur. Ein Laptop und eine Tasse für Leute im Homeoffice, Gitarre und Plektrum für Musiker, Helm und Handschuhe für Motorradfahrer.

Die Verpackung. Beschreibe sie wie ein echtes Produkt: „Blisterverpackung, transparente Kunststoffblase auf einer blauen Pappkarte, oben der Name MARIO in Großbuchstaben, darunter eine kurze Beschreibung“.

Hier ist eine Vorlage zum Ausfüllen:

Una action figure in plastica basata sulla persona nella foto allegata,
proporzioni realistiche da giocattolo, [abbigliamento e colori].
Accanto alla figura, in scomparti separati: [due o tre accessori].
Il tutto è dentro una confezione blister: bolla trasparente su cartoncino
[colore], con la scritta [NOME] in alto in stampatello.
Fotografia del prodotto, sfondo neutro, luce da studio morbida.

Du kannst auch mit dem Stil spielen: ein 80er-Jahre-Spielzeug mit etwas verblassten Farben und abgenutzten Ecken an der Pappe oder eine moderne Figur voller Details.

Schließe mit „Produktfotografie“. Anstatt einer Liste von künstlerischen Adjektiven sagt dieser Hinweis dem Modell, dass es ein echtes Objekt fotografieren soll, das irgendwo liegt, und nicht einfach einen Charakter zeichnen soll. Das ist die eine Ergänzung, die am meisten bewirkt.
Sammelfigur in Blisterverpackung mit Name in Großbuchstaben und Zubehör in separaten Fächern
Verpackung, Name und Zubehör als eigenständige Objekte beschrieben

Was Generatoren immer noch falsch machen #

ProblemSo begrenzt du es
Texte auf der Verpackung sind schief oder erfundenNur ein kurzer Name in Großbuchstaben; keine langen Sätze
Das Zubehör verschmilzt mit den HändenPlatziere es in separaten Fächern, nicht in der Hand
Die Figur sieht aus wie eine echte Person im MiniaturformatFordere Kunststoff, Gelenke und ein mattes Finish an
Das Gesicht ähnelt dem Original kaumBestehe auf Frisur, Brille oder Bart: Diese Details sind wichtiger als die exakten Gesichtszüge
Das Bild ist zu überladenMaximal drei Accessoires, neutraler Hintergrund

Die Regel bleibt immer gleich: Korrigiere, statt neu zu schreiben. Wenn das erste Bild fertig ist, verlange nur die fehlende Änderung („die Pappkarte soll rot statt blau sein“, „entferne die Tasse“), und so kommst du in zwei oder drei Schritten ans Ziel, anstatt fünfzehn Versuche zu brauchen.

Vom Bild zum 3D-Druck #

Hier geht es um den ernsthaften Einsatz, aber ein Punkt muss geklärt werden: Ein generiertes Bild ist kein 3D-Modell. Es ist ein flaches, künstliches Foto, von dem ein Drucker nicht direkt ausgehen kann.

Was das Bild jedoch sein kann (und das es oft ist), ist eine visuelle Referenz: Es zeigt dem 3D-Modellierer, wie die Figur aussieht, wie sie gekleidet ist, welche Pose sie einnimmt und welches Zubehör sie dabei hat. Wer mit 3D-Modellen arbeitet, weiß, wie viel wertvoll eine klare Vorlage im Vergleich zu einer rein textlichen Beschreibung ist.

Die Methode, die funktioniert:

  1. Generiere mehrere Ansichten desselben Motivs: Frontalansicht, Dreiviertelansicht, Profil und Rückansicht. Fordere diese nacheinander an und wiederhole dabei, dass es dieselbe Person sein soll.
  2. Behalte Kleidung und Zubehör bei allen Ansichten bei, indem du Unterschiede schrittweise korrigierst.
  3. Übergib alle Bilder zusammen dem Modellierer oder nutze sie selbst als Referenz.

Es gibt auch Tools wie Meshy oder Tripo, die versuchen, direkt aus einem Bild ein 3D-Modell zu erstellen. Diese sind deutlich besser geworden, bleiben aber eine grobe Basis: ungenaue Geometrie, verschmolzene Details, Oberflächen, die nachbearbeitet werden müssen. Für ein kleines, stilisiertes Objekt kann das reichen; für etwas, das wirklich gut gedruckt werden soll, ist professionelle Modellierung weiterhin notwendig.

Vier Ansichten derselben Actionfigur nebeneinander: Frontalansicht, Dreiviertelansicht, Profil und Rückansicht
Die konsistenten Ansichten, die ein Modellierer benötigt

Falls du sie wirklich druckst: Eine Figur von etwa zehn Zentimeter Höhe muss fast immer in Einzelteile zerlegt werden, um sie zusammenzukleben. Das liegt daran, dass vorspringende Teile (Arme, Zubehör, Haare) Stützstrukturen benötigen, die die Oberfläche beschädigen würden. Deshalb findet man Modelle für den 3D-Druck oft bereits als getrennte Komponenten vor.

Marken und Gesichter #

Die Grenzen, die du von Anfang an beachten solltest.

Marken. Der Name und das typische Aussehen einer Spielzeuglinie sind geschützt. Ein Bild für dich selbst zu erstellen, ist unproblematisch, aber es für ein Business zu nutzen, zu verkaufen oder kommerzielle Objekte daraus herzustellen, ist eine ganz andere Geschichte. Das ist auch der Grund, warum Generatoren immer häufiger Anfragen ablehnen, in denen Marken genannt werden: Es funktioniert besser, den Stil zu beschreiben, um das Problem zu umgehen.

Gesichter. Um das Foto einer anderen Person zu verwenden, benötigst du deren Einverständnis, und bei Fotos von Minderjährigen ist äußerste Vorsicht geboten. Bevor du persönliche Fotos auf einen externen Dienst hochlädst, suche in den Kontoeinstellungen nach der Option, die deine Inhalte vom Training der Modelle ausschließt: Fast alle Dienste bieten das an, aber selten ist es standardmäßig aktiviert.

Häufig gestellte Fragen #

Welche KI solltest du verwenden? #

ChatGPT und Gemini sind am einfachsten: Du lädst das Foto hoch, schreibst den Prompt und hast das Ergebnis in wenigen Sekunden, sogar mit einem kostenlosen Account. Beide kommen gut mit Texten auf der Verpackung zurecht, was bis vor kurzem die Schwachstelle aller Generatoren war.

Brauchst du ein Abonnement? #

Nein: Die Bildgenerierung ist auch in den kostenlosen Tarifen enthalten, allerdings mit einer Begrenzung der täglichen Anfragen. Ein Abonnement hebt dieses Limit auf und gibt dir Zugriff auf die neuesten Modelle, die weniger Fehler bei Texten und kleinen Details machen.

Kann ich die generierte Figur 3D-drucken lassen? #

Nicht direkt: Das Bild ist flach und muss erst von jemandem in ein 3D-Modell umgewandelt werden, der es als Referenz nutzt, oder mit einem Konvertierungstool manuell nachbearbeitet werden. Für den privaten Gebrauch gibt es keine Probleme; das Vervielfältigen und Verkaufen von Objekten, die geschützte Produkte oder Charaktere imitieren, ist jedoch ein völlig anderes Thema.

Warum wird mein Prompt abgelehnt? #

Meistens, weil eine Marke, eine berühmte Figur oder ein Schauspieler genannt wird. Schreibe den Prompt um und beschreibe das Objekt (Plastikfigur, Blisterverpackung, bedruckter Karton), ohne Handelsnamen zu verwenden: Normalerweise klappt es dann, und das Ergebnis entspricht auch eher dem, was du wolltest.

Ist ein Ganzkörperfoto oder eine Nahaufnahme besser? #

Ein Ganzkörperfoto, da es dem Modell Informationen über die Körperhaltung und die Kleidung liefert. Eine Nahaufnahme funktioniert zwar auch, aber du musst Körper und Kleidung zusätzlich beschreiben, sonst erfindet die KI sie einfach dazu.

Wie viele Ansichten werden benötigt, um das Objekt modellieren zu lassen? #

Mindestens drei: frontal, Dreiviertelansicht und von hinten; vier sind sogar besser. Wichtig ist, dass sie konsistent sind: gleiche Kleidung, gleiche Accessoires, gleiche Farben. Die Unterschiede zwischen den einzelnen Ansichten sind die größte Herausforderung bei dieser Methode.

Weiterlesen