↓Aller au contenu
Alemasone

Photos style anime avec l'IA : ce qu'il est possible de faire

Après la mode du style Ghibli, les générateurs imposent des limites. Découvrez comment créer vos prompts et ce qu'en dit le droit.

8 min de lecture Mis à jour le
Photographie d'un paysage à côté de sa version réinterprétée en style illustration
Sur cette page
Au printemps 2025, les réseaux sociaux se sont remplis de photos transformées en illustrations dans le style Studio Ghibli avec ChatGPT. Quelques semaines plus tard, OpenAI a durci le ton : aujourd’hui, les requêtes mentionnant un studio ou un auteur sont souvent refusées, tandis que décrire l’esthétique que vous souhaitez fonctionne encore très bien. Changez la manière dont vous rédigez votre prompt, et le résultat en sera meilleur.

Derrière cette mode se cache également un débat toujours ouvert qui concerne quiconque utilise ces outils : jusqu’à quel point est-il juste de demander à un modèle d’imiter le travail de quelqu’un d’autre ? Plus bas, je parlerai des deux aspects : comment transformer une photo et rédiger la requête, et ce qu’en dit la loi.

Comment transformer une photo, étape par étape #

  1. Ouvrez ChatGPT (via l’application ou sur chatgpt.com) ou Gemini, qui fait de même avec son générateur d’images. Les comptes gratuits conviennent également, avec une limite quotidienne d’images.
  2. Joignez la photo à l’aide du bouton + ou de l’icône trombone.
  3. Écrivez votre requête en décrivant l’illustration que vous souhaitez obtenir (vous trouverez comment la construire plus bas) et envoyez-la.
  4. Observez le résultat et demandez des corrections une par une : « plus de lumière chaude », « arrière-plan plus simple », « couleurs plus douces ».

Si la requête mentionne explicitement le Studio Ghibli, il peut arriver qu’elle soit refusée ou que le service vous propose lui-même une version « inspirée de l’animation japonaise » sans citer de noms. C’est le signe que vous devez décrire le style au lieu de le nommer.

Ce qui s’est passé et où se situe la limite #

OpenAI a expliqué refuser automatiquement les requêtes d’images dans le style d’un artiste vivant, alors qu’au début, les styles de studios ou de courants artistiques plus larges étaient autorisés. C’est précisément cette distinction qui a créé l’incohérence concernant le cas Ghibli, étant donné que le fondateur du studio est toujours en activité, et après les polémiques, les restrictions ont été élargies.

D’un point de vue juridique, la question est plus subtile qu’on ne le raconte. Le style en soi n’est pas protégé par le droit d’auteur : personne ne peut revendiquer l’exclusivité sur une palette de couleurs, un type de trait ou une manière de dessiner les nuages. En revanche, l’œuvre spécifique est protégée avec ses éléments reconnaissables : personnages, scènes, compositions.

La limite se situe donc entre une esthétique générale et la reproduction d’éléments appartenant à une œuvre précise.

Une phrase qui circule de manière déformée. La déclaration très ferme de Hayao Miyazaki sur l’intelligence artificielle, relayée partout pendant cette mode, provient d’un documentaire de 2016 et concernait une démonstration d’animation générée par ordinateur, pas les outils d’aujourd’hui. Le Studio Ghibli ne s’est pas exprimé directement sur la mode des photos transformées, mais à l’automne 2025, il fait partie des éditeurs japonais qui, via l’association CODA, ont demandé à OpenAI de ne pas utiliser leurs œuvres pour entraîner Sora 2 sans autorisation.

Comment écrire une requête qui fonctionne #

La leçon pratique de toute cette affaire est que décrire fonctionne mieux que citer. Nommer un studio ne fonctionne souvent plus aujourd’hui ; décrire les éléments visuels qui vous plaisent fonctionne toujours, et cela vous offre en plus un contrôle qu’un nom ne vous donnerait pas.

Une bonne requête comporte cinq ingrédients :

  1. Le sujet et ce qu’il fait. Pas « une fille », mais « une fille qui court le long d’un sentier de campagne en tenant un chapeau de paille ».
  2. Le cadre. Le lieu, la saison, l’heure de la journée, les éléments de décor.
  3. La lumière. C’est elle qui définit l’atmosphère : lumière chaude de fin d’après-midi, ciel couvert, contre-jour, ombres allongées.
  4. Les couleurs. Verts saturés et bleus profonds, tons pastels, couleurs sourdes.
  5. La technique et l’ambiance. Aquarelle, illustration faite à la main avec des contours doux, peinture numérique ; nostalgique, sereine, mélancolique.

Un schéma à remplir, qui fonctionne aussi bien en italien qu’en anglais :

Un'illustrazione di [soggetto] in [ambientazione], [ora del giorno]
con [descrizione della luce]. Palette di [colori].
Stile: [tecnica], atmosfera [aggettivo]. [Formato o inquadratura].

En anglais, les résultats sont souvent un peu meilleurs, car c’est la langue dans laquelle presque tous les textes utilisés pour l’entraînement des modèles ont été écrits. Des mots comme hand-drawn 2D animation, soft watercolor backgrounds et warm afternoon light donnent déjà une grande partie de l’atmosphère que vous recherchez.

Corrigez une chose à la fois. Au lieu de tout réécrire depuis le début, générez, observez ce qui ne va pas et demandez la modification individuelle : « plus de lumière chaude », « plan plus large », « moins de détails sur l’arrière-plan ». Cela fonctionne bien mieux que dix requêtes écrites de zéro.

Partir d’une de vos photos #

Les générateurs qui acceptent les images les réinterprètent. C’est ce qui a rendu la mode célèbre, et c’est aussi le cas qui nécessite le plus d’attention.

Photographie de départ d’un chien bien éclairé sur un arrière-plan peu chargé
Une lumière lisible et un arrière-plan épuré donnent de bien meilleurs résultats

Sur le plan pratique, les photos avec un sujet bien défini, une lumière claire et un arrière-plan pas trop encombré fonctionnent mieux. Les visages sont redessinés, ils seront donc ressemblants sans être identiques, et les petits détails comme les écritures, les mains ou les éléments lointains restent le point faible.

La même photo du chien redessinée comme une illustration de style anime avec des couleurs douces et une lumière chaude
Le modèle ne copie pas la photo : il la redessine, et la ressemblance s’atténue

Sur le plan de la vie privée, une photo téléchargée sur un service externe sort de votre ordinateur. Avant de le faire avec des photos d’autres personnes, et surtout d’enfants, marquez une pause : le consentement de la personne représentée est nécessaire, et les conditions de traitement des données doivent être lues au moins une fois. Presque tous les services permettent d’exclure vos contenus de l’entraînement des modèles, mais vous devrez chercher l’option dans les paramètres.

Ce que vous pouvez en faire #

Pour un usage personnel (une image pour vous, un cadeau, le fond d’écran du téléphone), il n’y a pas de problèmes pratiques.

Pour des usages publics ou commerciaux, les choses changent pour trois raisons :

  • les conditions d’utilisation du service déterminent ce que vous pouvez faire avec les images générées, et elles varient d’un service à l’autre ;
  • la protection d’une image générée automatiquement est douteuse dans de nombreux pays, car il manque la contribution créative humaine : en pratique, vous pourriez ne pas pouvoir en revendiquer l’exclusivité ;
  • une image qui rappelle de manière reconnaissable une œuvre protégée reste un problème, quelle que soit sa méthode de production.

Si le résultat doit finir sur un produit en vente ou sur du matériel d’entreprise, la voie prudente est de le commander à un illustrateur, éventuellement en utilisant l’image générée comme référence pour lui expliquer ce que vous voulez.

Les alternatives à ChatGPT #

Gemini de Google, Copilot de Microsoft et Midjourney génèrent également ce type d’illustrations, avec des règles sur les styles qui changent souvent. Sur Midjourney, il existe un modèle conçu spécifiquement pour l’animation japonaise, qui s’active en ajoutant le paramètre --niji à la fin de la requête.

Il existe ensuite des modèles qui tournent sur votre ordinateur, sans aucun filtre. Mais cela déplace simplement la responsabilité sur celui qui les utilise : ce qui n’est pas licite ne le devient pas parce que le modèle est installé en local.

Foire aux questions #

Peut-on encore créer des images dans le style Ghibli ? #

Les principaux services refusent généralement les requêtes mentionnant explicitement le studio. Décrire l’esthétique (illustration faite à la main, couleurs douces, paysages de campagne, lumière chaude) fonctionne toujours et vous donne des résultats que vous contrôlez bien mieux.

Quelle version de ChatGPT est nécessaire ? #

La version gratuite convient également, mais elle comporte une limite quotidienne d’images et peut être lente lors des pics de trafic. Les abonnements augmentent cette limite et offrent une priorité dans la file d’attente.

Le style artistique est-il protégé par le droit d’auteur ? #

Le style en soi, c’est-à-dire la technique et le type de trait, ne l’est pas : ce sont les œuvres spécifiques et leurs éléments reconnaissables, personnages inclus, qui sont protégés. C’est pourquoi la question des images générées reste ouverte, et les débats portent davantage sur l’éthique et les données utilisées pour entraîner les modèles que sur le résultat individuel.

Puis-je vendre les images que je génère ? #

Cela dépend des conditions d’utilisation du service que vous utilisez, et un doute subsiste quant à la protection d’une image sans contribution créative humaine : dans de nombreux pays, vous pourriez ne pas pouvoir en revendiquer l’exclusivité. Pour un usage commercial, lisez les conditions et, si le projet est important, demandez l’avis d’un professionnel.

Mes photos sont-elles utilisées pour entraîner les modèles ? #

Cela dépend du service et des paramètres de votre compte. Presque tous permettent d’exclure vos contenus de l’entraînement, mais c’est rarement le paramètre par défaut : vérifiez-le avant de télécharger des photos personnelles.

Pourquoi les visages ne ressemblent-ils jamais tout à fait ? #

Parce que le modèle ne copie pas la photo : il la réinterprète, créant une nouvelle image à partir de la description visuelle qu’il en retire. Un peu de ressemblance se perd toujours, et on en perd davantage à mesure que le style s’éloigne de la photographie.

À lire ensuite