Que ce soit sur l’App Store, Instagram ou Reddit, il est difficile de surfer sur le Web de nos jours sans tomber sur une image générée par l’IA. Il y a quelques mois, la seule façon d’en créer un était avec une interface web comme le Dall-E Mini. Désormais, d’innombrables modèles d’IA sont disponibles gratuitement pour créer toutes sortes d’images.
Lorsque StableDiffusion et ses semblables sont devenus populaires l’automne dernier, la génération d’images était tout sauf conviviale. Il nécessitait une interface utilisateur de style Automatic1111 et la carte vidéo la plus puissante possible sur votre ordinateur.
Sans GPU approprié, il était également possible d’exécuter des scripts basés sur Python via Google Colab, un environnement cloud avec une puissance de traitement presque illimitée. Vous pouviez également payer pour Midjourney, mais le style de l’image était très particulier.
Comment StableDiffusion est-il arrivé sur l’iPad ?
Au fil du temps, la puissance de traitement nécessaire pour créer des images avec l’IA a diminué. Au lieu d’utiliser des ordinateurs très puissants ou le cloud, il est désormais tout à fait possible de créer des images étonnantes sur l’iPad. Nous avons testé deux applications différentes sur l’iPad Pro M2, chacune avec ses propres forces et faiblesses : Guernika et Draw Things.
Les deux applications ne sont que des GUI (interfaces utilisateur graphiques) pour créer des images à l’aide d’un modèle. Et ils proposent tous les deux immédiatement une liste de modèles d’images à télécharger. Ici et là, vous trouverez StableDiffusion dans différentes versions, ainsi qu’Openjourney, une alternative open source à Midjourney. Draw Things, d’autre part, propose une liste complète de Disney à SuperMario et aux dessins animés.
Draw Things et Guernika vous permettent d’utiliser vos propres modèles, qui sont toujours publiés sous forme de fichiers .CKPT. Cette abréviation signifie « point de contrôle » et fait référence à l’état de « réflexion » d’un modèle d’apprentissage automatique capturé dans un fichier. Il existe d’innombrables sources sur Internet pour tous les modèles imaginables.
Quels sont les paramètres importants à considérer ?
En plus du modèle, dans les deux applications, vous trouverez un certain nombre de paramètres qui sont en grande partie les mêmes. Les conseils, les étapes et une «échelle de leadership» sont, bien sûr, particulièrement importants.
Pour obtenir le résultat souhaité avec Draw Things, il existe de nombreuses options de personnalisation et de mise à l’échelle ! / © NextPit
Un indice est une instruction textuelle à partir de laquelle le modèle IA génère une image. À première vue, cela semble plus facile qu’il ne l’est en réalité, car pour obtenir de bons résultats dans le style que vous souhaitez, vous devez souvent utiliser des invites complexes. De plus, les conseils négatifs vous permettent également d’exclure certains styles d’image, angles de vue ou autres éléments. Mais nous y reviendrons un peu plus tard.
Les étapes indiquent le nombre d’opérations nécessaires pour créer une image. Il y aura des étapes, meilleure sera la qualité, mais plus le temps de génération sera long. Selon le modèle utilisé, un nombre différent d’étapes donne de bons résultats. L’échelle de navigation détermine dans quelle mesure le modèle peut s’écarter de vos conseils. Une valeur faible permet à l’IA d’avoir plus de « liberté artificielle ».
Pour Draw Things et Guernica, vous pouvez également utiliser d’autres images d’entrée. Pour ce faire, il existe un curseur « Force », qui détermine à quel point le résultat doit être proche de l’image d’origine. Parce que chaque image générée est unique, Draw Things offre la possibilité de créer jusqu’à 100 images à la fois. Guernica propose même un mode sans fin.
Dans Guernica, vous trouverez la plupart des paramètres, comme dans Draw Things. Cependant (encore) il n’est pas possible de régler la résolution. / © NextPit
Enfin, seul Draw Things vous permet de définir la résolution de sortie. Actuellement, Guernika ne produit que des images de 512 × 512 pixels, bien que le développeur ait promis une mise à jour prochainement avec plus de flexibilité. Draw Things vous permet également d’ajouter un convertisseur AI qui augmente encore la résolution. Vous pourrez créer des images haute résolution à partir de 12 MP et plus.
Sur notre iPad Pro M2, la création d’image prenait entre 20 secondes et 5 minutes, selon le réglage choisi. Il s’est avéré utile de tester la pertinence d’indices à très basse résolution puis, si les résultats sont encourageants, de générer immédiatement une grande série d’images à haute résolution.
Comment rédiger de bons conseils ?
Écrire de bons conseils est une science en soi et doit d’abord être appris et maîtrisé. Ce n’est pas pour rien que l’on voit déjà sur des sites spécialisés les premières offres d’emploi pour un « Suggestion Engineer », c’est-à-dire quelqu’un qui rédige des instructions pour l’IA.
Vos conseils ne sont plus à jour ? Vous pouvez vous inspirer des combinaisons de mots clés avec lesquelles d’autres utilisateurs se sont bien débrouillés. Sur des sites comme PromptHero, vous pouvez cliquer sur une image et voir avec quel modèle ou point d’arrêt, et avec quelle invite l’image a été créée.
Vous pouvez également demander à ChatGPT de vous écrire des conseils détaillés pour des raisons spécifiques. Je vous invite à l’essayer.
Que pensez-vous de l’art généré par l’IA en général ? Trouvez-vous les réalisations actuelles de Midjourney, StableDiffusion et d’autres excitantes ou intimidantes ? Vous souhaitez voir ce sujet plus souvent sur NextPit ?

Grand fan de mangas et d’animes, je n’aime bien écrire qu’à propos de ses sujets, c’est pour ca que j’écris pour 5 minutes d’actus. Au quotidien de décortique, donne mes avis sur les différents épisodes et chapitres des mangas que j’aime lire.
