Parti, l'intelligence artificielle de Google pour créer des images à partir de texte

Publié le 28.06.2022
Voici la nouvelle IA de Google qui génère des images à partir de textes (Europapress)

La course à la création d'intelligences artificielles capables de créer des images à partir de texte se poursuit, car ce n'est pas nouveau car ces dernières semaines plusieurs entreprises ont lancé leurs propositions de technologies cloud capables de générer des contenus à destination du public graphique.

Cette fois, c'est au tour de Google, qui a développé son modèle Pathways Autoregressive Text-to-Image, Parti de son acronyme en anglais, un système autorégressif qui crée des conceptions graphiques photoréalistes à partir de texte.

Google est l'entreprise technologique avec le plus de propositions de ce type, par exemple, en mai dernier, elle a présenté "Image", une autre intelligence artificielle qui crée également des images hyperréalistes à partir de textes.

Selon l'entreprise, ces deux créations sont complémentaires et suggèrent également qu'« il existe deux familles différentes de modèles génératifs : diffusif et autorégressif, respectivement ». C'est-à-dire deux façons de traiter les données nécessaires pour créer les images.

Ce qui est intéressant à propos de Parti, c'est qu'il est capable de recevoir des indications longues et complexes, c'est pourquoi ses développeurs se sont efforcés de faire comprendre à cette Intelligence Artificielle les différents événements survenus tout au long de l'histoire de l'humanité et de montrer une "connaissance précise du monde". dans les mots de ses créateurs.

Un autre objectif de cette innovation est d'inclure la convergence des différents objets et intervenants pour parvenir au respect des différents formats et styles qui y sont indiqués.

Afin que Parti ait la capacité de comprendre plusieurs idées et concepts, lors de son développement, un système informatique appelé PartiPromts (P2) a été incorporé, composé d'environ 1 600 indications en anglais, à la fois simples et complexes.

Ce qui précède, dans le but que les personnes impliquées dans le projet aient la possibilité de mesurer l'évolution de l'outil au fur et à mesure de son utilisation par le public.

Il convient de noter que Parti peut générer des images basées sur des descriptions d'une longueur maximale de 67 mots.

Cette dernière intelligence artificielle de Google a été créée au moyen de séquences de données volumineuses d'images et de contenu graphique, par opposition au traitement de données typique de texte, de chiffres et de symboles. Toutes ces procédures sont connues sous le nom de "séquences de jetons" et sont effectuées au moyen de systèmes appelés Tokenizers, dans le cas de Parti, le ViT-VQGAN a été utilisé.

Image, également de Google, d'autre part, s'est spécialisé dans les descriptions textuelles courtes mais continue de maintenir une grande précision, par exemple, la société a affirmé qu'elle peut également générer des images avec des descriptions basées sur des emplacements spécifiques ou même des textes complexes.

Autrement dit, si un utilisateur saisit "une panthère courant avec une mouette sur les plages de Cancun", l'IA de l'entreprise générera une image basée sur cette description et comprendra le nom scientifique des deux animaux, ainsi que les lieux.

Cependant, il a été mentionné que cette IA pouvait générer des images offensantes et/ou stéréotypées, c'est pourquoi l'entreprise a continué à l'affiner, ainsi que le nouveau Parti.

Enfin, selon Google, « Image s'appuie sur des encodeurs de texte formés sur des données Web non traitées, et hérite donc des préjugés sociaux et des limites des grands modèles linguistiques. En tant que tel, il y a un risque qu'Imagen ait encodé des stéréotypes et des représentations nuisibles.

CONTINUER À LIRE:

Bibliothèque Mot Avec

Pour aller plus loin

Trois guides choisis en fonction du sujet de cet article.

Voir les 8 livres