Maison
OpenAI lance ChatGPT Images 2.0, capable de générer 8 images cohérentes par session
OpenAI vient de lancer un générateur d’images basé sur son nouveau modèle GPT Image2 : ChatGPT Images 2.0. La principale nouveauté de cette version réside dans le fait qu’elle dote l’IA d’une « capacité de raisonnement » renforcée, ce qui lui permet d’agir davantage comme un créateur logique lorsqu’elle aborde des tâches visuelles complexes.

Grâce à la planification par raisonnement, la génération d’images cesse d’être un « jeu de devinettes »
Contrairement à l’approche précédente qui générait directement des images, Images 2.0 intègre un système de planification logique approfondi. Lorsque le raisonnement est activé, l’IA recherche d’abord des informations en ligne et analyse les fichiers mis en ligne par l’utilisateur. En anticipant la structure de l’image et en planifiant sa mise en page, le résultat obtenu correspond davantage à une intuition logique plutôt qu’à un simple assemblage d’éléments. Cette fonctionnalité avancée est actuellement accessible aux abonnés ChatGPT Plus, Pro, Business et Enterprise.

Une avancée en matière de cohérence : générez jusqu’à 8 images à la fois pour les bandes dessinées et le design
En matière de génération multi-images, la dernière version marque une avancée majeure. Images 2.0 peut désormais produire jusqu’à 8 images cohérentes à partir d’une seule consigne. Plus impressionnant encore, le système préserve rigoureusement la cohérence de l’apparence des personnages, des détails des objets et du style visuel global lors des transitions entre les différentes scènes. Cette capacité réduit considérablement les obstacles à la création de longues bandes dessinées, d’illustrations pour des séries sur les réseaux sociaux ou de projets complets d’aménagement intérieur.
Améliorations de la qualité et optimisation multilingue
Sur le plan technique, la nouvelle version porte la résolution maximale à 2K et propose des formats d’image allant de 3:1 à 1:3, ce qui la rend idéale pour les photos de films, le pixel art et d’autres styles spécifiques. Afin de répondre aux besoins d’un public international, l’équipe a également affiné la précision de la génération de texte en chinois, japonais, coréen, hindi et bengali, remédiant ainsi à des problèmes courants tels que les erreurs d’encodage de texte et les interprétations erronées observées dans les images générées par l’IA précédentes.
Cette mise à jour marque une évolution du dessin par IA, qui passe de la simple « génération de pixels » à la « compréhension et à la création », offrant ainsi aux designers professionnels comme aux utilisateurs lambda des outils visuels plus efficaces.
Article connexe
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Recommandations de sujets spéciaux liés
commentaires (0)
OpenAI vient de lancer un générateur d’images basé sur son nouveau modèle GPT Image2 : ChatGPT Images 2.0. La principale nouveauté de cette version réside dans le fait qu’elle dote l’IA d’une « capacité de raisonnement » renforcée, ce qui lui permet d’agir davantage comme un créateur logique lorsqu’elle aborde des tâches visuelles complexes.

Grâce à la planification par raisonnement, la génération d’images cesse d’être un « jeu de devinettes »
Contrairement à l’approche précédente qui générait directement des images, Images 2.0 intègre un système de planification logique approfondi. Lorsque le raisonnement est activé, l’IA recherche d’abord des informations en ligne et analyse les fichiers mis en ligne par l’utilisateur. En anticipant la structure de l’image et en planifiant sa mise en page, le résultat obtenu correspond davantage à une intuition logique plutôt qu’à un simple assemblage d’éléments. Cette fonctionnalité avancée est actuellement accessible aux abonnés ChatGPT Plus, Pro, Business et Enterprise.

Une avancée en matière de cohérence : générez jusqu’à 8 images à la fois pour les bandes dessinées et le design
En matière de génération multi-images, la dernière version marque une avancée majeure. Images 2.0 peut désormais produire jusqu’à 8 images cohérentes à partir d’une seule consigne. Plus impressionnant encore, le système préserve rigoureusement la cohérence de l’apparence des personnages, des détails des objets et du style visuel global lors des transitions entre les différentes scènes. Cette capacité réduit considérablement les obstacles à la création de longues bandes dessinées, d’illustrations pour des séries sur les réseaux sociaux ou de projets complets d’aménagement intérieur.
Améliorations de la qualité et optimisation multilingue
Sur le plan technique, la nouvelle version porte la résolution maximale à 2K et propose des formats d’image allant de 3:1 à 1:3, ce qui la rend idéale pour les photos de films, le pixel art et d’autres styles spécifiques. Afin de répondre aux besoins d’un public international, l’équipe a également affiné la précision de la génération de texte en chinois, japonais, coréen, hindi et bengali, remédiant ainsi à des problèmes courants tels que les erreurs d’encodage de texte et les interprétations erronées observées dans les images générées par l’IA précédentes.
Cette mise à jour marque une évolution du dessin par IA, qui passe de la simple « génération de pixels » à la « compréhension et à la création », offrant ainsi aux designers professionnels comme aux utilisateurs lambda des outils visuels plus efficaces.
Les actions américaines atteignent un jalon historique alors que les géants de l'IA et de l'aérospatiale se préparent pour leur entrée boursière à la valeur du trillion de dollars.
Elon Musk, Sam Altman et Dario Amodei, trois titans du secteur technologique, s’approchent des introductions en bourse de leurs entreprises respectives. Avec SpaceX, OpenAI et Anthropic – trois géants de l’industrie dont les valorisations approchent
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter











