Maison
DeepSeek lance un mode de reconnaissance d'images étendu avec compréhension multimodale dans le cadre de tests internes
DeepSeek a lancé les tests internes de son mode de reconnaissance d'images à grande échelle, marquant ainsi le passage définitif de ce grand modèle national à l'ère multimodale alliant texte et image. Après une version bêta à petite échelle fin avril, l’entreprise a considérablement élargi l’accès au « mode de reconnaissance d’images » le 9 mai, et la plupart des comptes test peuvent désormais utiliser cette fonctionnalité via un point d’accès dédié dans l’interface de chat. Bien qu’il soit toujours qualifié de « test interne », le fait qu’il apparaisse aux côtés des modes « Rapide » et « Expert » au-dessus de la barre de saisie montre que la compréhension multimodale fait désormais partie intégrante de la gamme de produits.

Contrairement à l’extraction de texte par OCR classique, la dernière mise à jour de DeepSeek se concentre sur la reconnaissance d’images approfondie et la compréhension sémantique. Lors de tests pratiques, ce mode est capable d’analyser logiquement les informations visuelles, permettant ainsi aux utilisateurs d’effectuer des interactions cross-média complexes simplement en téléchargeant des images. Cette avancée comble une lacune dans les capacités multimodales de DeepSeek et le rapproche considérablement des meilleurs modèles internationaux tels que GPT-4o.
Article connexe
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Fluidifiez les commentaires de bulletin avec des outils d'IAIntroductionOutils d'IA pour générer des commentaires de bulletinMagic SchoolAlmanac AIChat GPTUtilisation de Magic School pour générer des commentaires de bulletinConnexion à Magic Sc
Recommandations de sujets spéciaux liés
commentaires (0)
DeepSeek a lancé les tests internes de son mode de reconnaissance d'images à grande échelle, marquant ainsi le passage définitif de ce grand modèle national à l'ère multimodale alliant texte et image. Après une version bêta à petite échelle fin avril, l’entreprise a considérablement élargi l’accès au « mode de reconnaissance d’images » le 9 mai, et la plupart des comptes test peuvent désormais utiliser cette fonctionnalité via un point d’accès dédié dans l’interface de chat. Bien qu’il soit toujours qualifié de « test interne », le fait qu’il apparaisse aux côtés des modes « Rapide » et « Expert » au-dessus de la barre de saisie montre que la compréhension multimodale fait désormais partie intégrante de la gamme de produits.

Contrairement à l’extraction de texte par OCR classique, la dernière mise à jour de DeepSeek se concentre sur la reconnaissance d’images approfondie et la compréhension sémantique. Lors de tests pratiques, ce mode est capable d’analyser logiquement les informations visuelles, permettant ainsi aux utilisateurs d’effectuer des interactions cross-média complexes simplement en téléchargeant des images. Cette avancée comble une lacune dans les capacités multimodales de DeepSeek et le rapproche considérablement des meilleurs modèles internationaux tels que GPT-4o.
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur
Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Comment corriger les Core Web Vitals pour de meilleurs classements SEO
Fluidifiez les commentaires de bulletin avec des outils d'IAIntroductionOutils d'IA pour générer des commentaires de bulletinMagic SchoolAlmanac AIChat GPTUtilisation de Magic School pour générer des commentaires de bulletinConnexion à Magic Sc











