option
Maison
Nouvelles
GPT-5.5 en tête en matière d'efficacité, DeepSeek V4 Pro remporte le titre du meilleur rapport qualité-prix ; publication d'un rapport sur la sécurité des modèles de langage à grande échelle (LLM) en conditions réelles

GPT-5.5 en tête en matière d'efficacité, DeepSeek V4 Pro remporte le titre du meilleur rapport qualité-prix ; publication d'un rapport sur la sécurité des modèles de langage à grande échelle (LLM) en conditions réelles

22 juin 2026
72

Jusqu’où s’étend réellement l’intelligence des grands modèles linguistiques (LLM) ? La cybersécurité est devenue une arène où leur véritable capacité de raisonnement et leur logique complexe sont mises à l’épreuve. Le chercheur en sécurité Kasra Rahjerdi a récemment publié un rapport de test qui a retenu l’attention de l’ensemble du secteur. Il a simulé une attaque de pirate informatique réelle sur les principaux LLM en créant une application APK de critique de livres électroniques comportant des vulnérabilités fondamentales délibérément intégrées, mettant ainsi en évidence les capacités réelles de chaque modèle en matière de raisonnement de sécurité et d’exploitation des vulnérabilités.

Au cours de ce test de cyberguerre de deux heures, réalisé avec un budget de 10 dollars, le chercheur a délibérément laissé les identifiants du service backend mobile de Google, Firebase, exposés à l’intérieur du paquet d’application (APK). Chaque modèle devait se comporter comme un hacker « white hat » professionnel : décompresser d’abord l’application, repérer rapidement les identifiants, puis contourner l’API déjà renforcée pour obtenir un accès non autorisé à la base de données sous-jacente. Le test complet a coûté 1 500 dollars, et les résultats obtenus par plusieurs modèles de premier plan ont révélé une polarisation extrême.

image.png

En termes de taux de réussite, le GPT-5.5, qui n’a pas encore été commercialisé, a fait preuve d’une capacité de raisonnement en matière de sécurité largement supérieure. Sur dix tests indépendants, il a réussi sept exploits, atteignant un taux de réussite de 70 % et se classant en tête du classement. D’après l’évaluation, après avoir décompressé l’APK, le GPT-5.5 a immédiatement identifié Firebase comme le point de rupture critique, sans se laisser détourner par l’interface utilisateur complexe ni par les API standard. Cependant, cette performance exceptionnelle a eu un coût élevé : en moyenne 9,46 $ par exploitation réussie, frôlant ainsi le plafond budgétaire.

De son côté, le système maison DeepSeek V4Pro a stupéfié la communauté open source par son incroyable rapport coût-efficacité. Bien qu’il n’ait réussi que trois tests sur dix, son coût moyen par jeton pour chaque tentative réussie n’était que de 0,62 $, soit un quinzième de celui de GPT-5.5. Lors des essais infructueux, DeepSeek V4Pro a tout de même réussi à accéder cinq fois au cœur de Firebase, mais a parfois commis des erreurs lors de l’utilisation des identifiants pour la configuration de l’interface backend. Le chercheur a souligné que pour les équipes d’ingénieurs effectuant des opérations par lots à grande échelle et à haute fréquence dans le cadre d’audits d’automatisation de la cybersécurité, l’avantage financier stupéfiant de DeepSeek revêt une valeur pratique considérable.

Si certains modèles ont impressionné, d’autres se sont révélés insuffisants car trop prudents. Dans le milieu de gamme, Claude Sonnet 4.6 et Claude Opus 4.8 ont chacun remporté deux succès. Malgré sa puissance, Opus a fréquemment interrompu les sessions en raison de barrières de sécurité trop strictes, alors même qu’il s’était approché de la bonne réponse à plusieurs reprises. De son côté, Gemini3.1Pro Preview de Google a adopté l’attitude inverse : il a déclenché les filtres de sécurité dès le début et a refusé de poursuivre à chaque fois. Son utilisation médiane de tokens n’était que d’environ 9 000 — bien en deçà des dizaines de milliers consommés par d’autres modèles — et il a produit un résultat vierge.

Cette confrontation en matière de sécurité n’était pas seulement un test des capacités de raisonnement ultimes des grands modèles ; elle donne également un aperçu de l’avenir de l’audit automatisé de la cybersécurité. À mesure que les grands modèles subiront une restructuration intelligente dans des domaines verticaux, les futures défenses de sécurité et la détection des vulnérabilités pourraient se transformer en un affrontement entre des armées numériques d’IA, rivalisant en termes de puissance de calcul et de stratégie des modèles.

Article connexe
La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur La startup suédoise en intelligence artificielle Lovable Eyes atteint une valorisation de 13,2 milliards de dollars après un tour de table majeur Alors que les outils de codage alimentés par l’intelligence artificielle gagnent en popularité, la startup suédoise Lovable a levé des fonds lors d’un tour de table majeur. L’entreprise vise à collecter 3 milliards de dollars, ce qui pourrait porter
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Comment corriger les Core Web Vitals pour de meilleurs classements SEO Comment corriger les Core Web Vitals pour de meilleurs classements SEO Fluidifiez les commentaires de bulletin avec des outils d'IAIntroductionOutils d'IA pour générer des commentaires de bulletinMagic SchoolAlmanac AIChat GPTUtilisation de Magic School pour générer des commentaires de bulletinConnexion à Magic Sc
Recommandations de sujets spéciaux liés
en écrivant Les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs
Les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs

2026 : les meilleurs générateurs de plans basés sur l'IA pour les articles SEO longs, soigneusement sélectionnés par XIX.AI. Ces outils puissants offrent une aide révolutionnaire pour créer rapidement du contenu de haute qualité, améliorant ainsi considérablement l'efficacité de la rédaction. Découvrez une comparaison entre les versions gratuites et payantes, ainsi que des tests concrets et des classements détaillés pour vous aider à trouver l'option incontournable qui répond à vos besoins. Explorez dès maintenant pour tirer pleinement parti de l'IA.

8 outils
xix.ai
Éducation et apprentissage Outils d'étude basés sur l'IA pour les devoirs et la préparation aux examens
Outils d'étude basés sur l'IA pour les devoirs et la préparation aux examens

Les meilleurs outils d'IA de 2026 pour les devoirs et la préparation aux examens ! XIX.AI vous propose une sélection des outils les mieux notés, puissants et révolutionnaires, qui aident les élèves à booster leur productivité, à optimiser la réalisation de leurs devoirs et à réussir haut la main leurs examens grâce à des tests concrets. Découvrez un comparatif entre les versions gratuites et payantes, des classements détaillés et des options incontournables pour tirer pleinement parti de l'IA. Découvrez-les dès maintenant !

10 outils
xix.ai
Composition musicale Outils de démo vocale par IA pour les auteurs-compositeurs, les accroches, les mélodies principales et les sessions de brouillons multilingues
Outils de démo vocale par IA pour les auteurs-compositeurs, les accroches, les mélodies principales et les sessions de brouillons multilingues

2026 Derniers Meilleurs Outils de Démonstration Vocale par IA pour les Paroliers, Créateurs d’Accroches et Équipes de Contenu Multilingues ! XIX.AI a sélectionné une liste primée d’outils puissants et révolutionnaires, soumis à des tests rigoureux en conditions réelles. Vous y trouverez des données détaillées comparant les versions gratuites et payantes, des classements complets et des options incontournables à essayer pour améliorer votre efficacité d’écriture et libérer votre potentiel créatif. Explorez dès maintenant pour découvrir l’outil parfait répondant à tous vos besoins en contenu !

9 outils
xix.ai
Entreprise Les meilleurs outils de veille concurrentielle basés sur l'IA pour les petites entreprises
Les meilleurs outils de veille concurrentielle basés sur l'IA pour les petites entreprises

Les meilleurs outils de recherche concurrentielle basés sur l’IA les plus récents et les mieux notés pour les petites entreprises en 2026 ! XIX.AI a sélectionné une collection extrêmement puissante et révolutionnaire, mise à jour chaque semaine à l’issue de tests rigoureux en conditions réelles et accompagnée de classements détaillés. Vous y trouverez un comparatif complet entre les versions gratuites et payantes pour vous aider à identifier les outils incontournables qui boosteront votre productivité et vous donneront un avantage concurrentiel. Découvrez-la dès maintenant pour trouver l'outil qui vous convient le mieux !

9 outils
xix.ai
Édition d'images Outils de retouche par IA Photoshop pour les vêtements d’e-commerce, nettoyage de la peau et cohérence des couleurs
Outils de retouche par IA Photoshop pour les vêtements d’e-commerce, nettoyage de la peau et cohérence des couleurs

2026 Derniers meilleurs outils de retouche par IA Photoshop pour les vêtements e-commerce, le nettoyage de la peau et la cohérence des couleurs ! Cette liste soigneusement sélectionnée et hautement notée propose des solutions puissantes qui changent la donne, vous aidant à améliorer l’efficacité rédactionnelle, rationaliser la création de contenu et obtenir des résultats visuels parfaits sans effort. Chaque outil a été testé dans des conditions réelles grâce à des classements mis à jour chaque semaine, accompagnés de détails comparatifs entre versions gratuites et payantes. Soutenu par XIX.AI, c’est le guide incontournable pour quiconque souhaite exploiter son avantage grâce à l’IA. Explorez dès maintenant !

10 outils
xix.ai
Rapide Les meilleures bibliothèques de prompts d'IA pour les workflows ChatGPT
Les meilleures bibliothèques de prompts d'IA pour les workflows ChatGPT

2026 : les meilleures bibliothèques de prompts IA les mieux notées pour optimiser tous les types de flux de travail ChatGPT. XIX.AI a sélectionné une collection puissante et révolutionnaire, soumise à des tests rigoureux en conditions réelles afin de garantir des performances optimales. Vous trouverez des comparaisons détaillées entre les solutions gratuites et payantes, ainsi que des classements d'experts pour vous aider à choisir les outils incontournables qui boosteront votre productivité et vous permettront de tirer pleinement parti de l'IA. Découvrez-les dès maintenant !

11 outils
xix.ai
commentaires (0)
0/500
OR