option
Maison
Flash info
Contenu
PatrickTaylor
PatrickTaylor
26 mai 2026

Microsoft Research a mis son framework Webwright sous licence open-source, passant d’une approche basée sur les agents web à une approche pilotée par du code. Cela permet aux modèles d’IA d’écrire et d’exécuter directement du code Playwright ainsi que des commandes Bash dans un terminal, améliorant ainsi l’efficacité et la gestion de logiques complexes. Ce framework minimaliste dispose d’un mécanisme d’autovérification pour éviter les erreurs dans l’accomplissement des tâches, et d’une fonction de compression de l’historique des actions effectuées afin de mieux gérer le contexte. Lors des tests, il a démontré une grande précision sur les benchmarks et a largement surpassé les modèles de base dans les tâches à longue chaîne.

Microsoft Research a mis son framework Webwright sous licence open-source, passant d’une approche basée sur les agents web à une approche pilotée par du code. Cela permet aux modèles d’IA d’écrire et d’exécuter directement du code Playwright ainsi que des commandes Bash dans un terminal, améliorant ainsi l’efficacité et la gestion de logiques complexes. Ce framework minimaliste dispose d’un mécanisme d’autovérification pour éviter les erreurs dans l’accomplissement des tâches, et d’une fonction de compression de l’historique des actions effectuées afin de mieux gérer le contexte. Lors des tests, il a démontré une grande précision sur les benchmarks et a largement surpassé les modèles de base dans les tâches à longue chaîne. Microsoft Research a mis son framework Webwright sous licence open-source, passant d’une approche basée sur les agents web à une approche pilotée par du code. Cela permet aux modèles d’IA d’écrire et d’exécuter directement du code Playwright ainsi que des commandes Bash dans un terminal, améliorant ainsi l’efficacité et la gestion de logiques complexes. Ce framework minimaliste dispose d’un mécanisme d’autovérification pour éviter les erreurs dans l’accomplissement des tâches, et d’une fonction de compression de l’historique des actions effectuées afin de mieux gérer le contexte. Lors des tests, il a démontré une grande précision sur les benchmarks et a largement surpassé les modèles de base dans les tâches à longue chaîne.
commentaires (0)
0/300
OR