opción
Hogar
Última hora
Contenido
PatrickTaylor
PatrickTaylor
26 de mayo de 2026

Microsoft Research hizo disponible su código fuente del marco Webwright, pasando de utilizar agentes web basados en clics a un enfoque impulsado por código. Este nuevo enfoque permite que los modelos de IA escriban y ejecuten directamente código Playwright así como comandos Bash en una terminal, lo que aumenta la eficiencia y facilita el manejo de lógicas complejas. El marco, de diseño minimalista, cuenta con un mecanismo de autocomprobación para evitar completaciones erróneas de tareas y también incluye una función de compresión del historial de operaciones a fin de gestionar el contexto. En las pruebas, demostró tener una alta precisión en los benchmarks y superó significativamente a los modelos básicos en tareas que involucran múltiples pasos.

Microsoft Research hizo disponible su código fuente del marco Webwright, pasando de utilizar agentes web basados en clics a un enfoque impulsado por código. Este nuevo enfoque permite que los modelos de IA escriban y ejecuten directamente código Playwright así como comandos Bash en una terminal, lo que aumenta la eficiencia y facilita el manejo de lógicas complejas. El marco, de diseño minimalista, cuenta con un mecanismo de autocomprobación para evitar completaciones erróneas de tareas y también incluye una función de compresión del historial de operaciones a fin de gestionar el contexto. En las pruebas, demostró tener una alta precisión en los benchmarks y superó significativamente a los modelos básicos en tareas que involucran múltiples pasos. Microsoft Research hizo disponible su código fuente del marco Webwright, pasando de utilizar agentes web basados en clics a un enfoque impulsado por código. Este nuevo enfoque permite que los modelos de IA escriban y ejecuten directamente código Playwright así como comandos Bash en una terminal, lo que aumenta la eficiencia y facilita el manejo de lógicas complejas. El marco, de diseño minimalista, cuenta con un mecanismo de autocomprobación para evitar completaciones erróneas de tareas y también incluye una función de compresión del historial de operaciones a fin de gestionar el contexto. En las pruebas, demostró tener una alta precisión en los benchmarks y superó significativamente a los modelos básicos en tareas que involucran múltiples pasos.
comentario (0)
0/300
OR