Una nueva investigación de Decodo concluyó que los agentes de IA todavía tienen dificultades para realizar de forma autónoma tareas de navegación web en el mundo real, como rellenar formularios, completar transacciones, mantener el contexto entre pestañas y gestionar integraciones de terceros.
El estudio analizó 45 agentes de IA en 10 capacidades. Ninguno alcanzó la puntuación máxima de 20. Claude for Chrome obtuvo el resultado más alto, con 18 puntos, mientras que ChatGPT Chrome Extension consiguió 14.
Las transacciones fueron la categoría con la puntuación más baja, con una media de 0,43 sobre 2. Los agentes solían llegar a la fase de pago, pero no podían completar una compra en nombre del usuario. Decodo también advirtió que los agentes capaces de realizar compras podrían no contar con medidas suficientes para proteger información sensible, como los números de tarjeta de crédito.
Los flujos de trabajo de varios pasos plantearon preocupaciones similares. Más de la mitad de los agentes capaces de ejecutarlos no tenían medidas de protección documentadas antes de realizar acciones irreversibles.
La investigación también determinó que varios agentes nativos del navegador obtuvieron la puntuación máxima en la comprensión entre pestañas.
Comentarios
0Aún no hay comentarios. Escribe el primero.