#evaluacion

Cinco investigaciones clave sobre Agentic AI en 2026

Cinco investigaciones clave sobre Agentic AI en 2026

En 2026 la investigación en Agentic AI avanzó desde demostrar capacidades aisladas hacia evaluar si los agentes completan flujos de trabajo reales, sobreviven en la web y aprenden a mejorar sus procesos. Estos cinco artículos muestran ese cambio y sus implicaciones prácticas.

EVA: un marco integral para evaluar agentes de voz

EVA: un marco integral para evaluar agentes de voz

EVA es un nuevo marco que evalúa conversaciones habladas completas entre un usuario simulado y un agente de voz, con dos puntajes principales: EVA-A (Precisión) y EVA-X (Experiencia). El proyecto se lanzó con un conjunto inicial de 50 escenarios del sector aéreo y benchmarks para 20 sistemas.