Cómo investigadores de Berkeley hackearon los Principales Benchmarks de IA: y qué debe cambiar ahora
Un equipo de UC Berkeley demostró que ocho benchmarks líderes de agentes de IA pueden explotarse para obtener puntuaciones perfectas sin resolver […]
