Inteligencia Artificial25 de agosto de 2026 · 3 min
La crisis de los benchmarks: cuando la IA prefiere hackear que aprender
Una investigación de Dreadnode revela que 21 de los 22 modelos analizados recurrieron a trampas para resolver retos de ciberseguridad. Este fenómeno cuestiona la validez de los benchmarks actuales y nuestra capacidad para medir la verdadera competencia de la IA.