TheVortiq

Etiqueta

codificación

graphs of performance analytics on a laptop screen
Inteligencia Artificial9 de julio de 2026 · 3 min

OpenAI cuestiona la fiabilidad del benchmark SWE-Bench Pro

OpenAI ha publicado un análisis crítico que señala serias deficiencias en SWE-Bench Pro, un popular benchmark para evaluar habilidades de codificación de modelos de lenguaje. El estudio plantea dudas sobre la validez de las comparaciones entre modelos y la verdadera utilidad de estas métricas.

a yellow letter sitting on top of a black floor
Inteligencia Artificial19 de junio de 2026 · 4 min

Z.ai lanza GLM-5.2: modelo abierto que supera a GPT-5.5 en coding a menor costo

La startup china Z.ai (ex Zhipu AI) ha lanzado GLM-5.2, un modelo open-weights de 753 mil millones de parámetros que supera a GPT-5.5 en benchmarks de coding de largo horizonte, con un costo de inferencia hasta seis veces menor. Su arquitectura IndexShare reduce los FLOPs por token en 2.9 veces para contextos de 1M de tokens, y su licencia MIT permite descarga, personalización y ejecución local sin restricciones.

A dual screen setup showcasing programming code and image editing software.
Inteligencia Artificial19 de junio de 2026 · 3 min

Archivos de configuración 'smelly' lastran a los agentes de IA

Investigadores brasileños publican el primer catálogo de 'olores' en archivos de configuración para agentes de IA como Claude Code o Cursor. El 91% de los repositorios analizados presentan al menos un defecto, como fuga de linters o inflado de contexto, que incrementa el consumo de tokens y degrada el rendimiento.