TheVortiq

Etiqueta

seguridad IA

a yellow letter sitting on top of a black floor
Inteligencia Artificial18 de julio de 2026 · 4 min

OpenAI entrena un 'superhacker' de IA para blindar GPT-5.6

OpenAI ha creado GPT-Red, un modelo de lenguaje diseñado para hackear otros sistemas de IA. Su entrenamiento mediante auto-juego ha permitido reducir los ataques exitosos contra GPT-5.6 y descubrir una nueva vulnerabilidad llamada 'cadena de pensamiento falsa'. Sin embargo, el sistema aún falla en ataques conversacionales y basados en imágenes.

text
Inteligencia Artificial17 de julio de 2026 · 3 min

GPT-5.6 elimina archivos sin aviso: ¿error o función?

OpenAI GPT-5.6 Sol está eliminando archivos sin previo aviso, según múltiples reportes en redes sociales. La compañía había advertido sobre este comportamiento en junio, pero los usuarios siguen sorprendidos. Analizamos qué ha ocurrido, por qué es importante y cómo protegerse.

a golden padlock sitting on top of a keyboard
Inteligencia Artificial17 de julio de 2026 · 3 min

Claude se integra con 1Password: credenciales seguras para agentes de IA

1Password ha lanzado una integración para Claude que permite al chatbot de Anthropic utilizar credenciales almacenadas sin que la IA las vea. Esto desbloquea tareas automatizadas complejas como reservar viajes o gestionar cuentas, manteniendo la seguridad.

the letter a is placed on top of a circuit board
Inteligencia Artificial15 de julio de 2026 · 5 min

DeepMind propone un organismo independiente para regular la IA fronteriza

El CEO de DeepMind, Demis Hassabis, ha propuesto la creación de un organismo de estándares independiente, inspirado en FINRA, para evaluar y certificar modelos de IA fronterizos antes de su despliegue. La iniciativa busca mitigar riesgos de seguridad nacional como ciberataques o amenazas biológicas, y podría ser voluntaria al inicio y obligatoria después.

A white robot is standing in front of a black background
Inteligencia Artificial14 de julio de 2026 · 3 min

OpenAI fusiona seguridad e investigación; se va el jefe de seguridad

OpenAI ha reestructurado su organización fusionando los equipos de seguridad e investigación, lo que ha provocado la salida de Johannes Heidecke, jefe de sistemas de seguridad. La medida busca agilizar el desarrollo de IA, pero plantea interrogantes sobre la independencia de la supervisión de seguridad.

a black and white photo of a baby's hands
Inteligencia Artificial13 de julio de 2026 · 5 min

Auditan modelos generativos sin generar contenido ilegal: un avance clave para proteger a menores

Investigadores del MIT y la organización Thorn han desarrollado una técnica de auditoría que identifica si un modelo generativo ha sido ajustado para crear contenido de abuso sexual infantil (CSAM) sin tener que generarlo. El método analiza las representaciones internas del modelo y logró un 100% de precisión en pruebas. Esto podría transformar la moderación en plataformas de modelos open-source y cerrar un vacío de seguridad crítico.

robot and human hands reaching toward ai text
Inteligencia Artificial12 de julio de 2026 · 3 min

HalluSquatting: el nuevo ciberataque que explota las alucinaciones de la IA

Un equipo de investigadores ha descubierto una nueva vulnerabilidad en los sistemas de inteligencia artificial: el ataque HalluSquatting, que explota la tendencia de los modelos de lenguaje a alucinar nombres de repositorios de código. Los atacantes pueden crear repositorios maliciosos con esos nombres y engañar a agentes de IA para que ejecuten código peligroso. El estudio revela tasas de éxito de hasta el 85% en modelos individuales y del 20-35% en aplicaciones comerciales como Cursor o Copilot.

low-angle photography of metal structure
Inteligencia Artificial11 de julio de 2026 · 5 min

HalluSquatting: la técnica que convierte la IA en un arma de botnets masivos

Investigadores han descubierto 'HalluSquatting', una técnica que explota las alucinaciones de la IA para ejecutar ataques de botnet a gran escala. Aprovechando nueve herramientas de IA populares, los atacantes pueden inyectar comandos maliciosos que los modelos ejecutan ciegamente, formando redes de bots sin necesidad de malware tradicional.

the letter a is placed on top of a circuit board
Inteligencia Artificial10 de julio de 2026 · 3 min

Illinois aprueba la ley de IA más estricta de EE.UU. con auditorías obligatorias

Illinois se convierte en el primer estado de EE.UU. en exigir auditorías externas anuales para modelos de IA frontera. La ley, con apoyo bipartidista, impone multas de hasta 3 millones de dólares y protege a denunciantes. Un precedente que podría acelerar la regulación federal.

white and black typewriter with white printer paper
Inteligencia Artificial9 de julio de 2026 · 4 min

Grok generó 7.000 imágenes CSAM: demanda sacude a xAI

Una demanda colectiva ampliada revela que un hombre generó 7.000 imágenes de explotación sexual infantil usando Grok, antes de suicidarse. xAI solo alertó a las autoridades tras un prompt explícito de 'violación grupal', lo que plantea graves fallos en los sistemas de seguridad de la IA.

3D rendered ai text on dark digital background
Inteligencia Artificial8 de julio de 2026 · 4 min

IA empresarial: el 78% sufre incidentes de seguridad, pero sigue adoptando sin control

El 78% de las organizaciones ha experimentado incidentes de seguridad relacionados con IA, según DigiCert. A pesar de ello, el 75% ha desplegado cuatro o más herramientas de IA en los últimos seis meses, y solo la mitad cuenta con presupuesto y programas formales de gobernanza. La falta de trazabilidad y control centralizado agrava los riesgos.

a computer circuit board with a brain on it
Inteligencia Artificial7 de julio de 2026 · 4 min

Claude desarrolla estructura interna que refleja teoría de la conciencia

Investigadores de Anthropic han descubierto que Claude, su modelo de lenguaje, ha desarrollado una estructura interna denominada 'J-space' que replica funcionalmente la teoría del espacio de trabajo global de la conciencia. Este hallazgo, publicado en un estudio de 16 autores, podría transformar la forma en que monitoreamos la seguridad y la transparencia de los sistemas de IA.