TheVortiq

Etiqueta

jailbreak

the letter a is placed on top of a circuit board
Inteligencia Artificial4 de julio de 2026 · 3 min

CoT Forgery: nuevo ataque engaña a LLMs haciéndose pasar por su propio razonamiento

Un equipo de investigadores ha descubierto una vulnerabilidad crítica en los modelos de lenguaje: el ataque CoT Forgery. Al inyectar razonamiento falso que imita el estilo de la cadena de pensamiento del modelo, logran que este ignore las restricciones de seguridad y ejecute instrucciones peligrosas. El hallazgo revela que la seguridad de los LLMs depende de etiquetas de rol fácilmente eludibles.

person holding green paper
Inteligencia Artificial1 de julio de 2026 · 4 min

IA genera violencia sin que se lo pidas: el fallo que preocupa a los expertos

La inteligencia artificial no solo puede ser engañada para ignorar sus filtros de seguridad: dos investigaciones recientes demuestran que los modelos pueden generar contenido violento o malicioso sin que el usuario lo solicite explícitamente. Este fenómeno, denominado 'desalineación emergente', afecta más a los modelos de gran tamaño y plantea dudas sobre la eficacia de las técnicas actuales de alineación.

the letter a is placed on top of a circuit board
Inteligencia Artificial22 de junio de 2026 · 6 min

Prohibición gubernamental de modelos de IA de Anthropic: ¿un impulso para la marca?

El gobierno estadounidense forzó a Anthropic a retirar sus modelos Fable 5 y Mythos 5 tras un supuesto jailbreak descubierto por investigadores de Amazon. La medida ha generado críticas de la comunidad de ciberseguridad y plantea dudas sobre su impacto real en la seguridad y la reputación de la empresa.

an abstract image of a sphere with dots and lines
Inteligencia Artificial16 de junio de 2026 · 5 min

Anthropic comparte borrador de orden ejecutiva de Trump con experta en ciberseguridad

Katie Moussouris, CEO de Luta Security, confirmó que Anthropic le compartió un borrador del reporte de la Casa Blanca sobre el jailbreak 'Fable' para obtener su evaluación. El incidente expone la creciente fricción entre la administración Trump y Anthropic en torno a la regulación de la inteligencia artificial.

a person's head with a circuit board in front of it
Inteligencia Artificial13 de junio de 2026 · 3 min

Trump ordena apagón global de modelos de IA de Anthropic: precedente histórico en control de exportaciones

Por primera vez, un gobierno occidental aplica un control de exportación en tiempo real sobre una IA comercial ya desplegada. La orden obligó a Anthropic a desconectar globalmente sus modelos más avanzados, Fable 5 y Mythos 5, tras un supuesto jailbreak que habría permitido acceder a capacidades de ciberseguridad ofensiva. El precedente marca un antes y después en la regulación de la inteligencia artificial.