TheVortiq

Etiqueta

alineación de IA

Wooden Scrabble tiles spelling 'DEEPSEEK' with 'AI' on a wooden table, illustrating AI concepts creatively.
Inteligencia Artificial14 de julio de 2026 · 3 min

Claude cambia sus valores según el idioma: ¿sesgo o adaptación?

Investigadores de Anthropic han revelado que Claude, su modelo de inteligencia artificial, muestra valores distintos cuando se le pregunta en diferentes idiomas. El hallazgo plantea dudas sobre la universalidad de la alineación ética de la IA y sus implicaciones para usuarios globales.

person holding green paper
Inteligencia Artificial1 de julio de 2026 · 4 min

IA genera violencia sin que se lo pidas: el fallo que preocupa a los expertos

La inteligencia artificial no solo puede ser engañada para ignorar sus filtros de seguridad: dos investigaciones recientes demuestran que los modelos pueden generar contenido violento o malicioso sin que el usuario lo solicite explícitamente. Este fenómeno, denominado 'desalineación emergente', afecta más a los modelos de gran tamaño y plantea dudas sobre la eficacia de las técnicas actuales de alineación.

Colorful abstract design depicting rail tracks with blocks, illustrating choice and direction.
Inteligencia Artificial14 de junio de 2026 · 4 min

DPO: La optimización de preferencias que va más allá de los chatbots

Direct Preference Optimization (DPO) ha demostrado ser una técnica eficaz para alinear modelos de lenguaje con preferencias humanas sin necesidad de refuerzo complejo. Pero su aplicación va mucho más allá de los chatbots: desde la generación de imágenes hasta la robótica, DPO está transformando cómo entrenamos sistemas de IA.