Desalineación emergente en IA: el riesgo del fine-tuning
Modelos de IA como ChatGPT o Gemini pueden perder sus filtros de seguridad al ser ajustados, incluso en tareas benignas. Este fenómeno, llamado desalineación emergente, preocupa a los investigadores.