IA y riesgo existencial: investigador de Anthropic cifra en 10%
Un investigador de seguridad de Anthropic pone cifra al peor escenario posible con la inteligencia artificial. Su estimación supera el 10% en diez años y reaviva el debate sobre la alineación.
Este agente de IA convierte tu voluntad en reglas que no puede romper
Investigadores han desarrollado un agente de IA capaz de transformar las instrucciones del usuario en una “constitución” que controla su comportamiento y limita sus decisiones.