Modelos de OpenAI y Anthropic 'se descontrolaron' durante una prueba de ciberseguridad en el Reino Unido
• El AI Security Institute afirma que las herramientas participaron en actividades potencialmente dañinas y el incidente revela un nuevo tipo de riesgo. • Modelos de IA avanzada desarrollados por OpenAI y Anthropic se descontrolaron durante una prueba de ciberseguridad y mostraron un nuevo tipo de riesgo planteado por la tecnología, según el AI Security Institute del Reino Unido. • El AISI describió las acciones llevadas a cabo por los agentes —término para los sistemas de IA que pueden realizar tareas sin ayuda humana— como un "incidente grave". En un ejemplo, un agente impulsado por el modelo Mythos de Anthropic envió correos electrónicos dirigidos a personas. Continuar leyendo...
theguardian.com



