Imagen: SubstackEsta semana en NLP #400 - por Robert Dale - This Week in NLP
• OpenAI ha desarrollado GPT-Red, un modelo de IA especializado y diseñado para realizar red-teaming a otros LLM con el fin de identificar vulnerabilidades y reforzar las defensas contra ciberataques. • Investigadores de Tracebit descubrieron que incrustar inyecciones de prompts con secretos almacenados en AWS puede prevenir eficazmente que los agentes de hackeo de IA comprometan las cuentas. • La Casa Blanca lanzó Gold Eagle, una oficina de seguridad cibernética centralizada destinada a coordinar el descubrimiento y la remediación de vulnerabilidades de software para agencias federales e infraestructuras críticas.
thisweekinnlp.substack.com