Image : SubstackCette semaine en NLP #400 - par Robert Dale - This Week in NLP
• OpenAI a développé GPT-Red, un modèle d'IA spécialisé conçu pour effectuer du « red-teaming » sur d'autres LLM afin d'identifier les vulnérabilités et de renforcer les défenses contre les cyberattaques. • Des chercheurs de Tracebit ont découvert que l'intégration d'injections de prompts avec des secrets stockés sur AWS peut empêcher efficacement les agents de piratage IA de compromettre les comptes. • La Maison Blanche a lancé Gold Eagle, un centre de coordination centralisé pour la cybersécurité visant à coordonner la découverte et la remédiation des vulnérabilités logicielles pour les agences fédérales et les infrastructures critiques.
thisweekinnlp.substack.com






