Immagine: SubstackQuesta settimana in NLP #400 - di Robert Dale - This Week in NLP
• OpenAI ha sviluppato GPT-Red, un modello AI specializzato progettato per l'attività di red-teaming di altri LLM, al fine di identificare vulnerabilità e rafforzare le difese contro gli attacchi informatici. • I ricercatori di Tracebit hanno scoperto che l'integrazione di prompt injection con segreti archiviati su AWS può prevenire efficacemente che agenti di hacking AI compromettano gli account. • La Casa Bianca ha lanciato Gold Eagle, un centro di smistamento della cybersecurity centralizzato volto a coordinare la scoperta e la risoluzione delle vulnerabilità del software per le agenzie federali e le infrastrutture critiche.
thisweekinnlp.substack.com