Imagem: SubstackThis Week in NLP #400 - por Robert Dale - This Week in NLP
• A OpenAI desenvolveu o GPT-Red, um modelo de IA especializado, projetado para realizar red-teaming em outros LLMs a fim de identificar vulnerabilidades e fortalecer as defesas contra ciberataques. • Pesquisadores da Tracebit descobriram que a incorporação de prompt injections com segredos armazenados na AWS pode evitar efetivamente que agentes de hacking de IA comprometam contas. • A Casa Branca lançou o Gold Eagle, uma central de cibersegurança destinada a coordenar a descoberta e a remediação de vulnerabilidades de software para agências federais e infraestruturas críticas.
thisweekinnlp.substack.com






