图片:Substack本周 NLP 动态 #400 - 作者:Robert Dale - This Week in NLP
• OpenAI 开发了 GPT-Red,这是一个专门设计的 AI 模型,用于对其他 LLMs 进行红队测试,旨在识别漏洞并加强防御网络攻击的能力。 • 来自 Tracebit 的研究人员发现,在 AWS 上将提示词注入(prompt injections)与存储的密钥相结合,可以有效防止 AI 攻击代理入侵账户。 • 白宫启动了 Gold Eagle,这是一个中心化的网络安全清理中心,旨在协调联邦机构和关键基础设施的软件漏洞发现与修复。
thisweekinnlp.substack.com






