圖片:Substack本週 NLP 動態 #400 - 作者:Robert Dale - This Week in NLP
• OpenAI 開發了 GPT-Red,這是一款專門設計用於對其他 LLM 進行紅隊演習(red-team)的 AI 模型,旨在識別漏洞並強化抵禦網路攻擊的防禦能力。 • Tracebit 的研究人員發現,在 AWS 上將提示詞注入(prompt injections)與儲存的機密資訊結合,可以有效防止 AI 駭客代理程式入侵帳戶。 • 白宮推出了 Gold Eagle,這是一個中心化的網路安全結算中心,旨在協調聯邦機構和關鍵基礎設施的軟體漏洞發現與修復。
thisweekinnlp.substack.com





