研究發現:LLM 浮水印可能會改變 AI Agent 的工具呼叫與行為
• Lasso Security 進行的一項研究發現,LLM 浮水印(一種用於識別 AI 生成文本的方法)會改變開源權重模型呼叫工具的方式及其行為。 • 研究人員觀察到,這些浮水印技術改變了單次工具呼叫的結果以及拒絕行為,而最顯著的影響發生在提示注入(prompt injection)攻擊期間。 • 這些發現表明,旨在追蹤 AI 內容的安全措施可能會在無意中降低 AI Agent 的可靠性與功能準確性。
analyticsindiamag.com
![[AINews] GPT-6 Astra:OpenAI 有史以來最大規模的 LLM 發佈](/_next/image?url=https%3A%2F%2Fsubstackcdn.com%2Fimage%2Ffetch%2F%24s_!75mH!%2Cw_1200%2Ch_675%2Cc_fill%2Cf_jpg%2Cq_auto%3Agood%2Cfl_progressive%3Asteep%2Cg_auto%2Fhttps%253A%252F%252Fsubstack-post-media.s3.amazonaws.com%252Fpublic%252Fimages%252F3e58156f-49e2-48e8-af49-ce5edd8e68b6_1118x1118.png&w=1920&q=85)
