研究表明:LLM 水印可能会改变 AI Agent 的工具调用和行为
• Lasso Security 进行的一项研究发现,LLM 水印(一种用于识别 AI 生成文本的方法)会改变开源权重模型的工具调用方式及其行为。 • 研究人员观察到,这些水印技术改变了单个工具调用的结果和拒绝行为,而在遭受 Prompt Injection 攻击时,这种影响最为显著。 • 这些发现表明,旨在追踪 AI 内容的安全措施可能会在无意中降低 AI Agent 的可靠性和功能准确性。
analyticsindiamag.com
![[AINews] GPT-6 Astra:OpenAI 史上最大规模的 LLM 发布](/_next/image?url=https%3A%2F%2Fsubstackcdn.com%2Fimage%2Ffetch%2F%24s_!75mH!%2Cw_1200%2Ch_675%2Cc_fill%2Cf_jpg%2Cq_auto%3Agood%2Cfl_progressive%3Asteep%2Cg_auto%2Fhttps%253A%252F%252Fsubstack-post-media.s3.amazonaws.com%252Fpublic%252Fimages%252F3e58156f-49e2-48e8-af49-ce5edd8e68b6_1118x1118.png&w=1920&q=85)










