LLMの水印(ウォーターマーキング)がAIエージェントのツール呼び出しと動作を変更させる可能性:研究結果
• Lasso Securityが行った研究により、AI生成テキストを識別するための手法であるLLMの水印(ウォーターマーキング)が、オープンウェイトモデルのツール呼び出し方法や動作に影響を与えることが判明しました。 • 研究者らは、これらの水印技術が個々のツール呼び出しの結果や拒否動作を変更させることを観察しており、特にプロンプトインジェクション攻撃が発生している際に最も顕著な影響が現れることがわかりました。 • これらの知見は、AIコンテンツを追跡することを目的としたセキュリティ対策が、意図せずしてAIエージェントの信頼性と機能的な正確性を低下させる可能性があることを示唆しています。
analyticsindiamag.com


