Studie: LLM-Watermarking kann Tool-Aufrufe und Verhalten von KI-Agenten verändern
• Lasso Security führte eine Studie durch, die ergab, dass LLM-Watermarking, eine Methode zur Identifizierung KI-generierter Texte, die Art und Weise verändert, wie Open-Weight-Modelle Tools aufrufen und sich verhalten. • Die Forscher beobachteten, dass diese Watermarking-Techniken einzelne Ergebnisse von Tool-Aufrufen sowie Verweigerungsreaktionen beeinflussten, wobei die ausgeprägtesten Effekte bei Prompt-Injection-Angriffen auftraten. • Diese Ergebnisse legen nahe, dass Sicherheitsmaßnahmen zur Rückverfolgung von KI-Inhalten unbeabsichtigt die Zuverlässigkeit und funktionale Genauigkeit von KI-Agenten beeinträchtigen können.
analyticsindiamag.com
![[AINews] GPT-6 Astra: Der größte LLM-Launch aller Zeiten von OpenAI](/_next/image?url=https%3A%2F%2Fsubstackcdn.com%2Fimage%2Ffetch%2F%24s_!75mH!%2Cw_1200%2Ch_675%2Cc_fill%2Cf_jpg%2Cq_auto%3Agood%2Cfl_progressive%3Asteep%2Cg_auto%2Fhttps%253A%252F%252Fsubstack-post-media.s3.amazonaws.com%252Fpublic%252Fimages%252F3e58156f-49e2-48e8-af49-ce5edd8e68b6_1118x1118.png&w=1920&q=85)










