Watermerken van LLM's kunnen tool-aanroepen en gedrag van AI-agenten beïnvloeden: Studie
• Lasso Security heeft een studie uitgevoerd waaruit blijkt dat LLM-watermerken, een methode om AI-gegenereerde tekst te identificeren, de manier beïnvloeden waarop open-weight modellen tools aanroepen en zich gedragen. • De onderzoekers stelden vast dat deze watermerktechnieken de uitkomsten van individuele tool-aanroepen en weigeringsgedragingen veranderden, waarbij de meest uitgesproken effecten optraden tijdens prompt-injectieaanvallen. • Deze bevindingen suggereren dat beveiligingsmaatregelen die bedoeld zijn om AI-content te volgen, onbedoeld de betrouwbaarheid en functionele nauwkeurigheid van AI-agenten kunnen verslechteren.
analyticsindiamag.com



