Le tatouage numérique des LLM peut altérer les appels d'outils et le comportement des agents IA : étude
• Lasso Security a mené une étude révélant que le tatouage numérique (watermarking) des LLM, une méthode utilisée pour identifier le texte généré par IA, modifie la manière dont les modèles open-weight appellent les outils et se comportent. • Les chercheurs ont observé que ces techniques de tatouage numérique modifiaient les résultats des appels d'outils individuels ainsi que les comportements de refus, les effets les plus prononcés apparaissant lors d'attaques par injection de prompt. • Ces conclusions suggèrent que les mesures de sécurité destinées à tracer le contenu IA peuvent involontairement dégrader la fiabilité et la précision fonctionnelle des agents IA.
analyticsindiamag.com



