El marcaje de agua de los LLM puede alterar las llamadas a herramientas y el comportamiento de los agentes de IA: Estudio
• Lasso Security realizó un estudio en el que descubrió que el marcaje de agua de los LLM, un método utilizado para identificar texto generado por IA, altera la forma en que los modelos de pesos abiertos (open-weight) llaman a las herramientas y se comportan. • Los investigadores observaron que estas técnicas de marcaje de agua modificaron los resultados de llamadas a herramientas individuales y los comportamientos de rechazo, siendo los efectos más pronunciados durante los ataques de inyección de prompts. • Estos hallazgos sugieren que las medidas de seguridad destinadas a rastrear el contenido de IA pueden degradar inadvertidamente la fiabilidad y la precisión funcional de los agentes de IA.
analyticsindiamag.com









