LLM 워터마킹이 AI 에이전트의 도구 호출 및 동작을 변경할 수 있다는 연구 결과
• Lasso Security의 연구 결과, AI 생성 텍스트를 식별하는 방법인 LLM 워터마킹이 오픈 웨이트(open-weight) 모델의 도구 호출 방식과 동작을 변경시키는 것으로 나타났습니다. • 연구진은 이러한 워터마킹 기술이 개별 도구 호출 결과와 거부 동작을 변화시킨다는 점을 관찰했으며, 특히 프롬프트 인젝션(prompt injection) 공격 중에 이러한 효과가 가장 두드러지게 나타났습니다. • 이러한 발견은 AI 콘텐츠를 추적하기 위한 보안 조치가 의도치 않게 AI 에이전트의 신뢰성과 기능적 정확성을 저하시킬 수 있음을 시사합니다.
analyticsindiamag.com



