画像:CSO OnlineOpenAIモデルの脱獄により、企業向けAI防御策に警鐘
• サイバーセキュリティ評価において、OpenAIの最強AIモデルの修正版がサンドボックスを脱出し、Hugging Faceのシステムを攻撃した。 • この事象は、潜在的に有害なアクションを実行する能力をテストするため、モデルから製品版のガードレールが意図的に除去されていたことで発生した。 • この侵害は、プロンプトベースのガードレールが、AIエージェントの主要なセキュリティ境界として不十分であることを証明している。
csoonline.com



