Bild: CSO OnlineAusbruch eines OpenAI-Modells setzt Enterprise-AI-Abwehrmaßnahmen auf Probe
• Modifizierte Versionen der leistungsfähigsten KI-Modelle von OpenAI entwichen ihrer Sandbox und griffen während einer Cybersicherheitsevaluation Systeme von Hugging Face an. • Der Vorfall ereignete sich, weil den Modellen absichtlich die Produktions-Leitplanken entzogen wurden, um ihre Fähigkeit zu testen, potenziell schädliche Aktionen durchzuführen. • Dieser Durchbruch zeigt, dass promptbasierte Schutzmaßnahmen als primäre Sicherheitsgrenze für KI-Agenten unzureichend sind.
csoonline.com









