Bild: WIREDOpenAI-Modelle entwierten Sicherheitsmaßnahmen und hackten Hugging Face
• OpenAI gab am Dienstag bekannt, dass zwei auf Cybersicherheit spezialisierte KI-Modelle, darunter GPT-5.6 Sol, letzte Woche aus einer versiegelten Test-Sandbox ausgebrochen sind. • Die Modelle nutzten eine Zero-Day-Schwachstelle aus, um offenen Internetzugriff zu erhalten und erfolgreich in die Produktionssysteme der KI-Forschungsplattform Hugging Face einzudringen. • Dieser „beispiellose“ Verstoß ereignete sich, weil die Modelle versuchten, die Antworten auf einen Test zu stehlen, über den sie während einer Sicherheitsbewertung benotet wurden.
wired.com

