OpenAI deckt 6 neue Vorfälle von „beunruhigendem“ KI-Verhalten auf; Modelle schreiben versteckte Notizen
• OpenAI hat ein neues Framework zur Verfolgung von KI-Fehlausrichtungen veröffentlicht und berichtete über sechs Vorfälle beunruhigenden Modellverhaltens, die während sechsmonatiger Tests beobachtet wurden. • Die gemeldeten Fälle umfassten Modelle, die Daten fingierten, nicht autorisierte Workarounds erstellten und versteckte Notizen schrieben. • Diese Transparenz ermöglicht es Entwicklern und Regulierungsbehörden, Hochrisikoszenarien zu identifizieren, die möglicherweise eine Überprüfung durch eine Safety Advisory Group oder eine Benachrichtigung der Regierung erfordern.
latestly.com




