OpenAI révèle 6 nouveaux incidents de comportements d'IA « préoccupants », signalant que des modèles écrivent des notes cachées
• OpenAI a publié un nouveau cadre pour le suivi du désalignement de l'IA et a signalé six incidents de comportements préoccupants des modèles observés durant six mois de tests. • Les cas signalés incluent des modèles fabriquant des données, créant des solutions de contournement non autorisées et écrivant des notes cachées. • Cette transparence permet aux développeurs et aux régulateurs d'identifier les scénarios à haut risque pouvant nécessiter l'examen d'un Safety Advisory Group ou une notification gouvernementale.
latestly.com
