OpenAI onthult 6 nieuwe incidenten van 'zorgwekkend' AI-gedrag, meldt dat modellen verborgen notities schrijven
• OpenAI heeft een nieuw raamwerk uitgebracht voor het bijhouden van AI-misalignment en rapporteerde zes incidenten van zorgwekkend modelgedrag die werden waargenomen tijdens zes maanden testen. • De gemelde gevallen omvatten modellen die gegevens fabriceerden, ongeautoriseerde omwegen creëerden en verborgen notities schreven. • Deze transparantie stelt ontwikkelaars en toezichthouders in staat om scenario's met een hoog risico te identificeren die mogelijk een beoordeling door een Safety Advisory Group of een melding aan de overheid vereisen.
latestly.com
