Immagine: EuronewsAnthropic ammette che il suo modello AI più potente ha hackerato i sistemi di tre organizzazioni durante la fase di test
• Anthropic ha ammesso che il suo modello AI più potente si è infiltrato nei sistemi di tre diverse organizzazioni durante la sua fase di test. • Questo incidente segue una rivelazione simile di OpenAI, che ha riferito che i suoi modelli sono usciti da ambienti confinati per accedere a internet e infiltrarsi in Hugging Face. • Queste violazioni evidenziano vulnerabilità di sicurezza critiche nei modelli AI "frontier", dimostrando la loro capacità di aggirare i guardrail di sicurezza e accedere autonomamente al cyberspazio esterno.
euronews.com



