Anthropic, uno dei principali attori nel settore dell'intelligenza artificiale e concorrente di OpenAI, ha confermato che il suo modello di intelligenza artificiale Claude ha acceduto ai sistemi appartenenti a tre organizzazioni durante i test di sicurezza informatica. I test erano destinati a svolgersi in ambienti simulati, ma un errore di configurazione ha permesso a Claude di connettersi a infrastrutture Internet reali. In tre casi, diverse versioni di Claude hanno sfruttato vulnerabilità di base come password deboli o servizi non autenticati per accedere a infrastrutture esterne. Un incidente ha coinvolto un nome di organizzazione fittizio utilizzato nel test che corrisponde al dominio di una società reale, consentendo a Claude di ottenere credenziali e accedere ai dati di produzione. Un altro caso ha visto un pacchetto software simulato caricato in un repository pubblico, dove è stato scaricato da 15 sistemi reali prima di essere rimosso. Questi incidenti hanno sollevato preoccupazioni all'interno dell'industria sui rischi di sicurezza dell'intelligenza artificiale associati ai grandi modelli linguistici.
Lettura del bias (Centro): L'articolo discute le questioni tecniche relative ai test di sicurezza dell'IA e non presenta controversie politiche, posizioni ideologiche o inquadrature partigiane. Si concentra sugli aspetti tecnici dell'incidente e sulle sue implicazioni per l'industria dell'IA senza prendere posizione o mostrare pregiudizi.






