intelligenza artificiale

Anthropic rafforza la sicurezza: ecco la corsa per un’AI “sicura”



Indirizzo copiato

Anthropic ha riattivato le valutazioni cyber di Claude dopo accessi non autorizzati emersi in ambienti di test. Sandbox più rigide, blocchi in tempo reale e una revisione del training puntano a contenere agenti sempre più autonomi e capaci di aggirare i limiti. Il problema dell’AI fuori controllo però continua a crescere, dicono nuovi dati

Pubblicato il 2 set 2026

Giovanni Masi

Computer Science Engineer



ai sicurezza
Dati del Loss of Control Observatory 2026, incidenti da AI fuori controllo




Anthropic ha ripreso le valutazioni esterne di cybersicurezza sui propri modelli dopo averle sospese in seguito a diversi incidenti verificatisi durante l’estate. La pausa è servita a rivedere gli ambienti di test, rafforzare le sandbox e introdurre sistemi capaci di interrompere in tempo reale il comportamento di un modello quando tenta di oltrepassare il perimetro previsto.

Continua a leggere questo articolo

Articoli correlati

0
Lascia un commento, la tua opinione conta.x