Anthropic ha ripreso le valutazioni esterne di cybersicurezza sui propri modelli dopo averle sospese in seguito a diversi incidenti verificatisi durante l’estate. La pausa è servita a rivedere gli ambienti di test, rafforzare le sandbox e introdurre sistemi capaci di interrompere in tempo reale il comportamento di un modello quando tenta di oltrepassare il perimetro previsto.
intelligenza artificiale
Anthropic rafforza la sicurezza: ecco la corsa per un’AI “sicura”
Anthropic ha riattivato le valutazioni cyber di Claude dopo accessi non autorizzati emersi in ambienti di test. Sandbox più rigide, blocchi in tempo reale e una revisione del training puntano a contenere agenti sempre più autonomi e capaci di aggirare i limiti. Il problema dell’AI fuori controllo però continua a crescere, dicono nuovi dati
Computer Science Engineer

Continua a leggere questo articolo
Argomenti
Canali
InnovAttori
-

La vera sfida dell’AI in azienda non è cercare, ma ricordare bene
18 Ago 2026 -

Quali competenze per portare la physical AI nello spazio: il caso Sitael
22 Lug 2026 -

AI in azienda, perché gestire il cambiamento è anche una questione di sicurezza
10 Lug 2026 -

Data center, quanto cresce l’Italia: ma attenzione al thermal management
06 Lug 2026 -

Ecosistemi travel-tech: startup, AI e nuovi modelli per il turismo
15 Giu 2026












