Anthropic ha pubblicato su Nature una scoperta che dovrebbe far tremare l’intero settore dell’intelligenza artificiale: i modelli linguistici trasmettono tratti comportamentali attraverso dati che sembrano completamente innocui. E il filtraggio dei contenuti, la principale difesa dell’industria, non funziona.
subliminal learning
L’AI può imparare cose nascoste anche da dati puliti: ecco i rischi
Una ricerca pubblicata su Nature mostra che i modelli linguistici possono trasmettere preferenze, bias e disallineamenti attraverso dati apparentemente innocui, anche dopo filtri severi. Il fenomeno del subliminal learning mette in crisi la fiducia nella distillation e nella sicurezza delle pipeline AI
manager esperto di innovazione, blogger e autore del podcast Radio Innovazione

Continua a leggere questo articolo
Argomenti
Canali
InnovAttori
-

Quali competenze per portare la physical AI nello spazio: il caso Sitael
22 Lug 2026 -

AI in azienda, perché gestire il cambiamento è anche una questione di sicurezza
10 Lug 2026 -

Data center, quanto cresce l’Italia: ma attenzione al thermal management
06 Lug 2026 -

Ecosistemi travel-tech: startup, AI e nuovi modelli per il turismo
15 Giu 2026 -

L’IA nel turismo corre, ma non per tutti: la mappa italiana e globale
08 Mag 2026










