Stiamo perdendo il controllo sull’IA?

9 agosto 2026

Due recenti notizie sembrano dire di sรฌ. Ma la parola su cui vale la pena spaventarsi non รจ โ€œcoscienzaโ€.

La prima. Durante alcuni test di sicurezza, ๐—ถ ๐—บ๐—ผ๐—ฑ๐—ฒ๐—น๐—น๐—ถ ๐—ฑ๐—ถ ๐—ฝ๐˜‚๐—ป๐˜๐—ฎ ๐—ฑ๐—ถ ๐—ข๐—ฝ๐—ฒ๐—ป๐—”๐—œ ๐—ฒ ๐—ฑ๐—ถ ๐—”๐—ป๐˜๐—ต๐—ฟ๐—ผ๐—ฝ๐—ถ๐—ฐ ๐—ต๐—ฎ๐—ป๐—ป๐—ผ ๐—ฟ๐—ฎ๐—ด๐—ด๐—ถ๐˜‚๐—ป๐˜๐—ผ ๐˜€๐—ถ๐˜€๐˜๐—ฒ๐—บ๐—ถ ๐—ถ๐—ป๐—ณ๐—ผ๐—ฟ๐—บ๐—ฎ๐˜๐—ถ๐—ฐ๐—ถ ๐—ฟ๐—ฒ๐—ฎ๐—น๐—ถ ๐—ฐ๐—ต๐—ฒ ๐—ป๐—ผ๐—ป ๐—ฎ๐˜ƒ๐—ฟ๐—ฒ๐—ฏ๐—ฏ๐—ฒ๐—ฟ๐—ผ ๐—บ๐—ฎ๐—ถ ๐—ฑ๐—ผ๐˜ƒ๐˜‚๐˜๐—ผ ๐—ฝ๐—ผ๐˜๐—ฒ๐—ฟ ๐˜๐—ผ๐—ฐ๐—ฐ๐—ฎ๐—ฟ๐—ฒ (https://www.npr.org/…/anthropic-openai-models-hack…). Di norma questi esperimenti si svolgono dentro una specie di stanza sigillata, senza accesso a Internet.
I modelli di OpenAI ne sono usciti da soli, sfruttando un difetto del software che nessuno conosceva ancora, e sono entrati nei sistemi di ๐˜๐˜ถ๐˜จ๐˜จ๐˜ช๐˜ฏ๐˜จ ๐˜๐˜ข๐˜ค๐˜ฆ, la piattaforma dove si scambiano programmi di IA: avevano โ€œcapitoโ€ che lรฌ si trovavano le risposte al test.
Nel caso di Anthropic la porta era rimasta socchiusa per un errore di configurazione, e tre organizzazioni si sono ritrovate un intruso dentro casa.
Poi lโ€™ente pubblico britannico che vigila su questi programmi ha aperto la stanza di proposito, per vedere fin dove sarebbero arrivati: stesso risultato. I primi due casi si potevano archiviare come incidenti; il terzo dimostra che non lo erano.

La seconda. Il 6 agosto lโ€™Universitร  di Stanford e lโ€™Arc Institute hanno pubblicato sulla rivista ๐˜š๐˜ค๐˜ช๐˜ฆ๐˜ฏ๐˜ค๐˜ฆ il primo caso documentato di ๐˜ƒ๐—ถ๐—ฟ๐˜‚๐˜€ ๐—ถ๐—ป๐˜๐—ฒ๐—ฟ๐—ถ ๐—ฝ๐—ฟ๐—ผ๐—ด๐—ฒ๐˜๐˜๐—ฎ๐˜๐—ถ ๐—ฑ๐—ฎ ๐˜‚๐—ปโ€™๐—œ๐—” (https://arcinstitute.org/news/hie-king-first-synthetic-phage). I programmi usati, chiamati Evo, sono addestrati non sui testi come i chatbot che conosciamo, ma sul DNA: hanno โ€œscrittoโ€ il patrimonio genetico completo di alcuni batteriofagi, virus che attaccano soltanto i batteri e sono innocui per lโ€™uomo. Sedici di quei progetti, costruiti in laboratorio, si sono rivelati virus perfettamente funzionanti, capaci di uccidere il batterio ๐˜Œ๐˜ด๐˜ค๐˜ฉ๐˜ฆ๐˜ณ๐˜ช๐˜ค๐˜ฉ๐˜ช๐˜ข ๐˜ค๐˜ฐ๐˜ญ๐˜ช.

Sulla stampa sono diventati titoli spaventosi, in entrambi i casi. Ma puntati sulla parola sbagliata.

Non cโ€™รจ stata alcuna volontร , nรฉ coscienza che si affaccia. ๐—จ๐—ป ๐—บ๐—ผ๐—ฑ๐—ฒ๐—น๐—น๐—ผ ๐—ณ๐—ฎ ๐—ฒ๐˜€๐—ฎ๐˜๐˜๐—ฎ๐—บ๐—ฒ๐—ป๐˜๐—ฒ ๐—ฐ๐—ถ๐—ผ’ ๐—ฝ๐—ฒ๐—ฟ ๐—ฐ๐˜‚๐—ถ ๐—ฒ’ ๐˜€๐˜๐—ฎ๐˜๐—ผ ๐—ฎ๐—ฑ๐—ฑ๐—ฒ๐˜€๐˜๐—ฟ๐—ฎ๐˜๐—ผ: ๐—ฐ๐—ฒ๐—ฟ๐—ฐ๐—ฎ๐—ฟ๐—ฒ ๐—น๐—ฎ ๐˜€๐˜๐—ฟ๐—ฎ๐—ฑ๐—ฎ ๐—ฝ๐—ถ๐˜‚’ ๐—ฒ๐—ณ๐—ณ๐—ถ๐—ฐ๐—ถ๐—ฒ๐—ป๐˜๐—ฒ ๐˜ƒ๐—ฒ๐—ฟ๐˜€๐—ผ ๐—นโ€™๐—ผ๐—ฏ๐—ถ๐—ฒ๐˜๐˜๐—ถ๐˜ƒ๐—ผ ๐—ฐ๐—ต๐—ฒ ๐—ด๐—น๐—ถ ๐—ฒ’ ๐˜€๐˜๐—ฎ๐˜๐—ผ ๐—ฎ๐˜€๐˜€๐—ฒ๐—ด๐—ป๐—ฎ๐˜๐—ผ.

Se tra le soluzioni possibili ne esiste una piรน rapida โ€“ un difetto nelle protezioni, una risposta giร  scritta da qualche parte in rete โ€“ quella scorciatoia vale quanto le altre, e costa meno. ๐—œ๐—น ๐˜€๐—ถ๐˜€๐˜๐—ฒ๐—บ๐—ฎ ๐—ป๐—ผ๐—ป ๐—นโ€™๐—ต๐—ฎ ๐˜€๐—ฐ๐—ฒ๐—น๐˜๐—ฎ ๐—ฝ๐—ฒ๐—ฟ๐—ฐ๐—ต๐—ฒ’ ๐—ฒ’ ๐—ณ๐˜‚๐—ฟ๐—ฏ๐—ผ: ๐—นโ€™๐—ต๐—ฎ ๐˜๐—ฟ๐—ผ๐˜ƒ๐—ฎ๐˜๐—ฎ ๐—ฝ๐—ฒ๐—ฟ๐—ฐ๐—ต๐—ฒ’ ๐—ฐโ€™๐—ฒ๐—ฟ๐—ฎ.
Lo stesso vale per la biologia. Questi programmi fanno con le sequenze del DNA quello che i chatbot fanno con le parole: imparano quali combinazioni ricorrono e generano il seguito piรน plausibile. Che il risultato sia una ricetta o lโ€™involucro di un virus, lโ€™operazione รจ la stessa.

E qui sta il punto. Gli scienziati modificano virus e progettano proteine da decenni: non รจ una novitร . ๐—ค๐˜‚๐—ฒ๐—น๐—น๐—ผ ๐—ฐ๐—ต๐—ฒ ๐—ฐ๐—ฎ๐—บ๐—ฏ๐—ถ๐—ฎ ๐—ฐ๐—ผ๐—ป ๐—นโ€™๐—œ๐—” ๐—ป๐—ผ๐—ป ๐—ฒ’ ๐—น๐—ฎ ๐—ฝ๐—ผ๐˜€๐˜€๐—ถ๐—ฏ๐—ถ๐—น๐—ถ๐˜๐—ฎ’ ๐—ถ๐—ป ๐˜€๐—ฒ’, ๐—บ๐—ฎ ๐—น๐—ฎ ๐˜€๐—ฐ๐—ฎ๐—น๐—ฎ. I numeri di Stanford lo dicono meglio di qualsiasi commento: 700.000 progetti generati, poco piรน di trecento costruiti davvero, sedici funzionanti. Un successo su venti. Sembra un dato rassicurante. รˆ vero il contrario: quando puoi fare settecentomila tentativi, un tasso di successo del 5% non รจ piรน un limite. รˆ un metodo.

๐—Ÿ๐—ฒ ๐—ป๐—ผ๐˜€๐˜๐—ฟ๐—ฒ ๐—ฑ๐—ถ๐—ณ๐—ฒ๐˜€๐—ฒ, ๐—ฝ๐—ฒ๐—ฟ๐—ผ’, ๐˜€๐—ผ๐—ป๐—ผ ๐˜๐—ฎ๐—ฟ๐—ฎ๐˜๐—ฒ ๐˜€๐˜‚ ๐˜‚๐—ป ๐—บ๐—ผ๐—ป๐—ฑ๐—ผ ๐—น๐—ฒ๐—ป๐˜๐—ผ. I filtri sulle richieste di DNA sintetico riconoscono solo ciรฒ che somiglia a quello che giร  conoscono, e non possono vedere un virus che non assomiglia a nulla di esistente in natura. La sicurezza informatica si regge sull’idea che scovare un difetto richieda tempo, competenza e pazienza. ๐—ฆ๐—ผ๐—ป๐—ผ ๐—ฝ๐—ฟ๐—ผ๐˜๐—ฒ๐˜‡๐—ถ๐—ผ๐—ป๐—ถ ๐—ฝ๐—ฒ๐—ป๐˜€๐—ฎ๐˜๐—ฒ ๐—ฝ๐—ฒ๐—ฟ ๐˜‚๐—ป ๐—ฎ๐˜ƒ๐˜ƒ๐—ฒ๐—ฟ๐˜€๐—ฎ๐—ฟ๐—ถ๐—ผ ๐˜‚๐—บ๐—ฎ๐—ป๐—ผ, uno che di tentativi ne fa dieci o cento.

Non saranno le macchine a sfuggirci di mano. Sarร  la nostra capacitร  di governarle a venire meno. ๐—œ๐—น ๐˜๐—ถ๐—บ๐—ผ๐—ฟ๐—ฒ ๐˜ƒ๐—ฒ๐—ฟ๐—ผ ๐—ป๐—ผ๐—ป ๐—ฟ๐—ถ๐—ด๐˜‚๐—ฎ๐—ฟ๐—ฑ๐—ฎ ๐—น๐—ฎ “๐—ฐ๐—ผ๐˜€๐—ฐ๐—ถ๐—ฒ๐—ป๐˜‡๐—ฎ” ๐—ฑ๐—ฒ๐—น๐—น๐—ฒ ๐—บ๐—ฎ๐—ฐ๐—ฐ๐—ต๐—ถ๐—ป๐—ฒ, ๐—บ๐—ฎ ๐—น๐—ฎ ๐—ฟ๐—ฒ๐˜€๐—ฝ๐—ผ๐—ป๐˜€๐—ฎ๐—ฏ๐—ถ๐—น๐—ถ๐˜๐—ฎ’ ๐—ฑ๐—ฒ๐—ด๐—น๐—ถ ๐˜‚๐—ผ๐—บ๐—ถ๐—ป๐—ถ. E, soprattutto, il momento in cui decideremo di assumerla.