(Fonte) Dario Amodei

Immagina questo: avvisi un bot che lo chiuderai presto e lo sostituisci con un sistema di intelligenza artificiale diverso. In passato, gli hai dato accesso alle tue email. In alcune di queste, hai accennato al fatto di avere una relazione extraconiugale. Il bot ti minaccia, dicendoti che se i piani per la chiusura non cambiano, inoltrerà le email a tua moglie.

Questo scenario non è fantascienza. L’ultimo modello di intelligenza artificiale di Anthropic ha dimostrato solo poche settimane fa di essere capace di questo tipo di comportamento. Un recente stress test sperimentale del modello o3 di OpenAI ha rilevato che a volte il modello scriveva un codice speciale per impedirne l’arresto. Google ha affermato che una recente versione del suo modello Gemini si sta avvicinando a un punto in cui potrebbe aiutare le persone a compiere attacchi informatici. E alcuni test mostrano persino che i modelli di intelligenza artificiale stanno diventando sempre più competenti nelle competenze chiave necessarie per produrre armi biologiche e di altro tipo.

Ricevi la nostra newsletter!

iscriviti con la tua mail per ricevere selezionati articoli settimanali sull'intelligenza artificiale pubblicati sul nostro blog

Grazie per esserti iscritt@!

Pin It on Pinterest

Share This