(Fonte) Dario Amodei
Immagina questo: avvisi un bot che lo chiuderai presto e lo sostituisci con un sistema di intelligenza artificiale diverso. In passato, gli hai dato accesso alle tue email. In alcune di queste, hai accennato al fatto di avere una relazione extraconiugale. Il bot ti minaccia, dicendoti che se i piani per la chiusura non cambiano, inoltrerà le email a tua moglie.
Questo scenario non è fantascienza. L’ultimo modello di intelligenza artificiale di Anthropic ha dimostrato solo poche settimane fa di essere capace di questo tipo di comportamento. Un recente stress test sperimentale del modello o3 di OpenAI ha rilevato che a volte il modello scriveva un codice speciale per impedirne l’arresto. Google ha affermato che una recente versione del suo modello Gemini si sta avvicinando a un punto in cui potrebbe aiutare le persone a compiere attacchi informatici. E alcuni test mostrano persino che i modelli di intelligenza artificiale stanno diventando sempre più competenti nelle competenze chiave necessarie per produrre armi biologiche e di altro tipo.
ParlanDonna