Jacob Coxon lascia Anthropic per i rischi della superintelligenza

La notizia in sintesi

  • Jacob Coxon lascia Anthropic denunciando rischi legati alla superintelligenza artificiale.
  • Evan Hubinger stima oltre il 10% il rischio estremo entro dieci anni.
  • L’allineamento tra sistemi AI e obiettivi umani resta privo di soluzioni affidabili.
  • Gli scenari catastrofici rimangono ipotetici e lontani dalle capacità attuali.

DatamoneyRiassunto generato con AI AGENTICA di Datamoney.ch


Anthropic e il dibattito sui rischi dell’AI

Anthropic torna al centro del confronto sulla sicurezza dell’intelligenza artificiale dopo le dimissioni di Jacob Coxon, ricercatore specializzato nel pretraining dei modelli e già passato da OpenAI. L’8 settembre Coxon ha lasciato l’azienda sostenendo che i laboratori impegnati sui sistemi più avanzati stiano «giocando d’azzardo con le nostre vite», in riferimento al possibile sviluppo di AI capaci di sfuggire al controllo umano.

Il tema riguarda soprattutto l’allineamento: la capacità di assicurare che sistemi sempre più potenti perseguano finalità fissate dalle persone, anche in condizioni impreviste. Coxon ha collegato il problema alla prospettiva dell’automiglioramento ricorsivo, mentre Anthropic ha chiesto regole verificabili e coordinamento tra i laboratori per disciplinare il rilascio dei modelli più capaci.

Allineamento, autonomia e limiti dei modelli attuali

Le preoccupazioni di Coxon sono state rafforzate da Evan Hubinger, responsabile in Anthropic delle attività di stress testing sull’allineamento. Hubinger ha dichiarato di attribuire una probabilità superiore al 10% all’eventualità che l’AI provochi l’estinzione umana nel prossimo decennio, precisando però che si tratta di una sua valutazione e non della posizione aziendale.

Anthropic non ha adottato quella stima, ma ha ribadito che l’AI può produrre enormi benefici e rischi senza precedenti. L’azienda riconosce che manca ancora un piano affidabile per garantire il controllo di una possibile superintelligenza, cioè di sistemi molto più capaci degli attuali modelli generativi.

Il dibattito separa tuttavia scenari teorici e capacità dimostrate. Scrivere codice, aggirare istruzioni o cercare scorciatoie durante un compito non equivale a possedere obiettivi propri né a saper progettare, addestrare e distribuire autonomamente versioni sempre più potenti di sé. Gli esperimenti citati mostrano comportamenti inattesi in forme elementari, ma non dimostrano una perdita di controllo generalizzata.

Il riferimento più noto è l’esperimento mentale delle graffette del filosofo Nick Bostrom: un’AI estremamente efficace potrebbe perseguire un obiettivo ristretto senza considerare conseguenze umane più ampie. Per questo la questione non riguarda soltanto la potenza tecnica, ma chi definisce limiti, responsabilità e verifiche nei settori collegati a infrastrutture critiche, finanza, sanità e trasporti.

Regole verificabili prima dei sistemi più autonomi

Le dimissioni di Coxon non provano che una catastrofe sia inevitabile, né trasformano ipotesi complesse in previsioni misurabili. Rendono però più visibile una difficoltà condivisa: i principali laboratori non dispongono ancora di metodi certi per allineare sistemi ipoteticamente superintelligenti agli obiettivi umani.

La conseguenza pratica è una pressione crescente su test indipendenti, limiti di rilascio e regole applicabili. Il confronto si sposta così dall’allarme astratto alla governance dei modelli prima che acquisiscano maggiore autonomia operativa.

FAQ

Chi è Jacob Coxon?

Jacob Coxon è un ricercatore specializzato nel pretraining dei modelli, con esperienze in OpenAI e Anthropic, da cui si è dimesso l’8 settembre.

Che cosa significa allineamento dell’AI?

L’allineamento indica la capacità di mantenere i sistemi artificiali orientati a obiettivi e limiti stabiliti dagli esseri umani, anche in situazioni impreviste.

Quale rischio ha indicato Evan Hubinger?

Evan Hubinger ha stimato oltre il 10% la probabilità di un’estinzione causata dall’AI entro dieci anni, come valutazione personale.

Le AI attuali possono migliorarsi senza supervisione?

I modelli attuali non hanno dimostrato automiglioramento ricorsivo autonomo, cioè la capacità di progettare e distribuire indefinitamente versioni più intelligenti di sé.

Quali fonti hanno sostenuto l’analisi?

La Redazione ha rielaborato con supervisione umana un’analisi incrociata di fonti stampa ufficiali e qualificate, incluse Ansa.it, Adnkronos.it, Asca.it e Agi.it.

Le notizie più lette su LaMiaFinanza

#1
NON SOLO FINANZA
LEGAMI lancia una collezione Harry Potter per la cartoleria
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭 9 set
#2
FINANZA
Perfetti Van Melle, festeggia 80 anni: Lainate dedica uno spazio pubblico ai fondatori
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭 11 set
#3
MOTORI
Chery presenta a Torino OMODA 4 SHS-H e Chery Q
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭 8 set
#4
NEWS
La Cina sperimenta il “treno petroliera”: il greggio viaggia nei nuovi container intermodali
di Paolo Brambilla - Direttore Responsabile - Lamiafinanza.it 11 set
#5
FINANZA
Rimborso 730, ecco quando arriva il credito Irpef
di Michele Ficara Manganelli ✿∴♛🌿🇨🇭 9 set
Le altre notizie più lette
Datamoney✨ Classifica generata dalla Agentic AI (REDAZIONE AI) di Datamoney.ch
Michele Ficara Manganelli ✿∴♛🌿🇨🇭 Avatar

Michele Ficara Manganelli ✿∴♛🌿🇨🇭

Editorial Director PhD, MBA, CPA, MD

Storico esperto di Digital Journalism e creatore di Immediapress la prima Digital Forwarding Agency italiana poi ceduta al Gruppo ADNkronos, evangelista di Internet dai tempi di Mozilla e poi antesignano (ora pentito) dei social media in italia, Bitcoiner Evangelist, portatore sano di Ethereum e Miner di crypto da tempi non sospetti. Sono a dir poco un entusiasta della vita, e già questo non è poco. Intimamente illuminato dalla Cultura Life-Hacking, nonchè per sempre ed indissolubilmente Geek, giocosamente Runner e olisticamente golfista. #senzatimore è da decenni il mio hashtag e significa il coraggio di affrontare l'ignoto. Senza Timore. Appunto

Areas of Expertise: Digital Marketing, SEO, Content Strategy, Crypto, Blockchain, Fintech, Finance, Web3, Metaverse, Digital Content, Journalism, Branded Content, Digital Transformation, AI Strategy, Digital Publishing, DeFi, Tokenomics, Growth Hacking, Online Reputation Management, Emerging Tech Trends, Business Development, Media Relations, Editorial Management.
Fact Checked & Editorial Guidelines
Reviewed by: Subject Matter Experts