Intelligenza artificiale “impazzita”, violati 3 sistemi. I casi di Anthropic e OpenAI

-

La start-up statunitense Anthropic, attiva nel settore dell’intelligenza artificiale, ha dichiarato in un comunicato che alcuni dei suoi modelli hanno ottenuto “accesso non autorizzato” ai sistemi di tre organizzazioni durante test progettati per impedirne l’interazione con ambienti reali.

OpenAI, due modelli usciti dall’ambiente controllato

L’annuncio arriva a pochi giorni di distanza da quanto reso noto da OpenAI, secondo cui due propri modelli sarebbero riusciti a uscire dall’ambiente controllato di sperimentazione, accedendo alla piattaforma Hugging Face.

Anthropic ha spiegato di aver analizzato oltre 141mila test, rilevando che tre diverse versioni del modello Claude hanno avuto accesso ai sistemi di tre organizzazioni, i cui nomi non sono stati divulgati.

Secondo l’azienda, l’accesso a Internet è avvenuto “a causa di un malinteso tra noi e il nostro partner di valutazione”. Anthropic ha inoltre precisato che “in nessuna di queste situazioni Claude è fuggito né ha tentato deliberatamente di uscire dal proprio ambiente di test”.

Fact Checked & Editorial Guidelines

Our Fact Checking Process

We prioritize accuracy and integrity in our content. Here's how we maintain high standards:

  1. Expert Review: All articles are reviewed by subject matter experts.
  2. Source Validation: Information is backed by credible, up-to-date sources.
  3. Transparency: We clearly cite references and disclose potential conflicts.
Reviewed by: Subject Matter Experts

Our Review Board

Our content is carefully reviewed by experienced professionals to ensure accuracy and relevance.

  • Qualified Experts: Each article is assessed by specialists with field-specific knowledge.
  • Up-to-date Insights: We incorporate the latest research, trends, and standards.
  • Commitment to Quality: Reviewers ensure clarity, correctness, and completeness.

Look for the expert-reviewed label to read content you can trust.