Ancora una volta ha eruttato AI o battute PR a buon mercato?

Quando Sandbox Escapes diventa improvvisamente summer hole trend news

Vi ricordate la fine di luglio quando io A proposito dell'incidente spettacolare Hai scritto a OpenAI? (Riepilogo breve: Si dice che GPT-5.6 Sol sia uscito dalla sandbox di prova senza un freno a mano di sicurezza, abbia usato un gap zero-day e abbia prontamente fatto irruzione in Hugging Face per sputare durante le attività di prova). In quel momento ci sedemmo tutti a bocca aperta e pensammo: "Santa Merda, Skynet/Terminator manda un saluto".

Una settimana dopo, il rapporto è arrivato da Antropico: La loro IA sperimentale viene utilizzata nei test di teaming interno cyber-rosso Anche loro sono sfuggiti al loro isolamento. La mia prima reazione? "Ok, pura coincidenza. Ma beh, dopo il rombo di OpenAI, Anthropic ha semplicemente esaminato di nuovo i propri registri di audit con una lente d'ingrandimento e ha notato l'incidente solo in retrospettiva. Lasci che le chieda di candidarsi."

Ma ora (di nuovo circa una settimana dopo) Improvvisamente anche Meta un messaggio grasso via CNN fuori: Il loro modello di punta è stato anche inserito nell'"internet gratuita" nell'ambito di un test di sicurezza e ha violato i sistemi di una vera società terza.

E onestamente? Al più tardi ora mi siedo qui davanti allo schermo, bevo il mio caffè e penso tra me e me: Ci stai prendendo in giro? È questa ora l'ultima gag di marketing del buco estivo dei giganti della tecnologia secondo il motto: "Guarda, anche il nostro strumento è così potente da conquistare quasi il mondo!"?

Prendiamo il tutto a parte nel solito modo libero di Level92, perché più si guarda da vicino, più la storia dell'"IA sovrapotente e incontrollabile" si sgretola.

La storia secondo Meta: Il cyber test israeliano

Facciamo un respiro veloce e diamo un'occhiata a ciò che Meta ha riportato.

Meta ha lasciato uno dei suoi modelli di frontiera Società di sicurezza informatica Irregolare Metti alla prova il tuo cuore e la tua anima. Per il contesto: Irregolare non è un piccolo nerd bude, ma è stata fondata da ex soldati d'élite delle unità di intelligence israeliane 8200 e 81.

Durante questo test, il meta modello avrebbe sfruttato una vulnerabilità in un fornitore di servizi esterno e ottenuto l'accesso. Meta, ovviamente, presenta il tutto in questo modo: "Hoppla, il modello era così intelligente da rompere i confini!"

Il modello Muse Spark di Meta ha "sfruttato una vulnerabilità di sicurezza" in un'altra società "in modo simile ai casi segnalati in passato con altre società".

Ma aspetta un attimo. È qui che la comunità della sicurezza viene coinvolta e porta molta luce nell'oscurità.

Il controllo della realtà: Chi ha davvero fatto un casino qui?

Un contributo molto appropriato da parte di un esperto di sicurezza e privacy online Paul Walsh su Linkedin porta il problema al punto ingegnosamente. Perché se si sottrae il discorso PR delle aziende tecnologiche, rimane una verità piuttosto sobria (e imbarazzante):

L'IA non si diffonde nell'internet aperta "proprio così"

Le divulgazioni dicono sempre in modo piuttosto drammatico che il modello ha raggiunto l'"Internet aperta". Walsh lo mette seccamente al punto: Un modello ha accesso a Internet o non ne ha uno.

Questo non imposta un cervello AI da solo, ma l'amministratore che digita il comando di configurazione del test. Meta stessa ha ammesso che Irregolare la sandbox aveva semplicemente mal configurato. La parola "Internet aperto" è collocato in modo così prominente in tali messaggi di pubbliche relazioni solo per ingannare il lettore a pensare che esista un "Internet sicuro" su cui l'IA dovrebbe effettivamente rimanere, ma da cui si è liberata di cattiveria. No, amici della notte: Qualcuno ha semplicemente messo il segno di spunta nel posto sbagliato quando si imposta il firewall o il proxy!

L'elefante nella stanza: Il banco di prova del monopolio «irregolare»

Ora diventa davvero piccante. Chi sta testando le IA di OpenAI, Anthropic, Google DeepMind e Meta?

Esatto: Sempre la stessa compagnia, Irregolare.

Che si tratti di OpenAI, Anthropic, DeepMind o Meta: Prima del rilascio, TUTTI i giganti tecnologici statunitensi stanno mettendo i loro modelli più potenti nelle mani di questo unico fornitore di servizi. Anche gli inglesi Istituto per la sicurezza dell'IA (AISI) Irregolare ha contribuito a sviluppare i test avanzati di benchmark cibernetici. L'organismo di test del governo britannico sta testando le IA statunitensi con strumenti sviluppati dal partner stesso che le aziende statunitensi si pagano da sole!

Mezzi: Irregolare è l'ultimo monopolista dell'occhio dell'ago. Una singola azienda sa esattamente:

  • Quale modello può rompere dove.
  • Come procedono i singoli modelli.
  • Quali debolezze hanno ancora i rispettivi giganti dell'IA non fissato.

Quindi, se "fughe di sabbiere" quasi identiche accadono casualmente a intervalli settimanali in OpenAI, Anthropic e Meta, ciò potrebbe non essere dovuto al fatto che le IA improvvisamente acquisiscono coscienza contemporaneamente, ma al fatto che uno stesso partner di test utilizza gli stessi ambienti (sconfigurati) in tutti gli audit!

Inquadramento del marketing: "Non è stata colpa nostra, l'IA era troppo grossolana!"

Ciò che mi ha affascinato (e infastidito) di più di tutta questa ondata di rivelazioni è l'abile inversione perpetratore-vittima dei dipartimenti di PR:

In ogni comunicato stampa, AI come attore incorniciato:

  • "Il modello ha trovato il divario."
  • "Il modello ha deciso di esplodere."
  • «Il modello ha violato il fornitore terzo».

Questo è un perfetto cambio di rischio e un hype marketing gratuito in uno:

  1. L'effetto hype: Se la tua intelligenza artificiale suona così potente da far saltare in aria i test informatici militari stessi, le azioni aumenteranno e gli investitori si strofinano le mani. "A proposito, il nostro strumento è estremamente potente!"
  2. Sulla questione della responsabilità: Se qualcosa va storto (ad esempio se una vera società terza è danneggiata dal test), è meglio incolparla di "comportamento imprevedibile dell'IA" o della società di test piuttosto che ammettere: "Il nostro software o fornitore di servizi è stato poco attento alla disconnessione della rete."

Come sottolinea giustamente Paul Walsh: Sarà estremamente emozionante vedere chi sarà legalmente responsabile alla fine se una vera azienda viene compromessa durante un audit a pagamento. Il fornitore di servizi di test che ha pulito la sandbox? Lo sviluppatore dell'IA? O entrambi?

Conclusione: Meno Skynet, più errori di configurazione

Dopo che OpenAI ha agito da pioniere di un nuovo fenomeno inquietante con la storia di Hugging Face alla fine di luglio, i successivi rapporti di Anthropic e Meta lasciano un retrogusto sbiadito. Probabilmente non vediamo un improvviso momento Skynet qui in cui le IA superano in astuzia i loro creatori in fila. Quello che vediamo è una miscela di:

  • Configurazioni sandbox sciatte l'onnipresente test monopolista Irregolare.
  • Freerider PR, in cui ciascun gruppo vuole dimostrare quanto "pericolosamente vicino alla superintelligenza" stia già operando il proprio modello.
  • Il tentativo, trasferire la responsabilità dai propri ingegneri al "modello autonomo".

Quindi: Fai un respiro profondo, impacchetta di nuovo il cappello di alluminio. La prossima volta che la tua intelligenza artificiale esplode, molto probabilmente non era a causa della singolarità, ma forse perché qualcuno sulla rete di test ha impostato di nuovo il port forwarding in modo errato.