Sicurezza informatica

Perché il tuo computer è meno sicuro a causa dei tentativi di protezione delle aziende di IA

I guardrail dell'IA sono progettati per fermare gli hacker, ma attualmente ostacolano i ricercatori di sicurezza legittimi che mantengono sicuro il nostro mondo digitale.
Perché il tuo computer è meno sicuro a causa dei tentativi di protezione delle aziende di IA

L'opinione pubblica considera i guardrail dell'IA come un giubbotto antiproiettile digitale. La logica è semplice: se un modello si rifiuta di scrivere codice malevolo, gli hacker hanno un'arma in meno nel loro arsenale. Dietro il marketing aziendale e la supervisione governativa, queste misure di sicurezza stanno attualmente accecando proprio le persone che proteggono i nostri dispositivi dagli attacchi nel mondo reale. Cercando di sbarrare le porte ai criminali, i laboratori di IA stanno accidentalmente chiudendo fuori i fabbri.

Tecnologi e ricercatori di sicurezza stanno lanciando l'allarme su una tendenza che privilegia l'apparenza rispetto alla sicurezza effettiva. Mentre aziende come Anthropic e OpenAI commercializzano i loro modelli come potenti motori di innovazione, li hanno anche avvolti in strati di codice restrittivo progettati per prevenire l'"uso improprio". Per l'utente medio, questo significa che il software su cui fai affidamento — dalla tua app bancaria al sistema operativo del tuo smartphone — sta diventando più difficile da difendere.

Il mito del giubbotto antiproiettile digitale

Il problema fondamentale dei guardrail dell'IA è che la cybersicurezza è una strada a doppio senso. Per riparare un buco in un muro, un muratore deve prima capire esattamente come quel muro possa essere rotto. Nel mondo digitale, questa è chiamata ricerca offensiva. I professionisti della sicurezza legittimi passano le loro giornate agendo come hacker per trovare vulnerabilità prima che lo facciano i veri criminali.

Chris Anley, scienziato capo presso il colosso della consulenza per la sicurezza NCC Group, usa una semplice analogia. Un martello è uno strumento necessario per costruire una casa, ma è anche un'arma. Non si può costruire una struttura senza di esso. Se si vietano i martelli per prevenire la violenza, ci si assicura anche che non vengano costruite case. Quando un ricercatore chiede a un'IA di provare a sfruttare un bug, sta cercando di dimostrare che una vulnerabilità è reale affinché un produttore possa risolverla. Se l'IA si rifiuta di rispondere perché la richiesta sembra "malevola", il difensore rimane senza il suo strumento più efficiente.

Questo crea un paradosso in cui lo stesso meccanismo destinato a ostacolare un hacker ferma anche un difensore. I due ruoli utilizzano esattamente le stesse tecniche. Limitando l'accesso a queste capacità, le aziende di IA stanno rendendo il lavoro dei difensori di rete significativamente più difficile. Ciò si traduce in falle software che rimangono aperte per periodi più lunghi, offrendo ai criminali reali più tempo per trovarle e utilizzarle.

Negoziare con un tirocinante instancabile ma testardo

Per molti ricercatori, usare un moderno modello di IA è come lavorare con un tirocinante instancabile che è anche incredibilmente paranoico. Potresti chiedere al tirocinante di analizzare un pezzo di codice alla ricerca di errori. Il tirocinante vede la parola "exploit" o "vulnerabilità" e smette immediatamente di lavorare, facendoti una lezione sull'etica invece di fornirti i dati richiesti.

Chris Thompson, amministratore delegato di RemoteThreat, osserva che i ricercatori ora trascorrono una parte enorme della loro giornata a negoziare con il modello. Invece di concentrarsi sul problema di sicurezza principale, cercano di capire perché un modello ha fornito una risposta utile ieri ma si rifiuta di parlare oggi. Questa eccessiva sanificazione dell'output dell'IA porta a risultati incoerenti.

In alcuni casi, i guardrail sono così sensibili da attivarsi alla sola menzione di argomenti legati alla sicurezza. Un ricercatore che lavora per un importante produttore di componenti per smartphone ha riferito che i propri strumenti di IA sono quasi inutili perché i guardrail sono troppo rigidi. Se il modello percepisce qualsiasi attività legata alla sicurezza, si blocca semplicemente. Ciò crea una tassa sulla produttività proprio per le persone che dovrebbero proteggere la catena di approvvigionamento globale.

La burocrazia dei programmi di verifica

I laboratori di IA non sono ciechi di fronte a questo problema, ma la loro soluzione è uno strato di burocrazia. Anthropic ha il suo Cyber Verification Program e OpenAI offre Trusted Access for Cyber. Si tratta di programmi verificati in cui i ricercatori possono richiedere un accesso speciale ai modelli con meno restrizioni.

Tuttavia, questi programmi sono spesso opachi ed escludenti. L'accesso è frequentemente limitato a specifiche organizzazioni occidentali o a quelle che soddisfano rigorosi criteri aziendali. Anche quando un ricercatore viene approvato, i confini possono cambiare senza preavviso. Questo controllo degli accessi è particolarmente evidente nel caso del modello Mythos di Anthropic. L'azienda ha commercializzato Mythos come uno strumento di fascia alta così potente da richiedere una supervisione a livello governativo.

A giugno, il governo degli Stati Uniti ha applicato brevemente controlli sull'esportazione di Mythos e di un altro modello chiamato Fable. Questa mossa ha fatto seguito a segnalazioni secondo cui i guardrail dei modelli potevano essere aggirati per eseguire attacchi informatici. Sebbene i controlli siano stati successivamente allentati per le organizzazioni statunitensi verificate, l'incidente ha evidenziato una tendenza crescente a trattare l'IA come un'arma controllata piuttosto che come uno strumento di uso generale. Questo livello di sbarramento non ferma gli hacker che usano il proprio hardware, ma crea un enorme ostacolo per le aziende legittime che cercano di stare al passo con i tempi.

La migrazione verso l'open source e i modelli stranieri

Quando i ricercatori legittimi vengono bloccati dalle aziende di IA con sede negli Stati Uniti, non smettono semplicemente di lavorare. Cercano invece strumenti che non abbiano questi filtri restrittivi. Ciò significa spesso allontanarsi dai raffinati modelli cloud verso alternative open source che possono essere eseguite su hardware privato.

Paolo Stagno, direttore tecnologico di Crowdfense, spiega che il suo team evita i modelli basati su cloud per il lavoro sensibile. Inserire una falla software segreta in un'IA cloud rischia di far trapelare quei dati o di farli assorbire in una futura sessione di addestramento. Per mantenere la privacy ed evitare il "babysitting" dei guardrail aziendali, molti professionisti stanno ora utilizzando modelli open source che possono eseguire localmente senza alcuna supervisione.

C'è un rischio strategico in questo. Se i ricercatori statunitensi scoprono che i modelli domestici sono troppo restrittivi per essere utili, potrebbero rivolgersi a potenti modelli open source sviluppati in altri paesi. Chris Thompson sottolinea che i ricercatori vengono già spinti verso modelli cinesi come GLM. Questi modelli sono scaricabili gratuitamente e non presentano restrizioni d'uso. Questo spostamento sposta il centro dell'innovazione lontano dalla governance statunitense e in ambienti in cui gli standard di sicurezza occidentali non si applicano affatto.

Perché i modelli cloud sono un incubo per la privacy dei professionisti della sicurezza

La privacy è una preoccupazione fondamentale per chiunque lavori nella cybersicurezza ad alto rischio. Se un ricercatore trova uno "zero-day" — una falla che il produttore del software non conosce ancora — quell'informazione vale milioni di dollari sul mercato aperto. È anche un elemento critico di intelligence per i governi.

Inviare quell'informazione a un server di proprietà di OpenAI o Anthropic è un rischio enorme. Anche con programmi di accesso specializzati, non vi è alcuna garanzia che i dati non vengano utilizzati per addestrare la versione successiva dell'IA. Alcuni ricercatori, come Giuseppe Cali, usano l'IA solo per le parti noiose del lavoro, come la traduzione di codice complesso in un formato leggibile. Si rifiutano di usarla per la scoperta effettiva di bug perché vogliono mantenere privato il proprio lavoro.

Questa cautela significa che i modelli di IA più avanzati vengono attualmente utilizzati per compiti di basso livello piuttosto che per il ragionamento di alto livello che potrebbe effettivamente migliorare la sicurezza globale. I guardrail e la natura basata su cloud di questi strumenti creano un soffitto a quanto possano effettivamente aiutare le persone che proteggono le nostre reti.

Cosa significa questo per la tua sicurezza digitale

Il punto fondamentale per il consumatore medio è che le nostre difese digitali non tengono il passo con la velocità degli attacchi assistiti dall'IA. I criminali non seguono le regole e non usano programmi verificati. Usano modelli open source non censurati o la propria IA personalizzata per automatizzare il processo di individuazione e colpo dei bersagli.

Nel frattempo, i "buoni" sono bloccati in un ciclo di richieste di autorizzazioni e discussioni con i chatbot. Praticamente, questo significa che il software sul tuo telefono e laptop potrebbe avere vulnerabilità che rimangono prive di patch più a lungo. Significa anche che il costo della cybersicurezza sta aumentando, poiché le aziende devono dedicare più tempo al lavoro manuale che l'IA potrebbe teoricamente gestire in pochi secondi.

Per mantenere sicuro il mondo digitale, i laboratori di IA devono allontanarsi dall'idea di poter fare da babysitter a ogni utente. Invece di costruire muri che bloccano tutti, devono fornire un accesso responsabile e ad alta velocità alle persone che sono effettivamente in prima linea. Senza questo cambiamento, stiamo essenzialmente chiedendo ai nostri ricercatori di sicurezza di vincere una gara ad alta velocità mentre siamo noi a legare insieme i loro lacci delle scarpe.

Punti chiave per l'utente comune

  • L'IA è uno strumento a doppio uso: La stessa IA che aiuta un medico a diagnosticare una malattia può aiutare un hacker a trovare una falla nel sistema di sicurezza di una banca.
  • I guardrail non sono perfetti: Sebbene fermino alcuni abusi di basso livello, vengono facilmente aggirati da criminali determinati che usano hardware privato.
  • I difensori vengono rallentati: Le persone che trovano e risolvono i bug nelle tue app faticano a usare l'IA perché le regole di sicurezza sono troppo ampie.
  • La privacy è un ostacolo: I ricercatori professionisti spesso evitano gli strumenti di IA più popolari perché non vogliono far trapelare dati di sicurezza sensibili nel cloud.
  • L'open source è l'alternativa: L'industria si sta spostando verso modelli locali e senza restrizioni per svolgere il lavoro senza interferenze aziendali.

Fonti:

  • Anthropic Public Disclosures on Mythos and Fable Model Access
  • OpenAI Trusted Access for Cyber Program Documentation
  • NCC Group Technical Analysis on AI in Offensive Security
  • TechCrunch Report on AI Guardrails and Cybersecurity Researchers
bg
bg
bg

Ci vediamo dall'altra parte.

La nostra soluzione di archiviazione e-mail crittografata end-to-end fornisce i mezzi più potenti per lo scambio sicuro dei dati, garantendo la sicurezza e la privacy dei tuoi dati.

/ Creare un account gratuito