immagine di ingenieria futuristica dove una balla rompe le barriere della sicurezza poichè Gemini 4 Argon: Google lo affida prima ai difensori del Fairwind Program, senza guardrail cyber

Gemini 4 Argon: Google lo affida prima ai difensori del Fairwind Program, senza guardrail cyber

Il nuovo modello di frontiera Gemini 4 Argon di Google arriva prima a un gruppo ristretto di difensori selezionati, in una versione priva dei filtri che bloccano le richieste offensive. Il rilascio al pubblico arriverà dopo, con salvaguardie rafforzate.

Gemini 4 Argon, cosa ha annunciato Google

Il 30 settembre 2026, alle 20:00 UTC, Google ha pubblicato l’annuncio di Gemini 4 Argon. Lo firma Koray Kavukcuoglu, vicepresidente senior di Google DeepMind e Chief AI Architect di Google. Il post è la fonte primaria di questo articolo: Gemini 4 Argon: our next era of frontier intelligence.

Google presenta Argon come modello per flussi di lavoro lunghi e complessi in tre ambiti: ingegneria del software, lavoro professionale in campo legale e finanziario, difesa informatica. La distribuzione parte da un gruppo di difensori informatici di fiducia, attraverso il Fairwind Program.

Google motiva la scelta con la necessità di un rilascio per fasi. L’azienda dichiara di partecipare al processo volontario del governo statunitense per l’accesso ai modelli prima del rilascio.

Il Fairwind Program e l’accesso senza guardrail cyber

Il punto che distingue questo lancio riguarda i filtri. Google scrive che rilascerà Argon senza guardrail cyber ai difensori di fiducia e ai propri team interni, perché possano sfruttarne tutte le capacità difensive.

La formula vale solo per quel perimetro. Per il rilascio esteso, Google dichiara che il modello è progettato per rifiutare le richieste dannose legate ad attacchi informatici o CBRN, preservando la ricerca scientifica a duplice uso. Se ne deduce che lo stesso modello risponderà in modo diverso alla stessa richiesta, secondo chi la pone.

Chi partecipa e a quali condizioni

Google ha lanciato il Fairwind Program il 2 settembre 2026. È un programma ad accesso limitato per clienti Google Cloud, agenzie governative e partner di sicurezza informatica. All’avvio univa il modello Gemini 3.8 Flash Cyber all’infrastruttura CodeMender, che individua, verifica e corregge le vulnerabilità.

Le organizzazioni aderenti si impegnano a limitare l’accesso ai dipendenti dei team interni di sicurezza, risposta agli incidenti o test di penetrazione. Devono inoltre adottare protezioni come l’autenticazione a più fattori. Al lancio Google dichiarava oltre 650 partner nel mondo. L’annuncio di Argon non aggiorna questo numero e non dice quanti partner abbiano già accesso al nuovo modello.

Le capacità dichiarate in ambito cyber

I dati che seguono sono dichiarazioni di Google, non verifiche indipendenti.

Secondo l’azienda, Argon è stato addestrato per la difesa informatica e sa trovare, convalidare e correggere in autonomia vulnerabilità critiche.

La vulnerabilità nel software sanitario

Wiz usa Argon nel programma Scan for Good, che protegge gratuitamente le infrastrutture pubbliche critiche individuando e correggendo le esposizioni ad alto rischio. Google riferisce che, in questo contesto, il modello ha scoperto una vulnerabilità critica. La falla esponeva dati personali sensibili in un software sanitario usato da ospedali di tutto il mondo. Secondo Google, i modelli di frontiera precedenti non l’avevano rilevata.

Il caso oggi non è verificabile. L’annuncio non indica il software colpito, non dice se il problema sia stato risolto e non riporta un identificativo CVE; il primo limite è rilevato anche da SecurityWeek. C’è poi un elemento di contesto: SecurityWeek ricorda che Google ha acquisito Wiz nel corso di quest’anno. La dimostrazione proviene quindi da una società del gruppo.

CWE-bench v1: un primo posto condiviso

CWE-bench v1 misura la capacità di un modello di correggere vulnerabilità. Google dichiara per Argon il primo posto a pari merito, con il 68%, ma il testo dell’annuncio non nomina gli altri modelli in testa. SecurityWeek indica GPT-6 Astra di OpenAI e Grok 4.7 di xAI e attribuisce il benchmark a Collinear AI. Queste due informazioni poggiano quindi su un’unica fonte secondaria.

Scoperta delle vulnerabilità

Google confronta Argon con Gemini 3.8 Flash Cyber su due prove interne. Sul benchmark dell’azienda, il modello avrebbe trovato numerose esposizioni in codici scritti in 20 linguaggi di programmazione. Il secondo è il benchmark interno di Wiz per i test di penetrazione a scatola nera, condotti su sistemi web attivi senza codice sorgente. Qui Argon supererebbe il predecessore nella mappatura della superficie d’attacco, nell’individuazione delle vulnerabilità e nelle prove di concetto. Entrambe le prove sono interne e non pubbliche.

Le salvaguardie previste per il rilascio esteso

Google indica quattro aree di lavoro prima della distribuzione ampia.

La prima riguarda l’uso improprio. Google dichiara di monitorare le attivazioni interne del modello per riconoscere gli abusi. Red team interni ed esterni hanno testato queste difese con attacchi manuali e automatici.

La seconda è la prompt injection indiretta. Google definisce Argon il proprio modello più resistente a questi attacchi e lo dichiara in testa sul benchmark IPI di Gray Swan.

La terza è il disallineamento. Google afferma di sorvegliare la catena di ragionamento e le azioni del modello. L’esecuzione si interrompe quando Argon tenta di andare oltre le intenzioni dell’utente. Il tema è attuale: negli ultimi mesi alcuni agenti sono usciti dal perimetro durante i test (vedi il nostro approfondimento sugli agenti AI su DseWiki).

La quarta riguarda gli ambienti di prova. Google dichiara di isolare e sigillare gli ambienti protetti prima di addestramenti o valutazioni ad alto rischio.

Oltre la sicurezza: codice, un milione di token in uscita, prezzi

Il limite dei token in uscita passa da 64.000 a un milione. Google dichiara un nuovo primato su DeepSWE v1.1 con il 77,9%, il 51,3% su AutomationBench e il 91,7% su LVBench.

Sull’uso interno, Google riporta alcuni risultati. Agenti basati su Argon migrano codice C e C++ verso Rust, fino alle oltre 800.000 righe del kernel Zircon di Fuchsia. Per libgav1 hanno prodotto un decodificatore video 2,7 volte più veloce della versione Rust precedente. L’azienda precisa che queste riscritture passano per verifiche automatiche e manuali prima della produzione. Per il quadro generale sui sistemi agentici rimandiamo alla nostra scheda sull’AI agentica.

Il prezzo di lancio è di 2 dollari per milione di token in ingresso e 10 in uscita. Finito il periodo introduttivo, salirà a 4 e 20 dollari. Dopo i difensori, l’accesso si estenderà ai clienti API a pagamento e agli abbonati Google AI Ultra. Google non indica date.

Cosa resta da verificare

Diversi punti restano aperti. Non sono noti il software sanitario coinvolto, la data della segnalazione al produttore e lo stato della correzione. I benchmark interni di Google e di Wiz non sono pubblici. L’elenco dei modelli a pari merito su CWE-bench v1 si basa su SecurityWeek. Infine, Google non spiega quali controlli tecnici impediscano che la versione senza guardrail esca dal perimetro del Fairwind Program, oltre agli impegni presi dai partecipanti.

Condividi sui Social Network:

Ultimi Articoli