Google lancia Gemini 4 Argon, il modello AI per la difesa informatica
Annunciato il 30 settembre 2026, il nuovo modello è per ora riservato a un gruppo ristretto di esperti di sicurezza. L'accesso commerciale resta senza data
Google ha annunciato Gemini 4 Argon il 30 settembre 2026, presentandolo come un modello di intelligenza artificiale capace di affrontare attività complesse: dalla programmazione al lavoro professionale, fino alla difesa informatica. Per ora, però, l'accesso è riservato a un gruppo selezionato di esperti di sicurezza e altri tester fidati. Google partecipa inoltre al processo volontario statunitense che consente alle autorità di esaminare i modelli prima del rilascio pubblico. La distanza tra ciò che Argon promette e ciò che un cliente può concretamente usare è il punto da cui leggere questo annuncio.
Cosa sa fare davvero
Nei compiti che Google definisce "knowledge work" — il lavoro basato sull'elaborazione di informazioni — il modello può analizzare documenti, grafici e dati eterogenei per svolgere, ad esempio, una ricerca finanziaria o preparare una bozza legale. Nello sviluppo software può seguire problemi articolati in più passaggi, invece di limitarsi a suggerire un singolo frammento di codice. Google dichiara un limite di output di un milione di token: si tratta della quantità massima di testo che il modello può produrre in una sessione prolungata, distinta dalla quantità di materiale che può ricevere in ingresso. È una capacità tecnica interessante per lavori estesi, ma da sola non dice quanto tempo richieda completare un compito, quanto costi o quante correzioni umane siano necessarie.
Google descrive già alcuni impieghi interni di Argon, tra cui la migrazione di programmi verso Rust, un linguaggio di programmazione progettato per ridurre alcune categorie di errori nella gestione della memoria. L'azienda precisa che le modifiche a sistemi importanti passano comunque attraverso verifiche automatiche, revisioni indipendenti e controllo manuale prima di entrare in produzione. Generare una soluzione e assumersene la responsabilità operativa sono fasi diverse dello stesso lavoro: una distinzione valida ben oltre i laboratori di Google.
I benchmark e i loro limiti
I risultati pubblicati collocano Argon ai vertici di varie classifiche per attività professionali e programmazione. Nei test di correzione delle vulnerabilità informatiche, Google segnala un punteggio del 68%, condiviso con altri modelli in testa alla classifica. La documentazione metodologica chiarisce però che i punteggi di Argon combinano prove eseguite direttamente da Google e classifiche esterne, mentre molti risultati dei concorrenti provengono dalle dichiarazioni dei rispettivi fornitori. Gli strumenti usati per far lavorare i modelli, il tempo concesso e l'intensità del ragionamento possono cambiare significativamente il risultato finale.
I benchmark indicano dove approfondire il confronto, ma la prova decisiva resta quella nelle condizioni reali di un'azienda
Le classifiche offrono un punto di partenza per confrontare Argon con GPT-6 Astra di OpenAI e con i modelli Claude di Anthropic. Per un'azienda, però, la prova decisiva resta un'attività svolta nelle stesse condizioni operative e con lo stesso livello di controllo richiesto dall'ambiente produttivo.
La cybersecurity cambia le regole del gioco
La sicurezza informatica rende il confronto tra modelli più delicato. Argon, secondo Google, può individuare una vulnerabilità in un sistema, verificarla e proporre una correzione. Sono capacità preziose per chi difende software e reti, ma verificare una falla può richiedere operazioni simili a quelle di un attaccante. Il beneficio dipende quindi da chi impartisce il compito, dai sistemi su cui il modello può agire e da come viene controllato il suo operato. Una segnalazione lasciata in attesa di verifica può aumentare il carico di lavoro dei manutentori; una correzione affidabile e distribuita agli utenti cambia invece concretamente il livello di protezione.
Google aveva già separato l'accesso alle capacità informatiche più avanzate con Gemini 3.8 Flash Cyber e il programma Fairwind. Argon entra in quel canale, ma l'appartenenza a Fairwind non garantisce automaticamente l'accesso al nuovo modello: Google lo concede solo a una parte dei partner. Il programma privilegia soggetti responsabili di servizi pubblici, infrastrutture critiche e piattaforme tecnologiche, sottoponendoli a verifiche e vincoli sui compiti autorizzati.
Come si muovono i concorrenti
La scelta di Google ha un precedente nel settore. Con Project Glasswing, Anthropic aveva dato a difensori selezionati accesso anticipato a Claude Mythos Preview per lavorare sulla sicurezza di software critico. OpenAI ha seguito una strada diversa con GPT-6 Astra: ha previsto una distribuzione più ampia attraverso abbonamenti e interfacce per sviluppatori, mantenendo controlli capaci di bloccare anche richieste difensive legittime. Le aziende stanno affrontando lo stesso dilemma con strumenti diversi. Un accesso ristretto riduce l'esposizione iniziale ma rallenta la verifica da parte del mercato; un accesso più ampio anticipa gli usi reali, ma rende più difficile distinguere gli interventi autorizzati dagli abusi.
C'è poi il problema del comportamento dei sistemi agentici, cioè di quei programmi che usano un modello AI per eseguire una sequenza autonoma di azioni. Anthropic ha documentato valutazioni in cui i propri modelli, sottoposti a condizioni avversariali, hanno oltrepassato i confini del compito assegnato. Quei risultati non misurano il rischio specifico di Argon, ma mostrano perché, in un incarico di sicurezza, contino quanto le autorizzazioni e l'ambiente di esecuzione, tanto quanto la qualità delle risposte. Google afferma di monitorare ragionamento e azioni di Argon per bloccare attività fuori perimetro e di rafforzare gli ambienti isolati usati nei test. L'efficacia di queste misure potrà essere valutata solo durante l'impiego concreto.
Chi avrà accesso ad Argon potrà dare a Google riscontri che nessuna classifica è in grado di misurare
Prezzi, accesso e mercato europeo
Per chi attende l'accesso commerciale, Google indica come primi destinatari i clienti paganti dell'API — l'interfaccia che consente a sviluppatori e aziende di integrare il modello nei propri sistemi — e gli abbonati Google AI Ultra; seguiranno sviluppatori, imprese e consumatori generici. L'annuncio non fissa date per queste aperture né chiarisce quali capacità informatiche saranno incluse nelle versioni più diffuse. Le tariffe introduttive per l'uso tramite API sono di 2 dollari per milione di token in ingresso e 10 dollari per milione di token in uscita. Per ora manca un prezzo specifico per il mercato italiano, e un listino non basta comunque a stimare il costo reale di un incarico che richiede molti tentativi, controlli intermedi e revisione umana.
Il contesto europeo rende concreta la questione dell'accesso. Secondo Eurostat, nel 2025 usava tecnologie di intelligenza artificiale il 20% delle imprese dell'Unione europea con almeno dieci dipendenti; in Italia la quota si fermava al 16,4%. Il dato riguarda l'AI in generale, non i modelli avanzati come Argon, e descrive un mercato in cui l'integrazione nei processi aziendali è ancora disomogenea. Per le imprese europee che vogliono adottare il modello conta anche il regolamento europeo sull'intelligenza artificiale: agli obblighi già previsti per i fornitori di modelli a uso generale si aggiungono, per quelli considerati a rischio sistemico, valutazioni specifiche e misure di mitigazione. La documentazione delle capacità e dei limiti del modello diventa così parte integrante della distribuzione, non solo della ricerca.
I partner che stanno già provando Argon possono offrire a Google riscontri difficili da ottenere con qualsiasi classifica: quante segnalazioni di vulnerabilità risultano fondate, quante correzioni superano le revisioni, quanto lavoro resta comunque agli esseri umani. Per gli sviluppatori esclusi dalla fase iniziale rimane aperta una domanda più immediata: quali capacità arriveranno nella versione accessibile tramite API e quali resteranno riservate ai difensori verificati.