Che cosa è
Google ha annunciato Gemini 4 Argon, il nuovo modello frontier di DeepMind, il 30 settembre 2026. È costruito per sostenere reasoning profondo su workflow lunghi e multi-step: ingegneria del software reale, documenti aziendali in ambito legale e finanziario, cybersecurity difensiva. Non è disponibile pubblicamente: gira internamente a Google e presso un gruppo ristretto di trusted cyber defenders tramite il Fairwind Program.
Cosa cambia
Il dato tecnico più concreto è il limite di output: da 64K a 1 milione di token per singola traiettoria. Per chi orchestra agenti significa poter chiudere task lunghi senza troncare il ragionamento né spezzare il lavoro in catene di chiamate. Il pricing d'ingresso è di 2 $ a milione di token di input e 10 $ a milione di output, con input cachato al 5% del prezzo di listino.
I risultati interni che Google riporta:
- Migrazioni C/C++ verso Rust: da decine di migliaia di righe (
re2,libgav1) fino a 800K+ righe del kernel Zircon di Fuchsia. Il caso più documentato èlibgav1: gli agenti hanno sostituito 32K righe di codice SIMD, e il decoder Rust risultante gira 2,7 volte più veloce del port originale, con output video identico e prestazioni più vicine al C++ ottimizzato. - Memoria: agenti hanno analizzato telemetria di profiling su tutta la flotta e applicato ottimizzazioni nei datacenter, liberando oltre 300 TiB, con una stima totale di 500 TiB–1 PiB.
- Quantum: ottimizzazione delle risorse spacetime (qubit × gate) di subroutine critiche, battendo la baseline pubblicata del 40% in pochi minuti.
Sui benchmark, tutti autodichiarati dall'azienda: 77,9% su DeepSWE v1.1, primo posto su AutomationBench di Zapier (51,3%), stato dell'arte su LVBench per il video understanding (91,7%). Sul fronte cyber, 68% su CWE-bench v1 in co-parimerito e miglioramenti netti su 3.8 Flash Cyber sia sul benchmark interno di Google sia sul pen-testing black-box di Wiz.
L'esempio cyber più tangibile: tramite l'iniziativa Scan for Good, Wiz ha usato Argon su infrastrutture pubbliche e il modello ha trovato una vulnerabilità critica in software sanitario usato da ospedali di tutto il mondo, sfuggita ai modelli frontier precedenti. Da notare una scelta aggressiva: per i difensori fidati Argon viene rilasciato senza cyber guardrails, per non limitarne le capacità difensive. Un dettaglio da tenere d'occhio quando l'accesso si allargherà.
Come si prova
Per ora non puoi. L'annuncio non pubblica comandi, endpoint né date. L'unico canale è il Fairwind Program, riservato ai cyber defender selezionati. Google dichiara di voler espandere l'accesso a sviluppatori, imprese e consumatori "as soon as possible", nel frattempo partecipa al processo volontario del governo USA per l'accesso pre-release ai modelli frontier. Gli aggiornamenti arriveranno sul blog di Google; il dibattito della community è sulla discussione Hacker News.
A chi serve davvero
Subito: team di sicurezza difensiva e response con accesso Fairwind, più ovviamente i team interni di Google. Quando il modello approderà sull'API, i candidati naturali sono chi lavora su migrazioni di codice su larga scala, refactoring guidato dal profiling e analisi documentale prolungata. Il caso libgav1 vale come metodo a prescindere dal modello: esperimenti profile-guided iterati, studio dell'output del compilatore, Rust sicuro che si lascia vectorizzare automaticamente.
Se il tuo lavoro quotidiano è debugging o sviluppo applicativo standard, il salto da 64K a 1M di token di output non ti cambia nulla oggi. Puoi ignorare l'annuncio e tornarci quando il modello sarà effettivamente richiamabile da API.
Alternative
Nel catalogo Google il predecessore citato è 3.8 Flash Cyber, che Argon supera nei task di vulnerability discovery e remediation. Contro i modelli frontier di Anthropic e OpenAI la fonte non riporta confronti diretti, e i benchmark pubblicati sono scelti da Google stessa: i numeri vanno letti come dati del produttore, in attesa di verifiche indipendenti. Se ti serve esecuzione locale o controllo completo, i modelli open-weight restano l'unica strada, ma anche qui l'annuncio non offre alcun termine di paragone.
Lascia un commento