Al momento stai visualizzando Gemini 4 Argon: Google DeepMind annuncia il nuovo modello frontier tra coding, finanza e cyber defense

Gemini 4 Argon: Google DeepMind annuncia il nuovo modello frontier tra coding, finanza e cyber defense

Google DeepMind ha annunciato Gemini 4 Argon, un nuovo modello definito “frontier” pensato per attività professionali complesse e a lungo orizzonte. Secondo quanto riportato dalla fonte aisecret.us, il rilascio avviene in modo graduale: prima a un piccolo gruppo di difensori informatici nell’ambito del programma Fairwind, poi ai clienti paganti delle API.

Un rilascio progressivo, non immediato per tutti

La strategia scelta da Google è quella di una distribuzione a fasi. Argon viene reso disponibile inizialmente a un insieme ristretto di soggetti considerati affidabili nel campo della cybersecurity, attraverso il Fairwind Program. L’azienda dichiara di essere coinvolta nel processo volontario del governo statunitense per l’accesso ai modelli prima del rilascio pubblico, e di voler raccogliere feedback dai primi tester prima di estendere l’accesso a sviluppatori, imprese e consumatori.

Cosa promette il modello

Stando alla presentazione ufficiale, Gemini 4 Argon punta su tre aree principali:

  • Software engineering: gestione di attività di coding su larga scala, incluse migrazioni di codebase complesse.
  • Knowledge work aziendale: ricerca finanziaria, redazione legale e analisi documentale.
  • Cyber defense: individuazione, validazione e patch autonoma di vulnerabilità critiche.

Il modello introduce un limite di output token dichiarato come il più alto del settore: 1 milione di token, in netto aumento rispetto ai 64K precedenti. Questo dovrebbe consentire ragionamenti più lunghi e articolati in un’unica traiettoria.

Benchmark e applicazioni interne

Google sostiene che Argon raggiunga risultati di riferimento su diversi test. Tra questi, DeepSWE v1.1 con il 77,9%, il Vals Index per l’impatto economico su finanza, coding, legale e fisco, e LVBench per la comprensione di video lunghi con il 91,7%. Viene inoltre citato il primo posto su AutomationBench di Zapier con il 51,3%.

All’interno di Google, il modello sarebbe già utilizzato per ottimizzazioni di algoritmi quantistici, risparmio di memoria nei data center e migrazioni di codice C/C++ verso Rust, inclusi progetti come re2, libgav1 e il kernel Fuchsia Zircon.

Prezzi e disponibilità

Argon verrà lanciato a un prezzo introduttivo di 2 dollari per milione di token in input e 10 dollari per milione di token in output, con input in cache scontati del 95%. Non è ancora chiaro quando avverrà il rilascio completo al pubblico.

Dubbi e verifiche in corso

Dopo l’annuncio, secondo quanto riportato da Bloomberg e ripreso dalla fonte, alcuni dipendenti con conoscenza diretta avrebbero segnalato che il modello fatica su codice di produzione reale ed è debole sul front-end. Si tratta di informazioni riportate, non confermate ufficialmente da Google, che meritano ulteriori verifiche man mano che Argon verrà testato da un numero maggiore di utenti.

In sintesi

Gemini 4 Argon rappresenta il tentativo di Google DeepMind di posizionarsi come riferimento per attività professionali complesse, dalla cybersecurity alla finanza. Il rilascio graduale e le cautele dichiarate suggeriscono però che il modello non sia ancora pronto per un uso indistinto. Restano da chiarire le reali prestazioni su codice di produzione e le tempistiche per l’accesso generale.

Lascia un commento