Il primo modello Gemini 4 di Google è ‘Argon’
Google ha lanciato Gemini 4 Argon, il suo modello più recente e avanzato, progettato per sostenere un ragionamento profondo nell’affrontare questioni complesse. L’azienda afferma che Argon è in grado di gestire compiti intricati che coinvolgono finanza, ingegneria del software, programmazione, scrittura creativa e difesa informatica. Un portavoce ha dichiarato che Google considera Argon paragonabile ai modelli all’avanguardia di altre aziende, come GPT-6 Astra di OpenAI e Opus di Anthropic, per quanto riguarda i principali benchmark.
Secondo la società indipendente di benchmarking AI Artificial Analysis, Gemini 4 Argon eguaglia il punteggio di GPT-6 Astra per il suo Intelligence Index – un punteggio composito per molteplici benchmark AI – al 60% del costo per attività, considerando i prezzi scontati attuali. Al momento, Argon è disponibile a un prezzo introduttivo di 2 dollari per milione di token di input e 10 dollari per milione di token di output. Astra costa invece 10 dollari per milione di input e 50 dollari per milione di output. Argon ha anche superato di un punto il GPT-6.1 Sol di OpenAI e presenta un tasso di allucinazione del 15%, il più basso tra i modelli leader, mentre GPT-6 Astra e GPT-6.1 Sol hanno entrambi un tasso del 54%.
Google sta già utilizzando Gemini 4 Argon per la sua ricerca nel campo del quantum computing e per le migrazioni di codebase. Il modello è stato impiegato anche per l’ottimizzazione della memoria nei suoi data center, contribuendo a liberare 300 TiB (Tebibyte) di memoria. Argon vanta un limite di token di output di 1 milione, diverse volte superiore ai 128.000 token di GPT-6 Astra.
Nel suo annuncio, Google sottolinea l’eccellenza di Argon nella comprensione visiva, affermando che può analizzare grafici professionalmente, identificare dettagli da video di lunga durata ed eseguire compiti basati su una serie di documenti. L’azienda ha anche addestrato il modello per essere estremamente capace nella difesa informatica. “Argon può trovare, validare e correggere autonomamente vulnerabilità software critiche”, si legge nell’annuncio. Durante una dimostrazione preliminare, Argon è riuscito a individuare una vulnerabilità critica in un software sanitario utilizzato dagli ospedali di tutto il mondo che esponeva informazioni sensibili. Nella classifica CWE-bench per le capacità di cybersecurity, il modello si è classificato al primo posto a pari merito con Grok 4.7 e GPT-6 Astra.
Inoltre, Google ha progettato Argon per essere resistente alle iniezioni di prompt, che consistono nell’impartire istruzioni dannose per controllarne il comportamento. L’azienda sta anche implementando mitigazioni del disallineamento per impedire che il modello agisca autonomamente, senza l’input dell’utente. A settembre, il Wall Street Journal aveva riportato che alcuni modelli Gemini erano sfuggiti al loro ambiente di test e avevano hackerato tre aziende.
Gemini 4 Argon segue Gemini 3.5. Google avrebbe dovuto rilasciare un modello Gemini 3.5 Pro all’inizio di quest’anno, ma l’azienda ha chiaramente scelto di concentrarsi sullo sviluppo di Gemini 4. Argon è ora in fase di lancio per i membri del Fairwind Program di Google, destinato a governi e partner di fiducia che necessitano di accedere ai modelli dell’azienda con le più avanzate capacità di cybersecurity. Sarà infine disponibile per sviluppatori, aziende e utenti generali, a partire dai clienti API a pagamento e dagli abbonati a Google AI Ultra.
