Thursday, 1 October 2026 | Updating Daily AI insight, written for builders

Gemini 4 Argon vs GPT-6.1 Sol vs Claude Sonnet 5.5: tre nuovi modelli AI a confronto

  • Tre grandi modelli di IA sono arrivati in tre giorni: Claude Sonnet 5.5 (Anthropic, 28 settembre 2026), GPT-6.1 Sol (OpenAI, 29 settembre) e Gemini 4 Argon (Google, 30 settembre).
  • Tutti e tre vengono lanciati allo stesso prezzo per gli sviluppatori: $2 per milione di token di input e $10 per milione di token di output. Il prezzo di Argon è introduttivo e sale a $4 / $20 in seguito.
  • La vera differenza è chi può usarli oggi: Sonnet 5.5 è accessibile a tutti, inclusi gli utenti gratuiti di Claude; GPT-6.1 Sol è per i piani ChatGPT a pagamento (in ChatGPT Work e Codex) e l'API; Gemini 4 Argon non è ancora disponibile pubblicamente.
  • Ogni azienda riporta test diversi, quindi non c'è ancora un vincitore equo e unico. Google rivendica i punteggi più alti; OpenAI e Anthropic enfatizzano il costo per attività.

L'ultima settimana di settembre 2026 ha portato un accumulo insolito di lanci. In tre giorni, Anthropic, OpenAI e Google hanno ciascuno rilasciato un nuovo modello — e tutti e tre hanno raggiunto esattamente lo stesso prezzo per gli sviluppatori. Se stai cercando di capire quale conta per te, questo confronto affiancato si attiene a ciò che ogni azienda ha effettivamente pubblicato.

I tre modelli a colpo d'occhio

Gemini 4 Argon GPT-6.1 Sol Claude Sonnet 5.5
Azienda Google DeepMind OpenAI Anthropic
Annunciato 30 settembre 2026 29 settembre 2026 (DevDay) 28 settembre 2026
Posizione Il nuovo modello frontier di Google Modello di fascia media aggiornato, inferiore a GPT-6 Astra Modello di fascia media, inferiore a Claude Opus 5.5
Prezzo API (input/output per 1M token) $2 / $10 introduttivo, quindi $4 / $20 $2 / $10 $2 / $10
Input memorizzato nella cache per 1M token Sconto del 95% sul prezzo di input $0.10 $0.20 (letture dalla cache)
Affermazione distintiva Limite di output di 1M token; 77,9% su DeepSWE v1.1 Risultati vicini ad Astra a un quinto del prezzo di Astra 30%+ più veloce di Sonnet 5, fino al 30% più economico per attività
Accesso gratuito ai consumatori Non annunciato No (piani ChatGPT pagati) Sì, riportato nel piano gratuito di Claude
Disponibile oggi? No — solo collaudatori fidati Sì Sì

Fonti: Google, OpenAI e Anthropic annunci.

Chi può usare ogni modello adesso

Per la maggior parte delle persone questa è la parte che conta, perché un modello che non puoi aprire non serve molto.

Claude Sonnet 5.5: disponibile per tutti

Sonnet 5.5 è attivo nelle app Claude e su ogni principale cloud. Il piano gratuito di Claude include i modelli Sonnet, e secondo le segnalazioni gli utenti gratuiti ottengono Sonnet 5.5, mentre Opus 5.5 rimane sui piani pagati. Dettagli completi: Claude Sonnet 5.5 spiegato.

GPT-6.1 Sol: piani ChatGPT pagati e l'API

OpenAI dice che GPT-6.1 Sol è disponibile per Plus, Pro, Business, Enterprise e Edu utenti in ChatGPT Work e Codex, e per gli sviluppatori come gpt-6.1-sol. OpenAI aggiunge che «non è ancora disponibile in Chat», la schermata regolare di conversazione ChatGPT. Gli utenti gratuiti di ChatGPT non lo ottengono. Non sei sicuro di quale piano ChatGPT ti serve? Vedi ChatGPT Free vs Go vs Plus vs Pro. Per gli annunci DevDay intorno ad esso, leggi il nostro report DevDay.

Gemini 4 Argon: non ancora

Google ha rilasciato Argon solo ai difensori della sicurezza informatica selezionati attraverso il suo Fairwind Program e al suo staff. Dice che l'accesso si amplierà «il prima possibile», iniziando con i clienti API paganti e Google AI Ultra i sottoscrittori, ma non ha fornito una data. Dettagli completi: Gemini 4 Argon spiegato.

Prezzo: gli stessi $2 / $10, con un cavillo

È raro che tre lanci di classe flagship rivali corrispondano sul prezzo. Per gli sviluppatori che pagano per token:

  • Claude Sonnet 5.5 mantiene i $2 / $10 di Sonnet 5, e Anthropic afferma che richiede meno token per attività, rendendolo fino al 30% più economico in pratica.
  • GPT-6.1 Sol mantiene GPT-6 Soli $2 / $10 e dimezza l'input memorizzato a $0,10. La proposta di OpenAI è che corrisponde quasi a GPT-6 Astra — che costa $10 / $50 — a un quinto del prezzo.
  • Gemini 4 Argon parte da $2 / $10 ma solo per un periodo introduttivo di durata non annunciata, poi raddoppia a $4 / $20 — uguale a Claude Opus 5.5.

Il prezzo per token è solo metà della storia: un modello che utilizza meno token, o completa il compito in meno tentativi, può essere più economico anche allo stesso tasso. Sia OpenAI che Anthropic ora pubblicano cifre di costo per attività per esattamente questo motivo. Per stimare una fattura per il tuo utilizzo, prova il Calcolatore dei costi delle API per l'IA o confronta tutti i modelli attuali in database dei modelli AI.

Benchmark: ciò che ogni azienda riporta

Ecco il problema onesto nel confrontare questi tre: nella maggior parte dei casi riportano test diversi, spesso in versioni diverse e con diverse impostazioni di «sforzo». La tabella di seguito elenca i numeri principali di ogni azienda uno accanto all'altro, ma un numero più alto in una colonna non prova che un modello batte un altro.

Area Gemini 4 Argon (Google) GPT-6.1 Sol (OpenAI) Claude Sonnet 5.5 (Anthropic)
Programmazione DeepSWE v1.1: 77,9% (stato dell'arte) DeepSWE v1.1: corrisponde a GPT-6 Astra a ~⅕ del costo; 6,4 punti sopra il migliore di GPT-6 Sol Terminal-Bench 4.0: 70,6%; CursorBench 4.0: 55,5%
Flussi di lavoro aziendali AutomationBench: 51,3% (#1) AutomationBench: 2,2 punti sopra Claude Opus 5.5 a sforzo medio, ~⅓ del costo GDPval-AA v2.1: 1844 (Opus 5.5: 1846)
Utilizzo di un computer — OSWorld 2.0 offline: entro 2,1 punti da Astra a ~⅐ del costo per attività OSWorld 2.1: 80,1%
Documenti, grafici, video LVBench (video lungo): 91,7% GDP.pdf: sopra Opus 5.5 a meno della metà del costo per attività Chartography: 61,6%
Precisione — Risposte con un errore fattuale: 7,7% vs 11,4% per GPT-6 Sol (prompt difficili, basso sforzo) Humanity's Last Exam (con strumenti): 64,5%
Sicurezza CWE-bench v1: 68% (legato al primo) — Lanciato con salvaguardie informatiche di livello Opus

Alcune osservazioni giuste da questi numeri:

  • Programmazione: DeepSWE v1.1 è l'unico test di codifica che sia Google che OpenAI citano. Google attribuisce ad Argon un fermo 77,9%; OpenAI non dà a Sol un numero assoluto, solo che corrisponde a GPT-6 Astra. Fino a quando non compaiono risultati indipendenti, la rivendicazione di Argon è la più forte.
  • Flussi di lavoro aziendali: AutomationBench è l'altro test che sia Google che OpenAI citano. Google dice che Argon è #1 al 51,3%. OpenAI dice che Sol supera Claude Opus 5.5 lì di 2,2 punti. Anthropic non lo riporta per Sonnet 5.5.
  • Sonnet 5.5 vs Opus 5.5: I numeri di Anthropic mostrano che il suo modello di fascia media è quasi in parità con il suo stesso modello top sul lavoro d'ufficio, a metà prezzo.

Tratta ogni cifra qui come marketing fino a quando valutatori esterni come Artificial Analysis o LMArena non pubblicano i loro stessi risultati, il che di solito richiede giorni o settimane dopo un lancio.

Sicurezza: una settimana insolitamente cauta

Tutti e tre i lanci sono arrivati con più discussioni sulla sicurezza del solito:

  • OpenAI ha rilasciato GPT-6.1 Sol invece del più grande GPT-6.1 Astra, che ha trattenuto dopo che i test interni hanno sollevato preoccupazioni per l'inganno e l'agire senza permesso («il nostro rapporto»). OpenAI afferma che Sol mostra un migliore allineamento rispetto a GPT-6 Sol.
  • Google sta lanciando Argon in fasi, aderendo al processo di accesso pre-rilascio volontario del governo degli Stati Uniti e aggiungendo monitor che possono fermare il modello a metà attività.
  • Anthropic ha dato a Sonnet 5.5 le stesse salvaguardie informatiche dei suoi modelli top: le richieste di sicurezza ad alto rischio tornano al precedente Sonnet 5.

Quale dovresti usare?

  • Vuoi qualcosa di gratuito, oggi: Claude Sonnet 5.5 è l'unico dei tre su un piano gratuito. Gli utenti di Gemini mantengono i modelli attuali nell'app Gemini fino all'arrivo di Argon.
  • Paghi già per ChatGPT: prova GPT-6.1 Sol in ChatGPT Work o Codex per codifica, documenti e attività multi-step.
  • Paghi per Google AI Ultra: guarda Argon nell'app Gemini, ma non c'è una data. La nostra guida ai piani Google AI spiega cosa include Ultra ora.
  • Costruisci app: Sonnet 5.5 e GPT-6.1 Sol sono entrambi disponibili a $2 / $10 oggi, quindi testa entrambi sulle tue attività. Argon vale una prova una volta che l'API si apre, ma pianifica il raddoppio del prezzo dopo il periodo introduttivo.
  • Stai scegliendo un chatbot, non un modello: le funzionalità attorno al modello contano tanto quanto il modello stesso — vedi Claude vs ChatGPT.

Domande frequenti

Qual è il miglior modello di IA in questo momento: Gemini 4 Argon, GPT-6.1 Sol o Claude Sonnet 5.5?

Non c'è ancora una risposta unica corretta. Google riporta i punteggi più forti per Argon, ma Argon non è disponibile pubblicamente. Tra i modelli che puoi usare oggi, GPT-6.1 Sol e Claude Sonnet 5.5 costano lo stesso e ogni azienda riporta punti di forza su test diversi.

Gemini 4 Argon, GPT-6.1 Sol e Claude Sonnet 5.5 hanno lo stesso costo?

Al lancio, sì: $2 per milione di token di input e $10 per milione di token di output attraverso l'API di ciascuna azienda. Il prezzo di Argon è introduttivo e aumenta a $4 / $20 successivamente.

Quale dei tre posso usare gratuitamente?

Claude Sonnet 5.5, sul piano gratuito di Claude con limiti di utilizzo. GPT-6.1 Sol richiede un piano ChatGPT a pagamento, e Gemini 4 Argon non ha ancora un rilascio pubblico.

Quando sarà disponibile Gemini 4 Argon?

Google non ha fornito una data. Dice che il lancio inizierà con i clienti API paganti e i sottoscrittori di Google AI Ultra.

GPT-6.1 Sol è migliore di GPT-6 Astra?

No. OpenAI afferma che corrisponde quasi ad Astra nella programmazione, nell'uso del computer e nel lavoro professionale a un quinto del prezzo di Astra, ma Astra continua a ottenere punteggi più alti nei compiti più difficili, come Terminal-Bench Science (68,1%).

Scritto da Mustafa Ihsan

Mustafa Ihsan è il fondatore e redattore di Convly.ai. Ha costruito e mantiene il database dei modelli AI live del sito, il suo indice prestazioni-prezzo e i suoi calcolatori gratuiti per i requisiti VRAM, i costi API e l'economia dell'auto-hosting. Scrive sul pricing dei modelli, sui risultati dei benchmark e sull'hardware necessario per eseguire i modelli AI localmente, e preferisce costantemente i numeri misurati alle affermazioni dei fornitori.

Scroll to Top