Aggiornamento dal libro
Il mercato: modelli, agenti, strumenti e prezzi
Quali modelli di base esistono oggi, quali soluzioni agentiche offrono i grandi attori, cosa costano gli strumenti per chi lavora.
Il libro racconta chi sono i laboratori che contano e che cosa ciascuno ha scelto di essere. Quella parte non invecchia, e sta su carta. Qui c'è l'altra metà: quale modello è in cima oggi, quanto costano gli strumenti, e che cosa è cambiato dall'ultima volta.
Chi c'è, e con che cosa
Accanto a ogni modello c'è la data del suo rilascio: dice da sola quanto è fresca la riga.
| Chi | In cima oggi | Rilascio | Pesi |
|---|---|---|---|
| OpenAI | GPT-6 Astra. Sul piano standard non è ancora nella chat: si incontra dentro gli strumenti di lavoro e di sviluppo, mentre la chat resta a GPT-5.6, nelle varianti Sol, Terra e Luna | 3 settembre 2026 | chiusi |
| Anthropic | Claude Fable 5.1. Lo stesso giorno esce Mythos 5.1, che però non è sui piani: l'accesso è riservato a partner verificati | 1 settembre 2026 | chiusi |
| Google DeepMind | Gemini 3.8 Flash, terzo aggiornamento Flash in tre mesi. La linea Pro è ferma a 3.1, del 19 febbraio | 2 settembre 2026 | chiusi |
| SpaceXAI | Grok 4.6. L'azienda si chiamava xAI: il nome è cambiato a luglio 2026, il modello no | 12 agosto 2026 | chiusi |
| Meta | Muse Spark 1.3 a pesi chiusi. Muse Glimmer, 30 miliardi di parametri, pesi aperti in licenza Apache 2.0: è un modello minore, distillato da quello di punta. La vecchia famiglia Llama è ferma a Llama 4, aprile 2025 | 2 set. e 10 ago. 2026 | chiusi e aperti |
| DeepSeek | V4.1-Flash, licenza MIT: 552 miliardi di parametri in tutto, da 8 a 16 attivi per richiesta. Dal 14 settembre le chiamate dirette a V4-Pro rispondono con questo, e al prezzo del piccolo | 10 settembre 2026 | aperti |
| Moonshot AI | Kimi K3, 2,8 trilioni di parametri: il primo modello aperto di questa taglia | luglio 2026 | aperti |
| Alibaba | Qwen3.8-27B, licenza Apache 2.0 | 14 agosto 2026 | aperti |
| Mistral | Mistral Medium 3.5 | 22 maggio 2026 | aperti |
| Microsoft | MAI-Thinking-1, ancora in anteprima. Sui prodotti usa soprattutto modelli di terzi | — | chiusi |
| Apple | terza generazione dei modelli di sistema, costruita con Google: il più capace dei cinque gira nel cloud, non sul telefono | 8 giugno 2026 | chiusi |
Due righe di questa tabella smentiscono qualcosa che il libro dà per assodato, ed è giusto dirlo. Meta non è più solo il campione dei pesi aperti: la famiglia Muse nasce chiusa, la usi dentro le app dell'azienda e attraverso l'interfaccia di programmazione, e di aperto Meta pubblica un modello minore. E Apple tiene la sua scelta sul calcolo locale per i modelli piccoli, ma quello grande lo ha costruito insieme a Google e lo fa girare su hardware altrui.
Cosa costa, per chi lavora
Abbonamenti individuali, prezzo al mese per un utente in Italia.
| Chi | Gratuito | Economico | Standard | Professionale |
|---|---|---|---|---|
| OpenAI | 0 € | 8 € | 23 € | da 103 € |
| Anthropic | 0 € | — | 18 € | 90 e 180 € |
| 0 € | 4,99 € | 21,99 € | 99,99 e 219,99 € | |
| Microsoft | 0 € | 10 € | 22 € | — |
| Mistral | 0 € | — | 17,99 € | — |
| SpaceXAI | 0 € | — | ≈ 26 € | ≈ 87 € |
Le cifre di SpaceXAI sono le uniche convertite: quel fornitore pubblica solo in dollari (30 e 100 $). Conversione al tasso di riferimento della Banca Centrale Europea del 13 agosto 2026, 1 euro = 1,1534 dollari, al netto di IVA e di eventuali maggiorazioni di listino applicate fuori dagli Stati Uniti. Tutti gli altri prezzi sono quelli esposti dal fornitore in euro.
Quattro cose da sapere prima di leggere la tabella in orizzontale. La prima: dal 24 agosto la pubblicità è accesa, in 31 mercati europei, Italia compresa. La vedono il piano gratuito di OpenAI e quello economico; standard, professionale e aziendale no. Ad agosto qui c'era scritto che il piano economico dichiarava di poterla includere: adesso la include, e il gratuito con lui. Cambia il rapporto fra chi scrive nella chat e chi risponde.
La seconda: l'IVA non è trattata allo stesso modo. Mistral espone prezzi con l'imposta già dentro, Anthropic la aggiunge al pagamento. Fra due cifre vicine la differenza reale può essere di un quinto.
La terza: le colonne non vendono la stessa cosa. Microsoft mette l'IA dentro un abbonamento che comprende anche Word, Excel e lo spazio di archiviazione, e solo il piano da 22 euro dà accesso agli agenti.
La quarta: la fascia professionale esiste solo dove il fornitore ha qualcosa da vendere a chi consuma molto. Dove trovi un trattino, quel gradino non c'è.
Le classifiche: come si leggono
Quando esce un modello nuovo, la prima cosa che circola è la sua posizione in classifica. Vale la pena sapere come quel numero viene fuori.
La classifica più citata è quella dell'Arena, l'ex LMArena. Non è un test: è un torneo. Una persona scrive una domanda, riceve due risposte da due modelli di cui non conosce il nome, e sceglie quella che preferisce. Da milioni di confronti alla cieca esce un punteggio di tipo Elo, lo stesso sistema con cui si classificano i giocatori di scacchi.
Questo spiega che cosa la classifica misura davvero: la preferenza media di chi vota, su domande qualsiasi. È un'informazione buona, ed è anche l'unica raccolta su larga scala da esseri umani invece che da un test automatico. Ma tre cose non le dice.
| Non dice | come il modello se la cava sul tuo lavoro: chi vota fa domande generiche, tu no. |
| Non dice | se ha ragione: chi vota sceglie la risposta che preferisce, e la migliore da leggere non è sempre quella corretta. È il meccanismo che la sezione 7.2 chiama sicofanzia. |
| Non dice | nulla sul costo: in classifica un modello che costa venti volte un altro sta una riga sopra. |
Per questo l'Arena pubblica classifiche separate per tipo di compito, e i primi posti sono spesso diversi. Al 18 settembre 2026: in cima alla classifica di conversazione c'è Claude Fable 5, in quella sugli agenti Claude Fable 5.1, in quella sullo sviluppo web GPT-6 Astra. Cinque settimane prima gli agenti e lo sviluppo web erano tutti e due di Claude Opus 5: due primi posti su tre hanno cambiato riga, e uno ha cambiato fornitore. Guarda la classifica del compito che ti riguarda, non quella generale.
Classifica aggiornata su arena.ai →
Che cosa è cambiato
18 settembre 2026 · revisione
L'archivio dei pesi aperti ha un proprietario. Il 3 settembre Nvidia ha annunciato l'acquisto di Hugging Face per 12,93 miliardi di dollari. Hugging Face è il posto da cui si scaricano i pesi dei modelli aperti di questa tabella: Kimi K3, Muse Glimmer, Qwen e V4.1-Flash stanno tutti lì. Nvidia scrive che la piattaforma resta aperta all'intero ecosistema e che nessuno sarà obbligato a usare hardware suo. Resta una dichiarazione: la colonna dei pesi aperti, qui sopra, dipende adesso anche dalla promessa di chi vende le schede.
Quattro rilasci in tre giorni, e il primato sullo sviluppo web cambia mano. Fra l'1 e il 3 settembre escono Claude Fable 5.1, Gemini 3.8 Flash, Muse Spark 1.3 e GPT-6 Astra. Sullo sviluppo web l'Arena mette adesso GPT-6 Astra davanti a tutti, dove ad agosto c'era Opus 5. Google, intanto, aggiorna la linea Flash per la terza volta in tre mesi e lascia la Pro dov'era a febbraio: sette mesi.
DeepSeek manda in pensione il modello di punta sostituendolo con uno più piccolo. V4.1-Flash esce il 10 settembre con pesi scaricabili in licenza MIT e costa circa un terzo di V4-Pro. Dal 14 settembre le chiamate all'interfaccia di programmazione indirizzate a V4-Pro ricevono la risposta del piccolo, e la tariffa del piccolo, finché non esce una V4.1-Pro. Il modello grande resta scaricabile; smette di essere quello che risponde.
14 agosto 2026 · prima pubblicazione
Tre movimenti contano più degli altri, e nessuno riguarda un punteggio.
Meta ha smesso di essere solo aperta. Da aprile pubblica la famiglia Muse a pesi chiusi, dentro le proprie app e attraverso l'interfaccia di programmazione. Il 10 agosto ha aperto un solo modello della famiglia, Muse Glimmer, distillato da quello di punta e pubblicato con licenza Apache 2.0. Chi aveva costruito sull'idea che da Meta arrivi sempre un modello scaricabile deve rifare il conto.
Il vertice di Google non si muove da febbraio. Escono modelli Flash sempre più economici - 3.7 il 13 agosto, a metà prezzo del 3.6 di tre settimane prima - mentre la linea Pro resta a 3.1. Il prezzo scende molto più in fretta di quanto salga la capacità, ed è una tendenza che vale oltre Google.
La taglia dei modelli aperti ha raggiunto quella dei chiusi. Kimi K3, di Moonshot AI, esce a luglio con 2,8 trilioni di parametri e pesi scaricabili: è il primo modello aperto di questa classe. L'azienda stessa dichiara di stare dietro ai modelli di punta chiusi, il che rende la dichiarazione più credibile, non meno.
Come si legge un modello che non conosci
Sono le quattro domande del capitolo 3, nell'ordine in cui conviene farsele.
- Cosa sa fare sul tuo compito. Tieni da parte tre compiti tuoi di cui conosci la risposta giusta, e falli rifare a ogni modello nuovo. In mezz'ora sai quello che nessuna classifica ti dice.
- Quanto contesto regge davvero. La finestra dichiarata è la capienza, non la tenuta: l'accuratezza cala molto prima del limite.
- Quanto costa per token, in entrata e in uscita, e quanto costa meno con la cache. È il numero che decide se un'idea sta in piedi moltiplicata per il volume vero.
- Con quale licenza esce. Decide se puoi portarti il modello sui tuoi server, e quindi se qualcuno può spegnertelo.
Fonti
- Listini ufficiali di OpenAI, Anthropic, Google, Microsoft, Mistral e SpaceXAI, pagine consultate il 14 agosto 2026 da un collegamento italiano.
- Tasso di cambio: Banca Centrale Europea, tassi di riferimento dell'euro, valore del 13 agosto 2026.
- Comunicati di rilascio dei rispettivi fornitori per ogni modello in tabella, consultati il 14 agosto 2026. Per Muse Glimmer: research.meta.ai, 10 agosto 2026, e model card su huggingface.co/meta-models/Muse-Glimmer-30B.
- Arena, classifiche pubbliche, consultate il 14 agosto 2026 e di nuovo il 18 settembre 2026.
- Rilasci di settembre 2026: Anthropic, Claude Fable 5.1 e Mythos 5.1, 1 settembre; Google, Gemini 3.8 Flash, 2 settembre; Meta, Muse Spark 1.3, research.meta.ai, 2 settembre; OpenAI, GPT-6 Astra, 3 settembre; DeepSeek, V4.1-Flash e model card su Hugging Face, 10 settembre; Alibaba, Qwen3.8-27B, 14 agosto. Consultati il 18 settembre 2026. La distribuzione di GPT-6 Astra è avvenuta a scaglioni fra il 3 e il 9 settembre, e le fonti datano il rilascio in modo diverso: qui vale l'annuncio.
- Nvidia, annuncio dell'acquisizione di Hugging Face, blogs.nvidia.com, 3 settembre 2026. L'importo, 12.930.300.000 dollari, è quello scritto nell'annuncio.
- Pubblicità su ChatGPT in Europa: stampa internazionale del 21 agosto 2026 per la data di partenza, i 31 mercati e i piani interessati. Consultata il 18 settembre 2026.
- Dove una data manca, il fornitore non pubblica un rilascio puntuale per quella famiglia.