Il nuovo scenario competitivo nell’intelligenza artificiale per le imprese

Dalla fine del 2025 la competizione tra i principali fornitori di intelligenza artificiale si è spostata dal semplice confronto di potenza a una vera guerra dei prezzi. OpenAI, dopo un inizio d’anno sfavorevole, ha introdotto una serie di modelli a costi ridotti che gli hanno permesso di recuperare terreno su Anthropic, che fino a poco tempo prima dominava la spesa combinata delle aziende.

Questa dinamica influisce direttamente sui ricavi unitari dei due gruppi, proprio mentre entrambi aumentano gli investimenti in infrastrutture di data center e valutano la possibilità di accedere ai mercati azionari.

Dati di OpenRouter: l’evoluzione della quota di spesa

OpenRouter, piattaforma che aggrega modelli di diversi fornitori, ha pubblicato un’analisi basata su circa 120 mila imprese, tra startup AI‑centric, aziende tecnologiche e grandi corporation. I dati, citati dal Wall Street Journal, mostrano che all’inizio del 2026 Anthropic assorbiva tre quarti della spesa totale destinata ai due concorrenti. A settembre la situazione si è riequilibrata.

Nel bollettino del 22 settembre OpenRouter ha precisato che nella settimana iniziata il 7 settembre OpenAI ha superato di poco il 50 % della spesa attribuita ai due gruppi. Nella settimana del 14 settembre OpenAI ha raggiunto il 78 % dei token consumati nel confronto con Anthropic, dimostrando che i volumi di utilizzo non sempre si traducono in ricavi proporzionali, data la crescita dei modelli a basso costo.

Strategia di prezzo di OpenAI

La svolta commerciale è arrivata con la famiglia GPT‑5.6, presentata nell’estate 2026. Il 30 luglio OpenAI ha tagliato dell’80 % il prezzo di Luna e del 20 % quello di Terra. Dopo la riduzione, un milione di token in ingresso su Luna costava 0,20 $ rispetto a 1 $ prima dell’intervento; i token in uscita erano scesi a 1,20 $.

Settembre ha visto l’introduzione di GPT‑6 Astra, GPT‑6 Sol e Luna, seguiti il 29 settembre dal modello GPT‑6.1 Sol. Nella lista API di ottobre i prezzi di listino sono i seguenti:

Si tratta di prezzi di listino; la spesa effettiva dipende dal volume, dalla quantità di dati memorizzati nella cache e dalle funzionalità aggiuntive richieste.

Risposta di Anthropic: nuovi modelli e ulteriori sconti

Anthropic non è rimasto inattivo. Il 1 settembre ha lanciato Claude Fable 5.1, promettendo un risparmio medio del 25 % nei carichi di lavoro tipici grazie a tariffe ridotte per la lettura dalla cache. Il 22 settembre è arrivato Claude Opus 5.5, proposto a 4 $ per milione di token in ingresso e 20 $ per quelli in uscita. Sei giorni dopo Sonnet 5.5 ha ampliato l’offerta a 2 $ in ingresso e 10 $ in uscita.

L’ultimo intervento, il 7 ottobre, è stato Claude Haiku 5.5, pensato per attività ripetitive: parte da 0,10 $ in ingresso e 0,50 $ in uscita per richieste entro 100 000 token; per richieste più lunghe le tariffe salgono. Anthropic stima che il nuovo modello costi mediamente il 75 % in meno rispetto a Haiku 4.5 e ha dimezzato il prezzo delle letture dalla cache di Sonnet 5.5.

In sintesi, i due fornitori convergono verso prezzi molto bassi per i compiti meno complessi, mantenendo allo stesso tempo prodotti premium per le esigenze più sofisticate.

Testimonianze aziendali: il peso delle scelte operative

Le testimonianze raccolte dal Wall Street Journal mostrano come le decisioni di pricing influenzino le strategie di utilizzo. David Zhu, cofondatore e CEO della startup commerciale Reevo, ha dichiarato che l’azienda sta spostando parte del proprio utilizzo da Anthropic a OpenAI per ridurre i costi e non dipendere da un unico fornitore, senza escludere future modifiche.

David Hsu, fondatore della piattaforma di sviluppo Retool, attribuisce il passaggio a OpenAI ai modelli GPT‑5.6, stimando un risparmio circa del 20 % rispetto all’impiego dei modelli Anthropic. L’azienda avverte però che il vantaggio può invertire segno in presenza di compiti più complessi, di un numero maggiore di passaggi o di tassi di errore diversi.

Anthropic conserva comunque un forte richiamo. Michael Szklarski, cofondatore di ReadyM, ha indicato Fable 5.1 come scelta preferita per lavori particolarmente impegnativi, pur volendo discutere modalità per contenere i costi.

Un ulteriore aspetto riguarda la conservazione dei dati: Claude Fable 5 prevede la memorizzazione per 30 giorni, finalizzata ai controlli di sicurezza. Alcuni clienti, come Retool, hanno rinunciato all’uso di Fable per evitare obblighi contrattuali di cancellazione dei dati, evidenziando che la scelta del modello dipende anche da requisiti di localizzazione e conservazione dei dati, soprattutto nei settori regolamentati.

Il ruolo dei modelli open‑source e cinesi

OpenRouter ha rilevato che a settembre i modelli con pesi aperti hanno superato il 60 % dei token utilizzati sulla piattaforma, mentre i laboratori cinesi (DeepSeek, Moonshot AI, Z.ai) hanno raggiunto il 69 % del volume nella settimana esaminata. Tuttavia, nella stessa settimana i modelli a pesi chiusi rappresentavano ancora il 73 % della spesa su OpenRouter, dimostrando una netta differenza tra utilizzo e fatturato.

Questo scenario descrive un mercato segmentato: pochi modelli costosi per operazioni avanzate e una ampia gamma di strumenti più economici per grandi quantità di richieste di routine.

Indicazioni dal Ramp AI Index

Il rapporto del 9 settembre del Ramp AI Index, curato dall’economista Ara Kharazian, evidenzia che in agosto il 43,8 % delle aziende statunitensi osservate pagava servizi Anthropic, contro il 39,8 % per OpenAI. Il dato misura la diffusione tra i clienti, non la quota di spesa; inoltre una stessa impresa può acquistare da entrambi i fornitori.

Il rapporto segnala anche una diminuzione del 41