I fornitori modello cinesi ora si collocano ben al di sotto delle ammiraglie statunitensi in termini di prezzo. Abbiamo misurato il divario tra i modelli live 535 (US 385 / Cina 150).
In un tipico rapporto output-to-input 3:1, i modelli statunitensi hanno una media di circa $8.35 per 1 milione di token rispetto a circa $1.44 per i modelli cinesi, a parte circa 5.8×. Queste cifre provengono dai prezzi in tempo reale di OpenRouter, aggiornati quotidianamente; non sono stime.
I fornitori cinesi (DeepSeek, Qwen di Alibaba, Zhipu, Kimi, MiniMax e altri) si affidano a pesi aperti e prezzi aggressivi e, combinati con una feroce concorrenza interna e un focus sull’efficienza dell’inferenza, spingono i prezzi molto in basso. Le ammiraglie statunitensi costano di più in termini di capacità ed ecosistema. Per la stessa classe di attività, il modello scelto può modificare i costi di un ordine di grandezza.
Se il tuo carico di lavoro è sensibile al prezzo, i modelli cinesi (input fino a $0.010/1M) sono spesso il punto di partenza più economico, ma più economico non è automaticamente migliore. Valutalo rispetto ai tuoi standard di qualità, latenza e esigenze di conformità. Nella mappa prezzo-efficienza riportata di seguito, in alto a sinistra si ottiene il valore migliore; il colore segna la regione.
Ogni modello tracciato è tracciato in base al prezzo degli input (scala logaritmica) e all'efficienza composita. Verso l'alto a sinistra significa un migliore valore per dollaro.
Ogni punto è un modello · colore = regione · fare clic su un punto per aprirlo.
Il prezzo è reale (tramite OpenRouter, aggiornato quotidianamente). Questa è un'analisi di mercato, non una consulenza sugli investimenti o sugli appalti.