Los proveedores de modelos chinos ahora se sitúan muy por debajo de los precios de los buques insignia estadounidenses. Medimos la brecha entre los modelos activos 535 (385 de EE. UU. / 150 de China).
En una combinación típica de salida a entrada de 3:1, los modelos estadounidenses promedian alrededor de $8.35 por 1 millón de tokens, en comparación con aproximadamente $1.44 para los modelos chinos, aproximadamente 5.8× de diferencia. Estas cifras provienen de los precios en vivo de OpenRouter, actualizados diariamente; no son estimaciones.
Los proveedores chinos (DeepSeek, Qwen de Alibaba, Zhipu, Kimi, MiniMax y otros) se inclinan por pesos abiertos y precios agresivos, y combinados con una feroz competencia interna y un enfoque en la eficiencia de la inferencia, hacen que los precios bajen mucho. Los buques insignia estadounidenses cuestan más por su capacidad y ecosistema. Para la misma clase de tarea, el modelo que elija puede cambiar el costo en un orden de magnitud.
Si su carga de trabajo es sensible al precio, los modelos chinos (con entradas tan bajas como $0.010/1M) suelen ser el punto de partida más económico, pero más barato no es automáticamente mejor. Compárelo con sus necesidades de calidad, latencia y cumplimiento. En el siguiente mapa de precio versus eficiencia, arriba y hacia la izquierda se obtiene un mejor valor; El color marca la región.
Cada modelo rastreado está trazado por el precio de los insumos (escala logarítmica) y la eficiencia compuesta. Hacia la parte superior izquierda significa un mejor valor por dólar.
Cada punto es un modelo · color = región · haga clic en un punto para abrirlo.
El precio es real (a través de OpenRouter, actualizado diariamente). Se trata de un análisis de mercado, no de asesoramiento sobre inversiones o adquisiciones.