Precio combinado diario ($/1 millón): registrado cada día, genera una tendencia con el tiempo.
Mezcla típica de salida a entrada 3:1, por 1 millón de tokens
Precio a partir de 2026-04-28 · Fuente: legacy_model_catalog
Cargas de trabajo de generación de texto, chat, resúmenes y contenido de uso general donde la amplia capacidad y el bajo costo son lo más importante.
Qwen3-30B-A3B-Instruct-2507 is a 30.5B-parameter mixture-of-experts language model from Qwen, with 3.3B active parameters per inference. It operates in non-thinking mode and is designed for high-quality instruction fo...
qwen3-30b-a3b-instruct-2507 es un modelo Texto de Alibaba Cloud · Qwen (CN). HotON.ai lo rastrea en $0.09 por 1 millón de tokens de entrada y $0.30 por 1 millón de tokens de salida, con una ventana contextual de token 262K. Su puntuación de eficiencia compuesta es 90/100 con un $0.000 estimado por tarea exitosa.
qwen3-30b-a3b-instruct-2507 se rastrea en $0.09 por 1 millón de tokens de entrada y $0.30 por 1 millón de tokens de salida. Una carga de trabajo típica de salida a entrada de 3:1 se combina aproximadamente con $0.25 por 1 millón de tokens. Las cifras son datos de demostración ilustrativos.
Cargas de trabajo de generación de texto, chat, resúmenes y contenido de uso general donde la amplia capacidad y el bajo costo son lo más importante.
qwen3-30b-a3b-instruct-2507 admite hasta una ventana contextual de token 262K, lo suficientemente grande para documentos largos y conversaciones extensas en una sola solicitud.
Dentro del conjunto de seguimiento HotON.ai, qwen3-30b-a3b-instruct-2507 es más barato que el % 84 de los modelos en cuanto al precio de entrada y ocupa el puesto #97 de 521 por eficiencia general.
Sí, hunyuan-lite es una opción de menor costo en $0.11 por 1 millón de tokens de salida, y al mismo tiempo cubre casos de uso similares de Texto. Compárelos uno al lado del otro en HotON.ai.
El precio es real (a través del catálogo TestKey, actualizado diariamente). La calidad (Arena Elo) es real donde el modelo se clasifica en LMArena. La velocidad, la disponibilidad y la eficiencia son estimaciones modeladas.