Reciba un correo electrónico cuando baje el precio combinado de este modelo. No se necesita cuenta.
Un correo electrónico por entrega. Darse de baja en cualquier momento.
Precio combinado diario ($/1 millón): registrado cada día, genera una tendencia con el tiempo.
Mezcla típica de salida a entrada 3:1, por 1 millón de tokens
Fuente: litellm
Cargas de trabajo de generación de texto, chat, resúmenes y contenido de uso general donde la amplia capacidad y el bajo costo son lo más importante.
GPT-OSS 120B en Cerebras es un modelo de razonamiento abierto de producción para chat rápido, herramientas y codificación.
gpt-oss-120b es un modelo Texto de Cerebras (US). HotON.ai lo rastrea en $0.15 por 1 millón de tokens de entrada y $0.60 por 1 millón de tokens de salida, con una ventana contextual de token 131K. Su puntuación de eficiencia compuesta es 89/100 con un $0.001 estimado por tarea exitosa.
gpt-oss-120b se rastrea en $0.15 por 1 millón de tokens de entrada y $0.60 por 1 millón de tokens de salida. Una carga de trabajo típica de salida a entrada de 3:1 se combina aproximadamente con $0.49 por 1 millón de tokens. Las cifras son datos de demostración ilustrativos.
Cargas de trabajo de generación de texto, chat, resúmenes y contenido de uso general donde la amplia capacidad y el bajo costo son lo más importante.
gpt-oss-120b admite hasta una ventana contextual de token 131K, lo suficientemente grande para documentos largos y conversaciones extensas en una sola solicitud.
Dentro del conjunto de seguimiento HotON.ai, gpt-oss-120b es más barato que el % 70 de los modelos en cuanto al precio de entrada y ocupa el puesto #240 de 535 por eficiencia general.
Sí, deepseek-v4-flash es una opción de menor costo en $0.28 por 1 millón de tokens de salida, y al mismo tiempo cubre casos de uso similares de Texto. Compárelos uno al lado del otro en HotON.ai.
Listo para pegar en artículos, artículos o indicaciones de IA: los precios y la fecha se actualizan con los datos en vivo.
HotON.ai — gpt-oss-120b (Cerebras): $0.15/1M input, $0.60/1M output. https://hoton.ai/es/models/cerebras-gpt-oss-120bEl precio es real (a través del catálogo TestKey, actualizado diariamente). La calidad (Arena Elo) es real donde el modelo se clasifica en LMArena. La eficiencia es una combinación modelada de precio real y contexto.