Receba um e-mail quando o preço combinado deste modelo cair. Nenhuma conta necessária.
Um e-mail por gota. Cancele a inscrição a qualquer momento.
Preço combinado diário (US$/1 milhão) — registrado todos os dias, cria uma tendência ao longo do tempo.
Mix típico de saída para entrada de 3:1, por 1 milhão de tokens
Fonte: litellm
Cargas de trabalho mistas de texto, imagem, áudio e documentos que se beneficiam de um modelo em todas as modalidades.
Referência de implantação do Azure OpenAI para GPT-4o mini; o nome e a região reais da implantação são específicos do cliente.
gpt-4o-mini é um modelo Multimodal da Azure OpenAI (US). HotON.ai o rastreia em $0.15 por 1 milhão de tokens de entrada e $0.60 por 1 milhão de tokens de saída, com uma janela de contexto de token 128K. Sua pontuação de eficiência composta é 89/100 com um $0.001 estimado por tarefa bem-sucedida.
gpt-4o-mini é rastreado em $0.15 por 1 milhão de tokens de entrada e $0.60 por 1 milhão de tokens de saída. Uma carga de trabalho típica de saída para entrada de 3:1 combina aproximadamente $0.49 por 1 milhão de tokens. Os números são dados de demonstração ilustrativos.
Cargas de trabalho mistas de texto, imagem, áudio e documentos que se beneficiam de um modelo em todas as modalidades.
gpt-4o-mini suporta até uma janela de contexto de token 128K – grande o suficiente para documentos longos e conversas estendidas em uma única solicitação.
Dentro do conjunto rastreado HotON.ai, gpt-4o-mini é mais barato que 70% dos modelos no preço de entrada e classifica #201 de 535 em termos de eficiência geral.
Sim – qwen3.5-flash-02-23 é uma opção de custo mais baixo em $0.26 por 1 milhão de tokens de saída, ao mesmo tempo que cobre casos de uso semelhantes de Multimodal. Compare-os lado a lado no HotON.ai.
Pronto para colar em artigos, documentos ou avisos de IA — preços e datas atualizados com os dados em tempo real.
HotON.ai — gpt-4o-mini (Azure OpenAI): $0.15/1M input, $0.60/1M output. https://hoton.ai/pt/models/azure-openai-gpt-4o-miniO preço é real (através do catálogo TestKey, atualizado diariamente). A qualidade (Arena Elo) é real onde o modelo é classificado no LMArena. A eficiência é uma combinação modelada de preço real e contexto.