Receba um e-mail quando o preço combinado deste modelo cair. Nenhuma conta necessária.
Um e-mail por gota. Cancele a inscrição a qualquer momento.
Preço combinado diário (US$/1 milhão) — registrado todos os dias, cria uma tendência ao longo do tempo.
Mix típico de saída para entrada de 3:1, por 1 milhão de tokens
Preço em 2026-05-11 · Fonte: nvidia_reference_catalog
Geração de texto de uso geral, bate-papo, resumo e cargas de trabalho de conteúdo onde ampla capacidade e baixo custo são mais importantes.
Llama-3.3-Nemotron-Super-49B-v1.5 é um modelo de raciocínio/bate-papo centrado em inglês, com parâmetros 49B, derivado do Llama-3.3-70B-Instruct da Meta com um contexto de 128K. É pós-treinado para fluxos de trabalho de agente (RAG, chamada de ferramenta) vi...
llama-3.3-nemotron-super-49b-v1.5 é um modelo Texto da NVIDIA (US). HotON.ai o rastreia em $0.10 por 1 milhão de tokens de entrada e $0.40 por 1 milhão de tokens de saída, com uma janela de contexto de token 131K. Sua pontuação de eficiência composta é 89/100 com um $0.000 estimado por tarefa bem-sucedida.
llama-3.3-nemotron-super-49b-v1.5 é rastreado em $0.10 por 1 milhão de tokens de entrada e $0.40 por 1 milhão de tokens de saída. Uma carga de trabalho típica de saída para entrada de 3:1 combina aproximadamente $0.33 por 1 milhão de tokens. Os números são dados de demonstração ilustrativos.
Geração de texto de uso geral, bate-papo, resumo e cargas de trabalho de conteúdo onde ampla capacidade e baixo custo são mais importantes.
llama-3.3-nemotron-super-49b-v1.5 suporta até uma janela de contexto de token 131K – grande o suficiente para documentos longos e conversas estendidas em uma única solicitação.
Dentro do conjunto rastreado HotON.ai, llama-3.3-nemotron-super-49b-v1.5 é mais barato que 79% dos modelos no preço de entrada e classifica #155 de 535 em termos de eficiência geral.
Sim – deepseek/deepseek-v4-flash é uma opção de custo mais baixo em $0.28 por 1 milhão de tokens de saída, ao mesmo tempo que cobre casos de uso semelhantes de Texto. Compare-os lado a lado no HotON.ai.
Pronto para colar em artigos, documentos ou avisos de IA — preços e datas atualizados com os dados em tempo real.
HotON.ai — llama-3.3-nemotron-super-49b-v1.5 (NVIDIA): $0.10/1M input, $0.40/1M output, as of 2026-05-11. https://hoton.ai/pt/models/nvidia-llama-3-3-nemotron-super-49b-v1-5O preço é real (através do catálogo TestKey, atualizado diariamente). A qualidade (Arena Elo) é real onde o modelo é classificado no LMArena. A eficiência é uma combinação modelada de preço real e contexto.