Получите электронное письмо, когда смешанная цена на эту модель упадет. Никакой учетной записи не требуется.
Одно электронное письмо на каждую каплю. Отпишитесь в любое время.
Дневная смешанная цена ($/1 миллион) — регистрируется каждый день и со временем превращается в тренд.
Типичное соотношение вывода и ввода 3:1 на 1 млн токенов
Цена по состоянию на 2026-05-11 · Источник: nvidia_reference_catalog
Генерация текста общего назначения, чат, обобщение и работа с контентом, где широкие возможности и низкая стоимость имеют наибольшее значение.
Llama-3.3-Nemotron-Super-49B-v1.5 — это англоориентированная модель рассуждений/чата с 49 параметрами, созданная на основе Llama-3.3-70B-Instruct компании Meta с контекстом 128 КБ. Он прошел пост-обучение для агентских рабочих процессов (RAG, вызов инструментов) vi...
llama-3.3-nemotron-super-49b-v1.5 — это модель Текст от NVIDIA (US). HotON.ai отслеживает его на уровне $0.10 на 1 миллион входных токенов и $0.40 на 1 миллион выходных токенов с помощью контекстного окна токена 131K. Его совокупный показатель эффективности составляет 89/100 при расчетном $0.000 на каждую успешную задачу.
llama-3.3-nemotron-super-49b-v1.5 отслеживается по формуле $0.10 на 1 миллион входных токенов и $0.40 на 1 миллион выходных токенов. Типичная рабочая нагрузка вывода-ввода 3:1 составляет примерно $0.33 на 1 млн токенов. Цифры являются иллюстративными демонстрационными данными.
Генерация текста общего назначения, чат, обобщение и работа с контентом, где широкие возможности и низкая стоимость имеют наибольшее значение.
llama-3.3-nemotron-super-49b-v1.5 поддерживает контекстное окно токена 131K — достаточно большое для длинных документов и расширенных разговоров в одном запросе.
В гусеничном наборе HotON.ai модель llama-3.3-nemotron-super-49b-v1.5 дешевле моделей 79% по входной цене и занимает место #155 среди 535 по общей эффективности.
Да, deepseek-v4-flash — это более дешевый вариант $0.28 за 1 миллион выходных токенов, но при этом охватывающий аналогичные сценарии использования Текст. Сравните их на HotON.ai.
Готово для вставки в статьи, документы или подсказки AI — цены и дата обновляются с учетом текущих данных.
HotON.ai — llama-3.3-nemotron-super-49b-v1.5 (NVIDIA): $0.10/1M input, $0.40/1M output, as of 2026-05-11. https://hoton.ai/ru/models/nvidia-llama-3-3-nemotron-super-49b-v1-5Цены реальные (через каталог TestKey, обновляемый ежедневно). Качество (Арена Эло) является реальным там, где модель находится в рейтинге LMArena. Эффективность — это смоделированная совокупность реальной цены и контекста.