इस मॉडल की मिश्रित कीमत गिरने पर एक ईमेल प्राप्त करें। किसी खाते की आवश्यकता नहीं.
प्रति बूंद एक ईमेल. किसी भी समय सदस्यता समाप्त करें.
दैनिक मिश्रित मूल्य ($/1M) - प्रत्येक दिन दर्ज किया जाता है, समय के साथ एक प्रवृत्ति बन जाती है।
विशिष्ट 3:1 आउटपुट-टू-इनपुट मिश्रण, प्रति 1एम टोकन
कीमत 2026-05-11 के अनुसार · स्रोत: nvidia_reference_catalog
सामान्य प्रयोजन पाठ निर्माण, चैट, सारांश और सामग्री कार्यभार जहां व्यापक क्षमता और कम लागत सबसे अधिक मायने रखती है।
Llama-3.1-Nemotron-Ultra-253B-v1 एक बड़ा भाषा मॉडल (LLM) है जो उन्नत तर्क, मानव-इंटरैक्टिव चैट, पुनर्प्राप्ति-संवर्धित पीढ़ी (RAG), और टूल-कॉलिंग कार्यों के लिए अनुकूलित है। मेटा के लामा-3.1-40 से व्युत्पन्न...
llama-3.1-nemotron-ultra-253b-v1 NVIDIA (US) का मूलपाठ मॉडल है। HotON.ai इसे 131K-टोकन संदर्भ विंडो के साथ, $0.60 प्रति 1M इनपुट टोकन और $1.80 प्रति 1M आउटपुट टोकन पर ट्रैक करता है। प्रति सफल कार्य के लिए अनुमानित $0.002 पर इसका समग्र दक्षता स्कोर 89/100 है।
llama-3.1-nemotron-ultra-253b-v1 को $0.60 प्रति 1M इनपुट टोकन और $1.80 प्रति 1M आउटपुट टोकन पर ट्रैक किया जाता है। एक सामान्य 3:1 आउटपुट-टू-इनपुट कार्यभार लगभग 1M टोकन पर $1.50 में मिश्रित होता है। आंकड़े उदाहरणात्मक डेमो डेटा हैं।
सामान्य प्रयोजन पाठ निर्माण, चैट, सारांश और सामग्री कार्यभार जहां व्यापक क्षमता और कम लागत सबसे अधिक मायने रखती है।
llama-3.1-nemotron-ultra-253b-v1 131K-टोकन संदर्भ विंडो तक का समर्थन करता है - एक ही अनुरोध में लंबे दस्तावेज़ों और विस्तारित वार्तालापों के लिए पर्याप्त बड़ा।
HotON.ai ट्रैक किए गए सेट के भीतर, llama-3.1-nemotron-ultra-253b-v1 इनपुट मूल्य पर 40% मॉडलों से सस्ता है और समग्र दक्षता के आधार पर 535 के #179 रैंक पर है।
हाँ - minimax-m2.7 $1.20 प्रति 1M आउटपुट टोकन पर एक कम लागत वाला विकल्प है, जबकि अभी भी समान मूलपाठ उपयोग के मामलों को कवर करता है। HotON.ai पर उनकी साथ-साथ तुलना करें।
लेखों, दस्तावेज़ों या एआई संकेतों में चिपकाने के लिए तैयार - कीमतें और तारीख लाइव डेटा के साथ ताज़ा हो जाती हैं।
HotON.ai — llama-3.1-nemotron-ultra-253b-v1 (NVIDIA): $0.60/1M input, $1.80/1M output, as of 2026-05-11. https://hoton.ai/hi/models/nvidia-llama-3-1-nemotron-ultra-253b-v1मूल्य निर्धारण वास्तविक है (TestKey कैटलॉग के माध्यम से, दैनिक अद्यतन)। गुणवत्ता (एरिना एलो) वास्तविक है जहां मॉडल को LMArena पर रैंक किया गया है। दक्षता वास्तविक कीमत और संदर्भ का एक मॉडलीकृत संयोजन है।