Erhalten Sie eine E-Mail, wenn der Mischpreis dieses Modells sinkt. Kein Konto erforderlich.
Eine E-Mail pro Drop. Abmelden jederzeit möglich.
Täglicher gemischter Preis ($/1 Mio.) – wird jeden Tag aufgezeichnet und bildet im Laufe der Zeit einen Trend.
Typischer 3:1-Output-to-Input-Mix pro 1 Mio. Token
Preis ab 2026-04-28 · Quelle: legacy_model_catalog
Komplexe Überlegungen, Analysen, Planungen und mehrstufige Problemlösungen, bei denen die Qualität der Antworten wichtiger ist als die reinen Kosten.
Qwen3-VL-8B-TH ist die Reasoning-optimierte Variante des Qwen3-VL-8B multimodalen Modells, das für fortgeschrittene visuelle und textuelle Reasoning über komplexe Szenen, Dokumente und zeitliche Sequenzen konzipiert ist. Es integriert e...
qwen3-vl-8b-thinking ist ein Argumentation-Modell von Alibaba Cloud · Qwen (CN). HotON.ai verfolgt es bei $0.12 pro 1 Mio. Eingabe-Tokens und $1.37 pro 1 Mio. Ausgabe-Tokens mit einem 131K-Token-Kontextfenster. Sein zusammengesetzter Effizienzwert beträgt 89/100 bei einem geschätzten $0.001 pro erfolgreicher Aufgabe.
qwen3-vl-8b-thinking wird bei $0.12 pro 1 Mio. Eingabe-Tokens und $1.37 pro 1 Mio. Ausgabe-Tokens verfolgt. Eine typische 3:1-Ausgabe-zu-Eingabe-Arbeitslast ergibt ungefähr $1.06 pro 1 Mio. Token. Bei den Zahlen handelt es sich um illustrative Demodaten.
Komplexe Überlegungen, Analysen, Planungen und mehrstufige Problemlösungen, bei denen die Qualität der Antworten wichtiger ist als die reinen Kosten.
qwen3-vl-8b-thinking unterstützt bis zu einem 131K-Token-Kontextfenster – groß genug für lange Dokumente und längere Konversationen in einer einzigen Anfrage.
Innerhalb des von HotON.ai erfassten Bestands ist qwen3-vl-8b-thinking beim Eingabepreis günstiger als 77% der Modelle und liegt nach Gesamteffizienz auf Platz 126 von 535.
Ja – grok-4-1-fast-non-reasoning ist eine kostengünstigere Option bei $0.50 pro 1 Million Ausgabe-Tokens, deckt aber dennoch ähnliche Argumentation-Anwendungsfälle ab. Vergleichen Sie sie nebeneinander auf HotON.ai.
Bereit zum Einfügen in Artikel, Papiere oder KI-Eingabeaufforderungen – Preise und Datum werden mit den Live-Daten aktualisiert.
HotON.ai — qwen3-vl-8b-thinking (Alibaba Cloud · Qwen): $0.12/1M input, $1.37/1M output, as of 2026-04-28. https://hoton.ai/de/models/qwen-qwen3-vl-8b-thinkingDie Preise sind real (über den TestKey-Katalog, täglich aktualisiert). Qualität (Arena Elo) ist real, wenn das Modell auf der LMArena-Rangliste steht. Effizienz ist eine modellierte Kombination aus realem Preis und Kontext.