Insgesamt 1 Mio. US-Dollar für alle getrackten Versionen dieser Linie.
Typischer 3:1-Output-to-Input-Mix pro 1 Mio. Token
Quelle: litellm
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
OpenAI GPT Realtime 2 is a reasoning realtime voice model for low-latency speech-to-speech interactions and tool use.
gpt-realtime-2 ist ein Text-Modell von OpenAI (US). HotON.ai verfolgt es bei $4.00 pro 1 Mio. Eingabe-Tokens und $16.00 pro 1 Mio. Ausgabe-Tokens mit einem 128K-Token-Kontextfenster. Sein zusammengesetzter Effizienzwert beträgt 82/100 bei einem geschätzten $0.016 pro erfolgreicher Aufgabe.
gpt-realtime-2 wird bei $4.00 pro 1 Mio. Eingabe-Tokens und $16.00 pro 1 Mio. Ausgabe-Tokens verfolgt. Eine typische 3:1-Ausgabe-zu-Eingabe-Arbeitslast ergibt ungefähr $13.00 pro 1 Mio. Token. Bei den Zahlen handelt es sich um illustrative Demodaten.
Universelle Textgenerierung, Chat, Zusammenfassung und Content-Workloads, bei denen umfassende Funktionalität und niedrige Kosten am wichtigsten sind.
gpt-realtime-2 unterstützt bis zu einem 128K-Token-Kontextfenster – groß genug für lange Dokumente und längere Konversationen in einer einzigen Anfrage.
Innerhalb des von HotON.ai erfassten Bestands ist gpt-realtime-2 beim Eingabepreis günstiger als 7% der Modelle und liegt nach Gesamteffizienz auf Platz 485 von 521.
Ja – minimax-m2.5 ist eine kostengünstigere Option bei $0.99 pro 1 Million Ausgabe-Tokens, deckt aber dennoch ähnliche Text-Anwendungsfälle ab. Vergleichen Sie sie nebeneinander auf HotON.ai.
Die Preise sind real (über den TestKey-Katalog, täglich aktualisiert). Qualität (Arena Elo) ist real, wenn das Modell auf der LMArena-Rangliste steht. Geschwindigkeit, Verfügbarkeit und Effizienz sind modellierte Schätzungen.