OpenAI hat seiner API zwei Echtzeitmodelle hinzugefügt. GPT-Realtime-2.1-mini ist ein Mini-Realtime-Modell für Sprache, preislich wie das frühere gpt-realtime-mini. OpenAI reduzierte außerdem die p95-Latenz durch verbessertes Caching um mindestens 25 %. Er…
Rechenleistung, Energie und Rechenzentrumskapazität entscheiden darüber, wie kostengünstig KI betrieben werden kann. Infrastrukturverschiebungen zeigen sich Wochen später in den Inferenzkosten.
In dieser Geschichte erwähnte Unternehmen und Modelle – öffnen Sie ihre Seiten und sehen Sie die aktuellen Preise
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.