OpenAI a ajouté deux modèles en temps réel à son API. GPT-Realtime-2.1-mini est un mini modèle de raisonnement pour la voix, dont le prix est identique au précédent gpt-realtime-mini. OpenAI a également réduit la latence p95 d'au moins 25 % grâce à une mise en cache améliorée. Il…
L’approvisionnement informatique, l’énergie et la capacité du centre de données déterminent le coût de fonctionnement de l’IA. Les changements d’infrastructure apparaissent dans les coûts d’inférence des semaines plus tard.
Entreprises et modèles mentionnés dans cette histoire — ouvrez leurs pages et prix en direct
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.