OpenAI ha aggiunto due modelli Realtime alla sua API. GPT-Realtime-2.1-mini è un mini modello di ragionamento per voce, con il prezzo simile al precedente gpt-realtime-mini. OpenAI ha inoltre ridotto la latenza p95 di almeno il 25% attraverso una migliore memorizzazione nella cache. Lui…
L’offerta di elaborazione, l’energia e la capacità dei data center determinano quanto a buon mercato può funzionare l’intelligenza artificiale. I cambiamenti infrastrutturali si manifestano nei costi di inferenza settimane dopo.
Aziende e modelli menzionati in questa storia: apri le loro pagine e scopri i prezzi
I riepiloghi sono aggregati solo a scopo informativo: segui il collegamento alla fonte per la storia completa. Le voci demo sono illustrative.