OpenAI agregó dos modelos en tiempo real a su API. GPT-Realtime-2.1-mini es un mini modelo de razonamiento para voz, con un precio similar al del anterior gpt-realtime-mini. OpenAI también redujo la latencia de p95 en al menos un 25% mediante un almacenamiento en caché mejorado. Él…
El suministro de computación, la energía y la capacidad de los centros de datos deciden qué tan barato puede funcionar la IA. Los cambios en la infraestructura aparecen en los costos de inferencia semanas después.
Empresas y modelos mencionados en esta historia: abra sus páginas y vea los precios en vivo
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.