OpenAI adicionou dois modelos Realtime à sua API. GPT-Realtime-2.1-mini é um mini modelo de raciocínio para voz, com preço semelhante ao gpt-realtime-mini anterior. A OpenAI também reduziu a latência do p95 em pelo menos 25% por meio de cache aprimorado. Ele…
O fornecimento de computação, a energia e a capacidade do data center decidem o quão barato a IA pode funcionar. As mudanças na infraestrutura aparecem nos custos de inferência semanas depois.
Empresas e modelos mencionados nesta história – abra suas páginas e preços ao vivo
Os resumos são agregados apenas para fins informativos – siga o link da fonte para ver a história completa. As entradas de demonstração são ilustrativas.