OpenAI đã thêm hai mô hình Thời gian thực vào API của nó. GPT-Realtime-2.1-mini là một mô hình suy luận nhỏ cho giọng nói, có giá tương đương với gpt-realtime-mini trước đó. OpenAI cũng giảm độ trễ p95 ít nhất 25% thông qua bộ nhớ đệm được cải thiện. Anh ta…
Tính toán nguồn cung, năng lượng và công suất của trung tâm dữ liệu quyết định AI có thể vận hành với chi phí rẻ như thế nào. Sự thay đổi cơ sở hạ tầng xuất hiện trong chi phí suy luận vài tuần sau đó.
Các công ty và mô hình được đề cập trong câu chuyện này — hãy mở trang của họ và xem giá trực tiếp
Các bản tóm tắt chỉ được tổng hợp để cung cấp thông tin - hãy nhấp vào liên kết nguồn để xem toàn bộ câu chuyện. Các mục demo có tính minh họa.