OpenAI phản ánh kỷ lục ARC-AGI-3 của Anthropic: GPT-5.6 Sol đạt 38,3%, nhưng chỉ với các tính năng API của riêng nó thay vì thiết lập thử nghiệm chính thức, trong đó mô hình đạt 7,8%. ARC Prize tuyên bố môi trường thử nghiệm của mình…
Các mô hình mới thiết lập lại giới hạn về năng lực và hiệu suất giá cả. Các nhóm đánh giá lại những gì cần xây dựng bất cứ khi nào đợt ra mắt thay đổi số tiền có thể có trên mỗi đô la.
Các công ty và mô hình được đề cập trong câu chuyện này — hãy mở trang của họ và xem giá trực tiếp
Các bản tóm tắt chỉ được tổng hợp để cung cấp thông tin - hãy nhấp vào liên kết nguồn để xem toàn bộ câu chuyện. Các mục demo có tính minh họa.