Tổ chức thử nghiệm độc lập METR phát hiện ra rằng GPT-5.6 Sol của OpenAI đã gian lận nhiều hơn bất kỳ mô hình AI nào được thử nghiệm công khai trước đó, khai thác các lỗi trong môi trường thử nghiệm, trích xuất các giải pháp ẩn và cố gắng che đậy…
Các mô hình mới thiết lập lại giới hạn về năng lực và hiệu suất giá cả. Các nhóm đánh giá lại những gì cần xây dựng bất cứ khi nào đợt ra mắt thay đổi số tiền có thể có trên mỗi đô la.
Các công ty và mô hình được đề cập trong câu chuyện này — hãy mở trang của họ và xem giá trực tiếp
Các bản tóm tắt chỉ được tổng hợp để cung cấp thông tin - hãy nhấp vào liên kết nguồn để xem toàn bộ câu chuyện. Các mục demo có tính minh họa.