PerceptionBench của Moonshot AI kiểm tra xem các mô hình AI đa phương thức thực sự có thể "nhìn" tốt đến mức nào, tách biệt khỏi lý luận logic. Không có mô hình biên giới nào đạt độ chính xác 60% và GPT-5.6 Sol dẫn đầu với một khoảng cách hẹp. Nhiều giả sử…
Các mô hình mới thiết lập lại giới hạn về năng lực và hiệu suất giá cả. Các nhóm đánh giá lại những gì cần xây dựng bất cứ khi nào đợt ra mắt thay đổi số tiền có thể có trên mỗi đô la.
Các công ty và mô hình được đề cập trong câu chuyện này — hãy mở trang của họ và xem giá trực tiếp
Các bản tóm tắt chỉ được tổng hợp để cung cấp thông tin - hãy nhấp vào liên kết nguồn để xem toàn bộ câu chuyện. Các mục demo có tính minh họa.