Nguồn cung cấp điện toán, GPU, trung tâm dữ liệu và năng lượng — lớp vật lý quyết định mức độ vận hành của AI với chi phí rẻ như thế nào.
Câu chuyện 190
Tính toán nguồn cung, năng lượng và công suất của trung tâm dữ liệu quyết định AI có thể vận hành với chi phí rẻ như thế nào. Sự thay đổi cơ sở hạ tầng xuất hiện trong chi phí suy luận vài tuần sau đó.
Các tiểu thuyết gia, nhà báo và những người đăng bài quyền lực trên LinkedIn đang sử dụng những câu chuyện ở góc nhìn thứ nhất và phong cách riêng để tránh bị nhầm lẫn với các chương trình trò chuyện.
URL bài viết: https://www.ft.com/content/f8c03b5b-e194-4236-82c3-389b6f5dd7ae URL bình luận: https://news.ycombinator.com/item?id=49087537 Điểm: 34 # Bình luận: 5
Quyết định này được đưa ra khi tốc độ xây dựng trung tâm dữ liệu tăng chóng mặt khiến các nhà khai thác lưới điện phải nỗ lực sản xuất điện.
Các công tố viên Đài Loan đã bắt giữ một nhân viên của Nvidia liên quan đến cáo buộc xuất khẩu trái phép máy chủ Super Micro AI sang Trung Quốc, theo Bloomberg và Reuters. Bài viết Đài Loan bắt giữ nhân viên Nvidia trong…
Nhiều điều bạn không được phép làm trên máy bay là những điều bạn không nên làm.
Lee, một kỹ sư tại bộ phận bán dẫn của Samsung, hết giờ làm việc khi ca làm việc của anh kết thúc. Anh ấy từng làm việc nhiều giờ hơn, cố gắng nhiều hơn để hoàn thành xuất sắc các dự án của mình. Nhưng gần đây, anh ấy lại về thẳng nhà để làm việc…
Armenia không phải là một nước lớn. Đó không phải là một đất nước giàu có. Đó không phải là một đất nước nổi tiếng Chưa hết, nó không chỉ trở thành người tiêu dùng các sản phẩm AI khác nhau như trình tạo phụ đề Clideo để chỉnh sửa video hay những gã khổng lồ…
Mọi người ghé thăm gian hàng của Kimi, một LLM do công ty khởi nghiệp Moonshot của Trung Quốc phát triển, trong Hội nghị AI Thế giới ở Thượng Hải, Trung Quốc, ngày 20 tháng 7. | Hình ảnh: LONG WEI/ Feature China/ Future Publishing via Getty Images Silicon…
Tại TechCrunch Disrupt 2026, Giai đoạn Hệ thống Thông minh sẽ là nơi giao thoa giữa năng lượng, cơ sở hạ tầng và công nghệ, bao gồm mọi thứ, từ những đột phá về phản ứng tổng hợp cho đến sức căng lưới điện mà AI đang gây ra cho toàn bộ nền kinh tế.
'Bạn thu thập điện trong không gian và giải phóng nhiệt trong không gian. Thứ duy nhất đến với Trái đất là dữ liệu.”
Độ phức tạp của thiết kế chip hiện đại tiếp tục tăng lên khi các nhóm kỹ thuật làm việc để phát triển các CPU, GPU và hệ thống AI ngày càng phức tạp. Để giúp đáp ứng thách thức đó, NVIDIA đang hợp tác với các công ty hàng đầu trong ngành…
Trong tập mới nhất của Equity, chúng tôi đã thảo luận lý do tại sao Kimi của Moonshot AI dường như khiến Thung lũng Silicon và Phố Wall hoảng sợ.
Khám phá TileLang, một ngôn ngữ dành riêng cho miền Python cấp cao giúp đơn giản hóa việc thiết kế nhân GPU hiệu suất cao. Hướng dẫn này cung cấp cách tiếp cận từng bước để triển khai khối lượng công việc phức tạp—bao gồm cả…
Một cuộc gọi gần gũi ở Bắc Virginia đã tiết lộ các trung tâm dữ liệu phản ứng kém như thế nào trước sự gián đoạn lưới điện. Đây là cách khắc phục vấn đề.
Samsung Galaxy Z Fold 8 Ultra là một chiếc điện thoại tốt, nhưng Galaxy Z Fold 8 còn có điều gì đó hấp dẫn hơn nhiều.
Với chiếc điện thoại màn hình gập mới nhất của Samsung, công ty đã đưa ra những thay đổi về thiết kế và phần mềm khiến ngay cả Z Fold của năm ngoái cũng cảm thấy chưa đủ.
Datalab đã viết lại Marker dưới dạng đường dẫn ba chế độ. Phiên bản 2 đạt 76,0 trên olmOCR-bench và duy trì 2,9 trang mỗi giây trên một B200 — hơn 5× hệ thống phụ trợ của MinerU, đồng thời đánh bại Docling về cả độ chính xác và tốc độ. H…
Datalab đã viết lại Marker dưới dạng đường dẫn ba chế độ. Phiên bản 2 đạt 76,0 trên olmOCR-bench và duy trì 2,9 trang mỗi giây trên một B200 — hơn 5× hệ thống phụ trợ của MinerU, đồng thời đánh bại Docling về cả độ chính xác và tốc độ. H…
URL bài viết: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-lead-ultra-low-latency-and-high-throughput-ai-inference URL bình luận: https://news.ycombinator.com/item?id=49041347 Điểm: 17 # C…
Quy tắc sẽ cho phép các bang quyết định có thể có bao nhiêu ý kiến đóng góp của công chúng - nếu có.
Trong hướng dẫn này, chúng tôi xây dựng một quy trình làm việc hoàn chỉnh để chạy mô hình Unlimited-OCR của Baidu trên hình ảnh tài liệu và các tệp PDF nhiều trang. Từ việc định cấu hình môi trường GPU cho đến so sánh các suy luận và kết quả của…
URL bài viết: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 URL bình luận: https://news.ycombinator.com/item?id=49…
Khả năng tồn tại của các trung tâm dữ liệu quỹ đạo lưu trữ các mô hình ngôn ngữ lớn (LLM) lớn nhất và có khả năng nhất vẫn còn đang bị tranh cãi gay gắt. Nhưng việc triển khai quy mô lớn đòi hỏi hàng nghìn GPU không phải là cách duy nhất LLM có thể hỗ trợ…
Một người cầm biểu ngữ trong cuộc biểu tình toàn quốc phản đối việc mở rộng trung tâm dữ liệu AI bên ngoài Peace Hall ở New Port Richey, Florida. | AFP qua Getty Images Vào một buổi sáng thứ Bảy xám xịt, ẩm ướt ở miền trung Florida, một chút…
Người sáng lập và Giám đốc điều hành NVIDIA Jensen Huang hôm nay đã đến thăm Trường Sau đại học Hải quân ở Monterey, California để vận hành hệ thống NVIDIA DGX GB300 — đưa một trong những nền tảng AI mạnh mẽ nhất thế giới trực tuyến hoàn toàn cho…
URL bài viết: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ URL bình luận: https://news.ycombinator.com/item?id=49007525 Điểm: 39 # Bình luận: 53
Samsung Galaxy Z Fold 8 Ultra có tất cả sức mạnh thô mà bạn cần, nhưng giá và phụ kiện dành cho Google Pixel 10 Pro Fold có thể là một ưu đãi tốt hơn.
OpenAI vạch ra cam kết thúc đẩy khoa học Mỹ khi hợp tác với Bộ Năng lượng Hoa Kỳ và các phòng thí nghiệm quốc gia để sử dụng AI tiên phong nhằm tăng tốc quá trình khám phá.
SenseTime đã khởi động Dự án Galaxy, hợp tác với gần 20 đối tác để mở rộng cơ sở hạ tầng chip AI nội địa ở Trung Quốc. Trong bài phát biểu quan trọng có tiêu đề ‘Sự chuyển đổi thông minh và sự cộng sinh’, Yang Fan – đồng sáng lập của công ty…
Cam kết này đã được đưa ra vào tháng 3 và cho đến nay vẫn chưa làm được gì nhiều để dập tắt những lo ngại. | Hình ảnh: Cath Virginia / The Verge, Getty Images Trước phản ứng dữ dội trước những lo ngại về sự bùng nổ của AI sẽ làm tăng hóa đơn tiền điện tiêu dùng…
Các trung tâm dữ liệu mới được xây dựng đến năm 2033 có thể tiêu thụ nhiều điện như Ấn Độ sử dụng hiện nay.
https://www.energy.gov/undersecretaryforscience/genesis-miss... URL bình luận: https://news.ycombinator.com/item?id=48995074 Điểm: 84 # Bình luận: 56
AI đã bước vào kỷ nguyên gigascale. Các nhà máy AI tiên tiến nhất thế giới đang tập hợp hàng trăm nghìn GPU và CPU để đào tạo các mô hình tiên tiến, cung cấp năng lượng cho AI tác nhân và tạo ra trí thông minh với tốc độ chưa từng có…
Nền tảng Vera Rubin của Nvidia kết hợp CPU và GPU thành một hệ thống duy nhất, phản ánh tham vọng ngày càng tăng của công ty trong việc cung cấp năng lượng cho mọi lớp cơ sở hạ tầng AI.
Alphabet, công ty mẹ của Google, được cho là đang nghiên cứu một con chip mới được thiết kế để giúp các mẫu Gemini của họ chạy hiệu quả hơn nhiều.
Google đang phát triển "Frozen v2", một chip máy chủ tích hợp kiến trúc Gemini trực tiếp vào phần cứng. Theo nguồn tin nội bộ, nó có thể hiệu quả gấp 6 đến 10 lần so với TPU hiện tại. Dự kiến vào năm 2028, t…
Bài đăng này mô tả cách Couchbase áp dụng Amazon Bedrock để hỗ trợ Capella iQ với dòng mô hình Claude của Anthropic, các quyết định kiến trúc đằng sau cách tiếp cận đa mô hình của họ và các lợi ích hoạt động đã nhận ra…
Microsoft đang mở rộng cơ sở hạ tầng AI của Azure với nền tảng Helios mới của AMD, nền tảng này được thiết lập để thách thức các hệ thống GPU của Nvidia vào nửa cuối năm 2026. Một hồ sơ GitHub công khai cho thấy Anthropic cũng đang thử nghiệm AMD…
Erin Davis gọi nó là “SuperDuperPOD”. Đó là hai thứ cùng một lúc: gã khổng lồ dược phẩm Bristol Myers Squibb (BMS) đã điều hành một trong những cụm AI lớn nhất trong khoa học đời sống, với những kết quả đáng chú ý đã được chứng minh.…
Các công ty AI hàng đầu của Trung Quốc đang tăng áp lực lên Thung lũng Silicon, khi Moonshot và Alibaba tiết lộ các mô hình mà họ tuyên bố có thể sánh ngang với những sản phẩm tốt nhất từ OpenAI và Anthropic với chi phí thấp. Đoạn rap…
Chúng tôi xây dựng quy trình làm việc NVIDIA NeMo AutoModel toàn diện trong Google Colab bằng một GPU duy nhất. Chúng tôi xác minh hỗ trợ chính xác và phần cứng CUDA, cài đặt NeMo AutoModel từ nguồn và tải công thức LoRA Qwen3-0.6B chính thức. W…
Neil Rimer, nhà đầu tư mạo hiểm, người đồng sáng lập Index Ventures, dự đoán khối tài sản lịch sử mà AI đang tạo ra ở Thung lũng Silicon sẽ phải được phân phối lại, một cách tự nguyện hoặc không tự nguyện.
Meta được cho là đang đàm phán với Anthropic để thuê năng lực tính toán từ các trung tâm dữ liệu của mình. Bài báo về kế hoạch bán máy tính AI dư thừa của Zuckerberg có thể tìm thấy khách hàng lớn đầu tiên của họ ở Anthropic xuất hiện đầu tiên trên Th…
Moonshot AI đã phát hành Kimi K3, một mô hình được đánh giá ban đầu phù hợp với Opus 4.8 của Anthropic, được xây dựng bởi một nhóm chỉ 300 người. Ngay cả chiến lược gia Dean W. Ball của OpenAI cũng gọi nó là “rất tốt”, nhưng tất nhiên cũng cảnh báo rằng…
Levoit Vital 200S-P là máy lọc không khí thông minh vượt trội, với bộ lọc sơ bộ có thể giặt được và khả năng làm sạch diện tích lên tới 1.800 feet vuông trong một giờ.
Sự cố mất điện thực sự kéo dài ba ngày đã bộc lộ những vấn đề mà tôi chưa bao giờ tìm thấy trên bảng thông số kỹ thuật của nhà máy điện.
Sarah Friar, Giám đốc tài chính của OpenaAI, giới thiệu thẻ điểm AI thực tế để đo lường ROI thông qua công việc hữu ích, chi phí cho mỗi nhiệm vụ thành công, độ tin cậy và lợi nhuận trên điện toán.
<p>Gợi ý dành cho những người siêu quy mô cảm thấy áp lực về việc sử dụng nước của trung tâm dữ liệu:</p> <p>Mua một vài câu lạc bộ đồng quê độc quyền, chuyển sân gôn thành công viên công cộng, trả tiền cho hướng dẫn viên và ống nhòm để có được thành viên trước…
Tại Uncanny Valley ngày nay, chúng tôi giải thích câu chuyện đang diễn ra của OpenAI, cả về mặt pháp lý và danh tiếng, cũng như liệu những phát triển này có thể gây tổn hại thêm cho công ty hay không, đặc biệt là trong cuộc chiến chống lại Anthropic.
Trên 107 doanh nghiệp, chi tiêu cho cơ sở hạ tầng AI đang tăng tốc vượt xa khả năng nhìn thấy hoặc định hướng nền kinh tế của nó. Hầu hết các tổ chức đều chạy AI của họ trên nền tảng quen thuộc của các siêu quy mô và API của nhà cung cấp mô hình, tuy nhiên…
Chúng tôi khám phá SDK Patter bằng cách xây dựng quy trình làm việc của tác nhân thoại cho trường hợp sử dụng đặt chỗ nhà hàng. Chúng tôi xác định các biến người gọi động, đăng ký các công cụ có thể gọi để biết tình trạng sẵn sàng, đặt chỗ, giờ và chuyển tuyến nhân lực cũng như địa điểm…
Robot đa năng và máy tự động đang chuyển từ phòng thí nghiệm nghiên cứu sang triển khai trên thị trường đại chúng trong thế giới thực, tạo ra nhu cầu về siêu máy tính AI nhỏ gọn, tiết kiệm điện có khả năng chạy các mô hình nền tảng ở…
Được xây dựng với sự hợp tác của Trung tâm đổi mới AI sáng tạo AWS (GenAIIC), Đối tác AWS VÀ kỹ thuật số và nhóm tài khoản AWS để tạo ra một công cụ xử lý tài liệu được hỗ trợ bởi AI có thể mở rộng, có thể phân loại, phân tách, trích xuất, đánh giá…
Solix E10 của Anker giúp nguồn điện dự phòng trở nên dễ hiểu đối với người lần đầu tiên sử dụng này và tôi rất nóng lòng muốn mở rộng hệ thống.
New York đã trở thành tiểu bang đầu tiên tạm thời ngừng phê duyệt các trung tâm dữ liệu lớn, khi Thống đốc Kathy Hochul lập luận rằng sự bùng nổ xây dựng do AI thúc đẩy sẽ không dẫn đến chi phí điện, nguồn cung cấp nước cao hơn,…
Lệnh cấm trung tâm dữ liệu của New York có thể trở thành kế hoạch chi tiết cho phong trào chống AI.
Sức mạnh là hạn chế không thể tránh khỏi của cơ sở hạ tầng AI. Số lượng token mà một nhà máy AI có thể tạo ra trong ngân sách năng lượng cố định sẽ quyết định doanh thu và lợi nhuận của nó. Do đó, hiệu suất trên mỗi watt — một thước đo…
Demis Hassabis, trong phiên họp tại Diễn đàn Kinh tế Thế giới ở Davos, Thụy Sĩ. | Hình ảnh: Bloomberg qua Getty Images Demis Hassabis cho rằng thế giới cần một cơ quan giám sát AI có khả năng hãm phanh nếu…
URL bài viết: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ URL bình luận: https://news.ycombinator.com/item?id=48901420 Điểm: 19 # Bình luận: 4
Trong tất cả các cuộc tranh luận nổ ra về những nhược điểm tiềm tàng của AI, có một lo lắng khiến những người đam mê AI ở Thung lũng Silicon cảm thấy khó chịu nhất - đó là các phòng thí nghiệm AI khổng lồ bán các mô hình độc quyền bằng cách nào đó…
Chúng tôi đã thử nghiệm những chiếc máy tính tất cả trong một tốt nhất kết hợp sức mạnh của máy tính để bàn với thiết kế mỏng, nhẹ.
Một biển báo phản đối trung tâm dữ liệu theo kế hoạch được hiển thị dọc theo Đường 54 ở Thị trấn Mount Carmel Quận Northumberland. | Hình ảnh: Getty Images Đây là The Stepback, một bản tin hàng tuần kể về một câu chuyện quan trọng về…
Trong hướng dẫn này, chúng ta khám phá cách lập trình GPU dựa trên ô xếp NVIDIA với TileGym, xây dựng quy trình làm việc Colab chạy trên nhiều phần cứng khác nhau. Chúng tôi thăm dò môi trường CUDA, thử phần phụ trợ cuTile thực sự và quay lại Tr…
Sau khi ra mắt ChatGPT Work và GPT-5.6 Sol, OpenAI đã thừa nhận các vấn đề quan trọng: sử dụng tính toán quá mức, chuyển đổi khó hiểu sang giao diện máy tính để bàn cho các cuộc trò chuyện và dự án, sự phân biệt không rõ ràng b…
URL bài viết: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ URL bình luận: https://news.ycombinator.com/item?id=48865717 Điểm: 17 # Bình luận: 0
Trong bài đăng này, bạn sẽ tìm hiểu bốn mẫu triển khai để lấy các mô hình đã được lượng tử hóa bằng Unsloth và triển khai chúng trên cơ sở hạ tầng AWS. Các mẫu sử dụng Đám mây điện toán đàn hồi của Amazon (Amazon EC2)…
Một công ty lưu trữ năng lượng mặt trời và năng lượng gia đình đang mở rộng sang các trung tâm dữ liệu AI, nhưng không phải bằng cách xây dựng một trung tâm này - thay vào đó, họ đề nghị trả tiền cho khách hàng để đặt các thiết bị tính toán của mình trong nhà của họ. Sunrun đang triển khai chương trình thí điểm…
Nếu bạn cần nhiều năng lượng hơn mức dịch vụ lưu trữ chia sẻ có thể cung cấp, các nhà cung cấp dịch vụ lưu trữ VPS hàng đầu có thể cung cấp cho bạn các tài nguyên chuyên dụng và khả năng mở rộng cần thiết để đẩy dự án của bạn lên một tầm cao mới.
Dòng mô hình mới của OpenAI sẽ tiếp tục hỗ trợ bộ ứng dụng năng suất và nơi làm việc của Microsoft.
NVIDIA đã phát hành Nemotron-Labs-3-Puzzle-75B-A9B, một biến thể nén của Nemotron-3-Super. Iterative Puzzle xen kẽ việc nén cấu trúc nhận biết phần cứng với các giai đoạn phục hồi chắt lọc kiến thức ngắn. Chế độ…
Sau khi đã chứng minh được giá trị của điện toán, công ty nhận thấy mình là trung tâm của thị trường mà mọi người đều muốn tham gia — trong khi các công nghệ đơn giản hơn và các công ty kém thú vị hơn lại trở nên giàu có bên lề.
URL bài viết: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that- Should-put-silicon-valley-on-high-alert-1095178.html URL nhận xét: https://news.ycombinator.com/item?id=48846708 Điểm: 4…
Thứ Năm GFN này mang đến nhiều trò chơi hơn, nhiều sức mạnh hơn và nhiều cách chơi hơn trên GeForce NGAY BÂY GIỜ. Dịch vụ chơi game trên nền tảng đám mây đang mở rộng với máy chủ chạy GeForce RTX 5080 mới ở Toronto, mang lại hiệu suất cao chuyên dụng trong…
NVIDIA đã phát hành Nemotron-Labs-3-Puzzle-75B-A9B, một biến thể nén của Nemotron-3-Super. Iterative Puzzle xen kẽ việc nén cấu trúc nhận biết phần cứng với các giai đoạn phục hồi chắt lọc kiến thức ngắn. Chế độ…
Vai trò mới của Kevin Weil tại Stoke Space cho thấy tên lửa có thể tái sử dụng là xu hướng hấp dẫn tiếp theo ở Thung lũng Silicon.
Chắc chắn, dây nối dài trong nhà và ổ cắm điện rất tiện dụng, nhưng chúng cũng gây ra hàng nghìn vụ hỏa hoạn có thể ngăn ngừa được mỗi năm. Đây là cách sử dụng chúng an toàn hơn.
Việc siết chặt hóa đơn tiền điện ở Vành đai Rust đe dọa kế hoạch sản xuất của Trump.
Microsoft là gã khổng lồ mới nhất ở Thung lũng Silicon cắt giảm chi tiêu cho AI.
Công ty khởi nghiệp Deepseek của Trung Quốc đang xây dựng chip AI của riêng mình, Reuters đưa tin. Bài viết Deepseek đang thiết kế chip AI của riêng mình xuất hiện đầu tiên trên The Decode.
OpenAI đã thêm hai mô hình Thời gian thực vào API của nó. GPT-Realtime-2.1-mini là một mô hình suy luận nhỏ cho giọng nói, có giá tương đương với gpt-realtime-mini trước đó. OpenAI cũng giảm độ trễ p95 ít nhất 25% thông qua bộ nhớ đệm được cải thiện. Anh ta…
Anthropic's Fable 5 hứa hẹn sức mạnh AI huyền thoại, nhưng những hạn chế bất ngờ khiến tôi tự hỏi liệu nó có rắc rối hơn mức đáng để sử dụng hàng ngày hay không.
URL bài viết: https://xcancel.com/i/article/2072830533739192560 URL bình luận: https://news.ycombinator.com/item?id=48792463 Điểm: 17 # Bình luận: 1
URL bài viết: https://github.com/openai/codex/issues/30364 URL bình luận: https://news.ycombinator.com/item?id=48789428 Điểm: 131 # Bình luận: 41
URL bài viết: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 URL bình luận: https://news.ycombinator.com/item?id=48774246 Điểm: 18 # Bình luận: 6
Sự mở rộng nhanh chóng của cơ sở hạ tầng trí tuệ nhân tạo thường được coi là một vấn đề năng lượng. Các trung tâm dữ liệu được dự đoán sẽ tiêu thụ phần lớn nhu cầu điện toàn cầu: Cơ quan Năng lượng Quốc tế…
Tin tức này xuất hiện khoảng một tuần sau khi OpenAI công bố chip AI tùy chỉnh của riêng mình hợp tác với Broadcom.
Anthropic được cho là đang đàm phán với Samsung Electronics về việc sản xuất chip AI tùy chỉnh. Dự án vẫn còn ở giai đoạn đầu nhưng Anthropic đã thuê các kỹ sư chip. Sau "Jalapeño" của OpenAI, một AI lớn khác…
Eufy Omni S2 cải tiến so với phiên bản tiền nhiệm với lực hút gấp bốn lần và con lăn lau nhà không mùi.
Nvidia ngày càng hoạt động như một ngân hàng trung ương cho các công ty khởi nghiệp AI, tích cực định hình thị trường máy tính. Bài báo Nvidia đang tài trợ cho các công ty khởi nghiệp AI để nới lỏng sự kiểm soát của Big Tech đối với hoạt động kinh doanh chip của họ xuất hiện đầu tiên trên The…
Google cố gắng cân bằng lượng khí thải của trung tâm dữ liệu AI với nỗ lực sử dụng năng lượng sạch
URL bài viết: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ URL bình luận: https://news.ycombinator.com/item?id=48759329 Điểm: 26 # Bình luận…
Khi AI chuyển từ phát triển mô hình sang suy luận sản xuất, nhu cầu điện toán đang tăng nhanh và chuyển sang các nhà máy AI hoạt động liên tục để tạo ra mã thông báo trên quy mô lớn. Sự thay đổi này đòi hỏi quyền truy cập vào quy mô lớn…
Sound đã tạo dựng được danh tiếng của mình nhờ các vụ đặt cược tập trung, có sức thuyết phục cao vào các phòng thí nghiệm AI hàng đầu, trong khi quỹ mới của Kutcher dường như đang theo đuổi lớp bên dưới các công ty đó — cơ sở hạ tầng và năng lượng cung cấp…
Bài viết này được cung cấp bởi Văn phòng Hội nghị Melbourne (MCB) được hỗ trợ bởi Business Events Australia. Khi trí tuệ nhân tạo tăng tốc nhu cầu điện toán toàn cầu, một hạn chế song song đang xuất hiện với…
Meta đang phát triển các kế hoạch kinh doanh cơ sở hạ tầng đám mây, bán quyền truy cập vào các mô hình và sức mạnh tính toán AI. Động thái này sẽ cạnh tranh với các nhà cung cấp đám mây lớn như Amazon Web Services, Google Cloud và Microsoft Az…
URL bài viết: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute URL bình luận: https://news.ycombinator.com/item?id=48745966 Điểm: 15 # Bình luận: 11
“Nơi có chi phí thấp nhất để đưa AI vào không gian và điều đó sẽ trở thành sự thật trong vòng hai năm, có thể muộn nhất là ba năm,” người sáng lập SpaceX, Elon Musk, phát biểu tại Diễn đàn Kinh tế Thế giới ở Davos vào tháng 1 vừa qua, khi công ty của ông...
Theo báo cáo của The Information, OpenAI đã cắt giảm hơn một nửa chi phí suy luận cho các mô hình AI của mình. Công ty đã áp dụng các tính năng tối ưu hóa cho ChatGPT, trong đó số lượng GPU Nvidia cần thiết đã giảm xuống chỉ còn một phần…
Khoa học đời sống đã bước vào kỷ nguyên của quy mô tính toán và trong hơn một thập kỷ, NVIDIA đã xây dựng hệ thống điện toán được tăng tốc GPU đầy đủ — bao gồm phần cứng, khung, thư viện, mô hình, dịch vụ vi mô và miền…
Trong bài đăng này, chúng ta khám phá cách Outpost VFX đạt được tốc độ đào tạo nhanh hơn 8 lần bằng cách sử dụng cơ sở hạ tầng AWS để chuyển đổi quy trình thay thế khuôn mặt, kiến trúc kỹ thuật mà họ đã triển khai để vượt qua giới hạn GPU đơn…
Chính quyền Đài Loan đã đột kích các văn phòng của Super Micro Computer và một số công ty đối tác địa phương. Bài báo Đài Loan đột kích các văn phòng Super Micro để điều tra việc buôn lậu chip Nvidia sang Trung Quốc xuất hiện đầu tiên trên The…
URL bài viết: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ URL bình luận: https://news.ycombinator.com/item?id=48727538 Điểm: 27 # Bình luận: 22
Đây là cách tận dụng khả năng của trạm điện khi không phải trong trường hợp khẩn cấp.
xFusion đã giới thiệu các mô hình điện toán AI dành cho doanh nghiệp có khả năng mở rộng tại ISC 2026, chuyển đổi phần cứng từ thiết bị biên sang trung tâm dữ liệu. Những người mua công nghệ doanh nghiệp tham dự triển lãm Hamburg tìm kiếm sản phẩm thực tế…
URL bài viết: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark URL bình luận: https://news.ycombinator.com/item?id=48712791 Điểm: 15 # Bình luận: 2
Biết được những thực tế về năng lượng mặt trời tại nhà có thể giúp bạn làm ra những lựa chọn tốt hơn, thông tin hơn, tiết kiệm tiền và an toàn.
Người sáng lập 360, Chu Hồng Nghị giới thiệu hai công cụ bảo mật AI được thiết kế để cạnh tranh với Mythos của Anthropic. Một người đã gắn cờ 3.432 lỗ hổng. Chu thừa nhận người mẫu Trung Quốc kém người mẫu phương Tây từ 20 đến 30%, nhưng…
Không phải ai cũng chấp nhận tầm nhìn của Elon Musk về các trung tâm dữ liệu quỹ đạo.
Đối với những người đang sử dụng llms trên macbook, Bạn muốn hiểu macbook khác với GPU chuyên dụng như thế nào khi chạy các mẫu đó? và làm sao để biết macbook có khả năng chạy model bao nhiêu? URL bình luận: https://ne…
Nvidia đã thống trị thị trường chip AI trong nhiều năm, nhưng kỷ nguyên phụ thuộc hoàn toàn có thể sắp kết thúc. OpenAI vừa chia sẻ kế hoạch cải thiện mọi thứ với Jalapeño, chip suy luận tùy chỉnh được xây dựng với Broadcom, tham gia G…
Nvidia đã thống trị thị trường chip AI trong nhiều năm, nhưng kỷ nguyên phụ thuộc hoàn toàn có thể sắp kết thúc. OpenAI vừa chia sẻ kế hoạch cải thiện mọi thứ với Jalapeño, chip suy luận tùy chỉnh được xây dựng với Broadcom, tham gia G…
Các nhà phê bình của Anthropic cho rằng công ty này đang nhanh chóng tích tụ quyền lực. Công ty cho biết đó là điều mà phát triển AI có trách nhiệm trông như thế nào.
Quyết định của MGM Studios thuộc sở hữu của Amazon từ bỏ dự án phim của OpenAI chỉ là một phần trong việc AI và ngành công nghiệp phim ảnh ngày càng kết hợp chặt chẽ. Trên Uncanny Valley, chúng tôi sẽ xem xét hướng đi của mọi thứ này.
Tăng giá này do chi phí bộ vi xử lý nhớt tăng cao và nguồn cung thiếu hụt nhưng vẫn còn những ưu đãi nếu bạn biết nơi để tìm kiếm.
Un-0 là một công cụ hệ thống tạo hình ảnh cho thấy lần đầu tiên công nghệ của công ty có thể tái tạo các hệ thống AI truyền thống.
Đây là thị trường khó khăn đối với GPU, nhưng vẫn còn một số giao dịch tốt để bạn có thể mua vào ngày Prime Day của Amazon. Dưới đây là năm giao dịch đáng kiểm tra.
Để chào mừng sự kiện trở thành số 1 trong bảng xếp hạng chất lượng ban đầu của JD Power đối với các nhà sản xuất ô tô thông thường, Ford đã chia sẻ về những thách thức mà họ đã gặp phải trong những năm gần đây, đặc biệt là xung quanh sự phụ thuộc vào hệ thống tự động của mình...
Tại sao độ trễ của tổ chức đang trở thành rào cản lớn nhất để nhận ra đầy đủ lợi ích của AI
Qualcomm đang tiếp tục thâm nhập vào thị trường trung tâm dữ liệu với bộ xử lý mới có tên Dragonfly C1000. Bài viết Qualcomm bước vào thị trường trung tâm dữ liệu với bộ xử lý của riêng mình được đăng đầu tiên trên The Decoder.
Transistor nanostack của IBM có thể nâng cao hiệu suất hoặc hiệu quả năng lượng của chip.
Chuyến đi tài chính của OpenAI phụ thuộc mạnh vào chi phí cơ sở hạ tầng, một thực tế đã thúc đẩy việc phát triển chip Jalapeño tùy chỉnh mới của OpenAI. Được phát triển hợp tác với Broadcom, chip này là một phần cứng chuyên dụng...
Cuộc đua về silicon đang trở nên căng thẳng giữa việc cố gắng theo kịp nhu cầu.
Gradium đã ra mắt hai mô hình dịch nói thời gian thực, stt-translate và s2s-translate, bao gồm tiếng Anh, Pháp, Đức, Tây Ban Nha và Bồ Đào Nha trên 20 cặp ngôn ngữ. Các mô hình này giảm thiểu ba mô hình tiêu chuẩn...
Thông báo: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... Đường dẫn bình luận:…
Trong bài viết này, chúng tôi trình bày kiến trúc và phương pháp mà Loka sử dụng để giải quyết một vấn đề phổ biến: các trợ lý giọng nói robot, chậm chạp gây cho khách hàng phải treo máy, hủy hoại uy tín thương hiệu và tăng chi phí hỗ trợ.
OpenAI vừa ra mắt một chip "bộ xử lý trí tuệ" mới cho máy chủ AI được sản xuất hợp tác với Broadcom. Chip này có tên Jalapeño, được thiết kế để cung cấp năng lượng cho các mô hình ngôn ngữ lớn hiện tại và tương lai, theo một nghiên cứu...
OpenAI đang thêm phần cứng tùy chỉnh vào bộ công cụ công nghệ của mình. Chip "Jalapeño", được phát triển với Broadcom, được thiết kế cho việc inference của mô hình ngôn ngữ lớn và dự kiến sẽ chạy ở quy mô lớn vào cuối năm 2026. Bài viết OpenAI và Broadcom u...
URL bài viết: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ URL bình luận: https://news.ycombinator.com/item?id=48659257 Điểm: 141 # Bình luận: 1
Các mô hình ngôn ngữ có thể viết văn bản trong sáng hơn nhiều người, nhưng khi yêu cầu một mô hình đưa ra 100 luận điểm về một chủ đề, chúng sẽ tập trung vào một nhóm duy nhất. Giám đốc điều hành của Pangram Max Spero nói rằng lý luận của con người đa dạng hơn nhiều, đó là điều có thể...
DFlash của Đại học San Diego thay thế việc viết tự động với mô hình diffusion nhẹ để giải mã dự đoán. Nó viết toàn bộ khối token trong một bước duy nhất và điều kiện hóa dựa trên các đặc điểm ẩn mục tiêu...
OpenAI và Broadcom giới thiệu Jalapeño, chip AI tùy chỉnh được xây dựng cho inference LLM để cải thiện hiệu suất, hiệu quả và mở rộng trên các hệ thống AI.
Xây dựng hệ thống AI ở quy mô lớn đòi hỏi phải có khả năng inference với độ trễ thấp, tìm kiếm vector nhanh, hiệu suất giá cả phải chăng của GPU mạnh mẽ và cơ sở hạ tầng có thể phát triển mà không làm tăng phức tạp về vận hành. NVIDIA mới nhất...
Trong hướng dẫn này, chúng ta xây dựng một pipeline dịch máy đa ngôn ngữ và dịch nói với NVIDIA Canary-1B-v2. Chúng ta tải mô hình lên runtime có GPU, chuẩn bị âm thanh thành 16 kHz mono và chạy ASR tiếng Anh. Sau đó, chúng ta dịch...
Xin chào, tôi muốn chia sẻ với các bạn một bản đồ tương tác về các ràng buộc kinh tế và vật lý của việc xây dựng AI. Nó có các yếu tố thúc đẩy lớn, các điểm nghẽn công nghiệp và nơi đó xuất hiện trong thị trường. Tôi đã thêm 393 nút...
Tin Tức Nổi Bật: Công nghệ NVIDIA chạy 81% của TOP500 và 90% của các hệ thống mới vào danh sách. 26 hệ thống trong TOP500 đã sử dụng CPU NVIDIA Grace, tăng tám so với danh sách trước đó. Tám hệ thống hàng đầu trong Gree...
Sự gia tăng toàn cầu của mối đe dọa cyber từ AI không còn là vấn đề xa xôi đối với các trung tâm dữ liệu doanh nghiệp, theo một cảnh báo công cộng khẩn cấp từ liên minh tình báo mạnh mẽ nhất thế giới. Ngày 22 tháng 6 năm 2026, cybersecu...
Tìm hiểu cách Omio sử dụng OpenAI để cung cấp trải nghiệm du lịch đối thoại, tăng tốc phát triển sản phẩm và trở thành công ty AI bản địa.
Phản đối công khai đối với các trung tâm dữ liệu đã nhấn mạnh việc tiêu thụ nước và năng lượng của chúng, và bây giờ Nvidia đang nhấn mạnh yêu cầu của họ rằng thiết kế tham chiếu thế hệ Rubin cho trung tâm dữ liệu làm mát hoàn toàn bằng chất lỏng có "elim…
Nvidia công bố hệ thống làm mát mới để giảm sử dụng nước trong trung tâm dữ liệu. Nhưng nó không giải quyết được việc sử dụng nước lớn nhất của AI - các nhà máy điện hóa thạch.
Microsoft đang xây dựng một khu trung tâm dữ liệu 2 gigawatt tại Pecos, Texas, một trong những lần tăng cường công suất lớn nhất trong lịch sử của công ty. Trong một lá thư công khai, công ty hứa sẽ đảm bảo giá điện ổn định và sử dụng nước tối thiểu, d…
JUPITER, máy tính siêu mạnh exascale đầu tiên của châu Âu tại Forschungszentrum Jülich của Đức, chạy trên Superchip Grace Hopper của NVIDIA và mạng InfiniBand Quantum-X800 của NVIDIA — và nó đã có một năm bận rộn. Là quốc tế...
Nhiệm vụ, Tầm nhìn và Veritas — các siêu máy tính mới của Trung tâm Nghiên cứu Quốc gia Los Alamos (LANL) được xây dựng với sự hợp tác của HPE và NVIDIA — đang sử dụng CPU NVIDIA Vera để tăng tốc sự phát hiện khoa học, mở khóa AI tự chủ cho khoa học.…
Thời đại tiếp theo của AI sẽ không chỉ được xác định bởi tính toán. Sự phát triển của nó sẽ được quyết định bởi năng lượng. Khi tính toán tăng tốc mở rộng qua các nhà máy AI, AI có khả năng hành động, AI công nghiệp, tính toán biên và AI vật lý - bao gồm...
Công nghệ lớn đang đầu tư lớn vào việc xây dựng trung tâm dữ liệu. Khi sự phản đối của quốc gia đối với các cơ sở này ngày càng tăng, một số công nhân bắt đầu đặt câu hỏi liệu điều đó có đáng giá hay không.
Chúng tôi xây dựng quy trình làm việc dự báo từ đầu đến cuối với TimeCopilot trên bảng dữ liệu hành khách thực tế của các hãng hàng không và chuỗi mùa vụ tổng hợp có các bất thường được tiêm vào. Chúng tôi đánh giá thống kê, nền tảng và tùy chọn dựa trên GPU...
Có một luận điểm thương mại đi ngược lại với ý tưởng rằng ASML sẽ mạo hiểm giấy phép xuất khẩu của mình để trang bị cho khách hàng Trung Quốc.
Amazon SageMaker AI cung cấp dịch vụ lưu trữ inference thời gian thực hoàn toàn quản lý cho các mô hình học máy. Bạn triển khai mô hình đến một điểm cuối SageMaker được hỗ trợ bởi một hoặc nhiều instance tính toán, và SageMaker xử lý việc cung cấp…
Chơi các tựa game yêu thích từ các thư viện trò chơi phổ biến, giữ tiến trình đồng bộ và quay lại các phiên chơi game trên hầu hết các thiết bị. Đó là sức mạnh của GeForce NOW cloud gaming. Từ việc cung cấp quyền truy cập vào các tựa game yêu thích của thành viên...
Bằng cách mô phỏng cách hoạt động của não bộ, tính toán thần kinh học có thể tiêu thụ ít năng lượng hơn rất nhiều so với các chip AI điện tử truyền thống. Tuy nhiên, ngay cả các thiết bị thần kinh học phức tạp nhất hiện nay cũng vẫn còn rất đơn giản,...
Năm ngoái tại NVIDIA GTC Paris tại VivaTech, Pháp đã công bố kế hoạch thúc đẩy AI địa phương — từ các nhà máy AI mới và khả năng tính toán quốc gia đến các mô hình tiền phương mở và các nền tảng công nghiệp. Bây giờ, cơ sở hạ tầng AI đó...
Tokenmaxxing là xu hướng nóng nhất ở Silicon Valley vào đầu năm nay, khi các CEO khuyến khích nhân viên sử dụng AI đến mức tối đa. Sau đó, hóa đơn đến. Uber据报道 đã tiêu hết ngân sách AI hàng năm của mình...
Tokenmaxxing là xu hướng nóng nhất ở Silicon Valley vào đầu năm nay, khi các giám đốc điều hành khuyến khích nhân viên sử dụng AI đến mức tối đa. Sau đó, hóa đơn đến. Uber据报道 đã tiêu tốn hết ngân sách AI hàng năm của mình...
Bước chuyển đổi dự kiến vào thứ Hai sẽ tăng mạnh chi phí cho người dùng mạnh mẽ.
Hôm nay, chúng tôi rất vui mừng thông báo về việc lưu trữ hình ảnh container cho inference của Amazon SageMaker AI, một bước tiến quan trọng trong hành trình tối ưu hóa mở rộng nhanh hơn của chúng tôi. Điều này làm giảm thời gian chờ đợi từ đầu đến cuối lên đến 2 lần cho các mô hình...
Kính thông minh vẫn là một phân khúc còn non nớt, nhưng nhà sản xuất chip Qualcomm đang nỗ lực nâng cấp silicon để cung cấp năng lượng cho thế hệ thiết bị XR tiếp theo: Snapdragon Reality Elite. Mặc dù Qualcomm sẽ công bố chip ngày hôm nay...
Cơ quan Justice cho rằng Lầu Năm Góc cần xAI tiếp tục sử dụng các turbin khí không được phép.
Một nhà sản xuất phần mềm Silicon Valley và một công ty thương mại điện tử tiết lộ với WIRED cách họ đang đối phó với thách thức mới nổi của ‘tokenomics’.
Cuối hiệp một của trận đấu không có điểm giữa đội tuyển nam Anh và đối thủ Đức, hàng triệu người Anh thở dài một cách đồng loạt và làm điều mà họ thường làm trong những khoảnh khắc căng thẳng: Họ đã...
Hôm nay, tôi đang nói chuyện với Adam Bry, Giám đốc điều hành của Skydio, nhà sản xuất drone tự động hàng đầu của Mỹ. Trước khi chúng tôi ghi lại đoạn này, tôi thực sự đã điều khiển từ xa một drone của Skydio tại khu vực Bay Area từ nơi Adam làm việc...
Mirage, một mô hình thế giới video từ Microsoft Research và một số trường đại học, lưu trữ thông tin cảnh trực tiếp trong không gian tiềm ẩn thay vì điểm mây dựa trên pixel. Điều này giảm thời gian tính toán và bộ nhớ đồ họa...
Ngay cả các trung tâm dữ liệu có quy mô vừa phải cũng có thể có tác động cục bộ quá lớn.
OpenAI đang đàm phán để thuê một trung tâm dữ liệu quy hoạch 10 gigawatt ở Ohio có thể được tài trợ tài chính bởi Nvidia, theo thông tin từ The Information. Bài viết OpenAI muốn xây dựng trung tâm dữ liệu lớn nhất từ trước đến nay, và Nvidia sẽ...
Với công suất ban đầu là 24 megawatt, trung tâm dữ liệu sáng tạo này sử dụng nước biển như hệ thống làm mát tự nhiên.
Một báo cáo mới từ OpenAI tiết lộ các hoạt động ảnh hưởng liên kết với Trung Quốc sử dụng AI để nhắm vào các cuộc tranh luận công nghệ ở Mỹ, các câu chuyện về trung tâm dữ liệu, thuế quan và các yêu cầu sai về ChatGPT.
Mô hình ngôn ngữ lớn thứ tư (LLM) của OpenAI, GPT-4, mất khoảng 50 gigawatt giờ để đào tạo, tương đương với mức tiêu thụ điện hàng năm của 5.000 ngôi nhà ở Mỹ. Đó là vào năm 2023. Kể từ đó, khả năng tính toán…
Cơ sở 168 megawatt sẽ hỗ trợ nhu cầu tính toán AI toàn cầu của Meta và có thể mở rộng theo thời gian.
GPU của NVIDIA với Confidential Computing hiện được sử dụng cho inference bảo mật trong Compute Cloud riêng của Apple (PCC), khi nó mở rộng ra ngoài các trung tâm dữ liệu của Apple đến Google Cloud. Được công bố trong sự kiện WWDC hàng năm của Apple.
Tại sự kiện ở San Francisco hôm nay, General Motors đã công bố loạt thông báo xung quanh pin EV, lưu trữ năng lượng và độ bền của lưới điện trước sự gia tăng nhu cầu điện từ các trung tâm dữ liệu AI. Nhà sản xuất ô tô này đã...
Trong bài viết này, chúng tôi sẽ hướng dẫn cách đào tạo chính sách robot cho Unitree H1 humanoid với NVIDIA Isaac Lab trên Amazon SageMaker AI qua hai tùy chọn tính toán: Amazon SageMaker HyperPod và Amazon SageMaker Training Jobs.
Cách Notion sử dụng Codex cho các thông số kỹ thuật một lần, xây dựng Đầu vào bằng giọng nói AI cho web và nhân rộng sức mạnh kỹ thuật giữa các nhóm nhỏ.
Vào thứ Ba, Hội đồng Thành phố Seattle sẽ bỏ phiếu về việc có nên ban hành lệnh tạm dừng một năm đối với các trung tâm dữ liệu mới hay không - chỉ hai tháng sau khi một số công ty đề xuất xây dựng năm trung tâm quy mô lớn trong thành phố. Trong số các…
Trong hướng dẫn này, chúng tôi triển khai quy trình làm việc thực hành cho NVIDIA cuTile Python, giao diện lập trình GPU dựa trên ô xếp cho các hạt nhân kiểu CUDA trong Python. Chúng tôi chuẩn bị một môi trường thân thiện với Colab và kiểm tra GPU, trình điều khiển, CUDA,…
Google đã đặt hàng hơn ba triệu chip AI từ Intel cho năm 2028. Nvidia đang thử nghiệm công nghệ sản xuất của Intel cho kiến trúc Feynman sắp ra mắt của mình. Cả hai động thái đều diễn ra khi TSMC không thể đáp ứng kịp nhu cầu về chip AI. Int…
Nhóm MiMo của Xiaomi, cùng với TileRT, đã phát hành MiMo-V2.5-Pro-UltraSpeed, một chế độ phục vụ cho mẫu MiMo-V2.5-Pro. Nó giải mã hơn 1000 mã thông báo mỗi giây trên mô hình 1 nghìn tỷ tham số bằng cách sử dụng một nút hàng hóa 8 GPU duy nhất.…
Với quyền truy cập vào các mô hình AI tổng hợp mới nhất và điện toán tăng tốc hiệu suất cao theo nhu cầu toàn cầu cao, khách hàng AWS cần các công cụ để tận dụng tính khả dụng và năng lực của mô hình trên nhiều Khu vực AWS, v…
NVIDIA và Tập đoàn LG đang xây dựng một nhà máy AI để thúc đẩy làn sóng kinh doanh tiếp theo dựa trên AI của Tập đoàn LG, bao gồm robot, xe tự lái, công nghệ trung tâm dữ liệu và dịch vụ đám mây GPU. Nhà máy AI sẽ chứng minh…
Clive Chan, nhân viên phần cứng thứ hai trong chương trình chip tùy chỉnh của OpenAI, đang chuyển sang Anthropic. Anh ấy mang đến kinh nghiệm từ Autopilot ASIC của Tesla và quan hệ đối tác OpenAI-Broadcom. Động thái này diễn ra…
Google đã phát hành Colab CLI, cho phép các nhà phát triển và tác nhân AI chạy mã cục bộ trên GPU Colab và thời gian chạy TPU từ xa. Bài đăng Colab CLI mới của Google cho phép các nhà phát triển và tác nhân AI chạy Python trên GPU Colab từ xa và TPU.
Sakana AI đã ra mắt một phòng thí nghiệm nghiên cứu chuyên dụng để tự cải thiện đệ quy: AI tự cải thiện bản thân nhiều lần. Công ty khởi nghiệp Nhật Bản, được đồng sáng lập bởi đồng tác giả Transformer, Llion Jones, coi RSI là một giải pháp thay thế cho…
Nhà phát triển cảm thấy “bị đánh bại”, “không còn lựa chọn nào khác” ngoài việc thu nhỏ trung tâm dữ liệu.
NVIDIA đã phát hành Nemotron 3 Ultra, một Mamba-Transformer lai hỗn hợp mở có tổng công suất 550B (55B đang hoạt động) dành cho các đại lý hoạt động lâu dài. Nó kết hợp bối cảnh mã thông báo 1M với thông lượng suy luận cao hơn tới ~ 6 lần so với bối cảnh…
Meta có thể đã tìm ra một cách để cắt giảm chi phí trung tâm dữ liệu khổng lồ của mình: lều.
Kevin O'Leary đã đồng ý giảm một nửa quy mô trung tâm dữ liệu rộng 40.000 mẫu Anh theo kế hoạch của mình ở Utah trong bối cảnh áp lực ngày càng tăng từ người dân và các nhà hoạt động, như chi nhánh địa phương ABC4 đã đưa tin trước đó. Ngôi sao Shark Tank đã gửi thư cho…
Công ty khởi nghiệp ở California đã phát hành thế hệ thứ tư của robot hỗ trợ gia đình, Stretch.
Hyperscalers đã được xem xét kỹ lưỡng về tác động của chúng đối với chất lượng và tính sẵn có của nước.
Máy tính lượng tử hứa hẹn một ngày nào đó sẽ giải quyết được những vấn đề vượt xa khả năng tưởng tượng của những siêu máy tính mạnh nhất. Nhưng người ta thường đánh giá thấp lượng điện toán cổ điển cần thiết để vận hành những cỗ máy này. Như qubit tính…
Công suất trung tâm dữ liệu mới ở một số khu vực đã giúp giảm bớt khả năng sẵn có của GPU, giúp đẩy chỉ số chi phí suy luận khu vực xuống thấp hơn trong tuần này.
Nhiều nhà cung cấp hơn đang gắn giá điện toán với điều kiện năng lượng tại địa phương, bổ sung thêm khía cạnh thời gian trong ngày cho vị trí và thời điểm khối lượng công việc AI chạy rẻ nhất.
Hệ sinh thái NVIDIA AI Cloud đang đẩy nhanh quá trình xây dựng cơ sở hạ tầng nhà máy AI trên toàn cầu. Các đối tác đang mở rộng năng lực để đáp ứng nhu cầu ngày càng tăng từ các doanh nghiệp, công ty khởi nghiệp, quốc gia, phòng thí nghiệm AI và nhà phát triển mở rộng quy mô…
Anthropic đã phát hành Cowork vào thứ Hai, một khả năng tác nhân AI mới giúp mở rộng sức mạnh của công cụ Claude Code cực kỳ thành công của nó cho những người dùng không rành về kỹ thuật — và theo những người trong công ty, nhóm đã xây dựng toàn bộ kỳ tích…
Các bản tóm tắt chỉ được tổng hợp để cung cấp thông tin - hãy nhấp vào liên kết nguồn để xem toàn bộ câu chuyện. Các mục demo có tính minh họa.