Pasokan komputasi, GPU, pusat data, dan energi — lapisan fisik yang menentukan seberapa murah AI dijalankan.
cerita 189
Menghitung pasokan, energi, dan kapasitas pusat data menentukan seberapa murah AI dapat dijalankan. Pergeseran infrastruktur muncul dalam biaya inferensi beberapa minggu kemudian.
URL Artikel: https://www.ft.com/content/f8c03b5b-e194-4236-82c3-389b6f5dd7ae URL Komentar: https://news.ycombinator.com/item?id=49087537 Poin: 34 # Komentar: 5
Keputusan ini diambil seiring dengan pesatnya pembangunan pusat data yang membuat operator jaringan listrik berebut untuk menghasilkan listrik.
Jaksa Taiwan telah menahan seorang karyawan Nvidia sehubungan dengan dugaan ekspor ilegal server Super Micro AI ke Tiongkok, menurut Bloomberg dan Reuters. Artikel Taiwan menahan karyawan Nvidia di…
Banyak hal yang tidak boleh Anda lakukan di pesawat adalah hal yang tidak boleh Anda lakukan sama sekali.
Lee, seorang insinyur di divisi semikonduktor Samsung, akan bekerja ketika giliran kerjanya berakhir. Dia biasanya bekerja dengan jam kerja yang lebih panjang, berusaha lebih keras untuk unggul dalam proyeknya. Namun akhir-akhir ini, dia langsung pulang ke rumah untuk mengerjakan…
Armenia bukanlah negara besar. Ini bukan negara kaya. Ini bukan negara yang terkenal. Namun, mereka tidak hanya menjadi konsumen berbagai produk AI seperti generator subtitle Clideo untuk pengeditan video, atau raksasa…
Orang-orang mengunjungi stan Kimi, sebuah LLM yang dikembangkan oleh startup Tiongkok Moonshot, selama Konferensi AI Dunia di Shanghai, Tiongkok, 20 Juli. | Gambar: LONG WEI/ Fitur China/Penerbitan Masa Depan melalui Getty Images Silicon…
Di TechCrunch Disrupt 2026, Tahap Sistem Cerdas akan menjadi tempat energi, infrastruktur, dan teknologi bertabrakan, mencakup segala hal mulai dari terobosan fusi hingga tekanan jaringan listrik yang ditimbulkan oleh AI pada seluruh perekonomian.
'Anda mengumpulkan listrik di luar angkasa, dan Anda mengeluarkan panas di luar angkasa. Satu-satunya hal yang datang ke Bumi adalah data.'
Kompleksitas desain chip modern terus berkembang seiring tim teknik bekerja untuk mengembangkan CPU, GPU, dan sistem AI yang semakin canggih. Untuk membantu menjawab tantangan tersebut, NVIDIA berkolaborasi dengan pemimpin industri…
Pada episode terbaru Equity, kami membahas mengapa Kimi dari Moonshot AI tampak membuat panik Silicon Valley dan Wall Street.
Jelajahi TileLang, bahasa khusus domain Python tingkat tinggi yang menyederhanakan desain kernel GPU berkinerja tinggi. Tutorial ini memberikan pendekatan langkah demi langkah untuk mengimplementasikan beban kerja yang kompleks—termasuk ubin…
Penelitian yang dilakukan di Virginia Utara mengungkapkan betapa buruknya respons pusat data terhadap gangguan jaringan listrik. Berikut cara memperbaiki masalahnya.
Samsung Galaxy Z Fold 8 Ultra adalah ponsel yang bagus, tetapi ada sesuatu yang lebih menarik dari Galaxy Z Fold 8.
Dengan ponsel lipat terbaru Samsung, perusahaan menawarkan perubahan desain dan perangkat lunak yang membuat Z Fold tahun lalu pun terasa tidak cukup.
Datalab menulis ulang Marker sebagai saluran tiga mode. Versi 2 mencapai 76,0 pada olmOCR-bench dan mempertahankan 2,9 halaman per detik pada satu B200 — lebih dari 5× backend pipeline MinerU, sekaligus mengalahkan Docling dalam hal akurasi dan kecepatan. H…
Datalab menulis ulang Marker sebagai saluran tiga mode. Versi 2 mencapai 76,0 pada olmOCR-bench dan mempertahankan 2,9 halaman per detik pada satu B200 — lebih dari 5× backend pipeline MinerU, sekaligus mengalahkan Docling dalam hal akurasi dan kecepatan. H…
URL Artikel: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference URL Komentar: https://news.ycombinator.com/item?id=49041347 Poin: 17 # C…
Peraturan ini akan memungkinkan negara untuk memutuskan seberapa banyak—jika ada—masukan publik yang dapat diberikan.
Dalam tutorial ini, kami membangun alur kerja lengkap untuk menjalankan model Unlimited-OCR Baidu pada gambar dokumen dan PDF multi-halaman. Dari mengonfigurasi lingkungan GPU hingga membandingkan inferensi dan kecepatan Gundam dengan detail tinggi…
URL Artikel: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 URL Komentar: https://news.ycombinator.com/item?id=49…
Kelangsungan hidup pusat data orbital yang menampung model bahasa besar (LLM) terbesar dan paling mumpuni masih diperdebatkan. Namun penerapan besar-besaran yang membutuhkan ribuan GPU bukanlah satu-satunya cara LLM dapat pro…
Seseorang memegang tanda selama protes nasional terhadap perluasan pusat data AI di luar Peace Hall di New Port Richey, Florida. | AFP melalui Getty Images Pada Sabtu pagi yang kelabu dan lembab di Florida tengah, sedikit…
Pendiri dan CEO NVIDIA Jensen Huang hari ini mengunjungi Sekolah Pascasarjana Angkatan Laut di Monterey, California, untuk meresmikan sistem NVIDIA DGX GB300 — menjadikan salah satu platform AI terkuat di dunia sepenuhnya online untuk…
URL Artikel: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ URL Komentar: https://news.ycombinator.com/item?id=49007525 Poin: 39 # Komentar: 53
Samsung Galaxy Z Fold 8 Ultra memiliki semua kekuatan yang Anda perlukan, tetapi harga dan aksesori untuk Google Pixel 10 Pro Fold mungkin merupakan penawaran yang lebih baik.
OpenAI menguraikan komitmennya untuk memajukan ilmu pengetahuan Amerika, bekerja sama dengan Departemen Energi AS dan laboratorium nasional untuk menggunakan AI terdepan guna mempercepat penemuan.
SenseTime telah meluncurkan Proyek Galaxy, bekerja sama dengan hampir 20 mitra untuk meningkatkan infrastruktur chip AI domestik di Tiongkok. Dalam keynote bertajuk 'Transformasi dan Simbiosis Cerdas', Yang Fan – salah satu co-f…
Janji tersebut diperkenalkan pada bulan Maret, dan sejauh ini tidak berbuat banyak untuk meredakan kekhawatiran. | Gambar: Cath Virginia / The Verge, Getty Images Menghadapi reaksi negatif atas kekhawatiran bahwa ledakan AI akan meningkatkan tagihan listrik konsumen…
Pusat data baru yang dibangun hingga tahun 2033 dapat mengonsumsi listrik sebanyak yang digunakan India saat ini.
https://www.energy.gov/undersecretaryforscience/genesis-miss... URL Komentar: https://news.ycombinator.com/item?id=48995074 Poin: 84 # Komentar: 56
AI telah memasuki era skala raksasa. Pabrik-pabrik AI tercanggih di dunia menyatukan ratusan ribu GPU dan CPU untuk melatih model-model terdepan, memperkuat AI agen, dan menghasilkan kecerdasan pada tingkat yang belum pernah terjadi sebelumnya…
Platform Vera Rubin milik Nvidia menggabungkan CPU dan GPU ke dalam satu sistem, yang mencerminkan ambisi perusahaan yang semakin besar untuk mendukung setiap lapisan infrastruktur AI.
Alphabet, perusahaan induk Google, dilaporkan sedang mengerjakan chip baru yang dirancang untuk membuat model Gemini bekerja lebih efisien.
Google sedang mengembangkan "Frozen v2", sebuah chip server yang memasukkan arsitektur Gemini langsung ke dalam perangkat keras. Menurut sumber internal, TPU ini bisa 6 hingga 10 kali lebih efisien dibandingkan TPU yang ada saat ini. Dijadwalkan pada tahun 2028,…
Postingan ini menjelaskan bagaimana Couchbase mengadopsi Amazon Bedrock untuk mendukung Capella iQ dengan rangkaian model Claude Anthropic, keputusan arsitektur di balik pendekatan multi-model mereka, dan manfaat operasional yang direalisasikan…
Microsoft memperluas infrastruktur AI Azure dengan platform Helios baru AMD, yang akan menantang sistem GPU Nvidia pada paruh kedua tahun 2026. Profil GitHub publik menunjukkan bahwa Anthropic juga sedang menguji AMD…
Erin Davis menyebutnya “SuperDuperPOD.” Ada dua hal dalam satu nama: raksasa farmasi Bristol Myers Squibb (BMS) telah menjalankan salah satu klaster AI terbesar dalam ilmu kehidupan, dengan hasil yang serius.…
Perusahaan-perusahaan AI terkemuka di Tiongkok meningkatkan tekanan terhadap Silicon Valley, ketika Moonshot dan Alibaba meluncurkan model-model yang mereka klaim dapat bersaing dengan yang terbaik dari OpenAI dan Anthropic dengan biaya yang lebih murah. Rapnya…
Kami membangun alur kerja NVIDIA NeMo AutoModel menyeluruh di Google Colab menggunakan satu GPU. Kami memverifikasi perangkat keras CUDA dan dukungan presisi, menginstal NeMo AutoModel dari sumber, dan memuat resep resmi LoRA Qwen3-0.6B. A…
Neil Rimer, pemodal ventura yang ikut mendirikan Index Ventures, memperkirakan kekayaan bersejarah yang dihasilkan AI di Silicon Valley harus didistribusikan kembali, baik secara sukarela maupun tidak.
Meta dilaporkan sedang dalam pembicaraan dengan Anthropic untuk menyewakan kapasitas komputasi dari pusat datanya. Artikel Rencana Zuckerberg untuk menjual kelebihan komputasi AI dapat menemukan pelanggan besar pertamanya di Anthropic muncul pertama kali di Th…
Moonshot AI telah merilis Kimi K3, model yang menurut penilaian awal cocok dengan Opus 4.8 Anthropic, yang dibuat oleh tim yang hanya terdiri dari 300 orang. Bahkan ahli strategi OpenAI Dean W. Ball menyebutnya "sangat bagus", tetapi tentu saja memperingatkan bahwa…
Levoit Vital 200S-P adalah pembersih udara cerdas yang tiada duanya, dengan pra-filter yang dapat dicuci dan kapasitas membersihkan hingga 1.800 kaki persegi dalam satu jam.
Pemadaman listrik selama tiga hari mengungkapkan masalah yang tidak pernah saya temukan di lembar spesifikasi pembangkit listrik.
Sarah Friar, CFO OpenaAI, memperkenalkan kartu skor AI praktis untuk mengukur ROI melalui pekerjaan yang berguna, biaya per tugas yang berhasil, ketergantungan, dan laba atas komputasi.
<p>Saran bagi para hyperscaler yang merasakan tekanan atas penggunaan air di pusat data:</p> <p>Beli beberapa country club eksklusif, ubah lapangan golf menjadi taman umum, bayar pemandu dan teropong untuk mendapatkan anggota sebelumnya…
Di Uncanny Valley saat ini, kami mengungkap drama OpenAI yang sedang berlangsung, baik secara hukum maupun reputasi, dan apakah perkembangan ini dapat semakin merugikan perusahaan—khususnya dalam perjuangannya melawan Anthropic.
Di 107 perusahaan, belanja infrastruktur AI mengalami percepatan jauh melebihi kemampuan perusahaan untuk melihat atau mengarahkan perekonomiannya. Sebagian besar organisasi menjalankan AI mereka berdasarkan hyperscaler dan API penyedia model, namun…
Kami menjelajahi Patter SDK dengan membangun alur kerja agen suara untuk kasus penggunaan pemesanan restoran. Kami mendefinisikan variabel penelepon dinamis, mendaftarkan alat yang dapat dipanggil untuk ketersediaan, pemesanan, jam kerja, dan transfer manusia, serta lay…
Robot serba guna dan mesin otonom beralih dari laboratorium penelitian ke penerapan pasar massal di dunia nyata, sehingga menciptakan permintaan akan superkomputer AI yang ringkas dan hemat daya yang mampu menjalankan model dasar di ...
Dibangun bermitra dengan AWS Generative AI Innovation Center (GenAIIC), AWS Partner AND Digital, dan tim akun AWS untuk menciptakan mesin pemrosesan dokumen yang dapat diskalakan dan didukung AI yang dapat mengklasifikasikan, membagi, mengekstrak, mengevaluasi…
Solix E10 dari Anker membuat daya cadangan dapat dimengerti untuk pemula ini, dan saya tidak sabar untuk memperluas sistemnya.
New York telah menjadi negara bagian pertama yang menghentikan sementara persetujuan pusat data besar, karena Gubernur Kathy Hochul berpendapat bahwa ledakan pembangunan yang didorong oleh AI tidak boleh mengorbankan biaya listrik yang lebih tinggi, pasokan air,…
Moratorium pusat data di New York mungkin menjadi cetak biru gerakan anti-AI.
Ketenagalistrikan merupakan kendala yang tidak dapat dihindari dalam infrastruktur AI. Berapa banyak token yang dapat dihasilkan oleh pabrik AI dalam anggaran daya tetap menentukan pendapatan dan profitabilitasnya. Oleh karena itu, kinerja per watt — metrik yang…
Demis Hassabis, saat sesi panel di Forum Ekonomi Dunia di Davos, Swiss. | Gambar: Bloomberg via Getty Images Demis Hassabis berpendapat dunia membutuhkan pengawas AI yang memiliki kekuatan untuk mengerem jika menghadapi…
URL Artikel: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ URL Komentar: https://news.ycombinator.com/item?id=48901420 Poin: 19 # Komentar: 4
Dari semua perdebatan yang terjadi mengenai potensi kerugian AI, ada satu kekhawatiran yang paling menimbulkan kekhawatiran di kalangan penggemar AI di Silicon Valley — bahwa laboratorium AI raksasa yang menjual model berpemilik adalah…
Kami menguji komputer all-in-one terbaik yang menggabungkan kekuatan PC desktop dengan desain ramping dan ringan.
Tanda halaman yang menentang pusat data yang direncanakan ditampilkan di sepanjang Route 54 di Kotapraja Mount Carmel Northumberland County. | Gambar: Getty Images Ini adalah The Stepback, buletin mingguan yang menguraikan satu cerita penting dari…
Dalam tutorial ini, kami menjelajahi pemrograman GPU berbasis ubin NVIDIA dengan TileGym, membangun alur kerja Colab yang berjalan di berbagai perangkat keras. Kami menyelidiki lingkungan CUDA, mencoba backend cuTile yang sebenarnya, dan kembali ke Tr…
Setelah peluncuran ChatGPT Work dan GPT-5.6 Sol, OpenAI menyadari adanya masalah signifikan: penggunaan komputasi yang berlebihan, transisi yang membingungkan ke antarmuka desktop untuk chat dan proyek, perbedaan yang tidak jelas…
URL Artikel: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ URL Komentar: https://news.ycombinator.com/item?id=48865717 Poin: 17 # Komentar: 0
Dalam postingan ini, Anda akan mempelajari empat pola penerapan untuk mengambil model yang telah dikuantisasi dengan Unsloth dan menerapkannya pada infrastruktur AWS. Polanya menggunakan Amazon Elastic Compute Cloud (Amazon EC2)…
Sebuah perusahaan penyimpanan tenaga surya dan energi rumah tangga sedang berekspansi ke pusat data AI, namun tidak dengan membangun pusat data AI. Sebaliknya, perusahaan tersebut menawarkan pembayaran kepada pelanggannya untuk memasang unit komputasi di rumah mereka. Sunrun meluncurkan program percontohan…
Jika Anda membutuhkan lebih banyak kekuatan daripada yang dapat disediakan oleh layanan hosting bersama, penyedia hosting VPS teratas dapat memberi Anda sumber daya khusus dan skalabilitas yang diperlukan untuk mendorong proyek Anda ke tingkat berikutnya.
Rangkaian model baru OpenAI akan terus mendukung rangkaian aplikasi tempat kerja dan produktivitas Microsoft.
NVIDIA telah merilis Nemotron-Labs-3-Puzzle-75B-A9B, varian terkompresi dari Nemotron-3-Super. Teka-teki Iteratif menggantikan kompresi struktural yang sadar perangkat keras dengan fase pemulihan distilasi pengetahuan singkat. Modusnya…
Setelah membuktikan betapa berharganya komputasi, perusahaan ini mendapati dirinya berada di pusat pasar yang semua orang ingin masuki — sementara teknologi yang lebih sederhana dan perusahaan yang kurang menarik malah menjadi kaya raya.
URL Artikel: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html URL Komentar: https://news.ycombinator.com/item?id=48846708 Poin: 4…
GFN Thursday ini menghadirkan lebih banyak game, lebih banyak kekuatan, dan lebih banyak cara untuk bermain di GeForce SEKARANG. Layanan cloud gaming diperluas dengan server baru yang didukung GeForce RTX 5080 di Toronto, menghadirkan kinerja tinggi khusus di…
NVIDIA telah merilis Nemotron-Labs-3-Puzzle-75B-A9B, varian terkompresi dari Nemotron-3-Super. Teka-teki Iteratif menggantikan kompresi struktural yang sadar perangkat keras dengan fase pemulihan distilasi pengetahuan singkat. Modusnya…
Peran baru Kevin Weil di Stoke Space menunjukkan bahwa roket yang dapat digunakan kembali adalah hal yang populer berikutnya di Silicon Valley.
Tentu saja, kabel ekstensi rumah dan soket ekstensi sangat berguna, namun kabel tersebut juga mengakibatkan ribuan kebakaran yang dapat dicegah setiap tahunnya. Inilah cara menggunakannya dengan lebih aman.
Pembebanan tagihan listrik Rust Belt mengancam rencana produksi Trump.
Microsoft adalah raksasa Silicon Valley terbaru yang mengurangi pengeluaran AI-nya.
Startup Tiongkok Deepseek sedang membangun chip AI-nya sendiri, lapor Reuters. Artikel Deepseek sedang merancang chip AI-nya sendiri muncul pertama kali di The Decoder.
OpenAI menambahkan dua model Realtime ke API-nya. GPT-Realtime-2.1-mini adalah model penalaran mini untuk suara, dengan harga seperti gpt-realtime-mini sebelumnya. OpenAI juga mengurangi latensi p95 setidaknya 25% melalui peningkatan caching. Dia…
Fable 5 dari Anthropic menjanjikan kekuatan AI yang mistis, tetapi pembatasan yang mengejutkan membuat saya bertanya-tanya apakah ini lebih merepotkan daripada manfaatnya untuk penggunaan sehari-hari.
URL Artikel: https://xcancel.com/i/article/2072830533739192560 URL Komentar: https://news.ycombinator.com/item?id=48792463 Poin: 17 # Komentar: 1
URL Artikel: https://github.com/openai/codex/issues/30364 URL Komentar: https://news.ycombinator.com/item?id=48789428 Poin: 131 # Komentar: 41
URL Artikel: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 URL Komentar: https://news.ycombinator.com/item?id=48774246 Poin: 18 # Komentar: 6
Pesatnya perluasan infrastruktur kecerdasan buatan biasanya dibingkai sebagai masalah energi. Pusat data diproyeksikan akan mengkonsumsi sebagian besar permintaan listrik global: Badan Energi Internasional…
Berita ini muncul sekitar seminggu setelah OpenAI mengumumkan chip AI kustomnya dalam kemitraan dengan Broadcom.
Anthropic dilaporkan sedang dalam pembicaraan dengan Samsung Electronics tentang pembuatan chip AI khusus. Proyek ini masih awal, tetapi Anthropic telah merekrut insinyur chip. Setelah "Jalapeño" OpenAI, AI besar lainnya…
Eufy Omni S2 lebih baik dari pendahulunya dengan daya isap empat kali lipat, dan roller pel bebas bau.
Nvidia semakin bertindak seperti bank sentral bagi startup AI dan secara aktif membentuk pasar komputasi. Artikel Nvidia mendanai startup AI untuk melonggarkan cengkeraman Big Tech pada bisnis chipnya muncul pertama kali di The…
Google mencoba menyeimbangkan emisi pusat data AI dengan upaya energi ramah lingkungan.
URL Artikel: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ URL Komentar: https://news.ycombinator.com/item?id=48759329 Poin: 26 # Komentar…
Saat AI beralih dari pengembangan model ke inferensi produksi, permintaan komputasi semakin cepat dan beralih ke pabrik AI yang terus beroperasi yang menghasilkan token dalam skala besar. Pergeseran ini membutuhkan akses terhadap skala besar…
Sound membangun reputasinya berdasarkan taruhan yang terkonsentrasi dan bernilai tinggi di laboratorium AI yang terdepan di kategori tersebut, sementara dana baru Kutcher tampaknya mengejar lapisan di bawah perusahaan-perusahaan tersebut — infrastruktur dan energi yang memberdayakan…
Artikel ini dipersembahkan oleh Melbourne Convention Bureau (MCB) yang didukung oleh Business Events Australia. Ketika kecerdasan buatan mempercepat permintaan komputasi global, kendala serupa juga muncul dengan…
Meta sedang mengembangkan rencana untuk bisnis infrastruktur cloud, menjual akses ke kekuatan dan model komputasi AI. Langkah ini akan mengadunya dengan penyedia cloud besar seperti Amazon Web Services, Google Cloud, dan Microsoft Az…
URL Artikel: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute URL Komentar: https://news.ycombinator.com/item?id=48745966 Poin: 15 # Komentar: 11
“Tempat dengan biaya terendah untuk menempatkan AI adalah di luar angkasa, dan hal itu akan terwujud dalam waktu dua tahun, mungkin paling lambat tiga tahun,” kata pendiri SpaceX, Elon Musk, kepada Forum Ekonomi Dunia di Davos pada bulan Januari lalu, saat perusahaannya…
Menurut laporan The Information, OpenAI telah memangkas biaya inferensi untuk model AI-nya hingga lebih dari setengahnya. Perusahaan menerapkan pengoptimalan pada ChatGPT, sehingga jumlah GPU Nvidia yang dibutuhkan turun menjadi hanya beberapa…
Ilmu hayati telah memasuki era skala komputasi, dan selama lebih dari satu dekade, NVIDIA telah membangun tumpukan komputasi berakselerasi GPU secara penuh — yang mencakup perangkat keras, kerangka kerja, perpustakaan, model, layanan mikro, dan domain…
Dalam postingan ini, kami mengeksplorasi bagaimana Outpost VFX mencapai kecepatan pelatihan 8x lebih cepat menggunakan infrastruktur AWS untuk mengubah alur kerja penggantian wajah, arsitektur teknis yang mereka terapkan untuk mengatasi batas GPU tunggal…
Pihak berwenang Taiwan telah menggerebek kantor Super Micro Computer dan beberapa perusahaan mitra lokal. Artikel Taiwan menggerebek kantor Super Micro untuk menyelidiki penyelundupan chip Nvidia ke China muncul pertama kali di The…
URL Artikel: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ URL Komentar: https://news.ycombinator.com/item?id=48727538 Poin: 27 # Komentar: 22
Berikut cara memanfaatkan kemampuan pembangkit listrik Anda saat tidak dalam keadaan darurat.
xFusion menghadirkan model komputasi AI perusahaan yang skalabel di ISC 2026, mentransisikan perangkat keras dari perangkat edge ke pusat data. Pembeli teknologi perusahaan yang menghadiri pameran Hamburg mencari produksi praktis…
URL Artikel: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark URL Komentar: https://news.ycombinator.com/item?id=48712791 Poin: 15 # Komentar: 2
Mengetahui fakta tentang daya solar di rumah dapat membantu Anda membuat pilihan yang lebih baik dan informasi, menghemat uang, dan tetap aman.
Pendiri 360, Zhou Hongyi menghadirkan dua alat keamanan AI yang dirancang untuk bersaing dengan Mythos Anthropic. Seseorang telah menandai 3.432 kerentanan. Zhou mengakui model Tiongkok tertinggal 20 hingga 30 persen dibandingkan model Barat, namun…
Tidak semua orang percaya dengan visi Elon Musk untuk pusat data orbital.
Bagi mereka yang menggunakan llms di macbook, Ingin memahami perbedaan macbook dengan GPU khusus dalam menjalankan model tersebut? dan bagaimana cara mengetahui seberapa besar kemampuan macbook dalam menjalankan suatu model? URL Komentar: https://ne…
Nvidia telah mendominasi pasar chip AI selama bertahun-tahun, namun era ketergantungan total mungkin akan segera berakhir. OpenAI baru saja menyampaikan rencananya untuk menyempurnakannya dengan Jalapeño, chip inferensi khusus yang dibuat dengan Broadcom, bergabung dengan G…
Nvidia telah mendominasi pasar chip AI selama bertahun-tahun, namun era ketergantungan total mungkin akan segera berakhir. OpenAI baru saja menyampaikan rencananya untuk menyempurnakannya dengan Jalapeño, chip inferensi khusus yang dibuat dengan Broadcom, bergabung dengan G…
Kritikus Anthropic mengklaim bahwa perusahaan ini secara cepat mengumpulkan kekuatan. Perusahaan mengatakan bahwa hal itu adalah peningkatan pengembangan AI yang bertanggung jawab.
Keputusan MGM Studios yang dimiliki Amazon untuk menariknya data film OpenAI hanya bagian dari perkembangan yang semakin erat antara industri AI dan industri film. Pada Uncanny Valley, kami melihat arah mana ini berlangsung.
Kenaikan harga ini disebabkan oleh kenaikan biaya chip memori dan kekurangan persediaan, tetapi masih ada kesempatan untuk mendapatkan kesepakatan jika Anda tahu tempat untuk mencari.
Un-0 adalah alat sistem generasi gambar yang untuk pertama kalinya menunjukkan bagaimana teknologi perusahaan dapat replikasi sistem AI konvensional.
Ini adalah pasar yang berat untuk GPU, tetapi masih ada beberapa kesempatan penawaran yang bagus untuk diambil selama Hari Prime Amazon. Berikut adalah lima yang layak dicek.
Untuk merayakan status baru sebagai No. 1 di peringkat kualitas awal JD Power untuk produsen kendaraan umum, Ford membuka tentang tantangan yang dihadapi dalam beberapa tahun terakhir, khususnya seputar ketergantungan nya atas sistem otomatis...
Mengapa latensi organisasi menjadi hambatan terbesar dalam mewujudkan manfaat AI sepenuhnya
Qualcomm menggeser ke pasar data center dengan prosesor baru yang disebut Dragonfly C1000. Artikel Qualcomm memasuki pasar data center dengan prosesor sendiri pertama kali muncul di The Decoder.
Transistor nanostack IBM dapat meningkatkan kinerja atau efisiensi energi cip.
Trajektori keuangan OpenAI sangat tergantung pada biaya infrastruktur, kenyataan ini yang mendorong pengembangan chip khusus OpenAI Jalapeño yang baru. Dikembangkan dalam kerjasama dengan Broadcom, aplikasi spesifik integ…
Perlombaan silikon memasuki tahap panas di tengah perjuangan untuk memenuhi permintaan.
Gradium merilis dua model translasi suara real-time, stt-translate dan s2s-translate, yang mencakup Bahasa Inggris, Perancis, Jerman, Spanyol, dan Portugis di 20 pasangan bahasa. Model tersebut menggabungkan standar tiga model…
Pengumuman: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... URL Tanggapan:…
Dalam posting ini, kami menunjukkan arsitektur dan pendekatan yang digunakan Loka untuk mengatasi gangguan yang umum: asisten suara robotik dan lambat yang menyebabkan pelanggan menarik telp, merusak reputasi merek dan menaikkan biaya dukungan.
OpenAI baru saja mengumumkan chip "prosesor kecerdasan" baru untuk server AI yang dibuat dalam kerjasama dengan Broadcom. Chip yang disebut Jalapeño dirancang untuk mempertahankan model bahasa besar saat ini dan mendatang, menurut penelitian...
OpenAI menambahkan perangkat keras ke stack teknologi mereka. Chip "Jalapeño", yang dikembangkan bersama Broadcom, disesuaikan untuk inferensi model bahasa besar dan diharapkan berjalan skala besar mulai akhir 2026. Artikel OpenAI dan Broadcom u...
URL Artikel: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ URL Komentar: https://news.ycombinator.com/item?id=48659257 Poin: 141 # Komentar: 1
Model bahasa mungkin menulis prosa yang lebih bersih daripada sebagian besar manusia, tetapi minta 100 argumen tentang topik dan mereka akan bersama-sama. Pemikiran manusia jauh lebih beragam, kata CEO Pangram Max Spero, dan itu yang mungkin...
UC San Diego DFlash menggantikan drafting autoregressive dengan model penyebaran blok ringan untuk dekoding spekulatif. DFlash membuat draft blok token seluruhnya dalam jalur maju tunggal dan membedakannya berdasarkan fitur tersembunyi target.
OpenAI dan Broadcom meluncurkan Jalapeño, chip AI khusus yang dibangun untuk inferensi LLM untuk meningkatkan performa, efisiensi, dan skala di sistem AI.
Membangun sistem AI skala besar memerlukan, membutuhkan inferensi rendah laten, pencarian vektor cepat, kinerja harga GPU yang kuat dan infrastruktur yang dapat tumbuh tanpa menggandakan kompleksitas operasional. Terbaru NVIDIA...
Dalam tutorial ini, kami membangun pipelijn ASR dan penerjemahan berbagai bahasa dengan NVIDIA Canary-1B-v2. Kami memuat model di runtime yang disediakan GPU, mempersiapkan audio ke 16 kHz mono, dan menjalankan ASR Bahasa Inggris. kemudian kami menerjemahkan...
Hello, saya ingin berbagi dengan semua orang peta interaktif tentang batasan ekonomi dan fisika dari pengembangan AI. Ini memiliki penggerak makro, poin penyangkut industri, dan tempat itu muncul di pasar. Saya telah menambahkan 393 node...
Berita Utama: Teknologi NVIDIA berjalan di 81% TOP500 dan 90% sistem yang baru masuk dalam daftar. 26 sistem di TOP500 mengadopsi CPU NVIDIA Grace, bertambah delapan dari daftar sebelumnya. Sistem yang teratas delapan di Gree…
Tumbuhnya ancaman cyber AI di seluruh dunia tidak lagi menjadi masalah yang jauh untuk pusat data perusahaan, menurut peringatan publik yang penting dari aliansi intelijen paling kuat di dunia. Pada 22 Juni 2026, keamanan cyber...
Temukan bagaimana Omio menggunakan OpenAI untuk mempertahankan pengalaman perjalanan berbicara, mempercepat pengembangan produk, dan berubah menjadi perusahaan AI-native.
Tolakan publik terhadap pusat data telah menekankan pemakaian air dan energi mereka, dan sekarang Nvidia menyoroti klaimnya bahwa desain referensi generasi Rubin untuk pusat data yang penuh dengan pendingin cair mempunyai "elim...
Nvidia mengumumkan sistem penyejuk baru yang memotong penggunaan air di dalam pusat data. Tetapi hal itu tidak melakukan apapun untuk mengatasi penggunaan air terbesar AI — pemeliharaan batubara.
Microsoft membangun kampus pusat data sekitar 2 gigawatt di Pecos, Texas, salah satu penambahan kapasitas tunggal terbesar dalam sejarah perusahaan. Dalam surat terbuka, perusahaan berjanji harga listrik yang stabil dan penggunaan air yang minim, d…
JUPITER, superkomputer eksascale pertama di Eropa yang berada di Forschungszentrum Jülich Jerman, berjalan dengan Superchip Grace Hopper NVIDIA dan jaringan InfiniBand Quantum-X800 NVIDIA — dan tahunnya sibuk. Sebagai internasional...
Misi, Visi dan Veritas — superkomputer baru Laboratorium Nasional Los Alamos (LANL) yang akan dibangun dengan HPE dan NVIDIA — sedang menggunakan CPU NVIDIA Vera untuk mempercepat penemuan sains, membuka AI agentic untuk sains.…
Abad berikutnya AI tidak akan ditentukan hanya dengan komputasi. Pertumbuhannya akan ditentukan oleh energi. Sebagai penghitungan yang dipercepat skala di pabrik AI, AI agentic, AI industri, edge computing, dan AI fisik — termasuk...
Perusahaan Teknologi Besar menyumpah uang untuk membangun data center. Dengan pertumbuhan oposisi nasional terhadap fasilitas ini, beberapa pekerja mulai bertanya apakah hal ini layak.
Kami membangun alur kerja peng ramalan end-to-end dengan TimeCopilot di atas panel data penumpang penerbangan nyata dan serupa musiman yang diinjeksikan anomali. Kami mengevaluasi statistik, dasar, dan opsional GPU-based…
Ada logika komersial yang menentang gagasan bahwa ASML akan berisiko lisensi ekspornya untuk mempersenjatai pelanggan Cina.
Amazon SageMaker AI menyediakan hosting inferensi real-time yang dilayani penuh untuk model mesin belajar. Anda mengirimkan model ke endpoint SageMaker yang didukung oleh satu atau lebih instansi perhitungan, dan SageMaker mengelola pemberian…
Mainkan judul favorit dari pustaka permainan populer, simpan kemajuan yang disinkronkan, dan kembali ke sesi permainan di hampir semua perangkat. Itu kekuatan GeForce NOW cloud gaming. Dari memberikan akses ke pustaka permainan favorit anggota...
Dengan meniru bagaimana otak beroperasi, perhitungan neuromorfik dapat menggunakan energi yang jauh lebih sedikit daripada chip AI elektronik konvensional. Meski demikian, bahkan peralatan neuromorfik yang paling canggih saat ini masih sangat sederhana,...
Sebelumnya di NVIDIA GTC Paris di VivaTech, Perancis mengumumkan rencana untuk maju AI lokal — dari pabrik AI baru dan kapasitas perhitungan nasional hingga model frontier dan platform industri. Sekarang, infrastruktur AI itu d…
Tokenmaxxing adalah tren terpanas di Silicon Valley awal tahun ini, dengan CEO mendesak karyawan untuk memaksimalkan penggunaan AI. kemudian tagihan datang. Uber dilaporkan habis anggaran AI tahunannya i…
Tokenmaxxing adalah tren paling panas di Silicon Valley awal tahun ini, dengan CEO mempromosikan karyawan untuk memakai AI sejauh mungkin. kemudian tagihan datang. Uber dilaporkan habis anggaran AI tahunannya i…
Pindahnya yang dijadwalkan untuk hari Senin akan meningkatkan biaya pengguna tingkat tinggi secara besar-besaran.
Hari ini, kami sangat senang mengumumkan pengecapan citra kontainer untuk inferensi Amazon SageMaker AI, peningkatan utama dalam perjalanan optimisasi skala yang lebih cepat kami. Ini mempercepat latenansi end-to-end hingga 2 kali lipat untuk generasi…
Kaca cerdas masih berada di kategori yang masih muda, tetapi produsen chip Qualcomm sedang bekerja untuk meningkatkan silikon untuk mempertahankan gelombang berikutnya dari perangkat XR: Snapdragon Reality Elite. Meskipun Qualcomm mengumumkan chip hari ini...
Departemen Keadilan mengatakan bahwa Pentagon membutuhkan xAI untuk terus menggunakan turbin gas yang belum disahkan.
Pembuat software Silicon Valley dan perusahaan e-commerce mengungkapkan kepada WIRED bagaimana mereka menyelesaikan tantangan yang muncul dalam “tokenomics”.
Pada akhir babak pertama yang tenang dan tanpa skor antara tim putra Inggris dan rival Jerman, jutaan orang Inggris mengeksplorasi nafas bersama dan melakukan hal yang mereka lakukan sering dalam momen stress: mereka membuat...
Hari ini, saya berbicara dengan Adam Bry, yang menjadi CEO Skydio, produsen utama dron otomatis di AS. Sebelum merekam episode ini, saya sebenarnya dapat mengoperasikan salah satu dron Skydio di Area Teluk dari Adam...
Mirage, model dunia video dari Microsoft Research dan beberapa perguruan tinggi, menyimpan informasi pertunjukan langsung di ruang latent daripada awan titik berdasarkan pixel. Ini memotong waktu perhitungan dan memori grafis sambil tetap...
Bahkan pusat data berukuran sedang pun dapat menimbulkan dampak lokal yang sangat besar.
OpenAI sedang negosiasi untuk menyewa data center yang direncanakan 10 gigawatt di Ohio yang dapat didukung secara keuangan oleh Nvidia, menurut The Information.
Dengan kapasitas awal 24 megawatt, data center inovatif ini menggunakan air laut sebagai sistem penyejuk alam.
Laporan baru dari OpenAI menggambarkan operasi pengaruh yang terhubung dengan PRC menggunakan AI untuk menargetkan debat teknologi di Amerika Serikat, naskah data center, tarif, dan klaim palsu tentang ChatGPT.
Model bahasa besar (LLM) keempat OpenAI, GPT-4, membutuhkan waktu pelatihan sekitar 50 gigawatt-jam, atau setara dengan konsumsi listrik tahunan 5.000 rumah di Amerika. Itu terjadi pada tahun 2023. Sejak itu, sumber komputasi…
Fasilitas 168 megawatt ini akan mendukung kebutuhan perhitungan AI global Meta dan dapat diperluas seiring waktu.
GPU NVIDIA dengan Confidential Computing sekarang digunakan untuk inferensi pribadi di Cloud Pribadi Apple (PCC), saat ia meluas dari pusat data Apple ke Google Cloud. Diperkenalkan selama pertemuan tahunan WWDC Apple.
Pada acara di San Francisco hari ini, General Motors membuat berbagai pengumuman tentang baterai EV, penyimpanan energi, dan kekuatan jaringan di hadapan permintaan energi yang tumbuh dari pusat data AI. Pabrikan mobil ini an…
Dalam posting ini, kami menunjukkan bagaimana melatih kebijakan robot untuk humanoid Unitree H1 dengan NVIDIA Isaac Lab di Amazon SageMaker AI melalui dua opsi perhitungan: Amazon SageMaker HyperPod dan Amazon SageMaker Training Jobs.
Bagaimana Notion menggunakan Codex untuk spesifikasi satu kali, membangun Input Suara AI untuk web, dan melipatgandakan kekuatan teknis di seluruh tim kecil.
Pada hari Selasa, Dewan Kota Seattle akan melakukan pemungutan suara untuk menentukan apakah akan memberlakukan moratorium satu tahun terhadap pusat data baru – hanya dua bulan setelah beberapa perusahaan mengusulkan pembangunan lima pusat data berskala besar di kota tersebut. Di antara…
Dalam tutorial ini, kami mengimplementasikan alur kerja praktis untuk NVIDIA cuTile Python, antarmuka pemrograman GPU berbasis ubin untuk kernel bergaya CUDA dengan Python. Kami menyiapkan lingkungan ramah Colab dan memeriksa GPU, driver, CUDA,…
Google telah memesan lebih dari tiga juta chip AI dari Intel untuk tahun 2028. Nvidia sedang menguji teknologi manufaktur Intel untuk arsitektur Feynman yang akan datang. Kedua langkah tersebut dilakukan karena TSMC tidak dapat memenuhi permintaan chip AI. Ke dalam…
Tim MiMo Xiaomi, dengan TileRT, merilis MiMo-V2.5-Pro-UltraSpeed, mode penyajian untuk model MiMo-V2.5-Pro. Ini menerjemahkan lebih dari 1000 token per detik pada model 1 triliun parameter menggunakan satu node komoditas 8-GPU.…
Dengan akses ke model AI generatif terbaru dan akselerasi komputasi berkinerja tinggi dalam permintaan global yang tinggi, pelanggan AWS memerlukan alat untuk memanfaatkan ketersediaan dan kapasitas model di berbagai Wilayah AWS, dengan…
NVIDIA dan LG Group sedang membangun pabrik AI untuk mempercepat gelombang bisnis berbasis AI berikutnya dari LG Group, yang mencakup robotika, kendaraan otonom, teknologi pusat data, dan layanan cloud GPU. Pabrik AI akan memprov…
Clive Chan, menurut pengakuannya sendiri, adalah karyawan perangkat keras kedua dalam program chip khusus OpenAI, pindah ke Anthropic. Dia membawa pengalaman dari Autopilot ASIC Tesla dan kemitraan OpenAI-Broadcom. Langkah itu dilakukan…
Google merilis Colab CLI, yang memungkinkan developer dan agen AI menjalankan kode lokal pada GPU Colab jarak jauh dan waktu proses TPU. Pos Colab CLI Baru Google Memungkinkan Pengembang dan Agen AI Menjalankan Python pada GPU dan TPU Colab Jarak Jauh F…
Sakana AI telah meluncurkan laboratorium penelitian khusus untuk pengembangan diri secara rekursif: AI yang terus meningkatkan dirinya sendiri. Startup Jepang, yang didirikan bersama oleh salah satu penulis Transformer Llion Jones, melihat RSI sebagai alternatif…
Pengembang merasa "terpukul" karena "tidak punya pilihan" selain mengecilkan pusat data.
NVIDIA telah merilis Nemotron 3 Ultra, Mamba-Transformer hibrida terbuka Mixture-of-Experts total 550B (55B aktif) untuk agen yang sudah berjalan lama. Ini memasangkan konteks token 1 juta dengan throughput inferensi hingga ~6x lebih tinggi dibandingkan…
Meta mungkin telah menemukan satu cara untuk memangkas tagihan pusat datanya yang sangat besar: tenda.
Kevin O'Leary setuju untuk mengurangi separuh rencana pusat data seluas 40.000 hektar di Utah di tengah meningkatnya tekanan dari warga dan aktivis, seperti yang dilaporkan sebelumnya oleh afiliasi lokal ABC4. Bintang Shark Tank itu mengirimkan surat…
Startup California ini merilis robot bantuan rumah generasi keempat, Stretch.
Hyperscaler telah mendapat sorotan karena dampaknya terhadap kualitas dan ketersediaan air.
Komputer kuantum berjanji suatu hari nanti akan memecahkan masalah yang melampaui superkomputer paling kuat yang bisa dibayangkan. Namun sering kali kita kurang menyadari betapa besarnya komputasi klasik yang diperlukan untuk mengoperasikan mesin ini. Sebagai jumlah qubit…
Kapasitas pusat data yang baru di beberapa wilayah memudahkan ketersediaan GPU, membantu mendorong indeks biaya inferensi regional lebih rendah pada minggu ini.
Semakin banyak penyedia yang mengaitkan harga komputasi dengan kondisi energi lokal, sehingga menambahkan dimensi waktu ke tempat dan waktu paling murah untuk beban kerja AI.
Ekosistem NVIDIA AI Cloud mempercepat pembangunan infrastruktur pabrik AI secara global. Para mitra memperluas kapasitasnya untuk memenuhi permintaan yang terus meningkat dari perusahaan, startup, negara, laboratorium AI, dan pengembang yang melakukan penskalaan…
Anthropic merilis Cowork pada hari Senin, kemampuan agen AI baru yang memperluas kekuatan alat Claude Code yang sangat sukses untuk pengguna non-teknis — dan menurut orang dalam perusahaan, tim membangun seluruh fitur…
Ringkasan dikumpulkan untuk informasi saja — ikuti tautan sumber untuk cerita selengkapnya. Entri demo bersifat ilustratif.