コンピューティングの供給、GPU、データセンター、エネルギー - AI をいかに安価に実行できるかを決定する物理層。
178 のストーリー
コンピューティングの供給、エネルギー、データセンターの容量によって、AI をいかに安価に実行できるかが決まります。インフラストラクチャの変化は数週間後に推論コストに現れます。
高性能 GPU カーネルの設計を簡素化する、高レベルの Python ドメイン固有言語である TileLang を調べてください。このチュートリアルでは、タイル化などの複雑なワークロードを実装するための段階的なアプローチを提供します。
バージニア州北部での危機一髪の結果、送電網の混乱に対するデータセンターの対応がいかに劣悪であるかが明らかになった。問題を解決する方法は次のとおりです。
Samsung Galaxy Z Fold 8 Ultra は優れた携帯電話ですが、Galaxy Z Fold 8 にはもっと魅力的なものがあります。
サムスンの最新の折りたたみ式携帯電話では、同社は昨年の Z Fold でさえ不十分だと感じさせるデザインとソフトウェアの変更を提供しています。
Datalab は、Marker を 3 モードのパイプラインとして書き直しました。バージョン 2 は、olmOCR ベンチで 76.0 に達し、1 台の B200 で毎秒 2.9 ページを維持します。これは、MinerU のパイプライン バックエンドの 5 倍を超え、精度と速度の両方で Docling を上回っています。は…
Datalab は、Marker を 3 モードのパイプラインとして書き直しました。バージョン 2 は、olmOCR ベンチで 76.0 に達し、1 台の B200 で毎秒 2.9 ページを維持します。これは、MinerU のパイプライン バックエンドの 5 倍を超え、精度と速度の両方で Docling を上回っています。は…
記事URL: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference コメントURL: https://news.ycombinator.com/item?id=49041347 ポイント: 17 # C…
この規則により、公的意見があれば、その量を州が決定できるようになる。
このチュートリアルでは、Baidu の Unlimited-OCR モデルをドキュメント画像と複数ページの PDF で実行するための完全なワークフローを構築します。 GPU環境の構築から、ハイディテールタイル化されたガンダム推論とファ…
記事URL: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-Produce-more-energy-than-they-consume-stop-theft-of-content/5271535 コメントURL: https://news.ycombinator.com/item?id=49…
最大かつ最も機能的な大規模言語モデル (LLM) をホストする軌道データセンターの存続可能性については、依然として激しい議論が続いています。しかし、数千の GPU を必要とする大規模な導入だけが、LLM が効果を発揮できる唯一の方法ではありません。
フロリダ州ニューポートリッチーの平和会館前で、AI データセンター拡張に対する全国的な抗議活動中にプラカードを掲げる人物。 | AFP via Getty Images フロリダ中央部の灰色で湿気の多い土曜の朝、少し薄暗く…
NVIDIA の創設者兼 CEO のジェンスン ファンは本日、NVIDIA DGX GB300 システムを試運転するためにカリフォルニア州モントレーの海軍大学院を訪れ、世界で最も強力な AI プラットフォームの 1 つを完全にオンライン化して…
記事URL: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ コメントURL: https://news.ycombinator.com/item?id=49007525 ポイント: 39 # コメント: 53
Samsung Galaxy Z Fold 8 Ultra には必要な電力がすべて備わっていますが、価格と付属品を考えると Google Pixel 10 Pro Fold の方が優れている可能性があります。
OpenAI は、米国エネルギー省および国立研究所と協力してフロンティア AI を使用して発見を加速する、米国科学の進歩への取り組みを概説しています。
SenseTime は、中国国内の AI チップ インフラストラクチャを拡張するために、約 20 社のパートナーと協力して Galaxy プロジェクトを立ち上げました。 「インテリジェントな変革と共生」と題した基調講演で、同社の共同研究員であるヤン・ファン氏は…
この誓約は3月に導入されたが、これまでのところ懸念を払拭する効果はほとんどない。 |画像: Cath Virginia / The Verge、Getty Images AI ブームにより消費者の電気料金が上昇するのではないかという懸念に対する反発に直面して…
2033 年までに建設される新しいデータセンターは、インドが現在使用している電力と同じ量の電力を消費する可能性があります。
https://www.energy.gov/undersecretaryforscience/genesis-miss... コメント URL: https://news.ycombinator.com/item?id=48995074 ポイント: 84 # コメント: 56
AIはギガスケール時代に突入しました。世界で最も先進的な AI ファクトリーは、数十万の GPU と CPU を結集して、フロンティア モデルをトレーニングし、エージェント AI を強化し、前例のない速度でインテリジェンスを生成しています…
Nvidia の Vera Rubin プラットフォームは、CPU と GPU を 1 つのシステムに統合しており、AI インフラストラクチャのあらゆる層を強化するという同社の野心を反映しています。
Googleの親会社であるAlphabetは、Geminiモデルをより効率的に実行できるように設計された新しいチップの開発に取り組んでいると伝えられている。
Googleは、Geminiアーキテクチャをハードウェアに直接組み込むサーバーチップ「Frozen v2」を開発している。内部情報源によると、現在の TPU よりも 6 ~ 10 倍効率的である可能性があります。 2028年に予定されており、…
この投稿では、Couchbase が Amazon Bedrock を採用して、Anthropic の Claude ファミリーのモデルで Capella iQ を強化する方法、マルチモデルアプローチの背後にあるアーキテクチャ上の決定、および実現された運用上の利点について説明します。
Microsoft は、AMD の新しい Helios プラットフォームで Azure の AI インフラストラクチャを拡張しており、2026 年後半には Nvidia の GPU システムに挑戦する予定です。公開されている GitHub プロフィールによると、Anthropic は AMD もテストしているようです…
エリン・デイビスはそれを「SuperDuperPOD」と呼んでいます。これは、1 つの名前で 2 つのことを意味します。製薬大手ブリストル マイヤーズ スクイブ (BMS) は、すでにライフ サイエンス分野で最大規模の AI クラスターの 1 つを実行しており、重大な結果を示しています。
Moonshot と Alibaba が、OpenAI と Anthropic の最高の機能をわずかなコストで両立できると主張するモデルを発表し、中国の大手 AI 企業はシリコンバレーへの圧力を強めている。ラップは…
単一の GPU を使用して、Google Colab でエンドツーエンドの NVIDIA NeMo AutoModel ワークフローを構築します。 CUDA ハードウェアと精度のサポートを検証し、ソースから NeMo AutoModel をインストールし、公式 Qwen3-0.6B LoRA レシピをロードします。わ…
Index Ventures の共同設立者であるベンチャーキャピタリストのニール・ライマー氏は、AI がシリコンバレーで生み出してきた歴史的な富は、自発的または非自発的に再分配される必要があると予測しています。
伝えられるところによると、Meta は Anthropic と自社のデータセンターからコンピューティング能力をレンタルする交渉を行っているとのこと。余剰の AI コンピューティングを売却するザッカーバーグの計画により、Anthropic で最初の大口顧客が見つかる可能性があるという記事は、Th… に最初に掲載されました。
Moonshot AI は、初期の評価によると、わずか 300 人のチームによって構築された Anthropic の Opus 4.8 に匹敵するモデル Kim K3 をリリースしました。 OpenAI ストラテジストの Dean W. Ball でさえ、これを「非常に良い」と言っていますが、もちろん次のように警告しています…
Levoit Vital 200S-P は、洗えるプレフィルターを備え、1 時間で最大 1,800 平方フィートを掃除できる能力を備えた、優れたスマート空気清浄機です。
実際の 3 日間の停電により、発電所の仕様書では決して発見できなかった問題が明らかになりました。
OpenaAI の CFO である Sarah Friar は、有用な作業、成功したタスクごとのコスト、信頼性、コンピューティング収益率を通じて ROI を測定する実用的な AI スコアカードを紹介します。
<p>データセンターの水の使用にプレッシャーを感じているハイパースケーラーへの提案:</p> <p>高級カントリー クラブをいくつか買い占め、ゴルフ コースを公共の公園に変え、前のメンバーを獲得するためにガイドと双眼鏡の料金を支払います…
今日の不気味の谷では、法的および評判の両面で OpenAI が現在進行中のドラマを解き明かし、これらの展開が特に Anthropic との戦いにおいて同社にさらに損害を与える可能性があるかどうかを明らかにします。
107 社の企業にわたって、AI インフラストラクチャへの支出は、その経済状況を把握したり、舵取りしたりする能力をはるかに上回って加速しています。ほとんどの組織は、ハイパースケーラーとモデル プロバイダー API という使い慣れたベースで AI を実行していますが、それでも…
レストラン予約のユースケース用の音声エージェント ワークフローを構築することで、Patter SDK を探索します。動的な発信者変数を定義し、可用性、予約、時間、人的転送のための呼び出し可能なツールを登録し、レイヤーを配置します。
汎用ロボットと自律マシンは研究室から現実世界の量販市場への展開に移行しており、基礎モデルを高速で実行できるコンパクトで電力効率の高い AI スーパーコンピューターの需要が生じています。
AWS Generative AI Innovation Center (GenAIIC)、AWS パートナー AND デジタル、および AWS アカウント チームと提携して構築され、分類、分割、抽出、評価ができるスケーラブルな AI を活用したドキュメント処理エンジンを作成します。
Anker の Solix E10 により、バックアップ電源が初めての人でも理解できるようになり、システムを拡張するのが待ちきれません。
キャシー・ホチョル知事は、AI主導の建築ブームは、電気代や水道の供給などのコスト上昇を犠牲にして実現されるべきではないと主張しており、ニューヨーク州は大規模データセンターの承認を一時的に停止した最初の州となった。
ニューヨークのデータセンターの一時停止は、反AI運動の青写真になるかもしれない。
電力は AI インフラストラクチャの避けられない制約です。 AI ファクトリーが一定の電力予算内でどれだけのトークンを生成できるかによって、その収益と収益性が決まります。このため、ワットあたりのパフォーマンスという指標は…
スイスのダボスで開催された世界経済フォーラムのパネルセッション中のデミス・ハサビス氏。 |画像: Bloomberg via Getty Images デミス・ハサビス氏は、世界が危機に陥った場合にブレーキを踏む力を備えた AI 監視機関を必要としていると考えています。
記事URL: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ コメントURL: https://news.ycombinator.com/item?id=48901420 ポイント: 19 # コメント: 4
AI の潜在的なマイナス面について激化するすべての議論の中で、シリコンバレーの AI 愛好家の間で最も頭を悩ませている懸念が 1 つあります。それは、独自のモデルを販売する巨大な AI ラボが何らかの形で…
私たちは、デスクトップ PC のパワーとスリムで軽量なデザインを組み合わせた最高のオールインワン コンピューターをテストしました。
ノーサンバーランド郡マウント・カーメル・タウンシップの国道 54 号線沿いに、計画されているデータセンターの反対側にあるヤード標識が表示されています。 |画像: Getty Images これは、The Stepback です。このニュースレターでは、重要な 1 つのストーリーを詳しく紹介しています。
このチュートリアルでは、TileGym を使用した NVIDIA タイルベースの GPU プログラミングを検討し、さまざまなハードウェア間で実行される Colab ワークフローを構築します。 CUDA 環境を調査し、実際の cuTile バックエンドを試し、Tr にフォールバックします。
ChatGPT Work と GPT-5.6 Sol のリリース後、OpenAI は重大な問題を認識しました。それは、過剰なコンピューティング使用量、チャットとプロジェクトのデスクトップ インターフェイスへの混乱を招く移行、およびインターフェイスの不明瞭な区別です。
記事URL: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ コメントURL: https://news.ycombinator.com/item?id=48865717 ポイント: 17 # コメント: 0
この投稿では、Unsloth ですでに量子化されたモデルを取得し、AWS インフラストラクチャにデプロイするための 4 つのデプロイ パターンを学習します。パターンでは Amazon Elastic Compute Cloud (Amazon EC2) を使用します。
太陽光発電および家庭用エネルギー貯蔵会社は AI データセンターに進出していますが、データセンターを建設するのではなく、顧客に自社のコンピューティング ユニットを自宅に設置するために料金を支払うことを提案しています。 Sunrun はパイロット プログラムを開始しています…
共有ホスティング サービスが提供できる以上のパワーが必要な場合は、トップの VPS ホスティング プロバイダーが、プロジェクトを次のレベルに押し上げるために必要な専用リソースとスケーラビリティを提供します。
OpenAI の新しいモデル ファミリは、引き続き Microsoft の職場および生産性アプリのスイートを強化します。
NVIDIA は、Nemotron-3-Super の圧縮バージョンである Nemotron-Labs-3-Puzzle-75B-A9B をリリースしました。 Iterative Puzzle は、ハードウェアを意識した構造圧縮と短い知識の蒸留回復フェーズを交互に行います。モードは…
コンピューティングがいかに価値があるかを証明した同社は、誰もが参入したい市場の中心にいることに気づきました。一方、より単純なテクノロジーやあまり興味のない企業は傍観者として富を得ています。
記事URL: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-Should-put-silicon-valley-on-high-alert-1095178.html コメントURL: https://news.ycombinator.com/item?id=48846708 ポイント:4…
この GFN 木曜日では、GeForce NOW でさらに多くのゲーム、パワー、さまざまなプレイ方法が提供されます。クラウド ゲーム サービスは、トロントにある新しい GeForce RTX 5080 搭載サーバーによって拡張され、専用の高性能をもたらします。
NVIDIA は、Nemotron-3-Super の圧縮バージョンである Nemotron-Labs-3-Puzzle-75B-A9B をリリースしました。 Iterative Puzzle は、ハードウェアを意識した構造圧縮と短い知識の蒸留回復フェーズを交互に行います。モードは…
ストーク・スペースでのケビン・ワイルの新しい役割は、再利用可能なロケットがシリコンバレーで次に注目されるものであることを示唆しています。
確かに家庭用延長コードや電源タップは便利ですが、それらは年間何千件もの予防可能な火災の原因にもなります。より安全に使用する方法をご紹介します。
ラストベルトの電気代の圧迫はトランプ大統領の製造計画を脅かす。
マイクロソフトは、AI 支出を削減した最新のシリコンバレーの巨人です。
中国の新興企業ディープシークが独自のAIチップを開発しているとロイター通信が報じた。 Deepseek が独自の AI チップを設計しているという記事は、The Decoder に最初に掲載されました。
OpenAI は 2 つのリアルタイム モデルを API に追加しました。 GPT-Realtime-2.1-mini は音声用のミニ推論モデルで、価格は以前の gpt-realtime-mini と同じです。 OpenAI はまた、キャッシュの改善により p95 のレイテンシーを少なくとも 25% 削減しました。彼…
Anthropic の Fable 5 は神話的な AI パワーを約束していますが、驚くべき制限があるため、日常的に使用する価値があるというよりも、面倒な作業のほうが多いのではないかと思います。
記事URL: https://xcancel.com/i/article/2072830533739192560 コメントURL: https://news.ycombinator.com/item?id=48792463 ポイント: 17 # コメント: 1
記事URL: https://github.com/openai/codex/issues/30364 コメントURL: https://news.ycombinator.com/item?id=48789428 ポイント: 131 # コメント数: 41
記事URL: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 コメントURL: https://news.ycombinator.com/item?id=48774246 ポイント: 18 # コメント: 6
人工知能インフラの急速な拡大は、通常、エネルギー問題として捉えられます。データセンターは世界の電力需要の中でますます多くのシェアを消費すると予測されています:国際エネルギー機関…
このニュースは、OpenAIがBroadcomと提携して独自のカスタムAIチップを発表してから約1週間後に発表された。
アンスロピックはカスタムAIチップの製造についてサムスン電子と協議していると伝えられている。このプロジェクトはまだ初期段階にあるが、Anthropic はすでにチップエンジニアを雇用している。 OpenAI の「ハラペーニョ」に続いて、また新たな主要 AI が登場…
Eufy Omni S2 は、前モデルに比べて 4 倍の吸引力と無臭のモップ ローラーを備えています。
Nvidia は AI スタートアップ企業の中央銀行のような役割をますます強めており、コンピューティング市場を積極的に形成しています。 Nvidiaがチップ事業に対するビッグテックの支配を緩めるためにAIスタートアップに資金提供しているという記事は、The…に最初に掲載されました。
Google は AI データセンターの排出量とクリーン エネルギーへの取り組みのバランスをとろうとしています。
記事のURL: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ コメントURL: https://news.ycombinator.com/item?id=48759329 ポイント: 26 # コメント…
AI がモデル開発から生産推論に移行するにつれて、コンピューティング需要が加速し、大規模にトークンを生成する継続的に稼働する AI ファクトリーに移行しています。この変化には大規模なアクセスが必要です…
サウンドは、カテゴリーをリードするAI研究所への集中的で確信度の高い賭けで評判を築きましたが、カッチャーの新しいファンドは、これらの企業の下層、つまり電力を供給するインフラストラクチャとエネルギーを追いかけているようです…
この記事は、メルボルン コンベンション ビューロー (MCB) の支援により Business Events Australia によって提供されています。人工知能によりコンピューティングに対する世界的な需要が加速するにつれ、同等の制約が生じつつあります。
Meta はクラウド インフラストラクチャ ビジネスの計画を策定し、AI の計算能力とモデルへのアクセスを販売しています。この動きにより、Amazon Web Services、Google Cloud、Microsoft Az などの大手クラウドプロバイダーと競合することになる。
記事URL: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute コメントURL: https://news.ycombinator.com/item?id=48745966 ポイント: 15 # コメント: 11
「AIを導入する最も低コストの場所は宇宙になるだろう。それは2年以内、おそらく遅くとも3年以内には現実になるだろう」と、SpaceXの創設者イーロン・マスク氏は今年1月、ダボスで開催された世界経済フォーラムで、彼の会社が…
The Information のレポートによると、OpenAI は AI モデルの推論コストを半分以下に削減しました。同社は ChatGPT に最適化を適用し、必要な Nvidia GPU の数がわずか数個に減少しました。
ライフ サイエンスは計算規模の時代に入りました。NVIDIA は 10 年以上にわたって、ハードウェア、フレームワーク、ライブラリ、モデル、マイクロサービス、ドメインにわたる完全な GPU アクセラレーション コンピューティング スタックを構築してきました。
この投稿では、Outpost VFX が AWS インフラストラクチャを使用して顔置換ワークフローを変革し、単一 GPU の制限を克服するために実装した技術アーキテクチャをどのようにして 8 倍の高速トレーニング速度を達成したかを探ります。
台湾当局はスーパーマイクロコンピューターと複数の現地パートナー企業のオフィスを強制捜査した。 Nvidiaチップの中国への密輸を巡り、台湾がスーパーマイクロのオフィスを捜索するという記事がThe…に最初に掲載された。
記事URL: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ コメントURL: https://news.ycombinator.com/item?id=48727538 ポイント: 27 # コメント: 22
緊急時以外に発電所の機能を活用する方法は次のとおりです。
xFusion は、ISC 2026 でスケーラブルなエンタープライズ AI コンピューティング モデルを発表し、ハードウェアをエッジ デバイスからデータ センターに移行しました。ハンブルク展示会に参加したエンタープライズ テクノロジーのバイヤーは、実用的な生産を求めていました…
記事URL: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark コメントURL: https://news.ycombinator.com/item?id=48712791 ポイント: 15 # コメント: 2
自宅の太陽光に関する事実を知ることで、より良い、情報に基づいた選択をし、お金を節約し、安全に過ごすことができます。
360 の創設者 Zhou Honyi は、Anthropic の Mythos と競合するように設計された 2 つの AI セキュリティ ツールを紹介します。ある企業はすでに 3,432 件の脆弱性を報告しています。周氏は、中国モデルが西側モデルに20~30パーセント及ばないと認めているが、…
軌道上データセンターに関するイーロン・マスクのビジョンを誰もが支持しているわけではありません。
macbook で llms を使用している方は、これらのモデルの実行において macbook が専用 GPU とどのように異なるかを理解したいですか?そして、MacBook がモデルをどの程度実行できるかを知るにはどうすればよいでしょうか?コメントURL:https://ne…
Nvidia は長年にわたって AI チップ市場を独占してきましたが、完全に依存する時代は終わりを迎えるかもしれません。 OpenAI は、Broadcom と共同開発したカスタム推論チップである Jalapeño で物事を盛り上げる計画を共有し、G…
Nvidia は長年にわたって AI チップ市場を独占してきましたが、完全に依存する時代は終わりを迎えるかもしれません。 OpenAI は、Broadcom と共同開発したカスタム推論チップである Jalapeño で物事を盛り上げる計画を共有し、G…
Anthropicの批判者は、その会社が急速に力を蓄積していると主張している。同社は、これが責任あるAI開発の姿だと述べている。
アマゾンが所有するMGMスタジオがOpenAI映画を放棄する決定は、AIと映画産業がますます相互に関連するようになる一環に過ぎない。Uncanny Valleyで、これがどこへ向かうのかを探ります。
価格上昇はメモリチップのコストの急騰と供給不足によるものですが、どこを見つければ良いか分かれば、まだ取引があります。
Un-0は、初めて会社の技術が従来のAIシステムを再現できることを示す画像生成システムツールです。
GPU市場は厳しいですが、Amazon Prime Day中にも良い取引があります。チェックすべき5つをご紹介します。
組織の待ち時間が AI のメリットを十分に享受する上で最大の障壁となっている理由
フォードは、JD Powerの主流の自動車メーカー間の初期品質評価で第1位の新たな地位を祝うために、近年直面した挑戦について語り始めました。特に、自動化への依存に関する挑戦についてです。
Qualcommは新しいプロセッサ「Dragonfly C1000」を使ってデータセンター市場にさらに進出しています。この記事「Qualcommが自社のプロセッサでデータセンター市場に参入」はThe Decoderで最初に登場しました。
IBMのナノスタックトランジスタはチップの性能やエネルギー効率を向上させることができます。
OpenAIの財務的な軌道は、インフラコストに大きく依存しており、この現実が新しいカスタムOpenAI Jalapeñoチップの開発を促進しました。Broadcomと共同開発されたこのアプリケーション特定の統合デバイスは、...
需要に追いつくための半導体競争が激化しています。
Gradiumは、英語、フランス語、ドイツ語、スペイン語、ポルトガル語を含む20の言語ペアをカバーする、2つのリアルタイム音声翻訳モデル、stt-translateとs2s-translateを発表しました。これらのモデルは標準の3モデルの構造を……”
発表: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... コメントURL:…
この記事では、ロボット的で遅いボイスアシスタントが顧客を待たせる原因となり、ブランドの評判を損なうことやサポートコストの増加を引き起こす一般的な問題を解決するために、Lokaが使用したアーキテクチャとアプローチを紹介します。
OpenAIは、Broadcomと共同で開発した新しい「知能プロセッサー」チップ、Jalapeñoを発表しました。このチップは、現在および将来の大規模言語モデルを動力源とするように設計されています。
OpenAIは自社の技術スタックにカスタムハードウェアを追加しています。Broadcomと共同開発された「Jalapeño」チップは、大規模言語モデルの推論に特化しており、2026年末までにスケールアップすることを目指しています。OpenAIとBroadcom u...
記事URL: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ コメントURL: https://news.ycombinator.com/item?id=48659257 点数: 141 # コメント: 1
言語モデルはほとんどの人よりもきれいな文章を書けるかもしれませんが、あるトピックについて100の議論を求めると、すべてが集約されます。Pangram CEOのMax Speroは、人間の推論ははるかに多様であると言い、それが何かかもしれません...
カリフォルニア大学サンディエゴ校の DFlash は、自己回帰ドラフティングを投機的デコード用の軽量ブロック拡散モデルに置き換えます。単一の前方パスでトークン ブロック全体をドラフトし、ターゲットの隠れた特徴に条件を付けます。
OpenAIとBroadcomは、パフォーマンス、効率、AIシステムのスケールを向上させるためにLLM推論用に構築されたカスタムAIチップであるJalapeñoを紹介しました。
スケールの大きなAIシステムの構築は困難であり、低レイテンシ推論、高速ベクターセアーチ、強力なGPUの価格性能と、運用複雑性を増やさずに成長できるインフラが必要です。NVIDIAの最新のw…
このチュートリアルでは、NVIDIA Canary-1B-v2を使用した多言語のASRおよび音声翻訳パイプラインを構築します。モデルをGPU対応のランタイムにロードし、オーディオを16kHzモノに準備し、英語のASRを実行します。その後、翻訳…
こんにちは、皆さんにAIの展開における経済的および物理的な制約のインタラクティブマップを共有したいと思いました。これはマクロのドライバー、産業のボトルネック、そして市場にどのように表れるかを示しています。393ノードを追加しました...</p>
ニュースハイライト:NVIDIAの技術がTOP500の81%とリストに新しく追加されたシステムの90%を動かしています。TOP500の上位26システムがNVIDIA Grace CPUを採用しており、前回のリストから8台増えています。グリーンの上位8システムは…
AIサイバースパイの脅威が企業データセンターにとって遠い問題ではなくなったと、世界で最も強力な情報同盟からの緊急の公的な警告が示しています。2026年6月22日、サイバーセキュリティ...
OmioがOpenAIを使用して対話型旅行体験を駆動させ、製品開発を加速し、AIネイティブ企業に変革する方法を発見しましょう。
データセンターに対する公的な反対意見はその水とエネルギー消費に焦点を当てており、今やNvidiaは完全液体冷却データセンターのRubin世代の参考設計が「elim…」と主張しています
Nvidiaはデータセンター内の水使用量を削減する新しい冷却システムを発表した。しかし、それはAIの最大の水使用量である化石燃料発電所に対して何もしない。
マイクロソフトは、テキサス州ペコスに約2ギガワットのデータセンターを建設している。これは同社の歴史の中で最も大きな単一の容量追加の一つである。オープンレターで、会社は安定した電力価格と最小限の水使用を約束している。
ヨーロッパで初めてのエクサスケールスーパーコンピュータである、ドイツのForschungszentrum JülichにあるJUPITERは、NVIDIA Grace Hopper SuperchipsとNVIDIA Quantum-X800 InfiniBandネットワークで動作しており、今年は大忙しでした。国際…
ミッション、ビジョン、ヴェラティス - HPEとNVIDIAと共同で建設される新しいロス・アラモス国立研究所(LANL)のスーパーコンピュータ - は、科学的発見を加速させるためにNVIDIA Vera CPUを利用し、科学のためのアジェンティックAIを解鍵しています。
AIの次の世代は単なる計算力だけで定義されることはない。その成長はエネルギーによって決定される。加速計算がAI工場、エージェントAI、産業AI、エッジコンピューティング、物理AIなどに拡大するにつれて、次の世代のAIはエネルギーによって決定される。
ビッグテックはデータセンターの建設に大量の資金を注ぎ込んでいます。その施設に対する国内の反対が高まりつつある中、一部の労働者がそれが価値があるのか疑問に思つつあります。
実際の航空会社乗客データと合成季節系列に注入された異常を含む合成季節系列でTimeCopilotを使用して、統計的、基本、およびオプションのGPUベースの予測ワークフローを構築しました。評価しました。
ASMLが中国の顧客を武装するために輸出許可証をリスクにさらすという考えに反する商業的な論理があります。
Amazon SageMaker AIは、機械学習モデルのリアルタイム推論ホスティングを完全に管理しています。モデルを1つ以上のコンピュートインスタンスをバックボーンハンドルするSageMakerエンドポイントにデプロイし、SageMakerがプロビジョニングを処理します。
人気のゲームライブラリからお気に入りのタイトルをプレイし、進行を同期して、ほぼどんなデバイスでもゲームセッションに戻ることができます。これがGeForce NOWクラウドゲームの力です。メンバーのお気に入りのコンテンツにアクセスを提供することで、その力を発揮しています。
脳の動作を模倣することで、神経形态計算は従来の電子AIチップよりも劇的にエネルギーを節約できます。しかし、今の最も高度な神経形态デバイスでもまだ非常に単純です...
昨年のNVIDIA GTC Paris at VivaTechで、フランスはローカルのAIを進める計画を発表しました。それは新しいAI工場や国の計算能力、オープンなフロンティアモデル、産業プラットフォームにまで及びます。今やそのAIインフラは進行中です。
Tokenmaxxing は今年のシリコンバレーで最もホットなトレンドでした。CEOたちは従業員にAIの使用を極限まで推し進めるよう促していました。そして、請求書が届きました。Uberが年間AI予算を大幅に超えたと報道されています。
Tokenmaxxingは今年のシリコンバレーで最もホットなトレンドであり、CEOたちは従業員にAIの使用を可能な限り進めるよう促していました。そして請求書が届きました。Uberが年間AI予算を超えたと報道されています...
原定の月曜日に実施される予定だった変更は、パワーユーザーのコストを大幅に増加させたことになる。
今日、Amazon SageMaker AI推論のためのコンテナイメージキャッシングを発表し、より迅速なスケーリング最適化の次の大きな進展を発表しました。これにより、エンドツーエンドの遅延が最大2倍高速化されます。
スマートグラスはまだ新興分野ですが、チップメーカーのQualcommは次世代のXRデバイス:Snapdragon Reality Eliteを動かすためのシリコンをアップグレードするために一生懸命働いています。Qualcommは今日、チップを発表していますが...
司法省は、国防省がxAIの許可されていないガスタービンを使用し続ける必要があると述べています。
シリコンバレーソフトウェアメーカーやeコマース会社がWIREDに、彼らが新興の「トークノミクス」の課題をどのように乗り越えているかを明かしました。
イングランド男子チームとライバルのドイツとのサッカー試合が緊迫した無得点の前半が終わると、何百万ものイギリス人が一斉に息を切らし、ストレスの瞬間によくやることをしました:彼らは狂った…
今日は、米国の自動ドローンのリーダーであるSkydioのCEOであるアダム・ブライと話しています。このエピソードを録画する前に、実際にアダムのリモートからベイエリアでSkydioのドローンを操作する機会がありました。
Microsoft Researchと数々の大学が開発したビデオ世界モデルのMirageは、シーン情報をピクセルベースのポイントクラウドではなく潜在空間に直接保存します。これにより計算時間とグラフィックスメモリが削減されます。
中程度の規模のデータセンターであっても、局所的に甚大な影響を与える可能性があります。
The Information によると、OpenAI はオハイオ州に計画されている 10 ギガワットのデータセンターをリースする交渉を行っており、Nvidia から資金援助を受ける可能性があるという。記事 OpenAI はこれまでで最大のデータセンターを望んでおり、Nvidia は…
初期容量が 24 メガワットの革新的なデータセンターは、自然冷却システムとして海水を使用します。
OpenAIの新たな報告書では、米国の技術論争、データセンターの言説、関税、ChatGPTに関する虚偽の主張を標的とする、AIを利用した中国関連の影響力作戦について詳述している。
OpenAI の 4 番目の大規模言語モデル (LLM) である GPT-4 のトレーニングには推定 50 ギガワット時がかかり、これはアメリカの家庭 5,000 軒の年間電力消費量に相当します。それは 2023 年のことでした。それ以来、計算リソースは…
168 メガワットの施設は、Meta の世界的な AI コンピューティングのニーズをサポートし、時間の経過とともに拡張することができます。
Confidential Computing を備えた NVIDIA GPU は、Apple のデータセンターを超えて Google Cloud まで拡張される Apple のプライベート クラウド コンピューティング (PCC) での機密推論に使用されています。 Apple の年次 WWDC 集会中に発表されました…
本日、サンフランシスコで開催されたイベントで、ゼネラルモーターズは、AIデータセンターからの電力需要の増大に直面して、EVのバッテリー、エネルギー貯蔵、送電網の回復力に関する一連の発表を行った。自動車メーカーと…
この投稿では、Amazon SageMaker HyperPod と Amazon SageMaker トレーニング ジョブという 2 つのコンピューティング オプションにわたって、Amazon SageMaker AI 上の NVIDIA Isaac Lab を使用して Unitree H1 ヒューマノイドのロボット ポリシーをトレーニングする方法を示します。
シアトル市議会は火曜日、数社が市内に5つの大規模センターの建設を提案してからわずか2か月後、新規データセンターの1年間の一時停止を制定するかどうかを投票する予定だ。中でも…
Notion が Codex を使用してワンショット仕様を作成し、Web 用の AI 音声入力を構築し、小規模チーム全体でエンジニアリング能力を倍増させる方法。
このチュートリアルでは、Python の CUDA スタイル カーネル用のタイルベースの GPU プログラミング インターフェイスである NVIDIA cuTile Python の実践的なワークフローを実装します。 Colab に適した環境を準備し、GPU、ドライバー、CUDA などをチェックします。
Googleは、2028年に向けてIntelに300万以上のAIチップを発注した。Nvidiaは、次期ファインマンアーキテクチャ向けにIntelの製造技術をテストしている。どちらの動きも、TSMCがAIチップの需要に追いつけないために起こった。インター…
Xiaomi の MiMo チームは、TileRT と協力して、MiMo-V2.5-Pro モデルのサービング モードである MiMo-V2.5-Pro-UltraSpeed をリリースしました。単一の 8 GPU コモディティ ノードを使用して、1 兆パラメータ モデルで 1 秒あたり 1000 を超えるトークンをデコードします。
最新の生成 AI モデルと世界的に需要の高い高性能アクセラレーション コンピューティングにアクセスできるため、AWS の顧客は、複数の AWS リージョンにわたってモデルの可用性とキャパシティを活用するためのツールを必要としています。
NVIDIA と LG グループは、ロボティクス、自動運転、データセンター テクノロジー、GPU クラウド サービスに及ぶ LG グループの AI 主導型ビジネスの次の波を加速するために、AI ファクトリーを構築しています。 AI ファクトリーが証明するのは…
OpenAI のカスタム チップ プログラムにおける 2 人目のハードウェア従業員である Clive Chan 氏は、自身の説明によると、Anthropic に異動する予定です。彼は、Tesla の Autopilot ASIC と OpenAI と Broadcom のパートナーシップで得た経験をもたらします。この動きは…
Google が Colab CLI をリリースし、開発者と AI エージェントがリモート Colab GPU および TPU ランタイムでローカル コードを実行できるようにしました The post Google の新しい Colab CLI により、開発者と AI エージェントはリモート Colab GPU および TPU ランタイムで Python を実行できるようになりました…
Sakana AI は、再帰的自己改善 (反復的に自己改善を行う AI) のための専用の研究ラボを立ち上げました。 「Transformer」の共著者ライオン・ジョーンズが共同設立したこの日本のスタートアップは、RSI をトランスフォーマーの代替手段と考えています。
開発者は「打ちのめされた」と感じ、データセンターを縮小する以外に「選択肢はなかった」と感じました。
NVIDIA は、長期実行エージェント向けに合計 550B (アクティブ 55B) のオープン専門家混合ハイブリッド Mamba-Transformer である Nemotron 3 Ultra をリリースしました。 1M トークンのコンテキストと、競合製品よりも最大約 6 倍高い推論スループットを組み合わせます。
Meta は、膨大なデータセンター費用を削減する方法の 1 つであるテントを見つけたかもしれません。
地元関連会社ABC4が先に報じたように、ケビン・オリアリー氏は、住民や活動家からの圧力が高まる中、ユタ州に計画していた4万エーカーのデータセンターの規模を半分に減らすことに同意した。シャークタンクのスターが手紙を送りました…
カリフォルニアの新興企業は、家庭支援ロボット「ストレッチ」の第 4 世代をリリースした。
ハイパースケーラーは、水質と水の利用可能性への影響について厳しい監視を受けています。
量子コンピューターは、いつか想像できる最も強力なスーパーコンピューターを超えて問題を解決することを約束します。しかし、これらのマシンを動作させるだけで、どれだけの古典的なコンピューティングが必要になるかは過小評価されがちです。量子ビット数としては…
いくつかの地域で新しいデータセンターの容量が確保されたことで GPU の可用性が緩和され、今週地域の推論コスト指数が低下しました。
より多くのプロバイダーがコンピューティング価格を地域のエネルギー状況に結び付け、AI ワークロードが最も安く実行される場所と時間に時間帯の要素を追加しています。
NVIDIA AI クラウド エコシステムは、AI ファクトリー インフラストラクチャの世界的な構築を加速しています。パートナーは、企業、新興企業、国家、AI ラボ、規模を拡大する開発者からの需要の高まりに応えるために、生産能力を拡大しています。
Anthropic は月曜日、大成功を収めた Claude Code ツールの能力を技術者以外のユーザーにも拡張する新しい AI エージェント機能である Cowork をリリースしました。社内関係者によると、このチームは機能全体を構築したとのことです。
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。