コンピューティングの供給、GPU、データセンター、エネルギー - AI をいかに安価に実行できるかを決定する物理層。
55 のストーリー
コンピューティングの供給、エネルギー、データセンターの容量によって、AI をいかに安価に実行できるかが決まります。インフラストラクチャの変化は数週間後に推論コストに現れます。
アルゼンチンのパタゴニアは大規模AIデータセンターの候補地として注目を集めている。 「パタゴニアはAIデータセンターが望むものを備えている(これまでのところ抵抗がないことを含む)」という記事は、The Decoderに最初に掲載されました。
ASMLはサムスン、TSMC、インテルに勝って、より大型のフォトマスクへの切り替えを進めており、これにより最新のEUVマシンのスループットは40パーセント向上するはずだ。一方、ファーウェイは中国の対抗戦略を組織しており、その目的は…
Google の最新の AI 天気予報モデルは、現代の風力タービンの高さにほぼ等しい地上 100 メートルの風速を予測します。また、雲量や地表に届く太陽光の量も予測します。
記事URL: https://newsroom.arm.com/blog/arm-mali-g2-ultra-nx-ai-native-mobile-graphics コメントURL: https://news.ycombinator.com/item?id=49605511 ポイント: 43 # コメント: 26
記事URL: https://www.bbc.com/news/articles/c0m39g7xzevo コメントURL: https://news.ycombinator.com/item?id=49604956 ポイント: 15 コメント数: 14
記事URL: https://www.ft.com/content/ea9a9dcc-b1df-49b0-b80c-f320161b9efa コメントURL: https://news.ycombinator.com/item?id=49593778 ポイント: 18 コメント数: 9
記事の URL: https://rocm.blogs.amd.com/ecosystems-and-partners/rocm-x-blog/README.html コメントの URL: https://news.ycombinator.com/item?id=49592508 ポイント: 15 # コメント: 0
AI 研究エージェントは、実行する余裕をはるかに超える実験を提案する可能性があります。 Meta FAIR、オックスフォード、UCL が AI Research Preference Model を導入 — 15 人の未実行の候補者をランク付けし、実行のみを実行する凍結された LLM 裁判官
世論調査によると、圧倒的多数のアメリカ人がデータセンターを嫌っています。中国はテクノロジーリーダーとその同盟国にとって完璧なスケープゴートとなっているが、唯一の問題は証拠が不足していることだ。
AI 検索製品の検索品質は、埋め込みモデルがどれだけ優れているか、およびインデックス全体でどれだけ低コストで実行できるかという 2 つの要素によって制限されます。今週、Perplexity Engineering チームは GP で Fast Embeddings を公開しました…
Nous Research は、Hermes デスクトップでのローカル モデルのセットアップを 1 回のクリックに集約しました。アプリはハードウェアを読み取り、GPU に対してカタログを適合チェックし、適合する最高品質のビルドを選択してダウンロードし、コン…
Deepseek は、トレーニングではなく推論のみを目的として、160,000 個の Huawei Ascend-950DT チップを内モンゴルのデータセンターに設置したいと考えています。これは知られているファーウェイのチップクラスターとしては最大規模となる。しかし、生産のボトルネックはファーウェイの問題を意味します…
TechCrunch Disrupt 2026期間中のサイドイベントの主催を申請してシリコンバレーのシーンに名を残せるまで、残り 24 時間以内です。申請が今夜深夜太平洋太平洋時間で終了する前に申請してください。
Ugreen の HomeAgent H100 Pro ハブは、ローカル ストレージ、オンデバイス AI、新しい音声アシスタント Uliya を組み合わせてスマート ホームを実行します。 |写真:Jennifer Pattison Tuohy / The Verge 携帯電話のパワーバンク、充電器で知られるユーグリーン。
Nvidia の PAIR (パーソナル AI ルーター) は、ローカル AI リクエストをホーム ネットワーク上の利用可能なすべてのデバイスに自動的に分散し、並列エージェント タスクの待ち時間を短縮します。 Nvidia はホーム ネットワークの機能を望んでいるという記事…
Perplexity は、Mac アプリ用のハイブリッド コンピューティングを出荷し、単一の Perplexity Computer タスクをクラウド上のフロンティア モデルとユーザーのマシン上で実行されるコンパクト モデルに分割しました。タスクは海上のクラウドで開始されます…
Nvidia は、新しい Personal AI Router (PAIR) を発表します。これは、Ollama や LM Studio などのツールを使用してローカル AI 推論タスクに取り組むために自宅のコンピューターを同期する無料ツールです。明らかなことを話から取り出そう…
サム・アルトマン氏は、世界的なAIデータセンターの構築における「持続不可能な愚かさ」について警告する。あまりにも多くの Neocloud プロバイダーが、顧客のバックアップなしで大容量を発表しています。彼はまた、コンピューティングの衰退も認めています…
トランプ大統領は、全米で高まるAIデータセンターへの反対に対して強く反発している。 AIデータセンターに対する抗議は中国の手に影響を及ぼしているとトランプ大統領が述べた記事は、The Decoderに最初に掲載されたという。
10 年ちょっと前、私は米国の原子力発電所向けに、この種としては初となるフルデジタル制御システムの制御設計を指揮しました。紙の上では、それは現代の航空会社と同じように自動運転するように設計された美しい機械でした…
ほとんどのプロダクション音声スタックは、3 つのシステムがつなぎ合わされて構成されています。 1 つのモデルが文字起こしを行い、2 つ目のモデルが話者を分離し、検出器がユーザーがいつ話をやめたかを判断します。ハンドオフのたびに遅延が発生し、新たな障害が発生します。
エージェント アシスタントには構造的な問題があります。エージェントを有用にするコンテキスト (取引文書、特権ファイル、クライアント レコード) は、まさにユーザーがクラウド エンドポイントに送信できないコンテキストです。今週は、Perplexity が…
自宅サーバー、ゲーム用コンピューター、またはあまり愛されていないラップトップを所有している場合は、耳を傾けてください。余ったコンピューティング能力を活用して、その過程で不労所得を得ることができるようになりました。 AI企業は…
Nvidia は、AI アップスケーリング技術を「ビデオ ゲーム用のリアルタイム生成 AI フィルター」と「ビデオ ゲーム用のモーション スムージング」に例えた 3 月の意見の分かれる発表に続き、今週 DLSS 5 を正式に発表します。
音声エージェントは、インテリジェンスで失敗するずっと前に、遅延で失敗します。最初のトークンまでの時間は、ほとんどのチームが推論 API を選択するために使用する指標であり、正しい開始点でもあり、間違った終了点でもあります。このベンチは…
同社は技術者が実行できるタスクについてロボットをテストしている。
新世代のデータセンター システムは、プロセッサ サイクルを増やすだけでなく、よりスマートなトラフィック制御によって効率を向上させています。
Comulytic Note Pro AI ボイス レコーダーは、クレジット カード サイズのデバイスに多くの機能を搭載しています。しかし、その有用性はあなた次第です。
新しいデータセンターが近隣地域からの反発の高まりに直面しているのと同じように、米国環境保護庁(EPA)は、それらのセンターが引き起こす汚染について人々が評価することを困難にしようとしている。 EPAは…
同社はケーブルの交換やサーバーのリセットなど、技術者が行う作業を代行できるロボットのテストを行っており、一部の従業員の間で仕事が危険にさらされるのではないかとの懸念が高まっている。
データセンターに課税することでAI競争に勝つというトランプ大統領の計画にハイテク業界は困惑している。
自己ホスト型音声 AI には可観測性のトレードオフが伴います。キャパシティ プランニングとコスト管理を推進する数値は、ベンダー コンテナ内にロックされたままになります。 Deepgram は、2 つの機能で Amazon SageMaker AI のギャップを埋めます。
各リクエストが GPU の一部しか使用しない場合、自動音声認識 (ASR) モデルを大規模に提供するとコストがかかります。 Amazon EC2 G…
AI データセンターがハードウェア不足の一因となり、低価格携帯電話のメモリが少なくなる可能性があるため、Google は Android アプリに新たなメモリ使用制限を設定しています。
今日は Decoder で、Verge のシニア AI レポーターである Hayden Field と、純粋な Decoder の餌について話します。OpenAI の一見際限なく続く組織図の変化と、それらすべてが共同創設者の Greg の下でどのように権力を強化しているように見えるかについてです。
データセンターに関するご質問に『WIRED』がお答えします。 9 月 10 日のライブストリームに参加して、専門家パネルが知っておくべきことをすべて教えてくれます。
Google の新しい Gemini 3.5 Transcribe は、85 以上の言語を認識し、つなぎ言葉を削除し、失言をリアルタイムで修正します。ストリーミング モードではワード エラー率が 4.0 パーセントに達し、レイテンシが 70 パーセント低くなります…
Amazon は、今後 2 年間でさらに 200 万個の Nvidia GPU チップをデータセンターに追加します。しかし、このパートナーシップの拡大は、チップの追加購入だけに留まりません。
AI の次の波により、インフラストラクチャに新たな要求が生じています。 AI エージェントと数兆パラメータのワークロードが主流になるにつれて、AI インフラストラクチャのパフォーマンスはコンピューティングだけでなく、コンピューティング、メモリなどにも依存します。
SageMaker Python SDK v3 は、統合された ModelTrainer クラスと ModelBuilder クラスを使用してスクリプト モードを再設計します。この投稿では、scikit-learn ランダム フォレストとマルチ GPU Stable Diffusion 3.5 Lo の 2 つのエンドツーエンドの例を説明します。
それは単に太陽光発電を収穫するだけではなく、貯蔵や、オフピークの安価な電力をより高価な時間帯にタイムシフトすることも重要です。
マローン氏の退任に関するTechCrunchへの声明の中で、OpenAIは「私たちの仕事の規模とペースをサポートするためにインフラストラクチャ組織」を「最近再編した」と述べた。
記事URL: https://www.wsj.com/tech/ai/openais-head-of-data-centers-has-left-company-6d24fd83 コメントURL: https://news.ycombinator.com/item?id=49439489 ポイント: 27 コメント数: 9
OpenAI は、ChatGPT を使用してソーシャル メディア投稿を生成する秘密のロシア影響キャンペーンを、アカウントのクラスターを禁止することで妨害しました。オペレーターはロシアから VPN 経由でプラットフォームにアクセスし、…
OpenAI は、Hot Chips カンファレンスで、初の自社製推論チップである「Jalapeño」をベンチマークとともに披露しました。 SemiAnalysis のテストによると、このチップはスループットとエネルギー効率において Nvidia の Blackwell を上回り、さらには Rubin をも上回っています。
フロンティア モデルのトレーニングと提供は、コンピューティングの問題であると同時にネットワークの問題でもあります。 all-reduce や all-to-all などの集合的な操作は、トレーニング中に数千のアクセラレータを同期しますが、最も遅いアクセラレータは…
M5 Ultra を搭載した Mac Studio は、最大 512 GB のユニファイド メモリを搭載し、最大 8 台の外部ディスプレイを駆動します。
SemiAnalysis の InferenceX ベンチマークでテストしたところ、Jalapeño は、現在利用可能な最先端のものよりもユーザーあたりのトークンと 1 キロワットあたりのスループットの両方を多く記録しました。
火曜日に公開されたブログ投稿によると、OpenAIは、同社の新しいAIチップ「Jalapeño」は他のAIシステムよりも効率的にタスクを完了し、より速く応答を返すと述べている。記者との会見中、OpenAI ハードウェア…
Article URL: https://www.apple.com/newsroom/2026/08/apple-introduces-m6-and-m5-ultra-for-a-big-leap-in-performance-and-ai-compute/ Comments URL: https://news.ycombinator.com/item?id=49433292 Points: 443 # Comments: 364
Nvidia is moving its Groq 3 LPX inference chip into full production and reports 3,400 tokens per second on Gemma 4 31B, four times faster than Cerebras. But the numbers don't tell the whole story. Nvidia needs at least…
OpenAI CFO Sarah Friar explains how advances across chips, compute, models, and products compound to deliver more useful intelligence at greater scale and lower cost.
Jalapeño is a custom inference chip from OpenAI that delivers faster, more power-efficient AI inference, with higher throughput and lower latency for modern models.
Amazon SageMaker HyperPod は、Amazon EKS でマネージド Ray サポートを提供するようになりました。 Ray クラスターを作成および監視し、JupyterLab およびコード エディター ノートブックをライブ クラスターに接続し、すぐに使用できる可観測性を取得し、回復力のある実行…
The next era of AI inference won’t be defined by a single breakthrough chip, network or system. It’ll be defined by how every layer of the AI factory works together. That’s why NVIDIA is extending Vera Rubin NVL72 with…
概要は情報提供のみを目的としてまとめられています。全文についてはソース リンクを参照してください。デモのエントリは一例です。