컴퓨팅 공급, GPU, 데이터 센터 및 에너지는 AI 실행 비용을 결정하는 물리적 계층입니다.
178 스토리
컴퓨팅 공급, 에너지 및 데이터 센터 용량은 AI를 얼마나 저렴하게 실행할 수 있는지를 결정합니다. 인프라 변화는 몇 주 후에 추론 비용에 나타납니다.
고성능 GPU 커널의 설계를 단순화하는 고급 Python 도메인별 언어인 TileLang을 살펴보세요. 이 튜토리얼은 타일식 워크로드를 포함하여 복잡한 워크로드를 구현하는 단계별 접근 방식을 제공합니다.
버지니아 북부에서 실시된 긴밀한 통화를 통해 데이터 센터가 그리드 중단에 얼마나 제대로 대응하지 못하는지 드러났습니다. 문제를 해결하는 방법은 다음과 같습니다.
Samsung Galaxy Z Fold 8 Ultra는 좋은 휴대폰이지만 Galaxy Z Fold 8에는 훨씬 더 매력적인 점이 있습니다.
삼성전자는 최신 폴더블폰으로 지난해 출시된 Z폴드도 부족하다고 느낄 정도로 디자인과 소프트웨어 변화를 제시하고 있다.
Datalab은 Marker를 3가지 모드 파이프라인으로 다시 작성했습니다. 버전 2는 olmOCR-bench에서 76.0을 기록하고 하나의 B200에서 초당 2.9페이지를 유지합니다. 이는 MinerU의 파이프라인 백엔드의 5배 이상이며 정확성과 속도 모두에서 Docling을 능가합니다. 시간…
Datalab은 Marker를 3가지 모드 파이프라인으로 다시 작성했습니다. 버전 2는 olmOCR-bench에서 76.0을 기록하고 하나의 B200에서 초당 2.9페이지를 유지합니다. 이는 MinerU의 파이프라인 백엔드의 5배 이상이며 정확성과 속도 모두에서 Docling을 능가합니다. 시간…
기사 URL: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference 댓글 URL: https://news.ycombinator.com/item?id=49041347 포인트: 17 # C…
규칙에 따라 주정부는 공개 의견이 얼마나 있을 수 있는지 결정할 수 있습니다.
이 튜토리얼에서는 문서 이미지와 여러 페이지로 구성된 PDF에서 Baidu의 Unlimited-OCR 모델을 실행하기 위한 완전한 워크플로를 구축합니다. GPU 환경 구성부터 디테일한 타일 건담 추론과 속도 비교까지…
기사 URL: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 댓글 URL: https://news.ycombinator.com/item?id=49…
가장 크고 가장 유능한 LLM(대형 언어 모델)을 호스팅하는 궤도 데이터 센터의 생존 가능성은 여전히 뜨거운 논쟁을 벌이고 있습니다. 하지만 수천 개의 GPU가 필요한 대규모 배포가 LLM이 성공할 수 있는 유일한 방법은 아닙니다.
플로리다주 뉴포트리치의 평화의 전당 밖에서 AI 데이터센터 확장에 반대하는 전국적인 시위가 진행되는 동안 한 사람이 피켓을 들고 있다. | AFP via Getty Images 플로리다 중부의 습하고 회색빛의 토요일 아침, 약간…
NVIDIA 창립자이자 CEO인 Jensen Huang은 오늘 캘리포니아 몬트레이에 있는 해군 대학원을 방문하여 NVIDIA DGX GB300 시스템을 시운전했습니다. 이로써 세계에서 가장 강력한 AI 플랫폼 중 하나를 완전히 온라인으로 구현하게 되었습니다.
기사 URL: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ 댓글 URL: https://news.ycombinator.com/item?id=49007525 포인트: 39 # 댓글: 53
Samsung Galaxy Z Fold 8 Ultra는 필요한 모든 기본 성능을 갖추고 있지만 Google Pixel 10 Pro Fold의 가격과 액세서리가 더 나은 제안일 수 있습니다.
OpenAI는 미국 에너지부 및 국립 연구소와 협력하여 개척 AI를 사용하여 발견을 가속화하는 미국 과학을 발전시키겠다는 약속을 간략하게 설명합니다.
SenseTime은 중국에서 국내 AI 칩 인프라를 확장하기 위해 거의 20개 파트너와 팀을 이루는 Galaxy 프로젝트를 시작했습니다. '지능형 변혁과 공생'이라는 제목의 기조연설에서 양판 공동대표는…
이 서약은 지난 3월에 도입되었지만 지금까지 우려를 진정시키는 데 거의 도움이 되지 않았습니다. | 이미지: Cath Virginia / The Verge, Getty Images 우려에 대한 반발에 직면하여 AI 붐으로 인해 소비자 전기 요금이 인상될 것입니다…
2033년까지 건설되는 새로운 데이터 센터는 현재 인도가 사용하는 전력만큼을 소비할 수 있습니다.
https://www.energy.gov/undersecretaryforscience/genesis-miss... 댓글 URL: https://news.ycombinator.com/item?id=48995074 포인트: 84 # 댓글: 56
AI가 기가스케일 시대에 돌입했다. 세계에서 가장 진보된 AI 공장은 수십만 개의 GPU와 CPU를 통합하여 전례 없는 속도로 최첨단 모델을 훈련하고 에이전트 AI를 강화하며 인텔리전스를 생성하고 있습니다.
Nvidia의 Vera Rubin 플랫폼은 CPU와 GPU를 단일 시스템으로 결합하여 AI 인프라의 모든 계층을 지원하려는 회사의 성장하는 야망을 반영합니다.
Google의 모회사인 Alphabet은 Gemini 모델을 훨씬 더 효율적으로 실행할 수 있도록 설계된 새로운 칩을 개발하고 있는 것으로 알려졌습니다.
Google은 Gemini 아키텍처를 하드웨어에 직접 적용하는 서버 칩인 'Frozen v2'를 개발하고 있습니다. 내부 소스에 따르면 현재 TPU보다 6~10배 더 효율적일 수 있습니다. 2028년 예정…
이 게시물에서는 Couchbase가 Anthropic의 Claude 모델 제품군을 통해 Capella iQ를 지원하기 위해 Amazon Bedrock을 채택한 방법, 다중 모델 접근 방식의 아키텍처 결정, 실현된 운영상의 이점에 대해 설명합니다.
Microsoft는 2026년 하반기에 Nvidia의 GPU 시스템에 도전할 예정인 AMD의 새로운 Helios 플랫폼을 통해 Azure의 AI 인프라를 확장하고 있습니다. 공개 GitHub 프로필에 따르면 Anthropic도 AMD를 테스트하고 있습니다…
Erin Davis는 이를 "SuperDuperPOD"라고 부릅니다. 이름 하나에 두 가지가 담겨 있습니다. 거대 제약회사인 BMS(Bristol Myers Squibb)는 이미 생명과학 분야에서 가장 큰 AI 클러스터 중 하나를 운영하고 있으며 그에 대한 심각한 결과를 보여주고 있습니다.…
Moonshot과 Alibaba가 저렴한 비용으로 OpenAI와 Anthropic의 최고 성능과 맞붙을 수 있다고 주장하는 모델을 공개하면서 중국의 주요 AI 기업들이 실리콘 밸리에 대한 압박을 강화하고 있습니다. 랩은…
우리는 단일 GPU를 사용하여 Google Colab에서 엔드 투 엔드 NVIDIA NeMo AutoModel 워크플로를 구축합니다. CUDA 하드웨어 및 정밀 지원을 확인하고, 소스에서 NeMo AutoModel을 설치하고, 공식 Qwen3-0.6B LoRA 레시피를 로드합니다. 와…
Index Ventures를 공동 창립한 벤처 투자가인 Neil Rimer는 AI가 실리콘 밸리에서 창출하는 역사적 부는 자발적이든 비자발적이든 재분배되어야 할 것이라고 예측합니다.
Meta는 Anthropic과 데이터 센터의 컴퓨팅 용량을 임대하기 위해 협의 중인 것으로 알려졌습니다. 초과 AI 컴퓨팅을 판매하려는 Zuckerberg의 계획이 Anthropic의 첫 번째 대규모 고객을 찾을 수 있다는 기사가 Th…
Moonshot AI는 초기 평가에 따르면 단 300명의 팀이 구축한 Anthropic의 Opus 4.8과 일치하는 모델인 Kimi K3를 출시했습니다. OpenAI 전략가인 Dean W. Ball도 이를 "매우 훌륭하다"고 말하지만, 물론 다음과 같이 경고합니다.
Levoit Vital 200S-P는 세척 가능한 프리필터와 1시간에 최대 1,800평방피트를 청소할 수 있는 용량을 갖춘 최고의 스마트 공기 청정기입니다.
실제 3일간의 정전을 통해 발전소의 사양서에서는 결코 발견할 수 없는 문제가 드러났습니다.
OpenaAI의 CFO인 Sarah Friar는 유용한 작업, 성공적인 작업당 비용, 신뢰성 및 컴퓨팅 수익을 통해 ROI를 측정하는 실용적인 AI 스코어카드를 소개합니다.
<p>데이터 센터 물 사용에 대한 압박감을 느끼는 하이퍼스케일러를 위한 제안:</p> <p>전용 컨트리 클럽 몇 곳을 구입하고, 골프장을 공공 공원으로 바꾸고, 가이드와 쌍안경 비용을 지불하여 이전 회원을 확보하세요…
오늘 Uncanny Valley에서 우리는 법적, 평판 측면에서 OpenAI가 진행 중인 드라마와 이러한 발전이 특히 Anthropic과의 싸움에서 회사에 추가 피해를 줄 수 있는지 여부를 공개합니다.
107개 기업에서 AI 인프라 지출은 경제성을 확인하거나 조종하는 능력보다 훨씬 앞서 가속화되고 있습니다. 대부분의 조직은 친숙한 하이퍼스케일러 및 모델 제공자 API 기반에서 AI를 실행하지만…
레스토랑 예약 사용 사례를 위한 음성 에이전트 워크플로를 구축하여 Patter SDK를 살펴봅니다. 동적 발신자 변수를 정의하고, 가용성, 예약, 시간 및 인간 이동을 위한 호출 가능한 도구를 등록하고 레이어를…
범용 로봇과 자율 기계는 연구실에서 실제 대중 시장 배포로 이동하고 있으며, 기본 모델을 실행할 수 있는 소형의 전력 효율적인 AI 슈퍼컴퓨터에 대한 수요를 창출하고 있습니다.
AWS GenAIIC(AWS Generative AI Innovation Center), AWS 파트너 AND 디지털 및 AWS 계정 팀과 협력하여 분류, 분할, 추출, 평가할 수 있는 확장 가능한 AI 기반 문서 처리 엔진을 만들었습니다.
Anker의 Solix E10은 이 초보자가 백업 전력을 이해할 수 있게 해 주었고 시스템을 확장하고 싶습니다.
뉴욕주는 대규모 데이터 센터 승인을 일시적으로 중단한 최초의 주가 되었습니다. Kathy Hochul 주지사는 AI 기반 건물 붐이 더 높은 전기 비용, 물 공급 등을 희생하여 이루어져서는 안 된다고 주장했습니다.
뉴욕의 데이터 센터 유예는 AI 반대 운동의 청사진이 될 수 있습니다.
전력은 AI 인프라의 피할 수 없는 제약입니다. AI 공장이 고정 전력 예산 내에서 생성할 수 있는 토큰 수에 따라 수익과 수익성이 결정됩니다. 이 때문에 와트당 성능은 다음과 같은 측정 기준을 따릅니다.
데미스 허사비스(Demis Hassabis)가 스위스 다보스에서 열린 세계경제포럼(World Economic Forum)에서 패널 세션에 참석하고 있습니다. | 이미지: Bloomberg via Getty Images Demis Hassabis는 전방에서 브레이크를 밟을 수 있는 능력을 갖춘 AI 감시견이 세상에 필요하다고 생각합니다.
기사 URL: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ 댓글 URL: https://news.ycombinator.com/item?id=48901420 포인트: 19 # 댓글: 4
AI의 잠재적인 단점에 대한 모든 논쟁 중에서 실리콘 밸리의 AI 열광자들 사이에서 가장 큰 우려를 불러일으키는 우려가 하나 있습니다. 바로 독점 모델을 판매하는 거대한 AI 연구소가 어떻게든…
우리는 데스크톱 PC의 성능과 슬림하고 가벼운 디자인을 결합한 최고의 올인원 컴퓨터를 테스트했습니다.
Mount Carmel Township Northumberland 카운티의 Route 54를 따라 계획된 데이터 센터 맞은편에 야드 표지판이 표시되어 있습니다. | 이미지: Getty Images 이것은 The Stepback입니다. 주간 뉴스레터는 다음과 같은 주요 이야기를 담고 있습니다.
이 튜토리얼에서는 TileGym을 사용한 NVIDIA 타일 기반 GPU 프로그래밍을 살펴보고 다양한 하드웨어에서 실행되는 Colab 워크플로를 구축합니다. 우리는 CUDA 환경을 조사하고 실제 cuTile 백엔드를 시도한 후 Tr로 돌아갑니다…
ChatGPT Work 및 GPT-5.6 Sol 출시 이후 OpenAI는 과도한 컴퓨팅 사용, 채팅 및 프로젝트를 위한 데스크톱 인터페이스로의 혼란스러운 전환, 불분명한 구분 등 중요한 문제를 인정했습니다.
기사 URL: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ 댓글 URL: https://news.ycombinator.com/item?id=48865717 포인트: 17 # 댓글: 0
이 게시물에서는 Unsloth를 사용하여 이미 양자화한 모델을 가져와 AWS 인프라에 배포하기 위한 네 가지 배포 패턴을 알아봅니다. 패턴은 Amazon Elastic Compute Cloud(Amazon EC2)를 사용합니다…
태양광 및 가정용 에너지 저장 회사가 AI 데이터 센터로 확장하고 있지만 이를 구축하는 것이 아니라 고객의 집에 컴퓨팅 장치를 설치하는 데 비용을 지불하겠다고 제안하고 있습니다. Sunrun이 파일럿 프로그램을 시작합니다…
공유 호스팅 서비스가 제공할 수 있는 것보다 더 많은 기능이 필요한 경우 최고의 VPS 호스팅 제공업체가 프로젝트를 한 단계 더 발전시키는 데 필요한 전용 리소스와 확장성을 제공할 수 있습니다.
OpenAI의 새로운 모델 제품군은 Microsoft의 업무 공간 및 생산성 앱 제품군을 계속해서 강화할 것입니다.
NVIDIA는 Nemotron-3-Super의 압축 변형인 Nemotron-Labs-3-Puzzle-75B-A9B를 출시했습니다. Iterative Puzzle은 하드웨어 인식 구조 압축과 짧은 지식 증류 복구 단계를 번갈아 사용합니다. 모드는…
컴퓨팅이 얼마나 가치 있는지 입증한 이 회사는 모두가 진출하고 싶어하는 시장의 중심에 서 있는 반면, 단순한 기술과 덜 흥미로운 회사는 부업으로 부를 누리고 있습니다.
기사 URL: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html 댓글 URL: https://news.ycombinator.com/item?id=48846708 포인트: 4…
이번 GFN 목요일에는 GeForce NOW에서 더 많은 게임, 더 많은 성능, 더 많은 플레이 방법을 제공합니다. 클라우드 게임 서비스는 토론토의 새로운 GeForce RTX 5080 기반 서버로 확장되어 게임에 전용 고성능을 제공하고 있습니다.
NVIDIA는 Nemotron-3-Super의 압축 변형인 Nemotron-Labs-3-Puzzle-75B-A9B를 출시했습니다. Iterative Puzzle은 하드웨어 인식 구조 압축과 짧은 지식 증류 복구 단계를 번갈아 사용합니다. The mode…
Stoke Space에서 Kevin Weil의 새로운 역할은 재사용 가능한 로켓이 실리콘 밸리의 차세대 화두임을 시사합니다.
물론, 주택 연장 코드와 멀티탭은 편리하지만 매년 수천 건의 예방 가능한 화재를 발생시킵니다. 보다 안전하게 사용하는 방법은 다음과 같습니다.
Rust Belt 전기 요금을 압박하면 Trump의 제조 계획이 위협받습니다.
Microsoft는 AI 지출을 줄인 가장 최근의 실리콘 밸리 거대 기업입니다.
중국 스타트업 딥시크(Deepseek)가 자체 AI 칩을 만들고 있다고 로이터 통신이 보도했습니다. Deepseek이 자체 AI 칩을 설계하고 있다는 기사가 The Decoder에 처음 등장했습니다.
OpenAI는 API에 두 가지 실시간 모델을 추가했습니다. GPT-Realtime-2.1-mini는 음성용 미니 추론 모델로 가격은 이전 gpt-realtime-mini와 비슷합니다. OpenAI는 또한 향상된 캐싱을 통해 p95 대기 시간을 25% 이상 줄였습니다. 그…
Anthropic's Fable 5는 신화적인 AI 성능을 약속하지만, 놀라운 제한으로 인해 일상적으로 사용하는 데 가치가 있는 것보다 더 문제가 되는 것인지 궁금합니다.
기사 URL: https://xcancel.com/i/article/2072830533739192560 댓글 URL: https://news.ycombinator.com/item?id=48792463 포인트: 17 # 댓글: 1
기사 URL: https://github.com/openai/codex/issues/30364 댓글 URL: https://news.ycombinator.com/item?id=48789428 포인트: 131 # 댓글: 41
기사 URL: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 댓글 URL: https://news.ycombinator.com/item?id=48774246 포인트: 18 # 댓글: 6
인공지능 인프라의 급속한 확장은 일반적으로 에너지 문제로 간주됩니다. 데이터 센터는 전 세계 전력 수요의 점점 더 많은 부분을 소비할 것으로 예상됩니다: 국제 에너지 기구(International Energy Agency)…
이 소식은 OpenAI가 Broadcom과의 파트너십을 통해 자체 맞춤형 AI 칩을 발표한 지 약 일주일 후에 나왔습니다.
앤트로픽은 맞춤형 AI 칩 제조를 위해 삼성전자와 협의 중인 것으로 알려졌다. 프로젝트는 아직 초기 단계이지만 Anthropic은 이미 칩 엔지니어를 고용했습니다. OpenAI 'Jalapeño' 이후 또 다른 주요 AI…
Eufy Omni S2는 4배 향상된 흡입력과 냄새 없는 걸레 롤러로 이전 제품보다 개선되었습니다.
Nvidia는 점점 더 AI 스타트업의 중앙은행 역할을 하여 컴퓨팅 시장을 적극적으로 형성하고 있습니다. Nvidia가 칩 사업에 대한 Big Tech의 지배력을 완화하기 위해 AI 스타트업에 자금을 조달하고 있다는 기사가 The…
Google은 AI 데이터 센터 배출량과 청정 에너지 노력의 균형을 맞추려고 노력하고 있습니다.
기사 URL: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ 댓글 URL: https://news.ycombinator.com/item?id=48759329 포인트: 26 # 댓글…
AI가 모델 개발에서 생산 추론으로 이동함에 따라 컴퓨팅 수요가 가속화되고 대규모 토큰을 생성하는 AI 공장을 지속적으로 운영하는 쪽으로 이동하고 있습니다. 이러한 변화에는 대규모 접근이 필요합니다…
Sound는 카테고리를 선도하는 AI 연구실에서 집중적이고 높은 확신을 지닌 베팅으로 명성을 쌓은 반면, Kutcher의 새로운 펀드는 이러한 회사 아래 계층, 즉 힘을 실어주는 인프라와 에너지를 쫓고 있는 것으로 보입니다.
이 기사는 Business Events Australia의 지원을 받는 Melbourne Convention Bureau(MCB)에서 제공한 것입니다. 인공 지능이 컴퓨팅에 대한 글로벌 수요를 가속화함에 따라 동일한 제약 조건이 나타나고 있습니다.
Meta는 클라우드 인프라 비즈니스 계획을 개발하고 AI 컴퓨팅 성능 및 모델에 대한 액세스를 판매하고 있습니다. 이러한 움직임은 Amazon Web Services, Google Cloud 및 Microsoft Az와 같은 대형 클라우드 제공업체와 경쟁하게 될 것입니다.
기사 URL: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute 댓글 URL: https://news.ycombinator.com/item?id=48745966 포인트: 15 # 댓글: 11
SpaceX 창업자인 엘론 머스크(Elon Musk)는 지난 1월 다보스에서 열린 세계경제포럼(World Economic Forum)에서 "AI를 배치하는 데 가장 비용이 적게 드는 곳은 우주가 될 것이며 이는 2년, 늦어도 3년 안에 사실이 될 것"이라고 말했습니다.
The Information의 보고서에 따르면 OpenAI는 AI 모델의 추론 비용을 절반 이상 줄였습니다. 회사는 ChatGPT에 최적화를 적용하여 필요한 Nvidia GPU 수가 몇 개로 줄었습니다.
생명 과학은 컴퓨팅 규모의 시대에 진입했으며, NVIDIA는 10년 넘게 하드웨어, 프레임워크, 라이브러리, 모델, 마이크로서비스 및 도메인을 포괄하는 완전한 GPU 가속 컴퓨팅 스택을 구축해 왔습니다.
이 게시물에서는 Outpost VFX가 어떻게 AWS 인프라를 사용하여 얼굴 교체 워크플로를 혁신하고 단일 GPU 제한을 극복하기 위해 구현한 기술 아키텍처를 통해 8배 더 빠른 훈련 속도를 달성했는지 살펴봅니다.
대만 당국은 슈퍼마이크로컴퓨터(Super Micro Computer)와 여러 현지 협력업체 사무실을 급습했다. 대만이 엔비디아 칩을 중국으로 밀수한 사건을 조사하기 위해 슈퍼 마이크로 사무실을 급습했다는 기사가 The…
기사 URL: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ 댓글 URL: https://news.ycombinator.com/item?id=48727538 포인트: 27 # 댓글: 22
비상 상황이 아닐 때 발전소의 기능을 활용하는 방법은 다음과 같습니다.
xFusion은 ISC 2026에서 확장 가능한 엔터프라이즈 AI 컴퓨팅 모델을 선보이며 하드웨어를 엣지 장치에서 데이터 센터로 전환했습니다. 함부르크 전시회에 참가한 기업 기술 바이어들은 실용적인 생산을 모색했습니다…
기사 URL: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark 댓글 URL: https://news.ycombinator.com/item?id=48712791 포인트: 15 # 댓글: 2
집 태양광에 대한 사실을 알면 더 나은, 정보에 근거한 선택을 할 수 있고 돈을 절약하고 안전하게 유지할 수 있습니다.
360 창립자 Zhou Hongyi는 Anthropic의 Mythos와 경쟁하기 위해 설계된 두 가지 AI 보안 도구를 제시합니다. 한 곳에서는 이미 3,432개의 취약점을 신고했습니다. Zhou는 중국 모델이 서구 모델보다 20~30% 뒤처진다는 점을 인정하지만…
모든 사람이 궤도 데이터 센터에 대한 Elon Musk의 비전을 구매하는 것은 아닙니다.
Macbook에서 llms를 사용하는 분들을 위해 해당 모델을 실행할 때 macbook이 전용 GPU와 어떻게 다른지 알고 싶으십니까? 맥북이 모델을 얼마나 실행할 수 있는지 어떻게 알 수 있나요? 댓글 URL : https://ne…
엔비디아는 수년간 AI 칩 시장을 장악해 왔지만, 완전한 의존의 시대는 끝날지도 모릅니다. OpenAI는 방금 Broadcom으로 구축된 맞춤형 추론 칩인 Jalapeño를 통해 G에 합류할 계획을 공유했습니다.
엔비디아는 수년간 AI 칩 시장을 장악해 왔지만, 완전한 의존의 시대는 끝날지도 모릅니다. OpenAI는 방금 Broadcom으로 구축된 맞춤형 추론 칩인 Jalapeño를 통해 G에 합류할 계획을 공유했습니다.
Anthropic의 비판자들은 그들이 빠르게 권력을 쌓고 있다고 주장한다. 회사는 이것이 책임 있는 AI 개발의 모습이라고 말한다.
아마존이 소유한 MGM 스튜디오가 오픈에이이의 영화를 포기한 결정은 AI와 영화 산업이 점점 더 복잡하게 결합되고 있는 일부에 불과합니다. 언캐니 밸리에서 이들이 어디로 가고 있는지를 살펴보겠습니다.
가격 인상은 메모리 칩 가격 상승과 공급 부족으로 인해 발생했지만, 알고 보면 여전히 할인이 가능합니다.
Un-0는 회사의 기술이 전통적인 AI 시스템을 복제할 수 있는 방법을 최초로 보여주는 이미지 생성 시스템 도구입니다.
GPU 시장은 어려운 상황이지만, 아마존 프라임데이 동안에도 좋은 할인 정보가 있습니다. 확인해야 할 다섯 가지 정보를 소개합니다.
조직의 지연 시간이 AI의 이점을 완전히 실현하는 데 가장 큰 장애물이 되는 이유
주요 자동차 제조업체 중 JD Power의 초기 품질 순위에서 1위로의 새로운 지위를 기념하기 위해 포드는 최근 몇 년간 겪은 도전을 공개하고 있습니다, 특히 자동화된 시스템에 대한 의존성에 대한 도전입니다.
쿼알컴은 Dragonfly C1000이라는 새로운 프로세서를 통해 데이터 센터 시장에 더욱 진출하고 있습니다. 이 기사 쿼알컴이 자체 프로세서로 데이터 센터 시장에 진입이라는 기사는 The Decoder에서 먼저 나왔습니다.
IBM의 나노스택 트랜지스터는 칩 성능이나 에너지 효율성을 높일 수 있습니다.
OpenAI의 재정적 경로는 인프라 비용에 크게 의존하고 있으며, 이는 새로운 맞춤형 OpenAI Jalapeño 칩 개발을 촉진한 현실입니다. Broadcom과 협력하여 개발된 이 응용 특화 통합 칩...
수요를 따라잡기 위해 경쟁이 치열해지고 있습니다.
그라디움은 영어, 프랑스어, 독일어, 스페인어, 포르투갈어를 포함한 20개 언어 쌍을 다루는 두 가지 실시간 음성 번역 모델, stt-translate와 s2s-translate를 출시했습니다. 이 모델들은 표준 세 모델 구조를 축소하여...
공지: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... 댓글 URL:…
이 글에서는 Loka가 일반적인 불만을 해결한 방법을 설명합니다: 로봇적이고 느리는 음성 비서가 고객을 끊어버리게 하여 브랜드 명성을 훼손하고 지원 비용을 증가시키는 문제를 해결한 방법입니다.
OpenAI는 Broadcom과 협력하여 제작된 AI 서버용 새로운 "지능 프로세서" 칩을 공개했습니다. Jalapeño 칩은 현재와 미래의 대형 언어 모델을 운영하기 위해 설계되었습니다.
OpenAI는 자사의 기술 스택에 맞춤형 하드웨어를 추가하고 있습니다. Broadcom과 개발된 "Jalapeño" 칩은 대규모 언어 모델 추론에 맞추어 설계되었으며, 2026년 후반기부터 대규모로 운영될 예정입니다. OpenAI와 Broadcom u...
기사 URL: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ 댓글 URL: https://news.ycombinator.com/item?id=48659257 점수: 141 # 댓글: 1
언어 모델은 대부분의 사람들보다 깨끗한 문체를 작성할 수 있지만, 주제에 대해 100개의 주장을 요청하면 모두가 모여 있을 것입니다. 팡그램 CEO 맥스 스페로는 인간의 논리는 훨씬 다양하다고 말하며, 그것이 바로…
UC San Diego의 DFlash는 자동 회귀 제도를 추론적 디코딩을 위한 경량 블록 확산 모델로 대체합니다. 단일 전달 패스로 전체 토큰 블록을 작성하고 대상 숨겨진 기능에 대한 조건을 지정합니다.
OpenAI와 Broadcom이 Jalapeño라는 LLM 추론을 위해 구축된 맞춤형 AI 칩을 소개하여 성능, 효율성, 그리고 AI 시스템의 규모를 향상시켰다.
규모에 맞는 AI 시스템을 구축하는 것은 요구되며, 저지연 인터프레이션, 빠른 벡터 검색, 강력한 GPU 가격 성능 및 운영 복잡성이 증가하지 않고 성장할 수 있는 인프라가 필요합니다. NVIDIA의 최신 w…
이 튜토리얼에서는 NVIDIA Canary-1B-v2를 사용하여 다국어 ASR와 음성 번역 파이프라인을 구축합니다. GPU가 지원되는 런타임에 모델을 로드하고, 오디오를 16 kHz 모노로 준비한 후 영어 ASR를 실행합니다. 그런 다음 번역...
안녕하세요, 저는 AI 구축의 경제적 및 물리적 제약 상호작용 맵을 모두와 공유하고 싶습니다. 이 맵에는宏观经济 추진력, 산업적인 협착점, 그리고 이들이 시장에서 어디에 나타나는지가 포함되어 있습니다. 저는 393개의 노드를 추가했습니다...</p>
뉴스 하이라이트: NVIDIA 기술이 TOP500의 81%와 목록에 새로 추가된 시스템의 90%를 운영하고 있습니다. 이전 목록에서 8개 증가한 TOP500의 26개 시스템이 NVIDIA Grace CPU를 채택했습니다. Gree의 상위 8개 시스템은...
세계에서 가장 강력한 지능 연맹의 긴급한 공중 경고에 따르면, AI 사이버 위협의 글로벌 증가는 더 이상 기업 데이터 센터의 먼 문제가 아닙니다. 2026년 6월 22일, 사이버 보안...
오미오가 OpenAI를 통해 대화형 여행 경험을 활성화하고 제품 개발을 가속화하고 AI原生 회사로 변신하는 방법을 알아보세요.
데이터 센터에 대한 공중의 반대는 그들의 물과 에너지 소비를 강조했으며, 이제 Nvidia는 전체 유체 쿨링 데이터 센터를 위한 Rubin 세대 참조 설계가 "elim..."라고 주장하는 것을 강조하고 있습니다.
Nvidia는 데이터 센터 내 물 사용량을 줄이는 새로운 쿨링 시스템을 발표했습니다. 하지만 이는 AI가 가장 많이 사용하는 물을 처리하는 화석 연료 발전소 문제를 해결하는 데는 아무런 도움이 되지 않습니다.
미시간은 텍사스의 펙스에서 약 2기가와트 규모의 데이터 센터 캠퍼스를 건설하고 있으며, 이는 그 역사상 가장 큰 단일 용량 증가 중 하나입니다. 공개 서신에서 회사는 안정적인 전력 가격과 최소한의 물 사용을 약속했습니다.
JUPITER는 독일 포르셰르츠제니히의 Forschungszentrum Jülich에 위치한 유럽 최초의 엑사스케일 슈퍼컴퓨터로, NVIDIA Grace Hopper Superchips와 NVIDIA Quantum-X800 InfiniBand 네트워킹을 사용하고 있으며, 이 한 해 동안 바쁜 활동을 했습니다. 국제…
임무, 비전 및 베리타스 — HPE와 NVIDIA와 함께 건설될 새로운 로스알라모스 국립 연구소(LANL) 슈퍼컴퓨터 —은 과학적 발견을 가속화하기 위해 NVIDIA 베라 CPU를 활용하여 과학을 위한 Agentic AI를 해금하고 있습니다.…
AI의 다음 시대는 단순히 계산력으로 정의되지 않을 것입니다. 그 성장은 에너지에 의해 결정될 것입니다. 가속 계산이 AI 공장, 대리인 AI, 산업 AI, 에지 컴퓨팅 및 물리 AI와 같은 다양한 분야로 확대됨에 따라...
대형 기술 회사들이 데이터 센터 건설에 많은 돈을 투입하고 있다. 이 시설에 대한 국가적인 반대가 증가함에 따라, 일부 노동자들이 이게 가치가 있는지에 대해 의문을 가지기 시작하고 있다.
우리는 TimeCopilot을 사용하여 실제 항공 여객 데이터 패널과 이상치가 주입된 합성 계절 시리즈에서 종단 예측 작업을 수행합니다. 통계적, 기본, 선택적 GPU 기반의 평가를 수행합니다.
ASML이 중국 고객을 위한 수출 허가를 위험에さら지 않을 상업적 이유가 있다는 논리가 있습니다.
Amazon SageMaker AI는 머신러닝 모델의 실시간 추론 호스팅을 완전 관리합니다. SageMaker 엔드포인트에 모델을 배포하고, SageMaker가 프로비저닝을 처리합니다. ...
인기 게임 라이브러리에서 즐기는 인기 타이틀을 플레이하고, 진행 상황을 동기화하여 거의 모든 장치에서 게임 세션으로 돌아가세요. 이것이 GeForce NOW 클라우드 게이밍의 힘입니다. 멤버의 즐겨찾는...
뇌가 작동하는 방식을 모사함으로써 신경모픽 컴퓨팅은 전통적인 전자 AI 칩보다 훨씬 적은 에너지를 사용할 수 있습니다. 그러나 현재 가장 복잡한 신경모픽 장치들도 여전히 매우 간단합니다,...
지난해 VivaTech에서 NVIDIA GTC 파리에서 프랑스는 지역 AI를 발전시키기 위한 계획을 발표했습니다. 새로운 AI 공장과 국가 컴퓨팅 용량, 오픈 프론티어 모델 및 산업 플랫폼 등입니다. 지금, 이 AI 인프라는...
Tokenmaxxing은 올해 초 시리얼 밸리에서 가장 인기 있는 트렌드였으며, CEO들은 AI 사용을 최대한 확장하도록 직원들을 장려했습니다. 그런 다음 청구서가 도착했습니다. Uber가 연간 AI 예산을 초과했다는 소식이 전해졌습니다…
Tokenmaxxing이 올해 초 실리콘 밸리에서 가장 뜨거운 트렌드였습니다. CEO들은 직원들에게 AI 사용을 최대한 활용하도록 권장했습니다. 그런 다음 청구서가 왔습니다. Uber가 연간 AI 예산을 초과 사용했다는 소식이 전해졌습니다...
원래 계획대로 월요일에 이루어질 움직임은 강력한 사용자 비용을 크게 증가시키는 것으로 예상되었습니다.
오늘, 우리는 Amazon SageMaker AI 인터프레이션의 컨테이너 이미지 캐싱을 발표하자고 기쁩니다. 이는 더 빠른 확장 최적화 여정에서의 다음 주요 진보입니다. 이는 종료부터 시작까지의 지연을 최대 2배로 줄입니다.
스마트 글래스는 여전히 신생 카테고리지만, 칩 제조업체 쿼알컴은 다음 물결의 XR 장치를 운영할 수 있는 실리콘을 업그레이드하는 데 열심히 노력하고 있습니다: 스냅드래곤 레얼리티 엘리트. 쿼알컴이 오늘 칩을 발표하는에도 불구하고...
jusice department는 펜텐트먼트가 불법적인 가스 터빈을 계속 사용해야 한다고 주장합니다.
시리얼 밸리 소프트웨어 제작사와 일상상업 회사가 WIRED에 그들은 새로운 도전 과제인 “토큰 경제학”을 어떻게 이끌고 있는지 공개했습니다.
영국 남자 팀과 라이벌 독일 간의 긴장감 넘치고 점수가 없는 첫 절 마지막에 수많은 영국인들이 스트레스의 순간에 자주 하는 행동을 했습니다: 그들은 스트레스를 해소하기 위해 어떻게든 웃음을 지으며...
오늘, 저는 Skydio의 CEO인 Adam Bry와 인터뷰를 했습니다. Skydio는 자율 드론의 주도적인 미국 제조업체입니다. 이 에피소드를 녹음하기 전에, 저는 Adam의 Bay Area에서 Skydio의 드론을 원격으로 운영할 수 있었습니다.)、《Skydio CEO Adam Bry on why Silicon Valley shouldn’t draw red lines for drone use》
Microsoft Research와 여러 대학에서 개발된 Mirage 비디오 월드 모델은 장면 정보를 픽셀 기반 포인트 클라우드 대신 잠재 공간에 직접 저장합니다. 이는 계산 시간과 그래픽 메모리를 줄입니다.
중간 규모의 데이터 센터라도 지역적으로 큰 영향을 미칠 수 있습니다.
The Information에 따르면 OpenAI는 Nvidia의 재정적 지원을 받을 수 있는 오하이오에 계획된 10기가와트 규모의 데이터 센터 임대 협상을 진행 중입니다. 기사 OpenAI는 사상 최대 규모의 데이터 센터를 원하며 Nvidia는…
초기 용량이 24메가와트인 혁신적인 데이터 센터는 해수를 자연 냉각 시스템으로 사용합니다.
OpenAI의 새로운 보고서는 미국 기술 토론, 데이터 센터 설명, 관세 및 ChatGPT에 대한 허위 주장을 표적으로 삼기 위해 AI를 사용하는 중국과 연계된 영향력 작전을 자세히 설명합니다.
OpenAI의 네 번째 LLM(대형 언어 모델)인 GPT-4는 훈련하는 데 약 50기가와트시가 걸렸습니다. 이는 미국 5,000가구의 연간 전력 소비량에 해당합니다. 그게 2023년이었습니다. 그 이후로 컴퓨터 리소스는…
168메가와트 규모의 시설은 Meta의 글로벌 AI 컴퓨팅 요구 사항을 지원하며 시간이 지남에 따라 확장될 수 있습니다.
기밀 컴퓨팅 기능을 갖춘 NVIDIA GPU는 Apple의 데이터 센터를 넘어 Google Cloud로 확장됨에 따라 이제 Apple의 PCC(Private Cloud Compute)에서 기밀 추론에 사용됩니다. Apple의 연례 WWDC 행사에서 공개되었습니다…
오늘 샌프란시스코에서 열린 행사에서 General Motors는 AI 데이터 센터의 전력 수요 증가에 직면하여 EV 배터리, 에너지 저장 및 그리드 탄력성에 관한 일련의 발표를 했습니다. 자동차 제조사는…
이 게시물에서는 Amazon SageMaker HyperPod와 Amazon SageMaker 훈련 작업이라는 두 가지 컴퓨팅 옵션을 통해 Amazon SageMaker AI에서 NVIDIA Isaac Lab을 사용하여 Unitree H1 휴머노이드에 대한 로봇 정책을 훈련하는 방법을 보여줍니다.
화요일, 시애틀 시의회는 새로운 데이터 센터에 대한 1년 유예를 제정할지 여부를 투표할 예정입니다. 이는 여러 회사가 도시에 5개의 대규모 센터를 건설할 것을 제안한 지 불과 두 달 만입니다. 그중에…
Notion이 Codex를 사용하여 일회성 사양을 만들고, 웹용 AI 음성 입력을 구축하고, 소규모 팀 전체에 엔지니어링 역량을 배가하는 방법입니다.
이 튜토리얼에서는 Python의 CUDA 스타일 커널을 위한 타일 기반 GPU 프로그래밍 인터페이스인 NVIDIA cuTile Python에 대한 실습 워크플로를 구현합니다. Colab 친화적인 환경을 준비하고 GPU, 드라이버, CUDA,…
Google은 2028년에 Intel에 300만 개 이상의 AI 칩을 주문했습니다. Nvidia는 곧 출시될 Feynman 아키텍처를 위해 Intel의 제조 기술을 테스트하고 있습니다. 두 가지 움직임 모두 TSMC가 AI 칩 수요를 따라잡을 수 없기 때문에 나온 것입니다. 국제…
Xiaomi의 MiMo 팀은 TileRT와 함께 MiMo-V2.5-Pro 모델용 서비스 모드인 MiMo-V2.5-Pro-UltraSpeed를 출시했습니다. 단일 8GPU 상용 노드를 사용하여 1조 매개변수 모델에서 초당 1000개가 넘는 토큰을 디코딩합니다.…
전 세계적으로 높은 수요가 있는 최신 생성 AI 모델과 고성능 가속 컴퓨팅에 액세스할 수 있는 AWS 고객은 여러 AWS 리전에서 모델 가용성과 용량을 활용할 수 있는 도구가 필요합니다.
엔비디아와 LG그룹은 로봇공학, 자율주행, 데이터센터 기술, GPU 클라우드 서비스 등 LG그룹의 차세대 AI 기반 사업을 가속화하기 위해 AI 공장을 건설하고 있습니다. AI공장이 증명할 것…
OpenAI 맞춤형 칩 프로그램의 두 번째 하드웨어 직원인 Clive Chan이 Anthropic으로 이전하고 있습니다. 그는 Tesla의 Autopilot ASIC 및 OpenAI-Broadcom 파트너십 경험을 제공합니다. 이번 조치는…
Google은 개발자와 AI 에이전트가 원격 Colab GPU 및 TPU 런타임에서 로컬 코드를 실행할 수 있는 Colab CLI를 출시했습니다. Google의 새로운 Colab CLI를 통해 개발자와 AI 에이전트는 원격 Colab GPU 및 TPU에서 Python을 실행할 수 있습니다.
Sakana AI는 반복적 자기 개선, 즉 반복적으로 스스로를 개선하는 AI를 위한 전용 연구실을 시작했습니다. Transformer의 공동 저자인 Llion Jones가 공동 설립한 일본 스타트업은 RSI를 T의 대안으로 보고 있습니다.
개발자는 데이터 센터를 축소하는 것 외에는 "선택의 여지가 없다"는 느낌을 받았습니다.
NVIDIA는 장기 실행 에이전트를 위한 총 550B(활성 55B) 개방형 전문가 혼합 하이브리드 Mamba-Transformer인 Nemotron 3 Ultra를 출시했습니다. 1M 토큰 컨텍스트와 경쟁 제품보다 최대 6배 더 높은 추론 처리량을 결합합니다.
Meta는 막대한 데이터 센터 비용을 삭감하는 한 가지 방법을 찾았을 수도 있습니다. 바로 텐트입니다.
지역 계열사인 ABC4가 앞서 보도한 바와 같이, 케빈 오리어리는 주민과 활동가들의 압력이 가중되는 가운데 자신이 계획한 유타에 있는 40,000에이커 규모의 데이터 센터 규모를 절반으로 줄이는 데 동의했습니다. Shark Tank 스타가 편지를 보냈습니다 ...
캘리포니아 스타트업인 이 스타트업은 4세대 가정 보조 로봇인 Stretch를 출시했습니다.
하이퍼스케일러는 수질 및 가용성에 미치는 영향에 대해 면밀한 조사를 받았습니다.
양자 컴퓨터는 언젠가 상상할 수 있는 가장 강력한 슈퍼컴퓨터를 넘어서는 문제를 해결할 것을 약속합니다. 그러나 이러한 기계를 작동하는 데 얼마나 많은 클래식 컴퓨팅이 필요한지 종종 과소평가됩니다. 큐빗카운티로서…
여러 지역의 새로운 데이터 센터 용량으로 인해 GPU 가용성이 완화되어 이번 주 지역 추론 비용 지수가 낮아지는 데 도움이 되었습니다.
더 많은 공급업체가 컴퓨팅 가격을 지역 에너지 조건에 연결하고 AI 워크로드가 가장 저렴하게 실행되는 장소와 시기에 시간 차원을 추가하고 있습니다.
NVIDIA AI 클라우드 생태계는 AI 공장 인프라의 글로벌 구축을 가속화하고 있습니다. 파트너는 기업, 스타트업, 국가, AI 연구소 및 개발자의 증가하는 수요를 충족하기 위해 용량을 확장하고 있습니다.
Anthropic은 월요일에 큰 성공을 거둔 Claude Code 도구의 기능을 비기술적인 사용자에게도 확장하는 새로운 AI 에이전트 기능인 Cowork를 출시했습니다. 회사 내부자에 따르면 팀은 전체 기능을 구축했습니다.
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.