컴퓨팅 공급, GPU, 데이터 센터 및 에너지는 AI 실행 비용을 결정하는 물리적 계층입니다.
49 스토리
컴퓨팅 공급, 에너지 및 데이터 센터 용량은 AI를 얼마나 저렴하게 실행할 수 있는지를 결정합니다. 인프라 변화는 몇 주 후에 추론 비용에 나타납니다.
매사추세츠는 수개월 만에 데이터 센터 개발에 새로운 제한을 두는 세 번째 주가 되었습니다.
TorchServe는 더 이상 유지 관리되지 않으므로 팀이 전체 GPU 추론 스택을 소유하게 됩니다. AWS Ray Serve Deep Learning Container는 프레임워크, GPU 드라이버 및 서비스 계층이 포함되어 지원되고 사전 테스트된 컨테이너입니다.
Kepler Computing은 칩 설계에 대한 새로운 접근 방식과 독점 소재가 메모리 가격 급등을 가져온 공급 병목 현상을 종식시키는 데 도움이 될 수 있다고 주장합니다.
아르헨티나 파타고니아가 대규모 AI 데이터센터 유치 후보지로 주목받고 있다. Patagonia에는 AI 데이터 센터가 원하는 것이 있으며, 지금까지 아무런 저항도 없었다는 기사가 The Decoder에 처음 게재되었습니다.
ASML은 삼성, TSMC, Intel을 제치고 더 큰 포토마스크로 전환하도록 승리했으며, 이를 통해 최신 EUV 장비의 처리량이 40% 향상될 것입니다. 한편, 화웨이는 중국의 대응 전략을 조율하고 있습니다.
Google의 최신 AI 일기 예보 모델은 지상 100m에서의 풍속을 예측합니다. 이는 대략 현대식 풍력 터빈 높이에 해당합니다. 또한 구름의 양과 표면에 도달하는 햇빛의 양을 예측하고…
기사 URL: https://newsroom.arm.com/blog/arm-mali-g2-ultra-nx-ai-native-mobile-graphics 댓글 URL: https://news.ycombinator.com/item?id=49605511 포인트: 43 # 댓글: 26
기사 URL: https://www.bbc.com/news/articles/c0m39g7xzevo 댓글 URL: https://news.ycombinator.com/item?id=49604956 포인트: 15 # 댓글: 14
기사 URL: https://www.ft.com/content/ea9a9dcc-b1df-49b0-b80c-f320161b9efa 댓글 URL: https://news.ycombinator.com/item?id=49593778 포인트: 18 # 댓글: 9
기사 URL: https://rocm.blogs.amd.com/ecosystems-and-partners/rocm-x-blog/README.html 댓글 URL: https://news.ycombinator.com/item?id=49592508 포인트: 15 # 댓글: 0
AI 연구 에이전트는 실행할 수 있는 것보다 훨씬 더 많은 실험을 제안할 수 있습니다. Meta FAIR, Oxford 및 UCL은 AI 연구 선호 모델을 도입합니다. 즉, 실행되지 않은 후보자 15명의 순위를 매기고 실행하는 LLM 심사위원입니다.
여론조사에 따르면 대다수의 미국인이 데이터 센터를 싫어하는 것으로 나타났습니다. 중국은 기술 리더들과 그 동맹국들에게 완벽한 희생양이 됩니다. 유일한 문제는 증거가 부족하다는 것입니다.
AI 검색 제품의 검색 품질은 임베딩 모델이 얼마나 좋은지, 인덱스 전체에서 얼마나 저렴하게 실행할 수 있는지에 따라 결정됩니다. 이번 주 Perplexity Engineering 팀은 GP에 Fast Embeddings를 게시했습니다.
Nous Research는 Hermes Desktop에서 한 번의 클릭으로 로컬 모델 설정을 축소했습니다. 앱은 하드웨어를 읽고, GPU에 대한 카탈로그의 적합성을 검사하고, 적합한 최고 품질의 빌드를 선택하고, 다운로드한 후 구성합니다.
Deepseek은 훈련이 아닌 추론 목적으로만 160,000개의 Huawei Ascend-950DT 칩을 내몽골 데이터 센터에 배치하려고 합니다. 이는 알려진 화웨이 칩 클러스터 중 가장 큰 규모가 될 것입니다. 하지만 생산 병목 현상은 화웨이의 문제를 의미합니다…
TechCrunch Disrupt 2026 동안 사이드 이벤트 개최를 신청하고 실리콘 밸리 현장에서 명성을 떨칠 수 있는 기간이 24시간도 채 남지 않았습니다. 오늘 밤 자정(PT)에 지원이 마감되기 전에 지원하세요.
Ugreen의 HomeAgent H100 Pro 허브는 로컬 스토리지, 온디바이스 AI 및 새로운 음성 비서인 Uliya를 결합하여 스마트 홈을 실행합니다. | 사진 제공: Jennifer Pattison Tuohy / 휴대폰 보조 배터리로 유명한 The Verge Ugreen
Nvidia의 PAIR(Personal AI Router)는 로컬 AI 요청을 홈 네트워크의 사용 가능한 모든 장치에 자동으로 분산시켜 병렬 에이전트 작업의 대기 시간을 단축합니다. Nvidia는 홈 네트워크가 작동하기를 원한다는 기사…
Perplexity는 Mac 앱용 하이브리드 컴퓨팅을 출시하여 클라우드의 프론티어 모델과 사용자 컴퓨터에서 실행되는 컴팩트 모델 간에 단일 Perplexity Computer 작업을 분할했습니다. 바다를 위한 작업은 클라우드에서 시작됩니다…
Nvidia는 Ollama 및 LM Studio와 같은 도구를 사용하여 로컬 AI 추론 작업을 처리하기 위해 가정용 컴퓨터를 동기화하는 무료 도구인 새로운 개인 AI 라우터(PAIR)를 발표했습니다. WA에서 분명한 사실을 알아내자…
Sam Altman은 글로벌 AI 데이터 센터 구축의 "지속 불가능한 어리석음"을 경고합니다. 너무 많은 Neocloud 제공업체가 고객의 지원 없이 대규모 용량을 발표하고 있습니다. 그는 또한 컴퓨팅이 떨어지는 것을 인정합니다…
트럼프 대통령은 미국 전역에서 AI 데이터 센터에 대한 반대가 커지는 것에 대해 강력하게 반발했습니다. 트럼프 대통령은 AI 데이터 센터에 대한 항의 시위가 중국의 손에 들어갔다는 기사가 The Decoder에 처음 게재되었다고 말했습니다.
약 10년 전, 저는 미국 원자력 발전소를 위한 최초의 완전 디지털 제어 시스템 제어 설계를 주도했습니다. 그것은 서류상으로는 현대 항공사의 방식으로 스스로 작동하도록 설계된 아름다운 기계였습니다.
대부분의 프로덕션 음성 스택은 세 가지 시스템이 함께 연결되어 있습니다. 한 모델은 텍스트를 기록하고, 두 번째 모델은 화자를 분리하며, 탐지기는 사용자가 말을 중단한 시점을 결정합니다. 핸드오프할 때마다 대기 시간이 추가되고 새로운 오류가 발생합니다.
에이전트 보조자에는 구조적 문제가 있습니다. 이를 유용하게 만드는 컨텍스트(거래 문서, 권한 있는 파일, 클라이언트 레코드)는 정확히 사용자가 클라우드 엔드포인트로 보낼 수 없는 컨텍스트입니다. 이번 주 Perplexity는…
집에 서버, 게임용 컴퓨터 또는 별로 사랑받지 못하는 노트북을 소유하고 있다면 들어보세요. 이제 여분의 컴퓨팅 성능을 활용하여 그 과정에서 소극적 소득을 얻을 수 있습니다. AI 기업은 휴…
Nvidia는 지난 3월 AI 업스케일링 기술을 "비디오 게임용 실시간 생성 AI 필터" 및 "비디오 게임용 모션 스무딩"에 비유한 분열적인 발표에 이어 이번 주 공식적으로 DLSS 5를 출시합니다.
음성 에이전트는 인텔리전스에 실패하기 훨씬 전에 대기 시간에 실패합니다. 첫 번째 토큰까지의 시간은 대부분의 팀이 추론 API를 선택하는 데 사용하는 측정 기준이며 올바른 시작점이자 잘못된 중지점입니다. 이 벤…
회사는 기술자가 수행할 수 있는 작업에 대해 로봇을 테스트하고 있습니다.
차세대 데이터 센터 시스템은 프로세서 주기를 늘리는 대신 더 스마트한 트래픽 제어를 통해 효율성을 높이고 있습니다.
Comulytic Note Pro AI 음성 녹음기는 신용카드 크기의 장치에 많은 기능을 담았습니다. 그러나 그 유용성은 귀하에게 달려 있습니다.
새로운 데이터 센터가 인근 지역 사회의 거센 반발에 직면한 것처럼, 미국 환경 보호국(EPA)은 이러한 센터가 생성하는 오염에 대해 사람들이 무게를 두는 것을 더욱 어렵게 만들 예정입니다. EPA는…
이 회사는 케이블을 교체하고, 서버를 재설정하고, 기술자가 수행하는 기타 작업을 수행할 수 있는 로봇을 테스트하고 있어 일부 직원들 사이에서 자신의 작업이 위험에 처할 수 있다는 우려를 불러일으키고 있습니다.
기술 업계는 데이터센터에 세금을 부과해 AI 경쟁에서 승리하려는 트럼프의 계획에 당혹스러워하고 있다.
자체 호스팅 음성 AI는 관찰 가능성 균형을 유지합니다. 즉, 용량 계획 및 비용 관리를 추진하는 숫자는 공급업체 컨테이너 내에 고정되어 있습니다. Deepgram은 두 가지 기능을 통해 Amazon SageMaker AI의 격차를 해소합니다.
각 요청이 GPU의 일부만 사용하는 경우 ASR(자동 음성 인식) 모델을 대규모로 제공하는 데 비용이 많이 듭니다. Amazon EC2 G에서 NVIDIA Triton Inference Server를 사용하는 NVIDIA CUDA MPS(Multi-Process Service) 방법을 알아보세요.
AI 데이터 센터가 하드웨어 부족을 초래하여 저가형 전화기에 더 적은 메모리가 남게 되면서 Google은 Android 앱에 대한 새로운 메모리 사용 제한을 설정했습니다.
오늘 Decoder에서 저는 Verge 수석 AI 리포터인 Hayden Field와 순수한 Decoder 미끼에 대해 이야기하고 있습니다. OpenAI의 끝이 없어 보이는 조직도 변화와 이 모든 것이 공동 창립자 Greg 아래에서 어떻게 권력을 통합하는 것처럼 보이는지…
데이터 센터에 대한 질문이 있으시면 WIRED에서 답변을 얻으실 수 있습니다. 9월 10일 라이브 스트리밍에 참여하시면 전문가 패널이 귀하가 알아야 할 모든 것을 알려드립니다.
Google의 새로운 Gemini 3.5 Transcribe는 85개 이상의 언어를 인식하고 필러 단어를 제거하며 실시간으로 실수를 수정합니다. 스트리밍 모드에서 단어 오류율은 4.0%, 대기 시간은 70% 더 낮습니다.
Amazon은 향후 2년 동안 데이터 센터에 200만 개의 Nvidia GPU 칩을 추가할 예정입니다. 그러나 이러한 확장된 파트너십은 더 많은 칩을 구매하는 것 이상으로 확장됩니다.
차세대 AI 물결은 인프라에 대한 새로운 수요를 창출하고 있습니다. AI 에이전트와 1000억 개의 매개변수 워크로드가 주류가 되면서 AI 인프라의 성능은 컴퓨팅뿐만 아니라 컴퓨팅, 메모리…
SageMaker Python SDK v3은 통합 ModelTrainer 및 ModelBuilder 클래스를 사용하여 스크립트 모드를 재설계했습니다. 이 게시물에서는 scikit-learn Random Forest와 다중 GPU Stable Diffusion 3.5 Lo라는 두 가지 엔드투엔드 예제를 살펴봅니다.
이는 단순히 태양 에너지를 수확하는 것에 관한 것이 아니라 저장에 관한 것이며 값싸고 비첨두 전력을 더 비싼 시간으로 전환하는 것에도 관한 것입니다.
말론의 사임에 대해 TechCrunch에 보낸 성명에서 OpenAI는 "우리 작업의 규모와 속도를 지원하기 위해 인프라 조직을 최근 재편성"했다고 밝혔습니다.
기사 URL: https://www.wsj.com/tech/ai/openais-head-of-data-centers-has-left-company-6d24fd83 댓글 URL: https://news.ycombinator.com/item?id=49439489 포인트: 27 # 댓글: 9
OpenAI는 여러 계정을 금지함으로써 ChatGPT를 사용하여 소셜 미디어 게시물을 생성하는 비밀 러시아 영향력 캠페인을 방해했습니다. 운영자는 러시아의 VPN을 통해 플랫폼에 액세스하고 기능을 홍보했습니다.
OpenAI는 Hot Chips 컨퍼런스에서 벤치마크와 함께 자사 최초의 사내 추론 칩인 'Jalapeño'를 선보였습니다. SemiAnalytic 테스트에 따르면 이 칩은 처리량과 에너지 효율성 측면에서 Nvidia의 Blackwell과 심지어 Rubin을 능가합니다.
프론티어 모델을 훈련하고 제공하는 것은 이제 컴퓨팅 문제만큼이나 네트워킹 문제입니다. all-reduce 및 all-to-all과 같은 집단 작업은 훈련 중에 수천 개의 가속기를 동기화하며 가장 느린 속도는…
요약은 정보 제공 목적으로만 집계되었습니다. 전체 내용을 보려면 소스 링크를 따르세요. 데모 항목은 예시입니다.