Rechenleistung, GPUs, Rechenzentren und Energie – die physische Schicht, die darüber entscheidet, wie kostengünstig KI läuft.
180-Geschichten
Rechenleistung, Energie und Rechenzentrumskapazität entscheiden darüber, wie kostengünstig KI betrieben werden kann. Infrastrukturverschiebungen zeigen sich Wochen später in den Inferenzkosten.
Die Komplexität des modernen Chipdesigns nimmt weiter zu, da Ingenieurteams an der Entwicklung immer anspruchsvollerer CPUs, GPUs und KI-Systeme arbeiten. Um dieser Herausforderung gerecht zu werden, arbeitet NVIDIA mit Branchenführern zusammen …
In der neuesten Folge von Equity diskutierten wir darüber, warum Kimi von Moonshot AI das Silicon Valley und die Wall Street in Panik zu versetzen schien.
Entdecken Sie TileLang, eine domänenspezifische High-Level-Python-Sprache, die das Design von Hochleistungs-GPU-Kerneln vereinfacht. Dieses Tutorial bietet einen schrittweisen Ansatz zur Implementierung komplexer Workloads – einschließlich gekachelter…
Ein genauer Anruf in Nord-Virginia zeigte, wie schlecht Rechenzentren auf Netzstörungen reagieren. Hier erfahren Sie, wie Sie das Problem beheben können.
Das Samsung Galaxy Z Fold 8 Ultra ist ein gutes Telefon, aber das Galaxy Z Fold 8 hat etwas viel Überzeugenderes.
Mit dem neuesten faltbaren Telefon von Samsung bietet das Unternehmen Design- und Softwareänderungen an, die selbst das letztjährige Z Fold als unzureichend erscheinen lassen.
Datalab hat Marker als Drei-Modus-Pipeline umgeschrieben. Version 2 erreicht 76,0 auf dem olmOCR-Bench und erreicht 2,9 Seiten pro Sekunde auf einem B200 – mehr als das Fünffache des Pipeline-Backends von MinerU, während sie Docling sowohl bei der Genauigkeit als auch bei der Geschwindigkeit übertrifft. H…
Datalab hat Marker als Drei-Modus-Pipeline umgeschrieben. Version 2 erreicht 76,0 auf dem olmOCR-Bench und erreicht 2,9 Seiten pro Sekunde auf einem B200 – mehr als das Fünffache des Pipeline-Backends von MinerU, während sie Docling sowohl bei der Genauigkeit als auch bei der Geschwindigkeit übertrifft. H…
Artikel-URL: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference Kommentar-URL: https://news.ycombinator.com/item?id=49041347 Punkte: 17 # C…
Die Regel würde es den Staaten ermöglichen, zu entscheiden, wie viel – wenn überhaupt – öffentliche Beiträge geleistet werden dürfen.
In diesem Tutorial erstellen wir einen vollständigen Workflow für die Ausführung des Unlimited-OCR-Modells von Baidu auf Dokumentbildern und mehrseitigen PDFs. Von der Konfiguration der GPU-Umgebung bis zum Vergleich hochdetaillierter gekachelter Gundam-Inferenz und -Fas…
Artikel-URL: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 Kommentar-URL: https://news.ycombinator.com/item?id=49…
Die Machbarkeit orbitaler Rechenzentren, die die größten und leistungsfähigsten Large Language Models (LLMs) beherbergen, bleibt heiß umstritten. Aber enorme Bereitstellungen, die Tausende von GPUs erfordern, sind nicht die einzigen Möglichkeiten, die LLMs bieten können …
Eine Person hält Schilder während eines landesweiten Protests gegen die Erweiterung des KI-Rechenzentrums vor der Peace Hall in New Port Richey, Florida. | AFP über Getty Images An einem grauen, feuchten Samstagmorgen in Zentralflorida, ein wenig und…
Jensen Huang, Gründer und CEO von NVIDIA, besuchte heute die Naval Postgraduate School in Monterey, Kalifornien, um ein NVIDIA DGX GB300-System in Betrieb zu nehmen und damit eine der leistungsstärksten KI-Plattformen der Welt für ... vollständig online zu bringen.
Artikel-URL: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ Kommentar-URL: https://news.ycombinator.com/item?id=49007525 Punkte: 39 # Kommentare: 53
Das Samsung Galaxy Z Fold 8 Ultra verfügt über die nötige Leistung, aber der Preis und das Zubehör für das Google Pixel 10 Pro Fold könnten ein besseres Angebot sein.
OpenAI unterstreicht sein Engagement für die Weiterentwicklung der amerikanischen Wissenschaft in Zusammenarbeit mit dem US-Energieministerium und nationalen Laboren, um mithilfe von Grenz-KI die Entdeckung zu beschleunigen.
SenseTime hat das Galaxy-Projekt gestartet und arbeitet mit fast 20 Partnern zusammen, um die inländische KI-Chip-Infrastruktur in China zu skalieren. In einer Keynote mit dem Titel „Intelligente Transformation und Symbiose“ sagte Yang Fan – Mitgründer des Unternehmens …
Das Versprechen wurde im März eingeführt und hat bisher kaum dazu beigetragen, die Bedenken auszuräumen. | Bild: Cath Virginia / The Verge, Getty Images Angesichts der Gegenreaktionen auf Bedenken wird der KI-Boom die Stromrechnungen der Verbraucher erhöhen …
Neue Rechenzentren, die bis 2033 gebaut werden, könnten so viel Strom verbrauchen, wie Indien heute verbraucht.
https://www.energy.gov/undersecretaryforscience/genesis-miss... Kommentar-URL: https://news.ycombinator.com/item?id=48995074 Punkte: 84 # Kommentare: 56
KI ist in die Gigascale-Ära eingetreten. Die fortschrittlichsten KI-Fabriken der Welt vereinen Hunderttausende GPUs und CPUs, um Grenzmodelle zu trainieren, Agenten-KI zu betreiben und Intelligenz in beispiellosem Tempo zu generieren.
Die Vera Rubin-Plattform von Nvidia vereint CPUs und GPUs in einem einzigen System und spiegelt damit den wachsenden Ehrgeiz des Unternehmens wider, jede Ebene der KI-Infrastruktur zu betreiben.
Alphabet, die Muttergesellschaft von Google, arbeitet Berichten zufolge an einem neuen Chip, der dafür sorgen soll, dass seine Gemini-Modelle deutlich effizienter laufen.
Google entwickelt „Frozen v2“, einen Serverchip, der die Gemini-Architektur direkt in Hardware integriert. Internen Quellen zufolge könnte es 6 bis 10 Mal effizienter sein als aktuelle TPUs. Geplant für 2028, d…
Dieser Beitrag beschreibt, wie Couchbase Amazon Bedrock einführte, um Capella iQ mit der Claude-Modellfamilie von Anthropic zu betreiben, die architektonischen Entscheidungen hinter ihrem Multimodell-Ansatz und die realisierten betrieblichen Vorteile …
Microsoft erweitert die KI-Infrastruktur von Azure mit der neuen Helios-Plattform von AMD, die in der zweiten Hälfte des Jahres 2026 die GPU-Systeme von Nvidia herausfordern soll. Ein öffentliches GitHub-Profil deutet darauf hin, dass Anthropic auch AMD testet…
Erin Davis nennt es den „SuperDuperPOD“. Das sind zwei Dinge in einem Namen: Der Pharmariese Bristol Myers Squibb (BMS) betreibt bereits einen der größten KI-Cluster in den Biowissenschaften und kann ernsthafte Ergebnisse vorweisen.…
Chinas führende KI-Unternehmen erhöhen den Druck auf das Silicon Valley, da Moonshot und Alibaba Modelle vorgestellt haben, von denen sie behaupten, dass sie zu einem Bruchteil der Kosten mit den Besten von OpenAI und Anthropic mithalten können. Der Rap…
Wir erstellen einen End-to-End-NVIDIA NeMo AutoModel-Workflow in Google Colab mit einer einzigen GPU. Wir überprüfen die CUDA-Hardware und die Präzisionsunterstützung, installieren NeMo AutoModel von der Quelle und laden ein offizielles Qwen3-0.6B LoRA-Rezept. W…
Neil Rimer, der Risikokapitalgeber und Mitbegründer von Index Ventures, prognostiziert, dass der historische Reichtum, den KI im Silicon Valley generiert, freiwillig oder unfreiwillig umverteilt werden muss.
Berichten zufolge befindet sich Meta in Gesprächen mit Anthropic über die Vermietung von Rechenkapazitäten aus seinen Rechenzentren. Der Artikel „Zuckerbergs Plan, überschüssige KI-Rechenleistung zu verkaufen, könnte seinen ersten großen Kunden in Anthropic finden“ erschien zuerst auf Th…
Moonshot AI hat Kimi K3 veröffentlicht, ein Modell, das nach ersten Einschätzungen mit dem Opus 4.8 von Anthropic mithalten kann und von einem Team von nur 300 Leuten gebaut wurde. Sogar OpenAI-Stratege Dean W. Ball nennt es „sehr gut“, warnt aber natürlich davor…
Der Levoit Vital 200S-P ist der intelligente Luftreiniger, den es zu schlagen gilt, mit einem waschbaren Vorfilter und einer Kapazität zur Reinigung von bis zu 1.800 Quadratfuß in einer Stunde.
Ein echter dreitägiger Stromausfall offenbarte Probleme, die ich im Datenblatt eines Kraftwerks nie gefunden hätte.
Sarah Friar, CFO von OpenaAI, stellt eine praktische KI-Scorecard vor, um den ROI durch nützliche Arbeit, Kosten pro erfolgreicher Aufgabe, Zuverlässigkeit und Return on Computing zu messen.
<p>Vorschlag für Hyperscaler, die den Druck über den Wasserverbrauch von Rechenzentren verspüren:</p> <p>Kaufen Sie ein paar exklusive Country Clubs, wandeln Sie die Golfplätze in öffentliche Parks um, zahlen Sie für Führer und Ferngläser, um das vorherige Mitglied zu bekommen …
Im heutigen Uncanny Valley enthüllen wir das anhaltende Drama von OpenAI, sowohl rechtlicher als auch rufschädigender Natur, und ob diese Entwicklungen dem Unternehmen weiteren Schaden zufügen könnten – insbesondere im Kampf gegen Anthropic.
In 107 Unternehmen steigen die Ausgaben für die KI-Infrastruktur deutlich schneller an als die Möglichkeit, ihre Wirtschaftlichkeit zu erkennen oder zu steuern. Die meisten Unternehmen betreiben ihre KI auf einer vertrauten Basis von Hyperscalern und Modellanbieter-APIs, doch…
Wir erkunden das Patter SDK, indem wir einen Sprachagenten-Workflow für einen Anwendungsfall bei der Restaurantbuchung erstellen. Wir definieren dynamische Anrufervariablen, registrieren aufrufbare Tools für Verfügbarkeit, Buchungen, Stunden und Personenvermittlung und legen fest …
Allzweckroboter und autonome Maschinen verlagern sich von Forschungslaboren in den realen Einsatz auf dem Massenmarkt und schaffen Nachfrage nach kompakten, energieeffizienten KI-Supercomputern, die in der Lage sind, Basismodelle auf der ganzen Welt auszuführen.
Built arbeitete mit dem AWS Generative AI Innovation Center (GenAIIC), AWS Partner AND Digital und AWS-Account-Teams zusammen, um eine skalierbare, KI-gestützte Dokumentenverarbeitungs-Engine zu entwickeln, die klassifizieren, aufteilen, extrahieren, auswerten kann …
Ankers Solix E10 machte die Notstromversorgung für diesen Neuling verständlich und ich kann es kaum erwarten, das System zu erweitern.
New York ist der erste Staat, der die Genehmigung großer Rechenzentren vorübergehend ausgesetzt hat, da Gouverneurin Kathy Hochul argumentiert, dass der KI-gesteuerte Bauboom nicht auf Kosten höherer Stromkosten, Wasserversorgung usw. gehen sollte.
Das New Yorker Rechenzentrumsmoratorium könnte zur Blaupause für eine Anti-KI-Bewegung werden.
Leistung ist die unausweichliche Einschränkung der KI-Infrastruktur. Wie viele Token eine KI-Fabrik innerhalb eines festen Strombudgets generieren kann, bestimmt ihren Umsatz und ihre Rentabilität. Aus diesem Grund ist die Leistung pro Watt eine Kennzahl, die…
Demis Hassabis, während einer Podiumsdiskussion beim Weltwirtschaftsforum in Davos, Schweiz. | Bild: Bloomberg über Getty Images Demis Hassabis glaubt, dass die Welt einen KI-Wachhund braucht, der in der Lage ist, auf die Bremse zu treten, wenn …
Artikel-URL: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ Kommentar-URL: https://news.ycombinator.com/item?id=48901420 Punkte: 19 # Kommentare: 4
Von all den Debatten, die über die möglichen Nachteile von KI geführt werden, gibt es eine Sorge, die den KI-Enthusiasten im Silicon Valley am meisten Kopfzerbrechen bereitet – dass die riesigen KI-Labore, die proprietäre Modelle verkaufen, irgendwie ein … sind.
Wir haben die besten All-in-One-Computer getestet, die die Leistung eines Desktop-PCs mit einem schlanken, leichten Design kombinieren.
Entlang der Route 54 im Mount Carmel Township Northumberland County ist ein Schild angebracht, das sich gegen ein geplantes Rechenzentrum wendet. | Bild: Getty Images Dies ist The Stepback, ein wöchentlicher Newsletter, der eine wichtige Geschichte aus… aufschlüsselt.
In diesem Tutorial erkunden wir die kachelbasierte GPU-Programmierung von NVIDIA mit TileGym und erstellen einen Colab-Workflow, der auf unterschiedlicher Hardware läuft. Wir untersuchen die CUDA-Umgebung, probieren das echte cuTile-Backend aus und greifen auf Tr zurück.
Nach der Einführung von ChatGPT Work und GPT-5.6 Sol hat OpenAI erhebliche Probleme erkannt: übermäßige Rechennutzung, ein verwirrender Übergang zur Desktop-Oberfläche für Chats und Projekte, eine unklare Unterscheidung zwischen …
Artikel-URL: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ Kommentar-URL: https://news.ycombinator.com/item?id=48865717 Punkte: 17 # Kommentare: 0
In diesem Beitrag lernen Sie vier Bereitstellungsmuster kennen, um Modelle, die bereits mit Unsloth quantisiert wurden, auf der AWS-Infrastruktur bereitzustellen. Die Muster nutzen Amazon Elastic Compute Cloud (Amazon EC2)…
Ein Unternehmen für Solar- und Heimenergiespeicher expandiert in KI-Rechenzentren, aber nicht durch den Bau eines solchen, sondern bietet seinen Kunden stattdessen an, dafür zu zahlen, dass sie ihre Recheneinheiten in ihren Häusern unterbringen. Sunrun startet ein Pilotprogramm…
Wenn Sie mehr Leistung benötigen, als Shared-Hosting-Dienste bieten können, können Ihnen die führenden VPS-Hosting-Anbieter die dedizierten Ressourcen und die Skalierbarkeit zur Verfügung stellen, die Sie benötigen, um Ihr Projekt auf die nächste Stufe zu bringen.
Die neue Modellfamilie von OpenAI wird weiterhin die Grundlage für die Arbeitsplatz- und Produktivitäts-Apps von Microsoft bilden.
NVIDIA hat Nemotron-Labs-3-Puzzle-75B-A9B veröffentlicht, eine komprimierte Variante von Nemotron-3-Super. Iterative Puzzle wechselt hardwarebewusste strukturelle Komprimierung mit kurzen Wiederherstellungsphasen zur Wissensdestillation. Der Modus…
Nachdem das Unternehmen bewiesen hat, wie wertvoll Computer sein können, befindet es sich im Zentrum eines Marktes, in dem jeder tätig sein möchte – während einfachere Technologien und weniger interessante Unternehmen am Rande reich werden.
Artikel-URL: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html Kommentar-URL: https://news.ycombinator.com/item?id=48846708 Punkte: 4…
Dieser GFN-Donnerstag bringt mehr Spiele, mehr Leistung und mehr Möglichkeiten, auf GeForce NOW zu spielen. Der Cloud-Gaming-Dienst wird mit einem neuen GeForce RTX 5080-basierten Server in Toronto erweitert und bringt dedizierte Hochleistung in die …
NVIDIA hat Nemotron-Labs-3-Puzzle-75B-A9B veröffentlicht, eine komprimierte Variante von Nemotron-3-Super. Iterative Puzzle wechselt hardwarebewusste strukturelle Komprimierung mit kurzen Wiederherstellungsphasen zur Wissensdestillation. Der Modus…
Kevin Weils neue Rolle bei Stoke Space deutet darauf hin, dass wiederverwendbare Raketen das nächste heiße Ding im Silicon Valley sind.
Natürlich sind Verlängerungskabel und Steckdosenleisten für Privathaushalte praktisch, aber sie führen auch jedes Jahr zu Tausenden vermeidbaren Bränden. So verwenden Sie sie sicherer.
Der Druck auf die Stromrechnungen im Rust Belt gefährdet Trumps Produktionsplan.
Microsoft ist der jüngste Riese aus dem Silicon Valley, der seine KI-Ausgaben kürzt.
Das chinesische Startup Deepseek baut seinen eigenen KI-Chip, berichtet Reuters. Der Artikel Deepseek entwirft seinen eigenen KI-Chip erschien zuerst auf The Decoder.
OpenAI hat seiner API zwei Echtzeitmodelle hinzugefügt. GPT-Realtime-2.1-mini ist ein Mini-Realtime-Modell für Sprache, preislich wie das frühere gpt-realtime-mini. OpenAI reduzierte außerdem die p95-Latenz durch verbessertes Caching um mindestens 25 %. Er…
Fable 5 von Anthropic verspricht mythische KI-Leistung, aber überraschende Einschränkungen lassen mich fragen, ob es für den täglichen Gebrauch mehr Ärger macht, als es wert ist.
Artikel-URL: https://xcancel.com/i/article/2072830533739192560 Kommentar-URL: https://news.ycombinator.com/item?id=48792463 Punkte: 17 # Kommentare: 1
Artikel-URL: https://github.com/openai/codex/issues/30364 Kommentar-URL: https://news.ycombinator.com/item?id=48789428 Punkte: 131 # Kommentare: 41
Artikel-URL: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 Kommentar-URL: https://news.ycombinator.com/item?id=48774246 Punkte: 18 # Kommentare: 6
Der rasche Ausbau der Infrastruktur für künstliche Intelligenz wird typischerweise als Energieproblem betrachtet. Rechenzentren werden voraussichtlich einen wachsenden Anteil des weltweiten Strombedarfs verbrauchen: Die Internationale Energieagentur…
Die Nachricht kommt etwa eine Woche, nachdem OpenAI in Zusammenarbeit mit Broadcom seinen eigenen benutzerdefinierten KI-Chip angekündigt hat.
Berichten zufolge führt Anthropic Gespräche mit Samsung Electronics über die Herstellung eines maßgeschneiderten KI-Chips. Das Projekt ist noch am Anfang, aber Anthropic hat bereits Chip-Ingenieure eingestellt. Nach OpenAIs „Jalapeño“ eine weitere große KI…
Der Eufy Omni S2 ist gegenüber seinem Vorgänger um die vierfache Saugleistung und eine geruchsfreie Wischwalze verbessert.
Nvidia agiert zunehmend wie eine Zentralbank für KI-Startups und gestaltet den Computermarkt aktiv mit. Der Artikel Nvidia finanziert KI-Startups, um Big Techs Kontrolle über sein Chipgeschäft zu lockern, erschien zuerst auf The…
Google versucht, die Emissionen von KI-Rechenzentren mit Bemühungen um saubere Energie in Einklang zu bringen.
Artikel-URL: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ Kommentar-URL: https://news.ycombinator.com/item?id=48759329 Punkte: 26 # Kommentar…
Während sich die KI von der Modellentwicklung zur Produktionsinferenz bewegt, beschleunigt sich der Rechenbedarf und verlagert sich hin zu kontinuierlich arbeitenden KI-Fabriken, die Tokens in großem Maßstab generieren. Dieser Wandel erfordert den Zugang zu groß angelegten…
Sound baute seinen Ruf auf konzentrierten, überzeugenden Wetten in branchenführenden KI-Laboren auf, während Kutchers neuer Fonds offenbar die Schicht unter diesen Unternehmen jagt – die Infrastruktur und Energie, die …
Dieser Artikel wurde Ihnen vom Melbourne Convention Bureau (MCB) mit Unterstützung von Business Events Australia zur Verfügung gestellt. Da künstliche Intelligenz die weltweite Nachfrage nach Rechenleistung beschleunigt, entsteht eine parallele Einschränkung mit gleichem…
Meta entwickelt Pläne für ein Cloud-Infrastrukturgeschäft und verkauft Zugang zu KI-Rechenleistung und -Modellen. Der Schritt würde das Unternehmen mit den großen Cloud-Anbietern wie Amazon Web Services, Google Cloud und Microsoft Az konkurrieren lassen.
Artikel-URL: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute Kommentar-URL: https://news.ycombinator.com/item?id=48745966 Punkte: 15 # Kommentare: 11
„Der kostengünstigste Ort für den Einsatz von KI wird der Weltraum sein, und das wird in zwei, vielleicht spätestens drei Jahren der Fall sein“, sagte SpaceX-Gründer Elon Musk im vergangenen Januar auf dem Weltwirtschaftsforum in Davos, als sein Unternehmen …
Laut einem Bericht von The Information hat OpenAI die Inferenzkosten für seine KI-Modelle um mehr als die Hälfte gesenkt. Das Unternehmen wendete die Optimierungen auf ChatGPT an, wo die Anzahl der benötigten Nvidia-GPUs auf nur wenige Prozent sank …
Die Biowissenschaften sind in eine Ära des Rechenmaßstabs eingetreten, und seit mehr als einem Jahrzehnt hat NVIDIA den gesamten GPU-beschleunigten Computing-Stack aufgebaut – von Hardware, Frameworks, Bibliotheken, Modellen, Microservices und Domänen …
In diesem Beitrag untersuchen wir, wie Outpost VFX mithilfe der AWS-Infrastruktur 8-mal schnellere Trainingsgeschwindigkeiten erreichte, um den Arbeitsablauf für den Gesichtsaustausch zu transformieren, sowie die technische Architektur, die sie implementierten, um das Limit einer einzelnen GPU zu überwinden …
Taiwanesische Behörden haben die Büros von Super Micro Computer und mehreren lokalen Partnerunternehmen durchsucht. Der Artikel Taiwan durchsucht Büros von Super Micro wegen Ermittlungen wegen Nvidia-Chipschmuggel nach China erschien zuerst auf The…
Artikel-URL: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ Kommentar-URL: https://news.ycombinator.com/item?id=48727538 Punkte: 27 # Kommentare: 22
Hier erfahren Sie, wie Sie die Leistungsfähigkeit Ihres Kraftwerks auch außerhalb eines Notfalls nutzen können.
xFusion präsentierte auf der ISC 2026 skalierbare KI-Computing-Modelle für Unternehmen und überführte Hardware von Edge-Geräten in Rechenzentren. Auf der Hamburger Messe waren Einkäufer von Unternehmenstechnologie auf der Suche nach praktischer Produktion…
Artikel-URL: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark Kommentar-URL: https://news.ycombinator.com/item?id=48712791 Punkte: 15 # Kommentare: 2
Die Fakten über Solarenergie zu Hause zu kennen, kann Ihnen helfen, bessere, informierte Entscheidungen zu treffen, Geld zu sparen und sicher zu bleiben.
360-Gründer Zhou Hongyi präsentiert zwei KI-Sicherheitstools, die mit Mythos von Anthropic konkurrieren sollen. Man hat bereits 3.432 Schwachstellen gemeldet. Zhou gibt zu, dass chinesische Modelle 20 bis 30 Prozent hinter westlichen Modellen zurückbleiben, aber c…
Nicht jeder glaubt Elon Musks Vision für orbitale Datenzentren.
Für diejenigen, die LLMS auf einem MacBook verwenden: Möchten Sie verstehen, wie sich ein MacBook bei der Ausführung dieser Modelle von einer dedizierten GPU unterscheidet? Und woher weiß man, wie gut ein MacBook ein Modell ausführen kann? Kommentar-URL: https://ne…
Nvidia dominiert seit Jahren den Markt für KI-Chips, aber die Ära der völligen Abhängigkeit könnte zu Ende gehen. OpenAI hat gerade seine Pläne mitgeteilt, die Sache mit Jalapeño, seinem mit Broadcom entwickelten benutzerdefinierten Inferenzchip, aufzupeppen und sich G anzuschließen …
Nvidia dominiert seit Jahren den Markt für KI-Chips, aber die Ära der völligen Abhängigkeit könnte zu Ende gehen. OpenAI hat gerade seine Pläne mitgeteilt, die Sache mit Jalapeño, seinem mit Broadcom entwickelten benutzerdefinierten Inferenzchip, aufzupeppen und sich G anzuschließen …
Anthropics Kritiker argumentieren, dass das Unternehmen schnell an Macht gewinnt. Das Unternehmen sagt, das sei, wie verantwortungsvolle KI-Entwicklung aussehen solle.
Die Entscheidung des von Amazon besitzenden MGM Studios, den OpenAI-Film abzusetzen, ist nur ein Teil davon, wie sich die AI- und Filmindustrie immer mehr miteinander verweben. Auf Uncanny Valley schauen wir uns an, wohin dies alles führt.
Die Preiserhöhungen resultieren aus steigenden Kosten für Speicherchips und Knappheit, aber es gibt immer noch Angebote, wenn man weiß, wo man suchen muss.
Un-0 ist ein Bildgenerierungssystem-Tool, das zum ersten Mal zeigt, wie die Technologie des Unternehmens konventionelle AI-Systeme replizieren kann.
Es ist ein hart umkämpfter Markt für GPUs, aber es gibt immer noch einige gute Angebote während des Amazon Prime Day. Hier sind die fünf, die es sich lohnt zu überprüfen.
Warum organisatorische Latenz zum größten Hindernis für die vollständige Nutzung der Vorteile von KI wird
Um seinen neuen Status als Nummer 1 in der JD Power-Bewertung der Qualität bei Hauptautomobilherstellern zu feiern, spricht Ford über die Herausforderungen, die es in den letzten Jahren zu bewältigen hatte, insbesondere um seine Abhängigkeit von automatisierten Systemen herum.
Qualcomm dringt weiter in den Markt für Datenzentren mit einem neuen Prozessor namens Dragonfly C1000 vor. Der Artikel "Qualcomm enters the data center market with its own processor" erschien zuerst auf The Decoder.
IBM Nanostack Transistoren könnten die Chip-Leistung oder Energieeffizienz verbessern.
Der finanzielle Weg OpenAI's hängt stark von den Infrastrukturkosten ab, eine Realität, die die Entwicklung des neuen maßgeschneiderten OpenAI Jalapeño Chips vorantrieb. Entwickelt in Zusammenarbeit mit Broadcom, ist der anwendungsspezifische integ…
Der Silizium-Wettlauf wird immer heißer, während versucht wird, der Nachfrage gerecht zu werden.
Gradium hat zwei Echtzeit-Sprachübersetzungsmodelle, stt-translate und s2s-translate, herausgebracht, die Englisch, Französisch, Deutsch, Spanisch und Portugiesisch in 20 Sprachpaaren abdecken. Die Modelle reduzieren den Standard auf drei Modelle…
Ankündigung: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... Kommentare URL:…
In diesem Beitrag zeigen wir die Architektur und den Ansatz, den Loka verwendet hat, um eine gängige Frustration zu lösen: Roboterische, langsame Sprachassistenten, die Kunden dazu bringen, aufzulegen, die Markenreputation schädigen und die Supportkosten in die Höhe treiben.
OpenAI hat gerade einen neuen "Intelligenz-Prozessor"-Chip für AI-Server vorgestellt, der in Partnerschaft mit Broadcom entwickelt wurde. Der Chip, der Jalapeño genannt wird, ist dafür konzipiert, aktuelle und zukünftige große Sprachmodelle zu betreiben, wie eine an…
OpenAI integriert maßgeschneiderte Hardware in seine Technologiepalette. Der Chip "Jalapeño", gemeinsam mit Broadcom entwickelt, ist auf die Inferenz großer Sprachmodelle zugeschnitten und soll bis spätestens Ende 2026 skalierbar sein. Der Artikel OpenAI und Broadcom u…
Artikel-URL: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ Kommentare-URL: https://news.ycombinator.com/item?id=48659257 Punkte: 141 # Kommentare: 1
Sprachmodelle können saubereres Prosa schreiben als die meisten Menschen, aber wenn man sie um 100 Argumente zu einem Thema bittet, klammern sie sich alle zusammen. Der CEO von Pangram, Max Spero, sagt, dass menschliches Denken viel vielfältiger ist und das könnte der Grund sein…
Die DFlash von der UC San Diego ersetzt autoregressive Drafting durch ein leichtes Block-Diffusion-Modell für spekulatives Decoding. Es entwirft ganze Token-Blöcke in einem einzigen Vorlauffehler und bedingt sich auf Ziel-geheime Merkmale th…
OpenAI und Broadcom stellen Jalapeño vor, einen maßgeschneiderten AI-Chip, der für die LLM-Inferenz entwickelt wurde, um die Leistung, Effizienz und Skalierbarkeit in AI-Systemen zu verbessern.
Der Aufbau von AI-Systemen im Massstab ist anspruchsvoll, erfordert geringe Latenz bei der Inferenz, schnelle Vektor-Suche, starke GPU-Preis-Leistungs-Verhältnisse und Infrastruktur, die wachsen kann, ohne die operative Komplexität zu vervielfachen. Die neueste w…
In diesem Tutorial bauen wir einen mehrsprachigen ASR- und Sprachübersetzungspipeline mit NVIDIA Canary-1B-v2 auf. Wir laden das Modell auf einem GPU-fähigen Runtime, bereiten Audio in 16 kHz Mono vor und führen Englische ASR durch. Anschließend übersetzen wir …
Hallo, ich möchte euch alle auf eine interaktive Karte der wirtschaftlichen und physikalischen Einschränkungen des AI-Ausbaus aufmerksam machen. Sie enthält makroökonomische Treiber, industrielle Engpässe und wo sich das in den Märkten zeigt. Ich habe 393 Knoten hinzugefügt...</p>
Nachrichten-Highlights: NVIDIA-Technologie läuft auf 81% der TOP500 und 90% der neuen Systeme der Liste. 26 Systeme der TOP500 haben den NVIDIA Grace CPU übernommen, acht mehr als in der vorherigen Liste. Die ersten acht Systeme im Gree…
Der globale Anstieg der künstlichen Intelligenz Cyberbedrohungen ist laut einer dringenden öffentlichen Warnung der mächtigsten Geheimdienstallianz der Welt nicht mehr ein ferntlicher Problem für Unternehmensdatenzentren. Am 22. Juni 2026, sagte der Cybersecu…
Entdecken Sie, wie Omio OpenAI verwendet, um konversationelle Reisenerfahrungen anzuheizen, die Produktentwicklung zu beschleunigen und in ein AI-native Unternehmen zu transformieren.
Der öffentliche Widerstand gegen Datenzentren hat den Wasserverbrauch und den Energieverbrauch betont, und nun hebt Nvidia seinen Anspruch hervor, dass das Rubin-Generation-Referenzdesign für ein vollflüssigkeitsgekühltes Datenzentrum "eliminiert" hat...
Nvidia hat ein neues Kühlungssystem angekündigt, das den Wasserverbrauch im Rechenzentrum reduziert. Es tut jedoch nichts, um den größten Wasserverbrauch der KI – fossile Kraftwerke – zu adressieren.
Microsoft plant ein etwa 2-Gigawatt-Datenzentrums-Gelände in Pecos, Texas, eine der größten Einzelschritte in seiner Geschichte. In einem offenen Brief verspricht das Unternehmen stabile Energiepreise und geringen Wasserverbrauch, d…”
JUPITER, Europas erster Exascale-Supercomputer am Forschungszentrum Jülich in Deutschland, läuft auf NVIDIA Grace Hopper Superchips und NVIDIA Quantum-X800 InfiniBand-Netzwerken – und hat ein arbeitsreiches Jahr hinter sich. Als internationaler…
Mission, Vision und Veritas — neue Supercomputer des Los Alamos National Laboratory (LANL), die gemeinsam mit HPE und NVIDIA errichtet werden — nutzen NVIDIA Vera CPUs, um wissenschaftliche Entdeckungen zu beschleunigen und agensische KI für die Wissenschaft zu freigeben.…
Die nächste Ära der KI wird nicht nur durch Rechenleistung definiert. Ihr Wachstum wird durch Energie bestimmt. Da das beschleunigte Rechnen in AI-Fabriken, agiler KI, industrieller KI, Edge-Computing und physischer KI skaliert, einschließlich …
Große Tech-Unternehmen stecken viel Geld in den Ausbau von Datenzentren. Mit wachsender nationaler Opposition gegen diese Einrichtungen beginnen einige Arbeiter zu fragen, ob es sich lohnt.
Wir bauen einen End-to-End-Vorhersage-Workflow mit TimeCopilot auf einer Reihe echter Fluggastdaten und einer synthetischen saisonalen Reihe mit eingeschleusten Anomalien auf. Wir bewerten statistische, grundlegende und optionale GPU-basierte...
Es gibt eine kommerzielle Logik, die gegen die Idee spricht, dass ASML sein Exportlizenzrisiko eingehen würde, um einem chinesischen Kunden Waffen zu liefern.
Amazon SageMaker AI bietet vollständige Verwaltung und Echtzeit-Infusionsunterstützung für maschinelles Lernen. Sie deployen ein Modell zu einem SageMaker-Endpunkt, der von einem oder mehreren Compute-Instanzen unterstützt wird, und SageMaker kümmert sich um die Bereitstellung…
Spiele deine Lieblingstitel aus beliebten Spielbibliotheken, behalte den Fortschritt synchron und springe in nahezu jedem Gerät in deine Spielrunden zurück. Das ist die Kraft von GeForce NOW Cloud Gaming. Vom Zugang zu den Lieblingsinhalten der Mitglieder...
Durch die Nachahmung der Funktionsweise des Gehirns kann neuronale Informatik erheblich weniger Energie als konventionelle elektronische AI-Chips verbrauchen. Allerdings sind selbst die fortschrittlichsten neuronomischen Geräte heute noch relativ einfach …
Vor einem Jahr bei NVIDIA GTC Paris auf VivaTech legte Frankreich Pläne zur Förderung der lokalen KI vor — von neuen AI-Fabriken und nationaler Rechenkapazität bis hin zu offenen Frontier-Modellen und industriellen Plattformen. Jetzt wird diese AI-Infrastruktur i…
Tokenmaxxing war earlier this year in Silicon Valley der heißeste Trend, mit CEOs, die Mitarbeitern ermutigten, die Nutzung von AI so weit wie möglich zu fördern. Dann kam die Rechnung. Uber soll angeblich seinen jährlichen AI-Budget…
Tokenmaxxing war earlier this year in Silicon Valley der heißeste Trend, mit CEOs, die ihre Mitarbeiter ermutigten, die Nutzung von AI so weit wie möglich zu pushen. Dann kam die Rechnung. Uber soll angeblich sein jährliches AI-Budget durchgebläht haben i…
Der originally geplante Schritt hätte die Kosten für starke Nutzer erheblich erhöht.
Heute freuen wir uns, das Caching von Container-Images für die Amazon SageMaker AI-Inferversion bekannt zu geben, den nächsten großen Fortschritt auf unserer Reise zur schnelleren Skalierungsoptimierung. Dies verkürzt die End-zu-End-Latenz um bis zu 2x für genera…
Smartbrillen sind noch eine junge Kategorie, aber der Chiphersteller Qualcomm arbeitet hart daran, die Siliziumtechnologie zu verbessern, um die nächste Generation von XR-Geräten anzutreiben: den Snapdragon Reality Elite. Obwohl Qualcomm heute den Chip ankündigt…
Das Justizministerium sagt, dass das Verteidigungsministerium xAI benötigen, um seine ungenehmigten Gasturbinen weiterhin zu nutzen.
Ein Softwarehersteller aus Silicon Valley und ein E-Commerce-Unternehmen erzählen WIRED, wie sie die neu auftretende Herausforderung der "Tokenonomie" navigieren.
Am Ende einer spannungsreichen und torlosen ersten Halbzeit des Fußballspiels zwischen der englischen Männermannschaft und dem Rivalen Deutschland lassen Millionen von Briten einen kollektiven Seufzer aus und tun, was sie so oft in Momenten des Stress tun: Sie machen...
Heute spreche ich mit Adam Bry, CEO von Skydio, dem führenden US-Hersteller von autonomen Drohnen. Bevor wir diese Episode aufnahmen, konnte ich tatsächlich eines von Skydios Drohnen in der Bay Area von Adams Lage aus fernsteuern…
Mirage, ein Videoweltenmodell von Microsoft Research und mehreren Universitäten, speichert Szeneninformationen direkt im latenten Raum anstatt in pixelbasierten Punktwolken. Das reduziert die Berechnungszeit und die Grafikspeicherleistung, während ke...
Selbst Rechenzentren mittlerer Größe können eine übergroße lokale Auswirkung haben.
Laut The Information verhandelt OpenAI über die Anmietung eines geplanten 10-Gigawatt-Rechenzentrums in Ohio, das von Nvidia finanziell unterstützt werden könnte. Der Artikel OpenAI will sein bisher größtes Rechenzentrum und Nvidia würde …
Mit einer anfänglichen Kapazität von 24 Megawatt nutzt das innovative Rechenzentrum Meerwasser als natürliches Kühlsystem.
In einem neuen Bericht von OpenAI werden Einflussoperationen im Zusammenhang mit der Volksrepublik China detailliert beschrieben, bei denen KI zum Einsatz kommt, um US-Technologiedebatten, Narrative über Rechenzentren, Zölle und falsche Behauptungen über ChatGPT ins Visier zu nehmen.
Das vierte große Sprachmodell (LLM) von OpenAI, GPT-4, benötigte schätzungsweise 50 Gigawattstunden für das Training, was dem jährlichen Stromverbrauch von 5.000 amerikanischen Haushalten entspricht. Das war im Jahr 2023. Seitdem ist die Rechenressource …
Die 168-Megawatt-Anlage wird Metas weltweiten Bedarf an KI-Computing decken und kann im Laufe der Zeit erweitert werden.
NVIDIA-GPUs mit Confidential Computing werden jetzt für vertrauliche Schlussfolgerungen in Apples Private Cloud Compute (PCC) verwendet, da es über die Rechenzentren von Apple hinaus auf Google Cloud ausgeweitet wird. Enthüllt während Apples jährlichem WWDC-Treffen …
Auf einer Veranstaltung in San Francisco machte General Motors heute eine Reihe von Ankündigungen zu den Themen EV-Batterien, Energiespeicherung und Netzstabilität angesichts der wachsenden Stromnachfrage aus KI-Rechenzentren. Der Autohersteller und…
In diesem Beitrag zeigen wir, wie Sie Roboterrichtlinien für den Humanoiden Unitree H1 mit NVIDIA Isaac Lab auf Amazon SageMaker AI über zwei Rechenoptionen trainieren: Amazon SageMaker HyperPod und Amazon SageMaker Training Jobs.
Wie Notion Codex nutzt, um One-Shot-Spezifikationen zu erstellen, KI-Spracheingaben für das Web zu erstellen und die technische Leistung in kleinen Teams zu vervielfachen.
Am Dienstag wird der Stadtrat von Seattle darüber abstimmen, ob ein einjähriges Moratorium für neue Rechenzentren erlassen werden soll – nur zwei Monate nachdem mehrere Unternehmen den Bau von fünf großen Zentren in der Stadt vorgeschlagen hatten. Unter den Mo…
In diesem Tutorial implementieren wir einen praktischen Workflow für NVIDIA cuTile Python, eine kachelbasierte GPU-Programmierschnittstelle für Kernel im CUDA-Stil in Python. Wir bereiten eine Colab-freundliche Umgebung vor und überprüfen GPU, Treiber, CUDA usw.
Google hat für 2028 mehr als drei Millionen KI-Chips bei Intel bestellt. Nvidia testet Intels Fertigungstechnologie für seine kommende Feynman-Architektur. Beide Schritte erfolgen, da TSMC mit der Nachfrage nach KI-Chips nicht Schritt halten kann. Int…
Das MiMo-Team von Xiaomi hat mit TileRT MiMo-V2.5-Pro-UltraSpeed veröffentlicht, einen Serviermodus für das MiMo-V2.5-Pro-Modell. Es dekodiert über 1000 Token pro Sekunde auf einem 1-Billion-Parameter-Modell unter Verwendung eines einzigen 8-GPU-Commodity-Knotens.…
Da der Zugriff auf die neuesten generativen KI-Modelle und hochleistungsfähige beschleunigte Berechnungen weltweit stark nachgefragt werden, benötigen AWS-Kunden Tools, um die Modellverfügbarkeit und -kapazität in mehreren AWS-Regionen zu nutzen.
NVIDIA und die LG Group bauen eine KI-Fabrik, um die nächste Welle von KI-gesteuerten Unternehmen der LG Group zu beschleunigen, die Robotik, autonomes Fahren, Rechenzentrumstechnologien und GPU-Cloud-Dienste umfassen. Die KI-Fabrik wird beweisen…
Clive Chan, nach eigenen Angaben der zweite Hardware-Mitarbeiter im Custom-Chip-Programm von OpenAI, wechselt zu Anthropic. Er bringt Erfahrungen aus Teslas Autopilot ASIC und der OpenAI-Broadcom-Partnerschaft mit. Der Umzug kommt…
Google hat die Colab-CLI veröffentlicht, mit der Entwickler und KI-Agenten lokalen Code auf der Remote-GPU und TPU-Laufzeit von Colab ausführen können. Der Beitrag Die neue Colab-CLI von Google ermöglicht es Entwicklern und KI-Agenten, Python auf Remote-GPUs und TPUs von Colab auszuführen.
Sakana AI hat ein spezielles Forschungslabor für rekursive Selbstverbesserung eingerichtet: KI, die sich iterativ selbst verbessert. Das japanische Startup, mitbegründet von Transformer-Co-Autor Llion Jones, sieht RSI als Alternative zu …
Der Entwickler fühlte sich „zusammengeschlagen“ und hatte „keine andere Wahl“, als das Rechenzentrum zu verkleinern.
NVIDIA hat Nemotron 3 Ultra veröffentlicht, einen offenen Mixture-of-Experts-Hybrid-Mamba-Transformer mit insgesamt 550 B (55 B aktiv) für Agenten mit langer Laufzeit. Es kombiniert einen 1-M-Token-Kontext mit einem bis zu ~6-mal höheren Inferenzdurchsatz als vergleichbare…
Meta hat möglicherweise einen Weg gefunden, seine enormen Kosten für Rechenzentren zu senken: Zelte.
Kevin O'Leary stimmte zu, die Größe seines geplanten 40.000 Hektar großen Rechenzentrums in Utah zu halbieren, obwohl der Druck von Anwohnern und Aktivisten zunahm, wie zuvor von der lokalen Tochtergesellschaft ABC4 berichtet wurde. Der Shark Tank-Star schickte einen Brief an …
Das kalifornische Startup brachte die vierte Generation seines Haushaltshilferoboters Stretch auf den Markt.
Hyperscaler werden auf ihre Auswirkungen auf die Wasserqualität und -verfügbarkeit untersucht.
Quantencomputer versprechen, eines Tages Probleme zu lösen, die über die leistungsstärksten Supercomputer hinausgehen, die man sich vorstellen kann. Allerdings wird oft unterschätzt, wie viel klassische Rechenleistung allein für den Betrieb dieser Maschinen erforderlich ist. Als Qubit zählen…
Neue Rechenzentrumskapazitäten in mehreren Regionen erleichterten die GPU-Verfügbarkeit und trugen dazu bei, die regionalen Inferenzkostenindizes diese Woche zu senken.
Immer mehr Anbieter koppeln die Rechenpreise an die lokalen Energiebedingungen und fügen eine tageszeitliche Dimension hinzu, um zu bestimmen, wo und wann KI-Workloads am günstigsten laufen.
Das NVIDIA AI Cloud-Ökosystem beschleunigt den globalen Aufbau der KI-Fabrik-Infrastruktur. Partner erweitern ihre Kapazitäten, um der wachsenden Nachfrage von Unternehmen, Startups, Nationen, KI-Laboren und Entwicklern gerecht zu werden.
Anthropic hat am Montag Cowork veröffentlicht, eine neue KI-Agentenfunktion, die die Leistungsfähigkeit seines äußerst erfolgreichen Claude Code-Tools auf technisch nicht versierte Benutzer ausdehnt – und Unternehmensinsidern zufolge hat das Team die gesamte Funktion entwickelt …
Zusammenfassungen werden nur zu Informationszwecken aggregiert – folgen Sie dem Quelllink für die vollständige Geschichte. Demo-Einträge dienen der Veranschaulichung.