Fourniture de calcul, GPU, centres de données et énergie : la couche physique qui décide du fonctionnement à moindre coût de l'IA.
Histoires 178
L’approvisionnement informatique, l’énergie et la capacité du centre de données déterminent le coût de fonctionnement de l’IA. Les changements d’infrastructure apparaissent dans les coûts d’inférence des semaines plus tard.
Explorez TileLang, un langage Python de haut niveau spécifique à un domaine qui simplifie la conception de noyaux GPU hautes performances. Ce didacticiel fournit une approche étape par étape pour implémenter des charges de travail complexes, notamment en mosaïque…
Un appel rapproché en Virginie du Nord a révélé à quel point les centres de données réagissent mal aux perturbations du réseau. Voici comment résoudre le problème.
Le Samsung Galaxy Z Fold 8 Ultra est un bon téléphone, mais il y a quelque chose de bien plus convaincant dans le Galaxy Z Fold 8.
Avec le dernier téléphone pliable de Samsung, la société propose des modifications de conception et de logiciel qui font que même le Z Fold de l'année dernière semble insuffisant.
Datalab a réécrit Marker en tant que pipeline à trois modes. La version 2 atteint 76,0 sur olmOCR-bench et prend en charge 2,9 pages par seconde sur un B200, soit plus de 5 fois le backend du pipeline de MinerU, tout en battant Docling en termes de précision et de vitesse. H…
Datalab a réécrit Marker en tant que pipeline à trois modes. La version 2 atteint 76,0 sur olmOCR-bench et prend en charge 2,9 pages par seconde sur un B200, soit plus de 5 fois le backend du pipeline de MinerU, tout en battant Docling en termes de précision et de vitesse. H…
URL de l'article : https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference URL des commentaires : https://news.ycombinator.com/item?id=49041347 Points : 17 # C…
La règle permettrait aux États de décider dans quelle mesure, le cas échéant, le public peut contribuer.
Dans ce didacticiel, nous construisons un flux de travail complet pour exécuter le modèle Unlimited-OCR de Baidu sur des images de documents et des PDF de plusieurs pages. De la configuration de l'environnement GPU à la comparaison de l'inférence Gundam en mosaïque très détaillée et de la rapidité…
URL de l'article : https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 URL des commentaires : https://news.ycombinator.com/item?id=49…
La viabilité des centres de données orbitaux hébergeant les grands modèles de langage (LLM) les plus grands et les plus performants reste vivement contestée. Mais les énormes déploiements qui nécessitent des milliers de GPU ne sont pas le seul moyen par lequel les LLM peuvent prospérer…
Une personne tient des pancartes lors d'une manifestation nationale contre l'expansion du centre de données d'IA à l'extérieur du Peace Hall à New Port Richey, en Floride. | AFP via Getty Images Par un samedi matin gris et humide dans le centre de la Floride, un peu un peu…
Le fondateur et PDG de NVIDIA, Jensen Huang, a visité aujourd'hui la Naval Postgraduate School de Monterey, en Californie, pour mettre en service un système NVIDIA DGX GB300, mettant ainsi l'une des plates-formes d'IA les plus puissantes au monde entièrement en ligne pour...
URL de l'article : https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ URL des commentaires : https://news.ycombinator.com/item?id=49007525 Points : 39 # Commentaires : 53
Le Samsung Galaxy Z Fold 8 Ultra possède toute la puissance brute dont vous avez besoin, mais le prix et les accessoires du Google Pixel 10 Pro Fold pourraient constituer une meilleure offre.
OpenAI souligne son engagement à faire progresser la science américaine en travaillant avec le département américain de l'Énergie et les laboratoires nationaux pour utiliser l'IA de pointe pour accélérer les découvertes.
SenseTime a lancé le projet Galaxy, en s'associant avec près de 20 partenaires pour faire évoluer l'infrastructure nationale des puces d'IA en Chine. Dans un discours intitulé « Transformation intelligente et symbiose », Yang Fan, co-fondateur de l'entreprise…
L’engagement a été introduit en mars et n’a jusqu’à présent pas fait grand-chose pour apaiser les inquiétudes. | Image : Cath Virginia / The Verge, Getty Images Face aux réactions négatives suscitées par les inquiétudes, le boom de l'IA augmentera les factures d'électricité des consommateurs…
Les nouveaux centres de données construits jusqu’en 2033 pourraient consommer autant d’électricité que l’Inde en consomme aujourd’hui.
https://www.energy.gov/undersecretaryforscience/genesis-miss... URL des commentaires : https://news.ycombinator.com/item?id=48995074 Points : 84 # Commentaires : 56
L’IA est entrée dans l’ère du gigascale. Les usines d'IA les plus avancées au monde rassemblent des centaines de milliers de GPU et de CPU pour former des modèles de pointe, alimenter l'IA agentique et générer de l'intelligence à un niveau sans précédent…
La plate-forme Vera Rubin de Nvidia combine CPU et GPU en un seul système, reflétant l'ambition croissante de l'entreprise d'alimenter chaque couche de l'infrastructure d'IA.
Alphabet, la société mère de Google, travaillerait sur une nouvelle puce conçue pour rendre ses modèles Gemini beaucoup plus efficaces.
Google développe "Frozen v2", une puce serveur qui intègre l'architecture Gemini directement dans le matériel. Selon des sources internes, il pourrait être 6 à 10 fois plus performant que les TPU actuels. Prévu pour 2028, le…
Cet article décrit comment Couchbase a adopté Amazon Bedrock pour alimenter Capella iQ avec la famille de modèles Claude d'Anthropic, les décisions architecturales derrière leur approche multimodèle et les avantages opérationnels réalisés…
Microsoft étend l'infrastructure d'IA d'Azure avec la nouvelle plate-forme Helios d'AMD, qui devrait concurrencer les systèmes GPU de Nvidia au second semestre 2026. Un profil GitHub public suggère qu'Anthropic teste également AMD…
Erin Davis l'appelle le « SuperDuperPOD ». Cela représente deux choses en un seul nom : le géant pharmaceutique Bristol Myers Squibb (BMS) gère déjà l’un des plus grands clusters d’IA dans les sciences de la vie, avec de sérieux résultats à montrer.…
Les principales sociétés chinoises d'IA augmentent la pression sur la Silicon Valley, alors que Moonshot et Alibaba ont dévoilé des modèles qui, selon eux, peuvent rivaliser avec le meilleur d'OpenAI et d'Anthropic à une fraction du prix. Le rap…
Nous construisons un flux de travail NVIDIA NeMo AutoModel de bout en bout dans Google Colab à l'aide d'un seul GPU. Nous vérifions le matériel CUDA et la prise en charge de précision, installons NeMo AutoModel à partir des sources et chargeons une recette officielle Qwen3-0.6B LoRA. W…
Neil Rimer, l'investisseur en capital-risque qui a cofondé Index Ventures, prédit que la richesse historique générée par l'IA dans la Silicon Valley devra être redistribuée, volontairement ou involontairement.
Meta serait en pourparlers avec Anthropic pour louer la capacité de calcul de ses centres de données. L'article Le projet de Zuckerberg de vendre ses excédents de calcul d'IA pourrait trouver son premier gros client dans Anthropic apparaît en premier sur Th…
Moonshot AI a publié Kimi K3, un modèle qui, selon les premières évaluations, correspond à l'Opus 4.8 d'Anthropic, construit par une équipe de seulement 300 personnes. Même le stratège OpenAI, Dean W. Ball, le qualifie de « très bon », mais prévient bien sûr que…
Le Levoit Vital 200S-P est le purificateur d'air intelligent à battre, avec un préfiltre lavable et une capacité de nettoyer jusqu'à 1 800 pieds carrés en une heure.
Une véritable panne de courant de trois jours a révélé des problèmes que je n'aurais jamais trouvés sur la fiche technique d'une centrale électrique.
Sarah Friar, directrice financière d'OpenaAI, présente un tableau de bord pratique de l'IA pour mesurer le retour sur investissement grâce au travail utile, au coût par tâche réussie, à la fiabilité et au retour sur le calcul.
<p>Suggestion pour les hyperscalers qui ressentent une pression sur la consommation d'eau des centres de données :</p> <p>Achetez quelques country clubs exclusifs, convertissez les terrains de golf en parcs publics, payez des guides et des jumelles pour obtenir le membre précédent…
Dans l'Uncanny Valley d'aujourd'hui, nous examinons le drame en cours d'OpenAI, à la fois juridique et réputationnel, et voyons si ces développements pourraient nuire davantage à l'entreprise, en particulier dans sa lutte contre l'anthropisme.
Dans 107 entreprises, les dépenses en infrastructures d’IA s’accélèrent bien avant la capacité de voir ou d’orienter ses aspects économiques. La plupart des organisations exécutent leur IA sur une base familière d’hyperscalers et d’API de fournisseurs de modèles, mais…
Nous explorons le SDK Patter en créant un flux de travail d'agent vocal pour un cas d'utilisation de réservation de restaurant. Nous définissons des variables d'appelant dynamiques, enregistrons des outils appelables pour la disponibilité, les réservations, les heures et le transfert humain, et laissons…
Les robots à usage général et les machines autonomes passent des laboratoires de recherche au déploiement réel sur le marché de masse, créant une demande pour des supercalculateurs d'IA compacts et économes en énergie, capables d'exécuter des modèles de base à t…
Construit en partenariat avec l'AWS Generative AI Innovation Center (GenAIIC), le partenaire AWS AND Digital et les équipes de comptes AWS pour créer un moteur de traitement de documents évolutif, alimenté par l'IA, qui peut classer, diviser, extraire, évaluer…
Le Solix E10 d'Anker a rendu l'alimentation de secours compréhensible pour ce débutant, et j'ai hâte d'étendre le système.
New York est devenu le premier État à suspendre temporairement l'approbation des grands centres de données, comme le gouverneur Kathy Hochul affirme que le boom de la construction basé sur l'IA ne devrait pas se faire au détriment de la hausse des coûts de l'électricité, de l'approvisionnement en eau,…
Le moratoire sur les centres de données de New York pourrait devenir le modèle du mouvement anti-IA.
La puissance est la contrainte incontournable de l’infrastructure d’IA. Le nombre de jetons qu’une usine d’IA peut générer dans le cadre d’un budget énergétique fixe détermine ses revenus et sa rentabilité. Pour cette raison, la performance par watt – une mesure qui…
Demis Hassabis, lors d'une table ronde au Forum économique mondial de Davos, en Suisse. | Image : Bloomberg via Getty Images Demis Hassabis pense que le monde a besoin d'un chien de garde de l'IA avec le pouvoir de freiner en cas de…
URL de l'article : https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ URL des commentaires : https://news.ycombinator.com/item?id=48901420 Points : 19 # Commentaires : 4
Parmi tous les débats qui font rage sur les inconvénients potentiels de l’IA, il y a une inquiétude qui suscite le plus d’inquiétude parmi les passionnés d’IA de la Silicon Valley : les laboratoires d’IA géants qui vendent des modèles propriétaires sont en quelque sorte un…
Nous avons testé les meilleurs ordinateurs tout-en-un combinant la puissance d’un ordinateur de bureau avec un design fin et léger.
Un panneau de signalisation s'opposant à un centre de données prévu est affiché le long de la route 54 dans le comté de Northumberland du canton de Mount Carmel. | Image : Getty Images Voici The Stepback, une newsletter hebdomadaire décrivant une histoire essentielle de…
Dans ce didacticiel, nous explorons la programmation GPU basée sur des tuiles NVIDIA avec TileGym, en créant un flux de travail Colab qui s'exécute sur différents matériels. Nous sondons l'environnement CUDA, essayons le vrai backend cuTile et revenons à Tr…
Suite au lancement de ChatGPT Work et de GPT-5.6 Sol, OpenAI a reconnu des problèmes importants : une utilisation excessive du calcul, une transition déroutante vers l'interface de bureau pour les discussions et les projets, une distinction peu claire entre...
URL de l'article : https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ URL des commentaires : https://news.ycombinator.com/item?id=48865717 Points : 17 # Commentaires : 0
Dans cet article, vous découvrirez quatre modèles de déploiement pour prendre des modèles déjà quantifiés avec Unsloth et les déployer sur l'infrastructure AWS. Les modèles utilisent Amazon Elastic Compute Cloud (Amazon EC2)…
Une entreprise de stockage d'énergie solaire et domestique se développe dans les centres de données d'IA, mais pas en en construisant un : elle propose plutôt de payer ses clients pour qu'ils installent ses unités de calcul chez eux. Sunrun lance un programme pilote…
Si vous avez besoin de plus de puissance que ce que les services d'hébergement partagé peuvent fournir, les meilleurs fournisseurs d'hébergement VPS peuvent vous fournir les ressources dédiées et l'évolutivité nécessaires pour faire passer votre projet au niveau supérieur.
La nouvelle famille de modèles d'OpenAI continuera à alimenter la suite d'applications de travail et de productivité de Microsoft.
NVIDIA a publié Nemotron-Labs-3-Puzzle-75B-A9B, une variante compressée de Nemotron-3-Super. Iterative Puzzle alterne la compression structurelle sensible au matériel avec de courtes phases de récupération de distillation de connaissances. Le mode…
Ayant prouvé à quel point le calcul peut être précieux, l’entreprise se retrouve au centre d’un marché dans lequel tout le monde veut être – tandis que des technologies plus simples et des entreprises moins intéressantes s’enrichissent en marge.
URL de l'article : https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html URL des commentaires : https://news.ycombinator.com/item?id=48846708 Points : 4…
Ce jeudi GFN apporte plus de jeux, plus de puissance et plus de façons de jouer sur GeForce NOW. Le service de jeu en nuage s'étend avec un nouveau serveur alimenté par GeForce RTX 5080 à Toronto, offrant des performances élevées dédiées dans le…
NVIDIA a publié Nemotron-Labs-3-Puzzle-75B-A9B, une variante compressée de Nemotron-3-Super. Iterative Puzzle alterne la compression structurelle sensible au matériel avec de courtes phases de récupération de distillation de connaissances. Le mode…
Le nouveau rôle de Kevin Weil chez Stoke Space suggère que les fusées réutilisables sont la prochaine nouveauté dans la Silicon Valley.
Bien sûr, les rallonges et les multiprises domestiques sont pratiques, mais elles entraînent également des milliers d’incendies évitables chaque année. Voici comment les utiliser de manière plus sûre.
La réduction des factures d’électricité de la Ceinture de rouille menace le plan manufacturier de Trump.
Microsoft est le dernier géant de la Silicon Valley à réduire ses dépenses en IA.
La startup chinoise Deepseek construit sa propre puce d'IA, rapporte Reuters. L'article Deepseek conçoit sa propre puce IA est apparu en premier sur The Decoder.
OpenAI a ajouté deux modèles en temps réel à son API. GPT-Realtime-2.1-mini est un mini modèle de raisonnement pour la voix, dont le prix est identique au précédent gpt-realtime-mini. OpenAI a également réduit la latence p95 d'au moins 25 % grâce à une mise en cache améliorée. Il…
Fable 5 d'Anthropic promet une puissance d'IA mythique, mais des restrictions surprises me font me demander si cela pose plus de problèmes que cela n'en vaut la peine pour une utilisation quotidienne.
URL de l'article : https://xcancel.com/i/article/2072830533739192560 URL des commentaires : https://news.ycombinator.com/item?id=48792463 Points : 17 # Commentaires : 1
URL de l'article : https://github.com/openai/codex/issues/30364 URL des commentaires : https://news.ycombinator.com/item?id=48789428 Points : 131 # Commentaires : 41
URL de l'article : https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 URL des commentaires : https://news.ycombinator.com/item?id=48774246 Points : 18 # Commentaires : 6
L’expansion rapide des infrastructures d’intelligence artificielle est généralement présentée comme un problème énergétique. Les centres de données devraient consommer une part croissante de la demande mondiale d’électricité : L’Agence internationale de l’énergie…
La nouvelle arrive environ une semaine après qu'OpenAI a annoncé sa propre puce d'IA personnalisée en partenariat avec Broadcom.
Anthropic serait en pourparlers avec Samsung Electronics sur la fabrication d'une puce IA personnalisée. Le projet en est encore à ses débuts, mais Anthropic a déjà embauché des ingénieurs en puces. Après « Jalapeño » d’OpenAI, encore une autre IA majeure…
L'Eufy Omni S2 améliore son prédécesseur avec une puissance d'aspiration quatre fois supérieure et un rouleau de vadrouille sans odeur.
Nvidia agit de plus en plus comme une banque centrale pour les startups d’IA, façonnant activement le marché du calcul. L'article Nvidia finance des startups d'IA pour desserrer l'emprise des Big Tech sur son activité de puces, apparu en premier sur The…
Google essaie d'équilibrer les émissions des centres de données d'IA avec des efforts en matière d'énergie propre.
URL de l'article : https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ URL des commentaires : https://news.ycombinator.com/item?id=48759329 Points : 26 # Commentaire…
À mesure que l’IA passe du développement de modèles à l’inférence de production, la demande de calcul s’accélère et s’oriente vers des usines d’IA fonctionnant en continu et générant des jetons à grande échelle. Ce changement nécessite l’accès à des ressources à grande échelle…
Sound a bâti sa réputation sur des paris concentrés et à forte conviction dans des laboratoires d'IA de premier plan, tandis que le nouveau fonds de Kutcher semble s'attaquer à la couche sous-jacente à ces entreprises : l'infrastructure et l'énergie qui alimentent…
Cet article vous est présenté par le Melbourne Convention Bureau (MCB) soutenu par Business Events Australia. Alors que l’intelligence artificielle accélère la demande mondiale de calcul, une contrainte parallèle émerge avec autant…
Meta développe des plans pour une entreprise d’infrastructure cloud, vendant l’accès à la puissance de calcul et aux modèles d’IA. Cette décision l'opposerait aux grands fournisseurs de cloud comme Amazon Web Services, Google Cloud et Microsoft Az…
URL de l'article : https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute URL des commentaires : https://news.ycombinator.com/item?id=48745966 Points : 15 # Commentaires : 11
"L'endroit le moins coûteux pour implanter l'IA sera dans l'espace, et ce sera vrai d'ici deux ans, peut-être trois au plus tard", a déclaré le fondateur de SpaceX, Elon Musk, au Forum économique mondial de Davos en janvier dernier, alors que son entreprise était en train de...
Selon un rapport de The Information, OpenAI a réduit de plus de moitié les coûts d’inférence pour ses modèles d’IA. La société a appliqué les optimisations à ChatGPT, où le nombre de GPU Nvidia nécessaires est tombé à seulement une fe…
Les sciences de la vie sont entrées dans une ère de calcul à grande échelle et, depuis plus d'une décennie, NVIDIA a construit la pile informatique complète accélérée par GPU, couvrant le matériel, les frameworks, les bibliothèques, les modèles, les microservices et les domaines…
Dans cet article, nous explorons comment Outpost VFX a atteint des vitesses de formation 8 fois plus rapides en utilisant l'infrastructure AWS pour transformer son flux de travail de remplacement de visage, l'architecture technique qu'ils ont mise en œuvre pour surmonter la limite d'un seul GPU…
Les autorités taïwanaises ont perquisitionné les bureaux de Super Micro Computer et de plusieurs sociétés partenaires locales. L'article Taïwan perquisitionne les bureaux de Super Micro dans le cadre d'une enquête sur la contrebande de puces Nvidia vers la Chine est apparu en premier sur The…
URL de l'article : https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ URL des commentaires : https://news.ycombinator.com/item?id=48727538 Points : 27 # Commentaires : 22
Voici comment tirer parti des capacités de votre centrale électrique en dehors d’une situation d’urgence.
xFusion a présenté des modèles informatiques d'IA d'entreprise évolutifs à l'ISC 2026, faisant passer le matériel des appareils de pointe aux centres de données. Les acheteurs de technologies d'entreprise présents au salon de Hambourg recherchaient une production pratique…
URL de l'article : https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark URL des commentaires : https://news.ycombinator.com/item?id=48712791 Points : 15 # Commentaires : 2
Connaître les faits sur l'énergie solaire domestique peut vous aider à faire de meilleurs choix informés, à économiser de l'argent et à rester en sécurité.
Le fondateur de 360, Zhou Hongyi, présente deux outils de sécurité IA conçus pour rivaliser avec Mythos d'Anthropic. On a déjà signalé 3 432 vulnérabilités. Zhou admet que les modèles chinois sont en retard de 20 à 30 pour cent sur les modèles occidentaux, mais c…
Tout le monde n’adhère pas à la vision d’Elon Musk concernant les centres de données orbitaux.
Pour ceux qui utilisent LLMS sur MacBook, vous voulez comprendre en quoi le MacBook est différent du GPU dédié lors de l'exécution de ces modèles ? et comment savoir à quel point un macbook est capable de faire tourner un modèle ? URL des commentaires : https://ne…
Nvidia domine le marché des puces IA depuis des années, mais l’ère de la dépendance totale pourrait toucher à sa fin. OpenAI vient de partager ses projets pour pimenter les choses avec Jalapeño, sa puce d'inférence personnalisée construite avec Broadcom, rejoignant G…
Nvidia domine le marché des puces IA depuis des années, mais l’ère de la dépendance totale pourrait toucher à sa fin. OpenAI vient de partager ses projets pour pimenter les choses avec Jalapeño, sa puce d'inférence personnalisée construite avec Broadcom, rejoignant G…
Les critiques d'Anthropic affirment qu'elle accumule rapidement du pouvoir. L'entreprise dit que c'est ainsi que devrait se présenter le développement responsable de l'IA.
La décision de MGM Studios, propriété d'Amazon, d'abandonner le projet de film avec OpenAI est seulement une partie de l'intégration croissante de l'IA et de l'industrie cinématographique. Sur Uncanny Valley, nous examinons où tout cela va en fin de compte.
Les hausses de prix sont le résultat de la flambée des coûts des puces de mémoire et du courtage, mais il reste des offres disponibles si vous savez où chercher.
Un-0 est un outil de système de génération d'images qui montre pour la première fois comment la technologie de l'entreprise peut reproduire des systèmes d'IA conventionnels.
C'est un marché difficile pour les GPU, mais il reste encore quelques bonnes affaires à saisir pendant Amazon Prime Day. Voici les cinq à vérifier.
Pourquoi la latence organisationnelle devient le principal obstacle à la pleine exploitation des avantages de l’IA
Pour célébrer son nouveau statut de N°1 dans le classement initial de qualité de JD Power parmi les constructeurs automobiles principaux, Ford ouvre un peu plus sur les défis qu'il a rencontrés ces dernières années, en particulier autour de sa dépendance aux systèmes automatisés...
Qualcomm s'implante davantage sur le marché des data centers avec un nouveau processeur appelé Dragonfly C1000. L'article Qualcomm entre sur le marché des data centers avec son propre processeur a été publié en premier sur The Decoder.
Les transistors nanostack d'IBM pourraient améliorer les performances ou l'efficacité énergétique des puces.
La trajectoire financière d'OpenAI dépend fortement des coûts d'infrastructure, une réalité qui a conduit au développement du nouveau chip personnalisé OpenAI Jalapeño. Développé en collaboration avec Broadcom, ce chip intégré spécifique à l'application...
La course aux semi-conducteurs s'intensifie au milieu de la lutte pour répondre à la demande.
Gradium a lancé deux modèles de traduction de parole en temps réel, stt-translate et s2s-translate, couvrant l'anglais, le français, l'allemand, l'espagnol et le portugais sur 20 paires de langues. Les modèles réduisent le standard des trois modèles…
Annonce : https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... Lien des commentaires :…
Dans cet article, nous démontrons l'architecture et l'approche utilisée par Loka pour résoudre une frustration courante : des assistants vocaux robotiques et lents qui font que les clients raccrochent, endommagent la réputation de la marque et augmentent les coûts de support.
OpenAI a récemment révélé un nouveau "processeur d'intelligence" en puce pour les serveurs IA, fabriqué en partenariat avec Broadcom. La puce, appelée Jalapeño, est conçue pour alimenter les modèles de grande taille actuels et futurs, selon une an…
OpenAI ajoute de l'équipement personnalisé à son stack technologique. Le processeur "Jalapeño", développé avec Broadcom, est conçu pour l'inference des modèles de langage grand format et est prévu pour fonctionner à grande échelle d'ici la fin de 2026. L'article OpenAI et Broadcom u…
Lien de l'article: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ Lien des commentaires: https://news.ycombinator.com/item?id=48659257 Points: 141 # Commentaires: 1
Les modèles de langage peuvent écrire un texte plus clair que la plupart des humains, mais demandez-en 100 arguments sur un sujet et ils se regrouperont tous. Le raisonnement humain est beaucoup plus diversifié, dit le PDG de Pangram Max Spero, et c'est cela qui pourrait…
Le DFlash de l’Université de Californie à San Diego remplace le brouillon autoregressif par un modèle de diffusion de blocs léger pour la décodage spéculatif. Il dessine des blocs de symboles entiers en un seul passage avant et conditionne sur des caractéristiques cachées cibles…
OpenAI et Broadcom introduisent Jalapeño, un chip AI personnalisé conçu pour l'inférence des LLM pour améliorer les performances, l'efficacité et l'échelle des systèmes AI.
La construction de systèmes d'IA à l'échelle est exigeante, nécessitant une inference à faible latence, une recherche vectorielle rapide, une forte performance prix/GPU et une infrastructure qui peut croître sans multiplier la complexité opérationnelle. La dernière innovation de NVIDIA...
Dans ce tutoriel, nous construisons un pipeline de transcription automatique et de traduction multilingue avec NVIDIA Canary-1B-v2. Nous chargeons le modèle sur un runtime avec GPU, préparons l'audio en mono 16 kHz et exécutons une transcription anglaise. Nous traduisons ensuite…
Bonjour, je voulais partager avec vous tous une carte interactive des contraintes économiques et physiques du déploiement de l'IA. Elle comporte des moteurs macroscopiques, des goulets d'étranglement industriels et où cela se manifeste sur les marchés. J'ai ajouté 393 nœuds...
Points de actualité : La technologie NVIDIA fonctionne sur 81% du TOP500 et 90% des systèmes nouveaux de la liste. 26 systèmes du TOP500 ont adopté le CPU NVIDIA Grace, soit huit de plus que la liste précédente. Les huit systèmes les plus puissants sur la Gree…
L'augmentation mondiale des menaces cybernétiques liées à l'IA n'est plus un problème éloigné pour les centres de données des entreprises, selon un avertissement public urgent de l'alliance de renseignement la plus puissante du monde. Le 22 juin 2026, la cybersécurité...
Découvrez comment Omio utilise OpenAI pour propulser les expériences de voyage conversationnel, accélérer le développement de produits et se transformer en entreprise native de l'IA.
Le retour d'expérience public contre les centres de données a mis en avant leur consommation d'eau et d'énergie, et Nvidia met en avant son affirmation selon laquelle le design de référence de la génération Rubin pour un centre de données complètement refroidi par liquide a "élim…
Nvidia a annoncé un nouveau système de refroidissement qui réduit la consommation d'eau à l'intérieur des data centers. Mais cela ne fait rien pour résoudre l'utilisation la plus importante de l'eau par l'IA, à savoir les centrales électriques au fuel fossile.
Microsoft construit un campus de centre de données d'environ 2 gigawatts à Pecos, au Texas, l'une des plus grandes augmentations de capacité unique dans son histoire. Dans une lettre ouverte, l'entreprise promet des prix de l'énergie stables et une consommation minimale d'eau, d…
JUPITER, le premier supercalculateur exascale d'Europe, installé au Forschungszentrum Jülich en Allemagne, fonctionne avec des Superchips Grace Hopper de NVIDIA et un réseau InfiniBand Quantum-X800 de NVIDIA — et il a eu une année chargée. Comme l'international…
Mission, Vision et Véritas — les nouveaux supercalculateurs du Laboratoire National du Los Alamos (LANL) à construire avec HPE et NVIDIA — utilisent les CPU NVIDIA Vera pour accélérer la découverte scientifique, déverrouillant l'IA agente pour la science.…
La prochaine ère de l'IA ne sera pas définie uniquement par le calcul. Sa croissance sera déterminée par l'énergie. Alors que le calcul accéléré s'échelle à travers les usines d'IA, l'IA agente, l'IA industrielle, le calcul aux bords et l'IA physique, incluant...
Les géants du numérique injectent de grosses sommes d'argent dans la construction de centres de données. Alors que l'opposition nationale à ces installations s'intensifie, certains travailleurs commencent à se demander s'il en vaut la peine.
Nous construisons un flux de travail de prévision complet avec TimeCopilot sur un ensemble de données réelles de passagers d'airlines et une série saisonnière synthétique avec des anomalies injectées. Nous évaluons des statistiques, des modèles de base et des options basées sur GPU...
Il y a une logique commerciale qui va à l'encontre de l'idée que ASML prendrait le risque de son licence d'exportation pour équiper un client chinois.
Amazon SageMaker AI fournit un hébergement d'inférence en temps réel géré intégralement pour les modèles de machine learning. Vous déployez un modèle vers un point de terminaison SageMaker soutenu par une ou plusieurs instances de calcul, et SageMaker s'occupe de la fourniture…
Jouez à vos titres préférés provenant de bibliothèques de jeux populaires, conservez votre progression synchronisée et revenez aux sessions de jeu sur pratiquement n'importe quel appareil. C'est la puissance du jeu en nuage GeForce NOW. De fournir l'accès aux titres préférés des membres…
En imitant le fonctionnement du cerveau, l'informatique neuromorphique peut utiliser beaucoup moins d'énergie que les puces AI électroniques conventionnelles. Cependant, même les appareils neuromorphiques les plus avancés d'aujourd'hui sont encore assez simples,...
L'année dernière lors de NVIDIA GTC Paris à VivaTech, la France a détaillé ses plans pour promouvoir l'IA locale - des nouvelles usines d'IA et de la capacité de calcul national aux modèles frontière ouverts et aux plateformes industrielles. Maintenant, cette infrastructure d'IA...
Tokenmaxxing était la tendance la plus populaire à Silicon Valley au début de l'année, avec des PDG incitant les employés à pousser l'utilisation de l'IA aussi loin que possible. Puis la facture est venue. Uber aurait épuisé son budget annuel en IA, selon des rapports…
Tokenmaxxing était la tendance la plus en vogue en Silicon Valley au début de l'année, avec des PDG incitant leurs employés à pousser l'utilisation de l'IA aussi loin que possible. Puis, la facture est venue. Selon des informations, Uber aurait épuisé son budget annuel en IA...
Le déplacement prévu pour lundi aurait fortement augmenté les coûts des utilisateurs intensifs.
Aujourd'hui, nous sommes ravis d'annoncer le cache d'image de conteneur pour l'inference Amazon SageMaker AI, la prochaine avancée majeure dans notre voyage d'optimisation de mise à l'échelle plus rapide. Cela accélère la latence du bout en bout jusqu'à 2 fois pour les généra…
Les lunettes intelligentes sont encore une catégorie naissante, mais le fabricant de puces Qualcomm travaille dur pour améliorer le silicium pour alimenter la prochaine vague de dispositifs XR : le Snapdragon Reality Elite. Bien que Qualcomm annoncent ce processeur aujourd'hui…
Le ministère de la Justice dit que le Pentagone a besoin que xAI continue d'utiliser ses turbines à gaz non autorisées.
Un fabricant de logiciels de la Silicon Valley et une entreprise de commerce électronique révèlent à WIRED comment ils naviguent dans le défi émergent de la ‘tokenomics’。”“
À la fin d'une première mi-temps tendue et sans but entre l'équipe masculine anglaise et l'Allemagne rivale, des millions de Britanniques ont laissé éclater un soupir collectif et ont fait ce qu'ils font si souvent en moments de stress : Ils ont...
Aujourd'hui, je parle avec Adam Bry, qui est le PDG de Skydio, le principal fabricant américain de drones autonomes. Avant d'enregistrer cet épisode, j'ai en fait pu opérer à distance un drone de Skydio dans la région de la Baie d'Hollywood depuis le bureau d'Adam…
Mirage, un modèle de monde vidéo de Microsoft Research et plusieurs universités, stocke l'information de la scène directement dans l'espace latent au lieu de points nuage basés sur les pixels. Cela réduit le temps de calcul et la mémoire graphique tout en...
Même les centres de données de taille moyenne peuvent avoir un impact local démesuré.
OpenAI négocie la location d'un centre de données prévu de 10 gigawatts dans l'Ohio qui pourrait être soutenu financièrement par Nvidia, selon The Information. L'article OpenAI veut son plus grand centre de données à ce jour, et Nvidia serait…
D'une capacité initiale de 24 mégawatts, le centre de données innovant utilise l'eau de mer comme système de refroidissement naturel.
Un nouveau rapport d'OpenAI détaille les opérations d'influence liées à la RPC utilisant l'IA pour cibler les débats technologiques américains, les récits des centres de données, les tarifs et les fausses déclarations sur ChatGPT.
Le quatrième grand modèle linguistique (LLM) d’OpenAI, GPT-4, a nécessité environ 50 gigawattheures pour s’entraîner, soit l’équivalent de la consommation électrique annuelle de 5 000 foyers américains. C’était en 2023. Depuis, les ressources informatiques…
L'installation de 168 mégawatts répondra aux besoins mondiaux en matière de calcul d'IA de Meta et pourra être étendue au fil du temps.
Les GPU NVIDIA avec Confidential Computing sont désormais utilisés pour l’inférence confidentielle dans le Private Cloud Compute (PCC) d’Apple, à mesure qu’il s’étend au-delà des centres de données d’Apple jusqu’à Google Cloud. Dévoilé lors du rassemblement annuel WWDC d’Apple…
Lors d'un événement à San Francisco aujourd'hui, General Motors a fait une série d'annonces concernant les batteries de véhicules électriques, le stockage d'énergie et la résilience du réseau face à la demande croissante d'électricité des centres de données d'IA. Le constructeur automobile et…
Dans cet article, nous montrons comment former des stratégies de robot pour l'humanoïde Unitree H1 avec NVIDIA Isaac Lab sur Amazon SageMaker AI à travers deux options de calcul : Amazon SageMaker HyperPod et Amazon SageMaker Training Jobs.
Mardi, le conseil municipal de Seattle votera sur l'opportunité d'adopter un moratoire d'un an sur les nouveaux centres de données - deux mois seulement après que plusieurs entreprises ont proposé de construire cinq centres à grande échelle dans la ville. Parmi les mo…
Comment Notion utilise Codex pour créer des spécifications uniques, créer une entrée vocale IA pour le Web et multiplier la puissance d'ingénierie au sein de petites équipes.
Dans ce didacticiel, nous implémentons un flux de travail pratique pour NVIDIA cuTile Python, une interface de programmation GPU basée sur des tuiles pour les noyaux de style CUDA en Python. Nous préparons un environnement convivial pour Colab et vérifions le GPU, le pilote, CUDA,…
Google a commandé plus de trois millions de puces IA à Intel pour 2028. Nvidia teste la technologie de fabrication d'Intel pour sa prochaine architecture Feynman. Les deux décisions surviennent alors que TSMC ne peut pas répondre à la demande de puces IA. Int…
L'équipe MiMo de Xiaomi, avec TileRT, a publié MiMo-V2.5-Pro-UltraSpeed, un mode de service pour le modèle MiMo-V2.5-Pro. Il décode plus de 1 000 jetons par seconde sur un modèle de 1 billion de paramètres à l'aide d'un seul nœud de base de 8 GPU.…
Avec l'accès aux derniers modèles d'IA générative et au calcul accéléré hautes performances face à une forte demande mondiale, les clients AWS ont besoin d'outils pour tirer parti de la disponibilité et de la capacité des modèles dans plusieurs régions AWS, avec…
NVIDIA et le groupe LG construisent une usine d'IA pour accélérer la prochaine vague d'activités du groupe LG axées sur l'IA, couvrant la robotique, la conduite autonome, les technologies de centres de données et les services cloud GPU. L’usine IA prouvera…
Clive Chan, selon son propre compte, le deuxième employé matériel du programme de puces personnalisées d'OpenAI, déménage chez Anthropic. Il apporte son expérience de l'ASIC Autopilot de Tesla et du partenariat OpenAI-Broadcom. Le déménagement intervient un…
Google a publié la CLI Colab, permettant aux développeurs et aux agents d'IA d'exécuter du code local sur le runtime GPU et TPU Colab à distance. L'article La nouvelle CLI Colab de Google permet aux développeurs et aux agents d'IA d'exécuter Python sur des GPU et TPU Colab distants F…
Sakana AI a lancé un laboratoire de recherche dédié à l'auto-amélioration récursive : une IA qui s'améliore de manière itérative. La startup japonaise, cofondée par Llion Jones, co-auteur de Transformer, considère RSI comme une alternative au t…
Le développeur s'est senti « battu », n'ayant « pas d'autre choix » que de réduire le centre de données.
NVIDIA a publié Nemotron 3 Ultra, un Mamba-Transformer hybride ouvert et mixte d'experts de 550 B au total (55 B actifs) pour les agents de longue durée. Il associe un contexte de 1 million de jetons à un débit d'inférence jusqu'à environ 6 fois supérieur à celui des concurrents.
Meta a peut-être trouvé un moyen de réduire la facture massive de son centre de données : les tentes.
Kevin O'Leary a accepté de réduire de moitié la taille de son centre de données prévu de 40 000 acres dans l'Utah, sous la pression croissante des résidents et des militants, comme l'a rapporté plus tôt la filiale locale ABC4. La star de Shark Tank a envoyé une lettre pour…
La startup californienne a lancé la quatrième génération de son robot d'assistance à domicile, Stretch.
Les hyperscalers ont été scrutés de près pour leur impact sur la qualité et la disponibilité de l’eau.
Les ordinateurs quantiques promettent de résoudre un jour des problèmes dépassant les supercalculateurs les plus puissants imaginables. Mais on sous-estime souvent la quantité d’informatique classique nécessaire au simple fonctionnement de ces machines. Comme le nombre de qubits…
De nouvelles capacités de centres de données dans plusieurs régions ont facilité la disponibilité des GPU, contribuant ainsi à faire baisser les indices de coûts d'inférence régionaux cette semaine.
De plus en plus de fournisseurs lient les prix de calcul aux conditions énergétiques locales, ajoutant une dimension horaire à l'endroit et au moment où les charges de travail d'IA sont les moins chères.
L’écosystème NVIDIA AI Cloud accélère le développement mondial de l’infrastructure des usines d’IA. Les partenaires augmentent leur capacité pour répondre à la demande croissante des entreprises, des startups, des pays, des laboratoires d'IA et des développeurs qui évoluent…
Anthropic a publié lundi Cowork, une nouvelle capacité d'agent d'IA qui étend la puissance de son outil Claude Code à succès aux utilisateurs non techniques - et selon les initiés de l'entreprise, l'équipe a construit l'intégralité de la fonctionnalité…
Les résumés sont regroupés à titre d’information uniquement – suivez le lien source pour l’histoire complète. Les entrées de démonstration sont illustratives.