Fornitura di elaborazione, GPU, data center ed energia: il livello fisico che decide quanto a buon mercato viene eseguita l'intelligenza artificiale.
Storie 178
L’offerta di elaborazione, l’energia e la capacità dei data center determinano quanto a buon mercato può funzionare l’intelligenza artificiale. I cambiamenti infrastrutturali si manifestano nei costi di inferenza settimane dopo.
Esplora TileLang, un linguaggio Python specifico per dominio di alto livello che semplifica la progettazione di kernel GPU ad alte prestazioni. Questo tutorial fornisce un approccio passo dopo passo all'implementazione di carichi di lavoro complessi, inclusi i moduli affiancati...
Un’indagine ravvicinata nella Virginia del Nord ha rivelato la scarsa risposta dei data center alle interruzioni della rete. Ecco come risolvere il problema.
Il Samsung Galaxy Z Fold 8 Ultra è un buon telefono, ma c'è qualcosa di molto più avvincente nel Galaxy Z Fold 8.
Con l'ultimo telefono pieghevole di Samsung, l'azienda offre modifiche al design e al software che fanno sembrare insufficiente anche lo Z Fold dell'anno scorso.
Datalab ha riscritto Marker come una pipeline a tre modalità. La versione 2 raggiunge 76,0 su olmOCR-bench e sostiene 2,9 pagine al secondo su un B200, oltre 5 volte il backend della pipeline di MinerU, battendo Docling sia in termini di precisione che di velocità. H…
Datalab ha riscritto Marker come una pipeline a tre modalità. La versione 2 raggiunge 76,0 su olmOCR-bench e sostiene 2,9 pagine al secondo su un B200, oltre 5 volte il backend della pipeline di MinerU, battendo Docling sia in termini di precisione che di velocità. H…
URL dell'articolo: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference URL dei commenti: https://news.ycombinator.com/item?id=49041347 Punti: 17 # C…
La regola consentirebbe agli Stati di decidere quanto – se del caso – contributo pubblico può esserci.
In questo tutorial, creiamo un flusso di lavoro completo per l'esecuzione del modello Unlimited-OCR di Baidu su immagini di documenti e PDF multipagina. Dalla configurazione dell'ambiente GPU al confronto dell'inferenza di Gundam piastrellata ad alto dettaglio e della velocità...
URL dell'articolo: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 URL dei commenti: https://news.ycombinator.com/item?id=49…
La fattibilità dei data center orbitali che ospitano i modelli LLM (Large Language Model) più grandi e capaci rimane fortemente contestata. Ma le enormi implementazioni che richiedono migliaia di GPU non sono l’unico modo in cui i LLM potrebbero pro...
Una persona tiene dei cartelli durante una protesta nazionale contro l'espansione del data center AI fuori dalla Peace Hall a New Port Richey, in Florida. | AFP tramite Getty Images In un sabato mattina grigio e umido nella Florida centrale, un po' und...
Il fondatore e CEO di NVIDIA, Jensen Huang, ha visitato oggi la Naval Postgraduate School di Monterey, in California, per commissionare un sistema NVIDIA DGX GB300, portando una delle piattaforme di intelligenza artificiale più potenti al mondo completamente online per...
URL dell'articolo: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ URL dei commenti: https://news.ycombinator.com/item?id=49007525 Punti: 39 # Commenti: 53
Il Samsung Galaxy Z Fold 8 Ultra ha tutta la potenza pura di cui hai bisogno, ma il prezzo e gli accessori per Google Pixel 10 Pro Fold potrebbero essere un'offerta migliore.
OpenAI delinea il suo impegno nel far progredire la scienza americana collaborando con il Dipartimento dell'Energia degli Stati Uniti e i laboratori nazionali per utilizzare l'intelligenza artificiale di frontiera per accelerare la scoperta.
SenseTime ha lanciato il Galaxy Project, collaborando con quasi 20 partner per ampliare l’infrastruttura nazionale dei chip AI in Cina. In un keynote intitolato "Trasformazione intelligente e simbiosi", Yang Fan, co-f...
L’impegno è stato introdotto a marzo e finora ha fatto ben poco per placare le preoccupazioni. | Immagine: Cath Virginia / The Verge, Getty Images Di fronte alla reazione negativa alle preoccupazioni, il boom dell'intelligenza artificiale aumenterà le bollette elettriche dei consumatori...
I nuovi data center costruiti entro il 2033 potrebbero consumare tanta elettricità quanta ne consuma oggi l’India.
https://www.energy.gov/undersecretaryforscience/genesis-miss... URL dei commenti: https://news.ycombinator.com/item?id=48995074 Punti: 84 # Commenti: 56
L’intelligenza artificiale è entrata nell’era della gigascala. Le fabbriche di intelligenza artificiale più avanzate al mondo stanno riunendo centinaia di migliaia di GPU e CPU per addestrare modelli di frontiera, potenziare l’intelligenza artificiale e generare intelligenza a livelli senza precedenti…
La piattaforma Vera Rubin di Nvidia combina CPU e GPU in un unico sistema, riflettendo la crescente ambizione dell'azienda di potenziare ogni livello dell'infrastruttura AI.
Secondo quanto riferito, Alphabet, la società madre di Google, sta lavorando su un nuovo chip progettato per far funzionare i suoi modelli Gemini in modo molto più efficiente.
Google sta sviluppando "Frozen v2", un chip server che integra l'architettura Gemini direttamente nell'hardware. Secondo fonti interne, potrebbe essere da 6 a 10 volte più efficiente degli attuali TPU. Previsto per il 2028,…
Questo post descrive come Couchbase ha adottato Amazon Bedrock per potenziare Capella iQ con la famiglia di modelli Claude di Anthropic, le decisioni architettoniche alla base del loro approccio multi-modello e i vantaggi operativi ottenuti...
Microsoft sta espandendo l'infrastruttura AI di Azure con la nuova piattaforma Helios di AMD, che è destinata a sfidare i sistemi GPU di Nvidia nella seconda metà del 2026. Un profilo pubblico di GitHub suggerisce che Anthropic sta anche testando AMD...
Erin Davis lo chiama "SuperDuperPOD". Sono due cose in un solo nome: il colosso farmaceutico Bristol Myers Squibb (BMS) gestisce già uno dei più grandi cluster di intelligenza artificiale nelle scienze della vita, con risultati seri da dimostrare.
Le principali aziende cinesi di intelligenza artificiale stanno aumentando la pressione sulla Silicon Valley, poiché Moonshot e Alibaba hanno svelato modelli che, secondo loro, possono competere con il meglio di OpenAI e Anthropic a una frazione del costo. Il rap...
Costruiamo un flusso di lavoro NVIDIA NeMo AutoModel end-to-end in Google Colab utilizzando una singola GPU. Verifichiamo l'hardware CUDA e il supporto di precisione, installiamo NeMo AutoModel dal sorgente e carichiamo una ricetta ufficiale Qwen3-0.6B LoRA. W...
Neil Rimer, il venture capitalist che ha co-fondato Index Ventures, prevede che la ricchezza storica che l’intelligenza artificiale sta generando nella Silicon Valley dovrà essere ridistribuita, volontariamente o involontariamente.
Secondo quanto riferito, Meta è in trattative con Anthropic per affittare la capacità di elaborazione dei suoi data center. L'articolo Il piano di Zuckerberg per vendere i computer di intelligenza artificiale in eccesso potrebbe trovare il suo primo grande cliente in Anthropic è apparso per la prima volta su Th...
Moonshot AI ha rilasciato Kimi K3, un modello che secondo le prime valutazioni corrisponde all'Opus 4.8 di Anthropic, costruito da un team di sole 300 persone. Anche lo stratega di OpenAI Dean W. Ball lo definisce "molto buono", ma, ovviamente, avverte che...
Levoit Vital 200S-P è il purificatore d'aria intelligente da battere, con un prefiltro lavabile e una capacità di pulire fino a 1.800 piedi quadrati in un'ora.
Un vero e proprio blackout di tre giorni ha rivelato problemi che non avrei mai trovato sulla scheda tecnica di una centrale elettrica.
Sarah Friar, CFO di OpenaAI, presenta una pratica scorecard AI per misurare il ROI attraverso il lavoro utile, il costo per attività riuscita, l'affidabilità e il ritorno sull'elaborazione.
<p>Suggerimento per gli hyperscaler che sentono la pressione sull'uso dell'acqua nei data center:</p> <p>Acquistare alcuni country club esclusivi, convertire i campi da golf in parchi pubblici, pagare guide e binocoli per ottenere il membro precedente...
Nell’Uncanny Valley di oggi, analizziamo il dramma in corso di OpenAI, sia legale che reputazionale, e se questi sviluppi potrebbero danneggiare ulteriormente l’azienda, in particolare nella sua lotta contro Anthropic.
In 107 imprese, la spesa per le infrastrutture IA sta accelerando ben oltre la capacità di vedere o indirizzare la sua economia. La maggior parte delle organizzazioni gestisce la propria intelligenza artificiale su una base familiare di hyperscaler e API di provider di modelli, eppure...
Esploriamo l'SDK Patter creando un flusso di lavoro con agente vocale per un caso d'uso di prenotazione di un ristorante. Definiamo variabili dinamiche del chiamante, registriamo strumenti richiamabili per disponibilità, prenotazioni, orari e trasferimento umano e poniamo...
I robot generici e le macchine autonome si stanno spostando dai laboratori di ricerca all’implementazione nel mercato di massa nel mondo reale, creando la domanda di supercomputer IA compatti ed efficienti dal punto di vista energetico in grado di eseguire modelli di base a...
Realizzato in collaborazione con AWS Generative AI Innovation Center (GenAIIC), AWS Partner AND Digital e i team degli account AWS per creare un motore di elaborazione dei documenti scalabile e basato sull'intelligenza artificiale in grado di classificare, dividere, estrarre, valutare...
Il Solix E10 di Anker ha reso comprensibile l'alimentazione di backup per chi è alle prime armi e non vedo l'ora di espandere il sistema.
New York è diventato il primo stato a sospendere temporaneamente l’approvazione di grandi data center, poiché il governatore Kathy Hochul sostiene che il boom edilizio guidato dall’intelligenza artificiale non dovrebbe avvenire a scapito di costi più elevati di elettricità, forniture idriche,…
La moratoria dei data center di New York potrebbe diventare il modello del movimento anti-IA.
Il potere è il vincolo ineludibile dell’infrastruttura AI. Il numero di token che una fabbrica di intelligenza artificiale può generare entro un budget energetico fisso ne determina le entrate e la redditività. Per questo motivo, le prestazioni per watt, un parametro che...
Demis Hassabis, durante una sessione del panel al World Economic Forum di Davos, in Svizzera. | Immagine: Bloomberg tramite Getty Images Demis Hassabis pensa che il mondo abbia bisogno di un cane da guardia dell'IA con il potere di frenare se da...
URL dell'articolo: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ URL dei commenti: https://news.ycombinator.com/item?id=48901420 Punti: 19 # Commenti: 4
Di tutti i dibattiti che infuriano sui potenziali svantaggi dell'intelligenza artificiale, c'è una preoccupazione che preoccupa maggiormente gli appassionati di intelligenza artificiale nella Silicon Valley: che i giganteschi laboratori di intelligenza artificiale che vendono modelli proprietari siano in qualche modo un...
Abbiamo testato i migliori computer all-in-one che combinano la potenza di un PC desktop con un design sottile e leggero.
Un cartello di cantiere che si oppone a un data center pianificato è visualizzato lungo la Route 54 nella contea di Mount Carmel Township Northumberland. | Immagine: Getty Images Questo è The Stepback, una newsletter settimanale che racconta una storia essenziale di...
In questo tutorial esploriamo la programmazione GPU basata su piastrelle NVIDIA con TileGym, costruendo un flusso di lavoro Colab che viene eseguito su hardware diversi. Esaminiamo l'ambiente CUDA, proviamo il vero backend cuTile e torniamo a Tr...
Dopo il lancio di ChatGPT Work e GPT-5.6 Sol, OpenAI ha riconosciuto problemi significativi: utilizzo eccessivo del computer, transizione confusa all'interfaccia desktop per chat e progetti, una distinzione poco chiara tra...
URL dell'articolo: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ URL dei commenti: https://news.ycombinator.com/item?id=48865717 Punti: 17 # Commenti: 0
In questo post imparerai quattro modelli di distribuzione per prendere modelli che sono già stati quantizzati con Unsloth e distribuirli sull'infrastruttura AWS. I modelli utilizzano Amazon Elastic Compute Cloud (Amazon EC2)...
Una società di stoccaggio dell'energia solare e domestica si sta espandendo nei data center AI, ma non costruendone uno: si offre invece di pagare i propri clienti per installare le sue unità di calcolo nelle loro case. Sunrun sta lanciando un programma pilota...
Se hai bisogno di più potenza di quella che i servizi di hosting condiviso possono fornire, i migliori provider di hosting VPS possono fornirti le risorse dedicate e la scalabilità necessarie per portare il tuo progetto al livello successivo.
La nuova famiglia di modelli di OpenAI continuerà a potenziare la suite Microsoft di app per il posto di lavoro e la produttività.
NVIDIA ha rilasciato Nemotron-Labs-3-Puzzle-75B-A9B, una variante compressa di Nemotron-3-Super. Puzzle iterativo alterna la compressione strutturale basata sull'hardware con brevi fasi di recupero della distillazione della conoscenza. La modalità…
Avendo dimostrato quanto possa essere prezioso l’informatica, l’azienda si ritrova al centro di un mercato in cui tutti vogliono essere, mentre tecnologie più semplici e aziende meno interessanti si arricchiscono in disparte.
URL dell'articolo: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html URL dei commenti: https://news.ycombinator.com/item?id=48846708 Punti: 4...
Questo giovedì GFN porta più giochi, più potenza e più modi di giocare su GeForce NOW. Il servizio di cloud gaming si sta espandendo con un nuovo server basato su GeForce RTX 5080 a Toronto, offrendo prestazioni elevate dedicate in t...
NVIDIA ha rilasciato Nemotron-Labs-3-Puzzle-75B-A9B, una variante compressa di Nemotron-3-Super. Puzzle iterativo alterna la compressione strutturale basata sull'hardware con brevi fasi di recupero della distillazione della conoscenza. La modalità…
Il nuovo ruolo di Kevin Weil presso Stoke Space suggerisce che i razzi riutilizzabili saranno la prossima novità nella Silicon Valley.
Certo, le prolunghe domestiche e le prese multiple sono utili, ma provocano anche migliaia di incendi prevenibili ogni anno. Ecco come utilizzarli in modo più sicuro.
La stretta sulle bollette elettriche della Rust Belt minaccia il piano di produzione di Trump.
Microsoft è l’ultimo gigante della Silicon Valley a tagliare la spesa per l’intelligenza artificiale.
La startup cinese Deepseek sta costruendo il proprio chip AI, riferisce Reuters. L'articolo che Deepseek sta progettando il proprio chip AI è apparso per la prima volta su The Decoder.
OpenAI ha aggiunto due modelli Realtime alla sua API. GPT-Realtime-2.1-mini è un mini modello di ragionamento per voce, con il prezzo simile al precedente gpt-realtime-mini. OpenAI ha inoltre ridotto la latenza p95 di almeno il 25% attraverso una migliore memorizzazione nella cache. Lui…
Fable 5 di Anthropic promette un potere mitico dell'IA, ma le restrizioni a sorpresa mi fanno chiedere se sia più un problema di quanto valga per l'uso quotidiano.
URL dell'articolo: https://xcancel.com/i/article/2072830533739192560 URL dei commenti: https://news.ycombinator.com/item?id=48792463 Punti: 17 # Commenti: 1
URL dell'articolo: https://github.com/openai/codex/issues/30364 URL dei commenti: https://news.ycombinator.com/item?id=48789428 Punti: 131 # Commenti: 41
URL dell'articolo: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 URL dei commenti: https://news.ycombinator.com/item?id=48774246 Punti: 18 # Commenti: 6
La rapida espansione delle infrastrutture di intelligenza artificiale è generalmente considerata un problema energetico. Si prevede che i data center consumeranno una quota crescente della domanda globale di elettricità: l’Agenzia internazionale per l’energia…
La notizia arriva circa una settimana dopo che OpenAI ha annunciato il proprio chip AI personalizzato in una partnership con Broadcom.
Secondo quanto riferito, Anthropic è in trattative con Samsung Electronics per la produzione di un chip AI personalizzato. Il progetto è ancora in fase iniziale, ma Anthropic ha già assunto ingegneri di chip. Dopo "Jalapeño" di OpenAI, un'altra importante intelligenza artificiale...
Eufy Omni S2 migliora rispetto al suo predecessore con una potenza di aspirazione quattro volte superiore e un rullo per la pulizia inodore.
Nvidia agisce sempre più come una banca centrale per le startup di intelligenza artificiale, plasmando attivamente il mercato dell’informatica. L'articolo Nvidia sta finanziando le startup di intelligenza artificiale per allentare la presa di Big Tech sul business dei chip è apparso per la prima volta su The...
Google cerca di bilanciare le emissioni dei data center IA con gli sforzi per l'energia pulita.
URL dell'articolo: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ URL dei commenti: https://news.ycombinator.com/item?id=48759329 Punti: 26 # Commento…
Mentre l’intelligenza artificiale passa dallo sviluppo del modello all’inferenza della produzione, la domanda di elaborazione sta accelerando e si sta spostando verso fabbriche di intelligenza artificiale a funzionamento continuo che generano token su larga scala. Questo cambiamento richiede l’accesso a servizi su larga scala…
Sound ha costruito la sua reputazione su scommesse concentrate e ad alta convinzione nei laboratori di intelligenza artificiale leader della categoria, mentre il nuovo fondo di Kutcher sembra inseguire lo strato sottostante quelle società: l'infrastruttura e l'energia che alimentano...
Questo articolo è stato presentato dal Melbourne Convention Bureau (MCB) con il supporto di Business Events Australia. Mentre l’intelligenza artificiale accelera la domanda globale di elaborazione, sta emergendo un vincolo parallelo con pari...
Meta sta sviluppando piani per un’attività di infrastruttura cloud, vendendo l’accesso alla potenza e ai modelli di calcolo dell’intelligenza artificiale. La mossa lo metterebbe a confronto con i grandi fornitori di servizi cloud come Amazon Web Services, Google Cloud e Microsoft Az...
URL dell'articolo: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute URL dei commenti: https://news.ycombinator.com/item?id=48745966 Punti: 15 # Commenti: 11
"Il luogo a costo più basso in cui collocare l'intelligenza artificiale sarà lo spazio, e ciò sarà vero entro due anni, forse tre al massimo", ha dichiarato il fondatore di SpaceX Elon Musk al World Economic Forum di Davos lo scorso gennaio, mentre la sua azienda...
Secondo un rapporto di The Information, OpenAI ha ridotto di oltre la metà i costi di inferenza per i suoi modelli di intelligenza artificiale. L'azienda ha applicato le ottimizzazioni a ChatGPT, dove il numero di GPU Nvidia necessarie è sceso a pochi...
Le scienze della vita sono entrate in un'era di scala computazionale e per più di un decennio NVIDIA ha costruito l'intero stack di elaborazione accelerato da GPU, che comprende hardware, framework, librerie, modelli, microservizi e domini...
In questo post, esploriamo come Outpost VFX ha raggiunto velocità di allenamento 8 volte più elevate utilizzando l'infrastruttura AWS per trasformare il flusso di lavoro di sostituzione del volto, l'architettura tecnica implementata per superare il limite della singola GPU...
Le autorità taiwanesi hanno fatto irruzione negli uffici di Super Micro Computer e di diverse aziende partner locali. L'articolo di Taiwan fa irruzione negli uffici di Super Micro per indagare sul contrabbando di chip Nvidia in Cina è apparso per la prima volta su The...
URL dell'articolo: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ URL dei commenti: https://news.ycombinator.com/item?id=48727538 Punti: 27 # Commenti: 22
Ecco come sfruttare le capacità della tua centrale elettrica quando non è durante un'emergenza.
xFusion ha presentato modelli di elaborazione AI aziendali scalabili all'ISC 2026, trasferendo l'hardware dai dispositivi edge ai data center. Gli acquirenti di tecnologia aziendale presenti alla fiera di Amburgo cercavano la produzione pratica...
URL dell'articolo: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark URL dei commenti: https://news.ycombinator.com/item?id=48712791 Punti: 15 # Commenti: 2
Conoscere i fatti sull'energia solare domestica ti aiuta a fare scelte migliori e informate, a risparmiare denaro e a rimanere in sicurezza.
Il fondatore di 360, Zhou Hongyi, presenta due strumenti di sicurezza AI progettati per competere con Mythos di Anthropic. Uno ha già segnalato 3.432 vulnerabilità. Zhou ammette che i modelli cinesi seguono quelli occidentali del 20-30%, ma c...
Non tutti credono nella visione di Elon Musk per i data center orbitali.
Per coloro che utilizzano llms su MacBook, vuoi capire in che modo il MacBook è diverso dalla GPU dedicata nell'esecuzione di tali modelli? e come sapere quanto un MacBook è in grado di eseguire un modello? URL dei commenti: https://ne...
Nvidia ha dominato per anni il mercato dei chip IA, ma l’era della dipendenza totale potrebbe finire. OpenAI ha appena condiviso i suoi piani per rendere le cose più interessanti con Jalapeño, il suo chip di inferenza personalizzato creato con Broadcom, unendosi a G...
Nvidia ha dominato per anni il mercato dei chip IA, ma l’era della dipendenza totale potrebbe finire. OpenAI ha appena condiviso i suoi piani per rendere le cose più interessanti con Jalapeño, il suo chip di inferenza personalizzato creato con Broadcom, unendosi a G...
I critici di Anthropic affermano che sta accumulando rapidamente potere. L'azienda dice che questo è ciò che sembra un sviluppo responsabile dell'AI.
La decisione della MGM Studios, di proprietà di Amazon, di abbandonare il progetto di film di OpenAI è solo un esempio dell'intreccio crescente tra l'industria dell'IA e quella cinematografica. Su Uncanny Valley, esploriamo dove tutto ciò sta portando.
L'aumento dei prezzi è dovuto al rialzo dei costi dei chip di memoria e alla scarsità delle scorte, ma ci sono ancora offerte disponibili se sai dove cercare.
Un-0 è uno strumento di sistema di generazione di immagini che per la prima volta mostra come la tecnologia dell'azienda può replicare sistemi AI convenzionali.
È un mercato difficile per le GPU, ma ci sono ancora alcune buone offerte durante Amazon Prime Day. Ecco le cinque da controllare.
Perché la latenza organizzativa sta diventando il più grande ostacolo alla piena realizzazione dei vantaggi dell’intelligenza artificiale
Per celebrare il nuovo status di numero 1 nella classifica iniziale di qualità di JD Power tra i costruttori automobilistici mainstream, Ford sta parlando delle sfide che ha affrontato negli ultimi anni, in particolare riguardo alla sua dipendenza dai sistemi automatizzati...
Qualcomm si avvicina ulteriormente al mercato dei data center con un nuovo processore chiamato Dragonfly C1000. L'articolo Qualcomm entra nel mercato dei data center con il proprio processore è apparso per primo su The Decoder.
I transistor nanostack di IBM potrebbero migliorare le prestazioni o l'efficienza energetica dei chip.
La traiettoria finanziaria di OpenAI dipende fortemente dai costi infrastrutturali, una realtà che ha spinto lo sviluppo del nuovo chip personalizzato OpenAI Jalapeño. Sviluppato in collaborazione con Broadcom, l'integrazione specifica applicativa...
La corsa ai silicium sta aumentando di intensità nel tentativo di soddisfare la domanda.
Gradium ha rilasciato due modelli di traduzione di parola in parola e di speech-to-speech in tempo reale, stt-translate e s2s-translate, coprendo inglese, francese, tedesco, spagnolo e portoghese su 20 coppie di lingue. I modelli riducono lo standard a tre modelli…
Annuncio: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... Commenti URL:…
In questo articolo, mostriamo l'architettura e l'approccio utilizzato da Loka per risolvere una frustrazione comune: assistenti vocali robotici e lenti che causano ai clienti di appendere il telefono, danneggiando la reputazione del marchio e aumentando i costi di supporto.
OpenAI ha appena rivelato un nuovo chip di "processore di intelligenza" per server AI realizzato in collaborazione con Broadcom. Il chip, chiamato Jalapeño, è progettato per alimentare modelli linguistici grandi attuali e futuri, secondo un an…
OpenAI sta aggiungendo hardware personalizzato alla sua tecnologia. Il chip "Jalapeño", sviluppato con Broadcom, è progettato per l'inferenza dei modelli linguistici a larga scala e dovrebbe funzionare a scala da fine 2026. L'articolo OpenAI e Broadcom u…
URL dell'articolo: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ URL dei commenti: https://news.ycombinator.com/item?id=48659257 Punti: 141 # Commenti: 1
I modelli linguistici possono scrivere prosa più pulita rispetto alla maggior parte degli esseri umani, ma chiedergli 100 argomenti su un argomento e tutti si raggrupperanno insieme. Il ragionamento umano è molto più vario, dice il CEO di Pangram Max Spero, e questo è ciò che potrebbe…
Il DFlash dell’Università di San Diego sostituisce il drafting autoregressive con un modello di diffusione leggero per la decodifica speculativa. Drafta blocchi di token interi in un singolo passaggio in avanti e condiziona sulle caratteristiche nascoste di destinazione…
OpenAI e Broadcom introducono Jalapeño, un chip AI personalizzato progettato per l'inferenza LLM per migliorare le prestazioni, l'efficienza e la scalabilità across AI systems.
Costruire sistemi di IA su larga scala è impegnativo, richiede inferenza a bassa latenza, ricerca vettoriale veloce, un forte rapporto prezzo-prestazioni delle GPU e infrastrutture che possono crescere senza moltiplicare la complessità operativa. L'ultima novità di NVIDIA è la...
In questo tutorial, costruiamo un pipeline di ASR e traduzione della voce multilingue con NVIDIA Canary-1B-v2. Carichiamo il modello su un runtime con GPU, prepariamo l'audio in mono a 16 kHz e eseguiamo ASR in inglese. Poi traduciamo…
Ciao, volevo condividere con voi una mappa interattiva delle constraint economiche e fisiche dell'implementazione dell'AI. Ha driver macro, punti di blocco industriali e dove si manifestano nei mercati. Ho aggiunto 393 nodi…
Evidenze delle Notizie: La tecnologia NVIDIA alimenta l'81% del TOP500 e il 90% dei sistemi nuovi alla lista. 26 sistemi del TOP500 hanno adottato il CPU NVIDIA Grace, otto in più rispetto alla lista precedente. I primi otto sistemi del Gree…
L'impennata globale delle minacce informatiche AI non è più un problema remoto per i centri di dati aziendali, secondo un avviso pubblico urgente dell'alleanza di intelligence più potente del mondo. Il 22 giugno 2026, la cybersicurezza...
Scopri come Omio utilizza OpenAI per alimentare esperienze di viaggio conversazionale, accelerare lo sviluppo del prodotto e trasformarsi in una società nativa AI.
La reazione pubblica contro i data center ha enfatizzato il loro consumo di acqua ed energia, e ora Nvidia evidenzia la sua affermazione che il design di riferimento della generazione Rubin per un data center interamente raffreddato a liquido ha "elim…
Nvidia ha annunciato un nuovo sistema di raffreddamento che riduce l'uso dell'acqua all'interno dei data center. Ma non fa nulla per affrontare il maggiore utilizzo di acqua dell'IA - le centrali elettriche a combustibili fossili.
Microsoft sta costruendo un campus di data center di circa 2 gigawatt a Pecos, Texas, uno dei più grandi aggiunti di capacità nella sua storia. In una lettera aperta, la compagnia promette prezzi di energia stabili e un uso minimo dell'acqua...
JUPITER, il primo supercomputer esascala d'Europa presso il Forschungszentrum Jülich in Germania, gira su Superchip NVIDIA Grace Hopper e rete InfiniBand NVIDIA Quantum-X800 — e ha avuto un anno intenso. Come l'internazionale…
Missione, Visione e Veritas — nuovi supercomputer del Laboratorio Nazionale di Los Alamos (LANL) costruiti con HPE e NVIDIA — stanno utilizzando le CPU NVIDIA Vera per accelerare la scoperta scientifica, sbloccando l'AI agente per la scienza.…
La prossima era dell'AI non sarà definita solo dal calcolo. La sua crescita sarà determinata dall'energia. Man mano che il calcolo accelerato si scala attraverso le fabbriche AI, l'AI agente, l'AI industriale, il computing ai margini e l'AI fisica — inclusi…
Il grande tech sta investendo enormi somme nella costruzione di data center. Man mano che l'opposizione nazionale alle strutture cresce, alcuni lavoratori stanno iniziando a chiedersi se valga la pena.
Costruiamo un flusso di lavoro di previsione end-to-end con TimeCopilot su un pannello di dati reali di passeggeri di compagnie aeree e una serie stagionale sintetica con anomalie iniettate. Valutiamo statistici, di base e opzionalmente basati su GPU...
C'è una logica commerciale che va contro l'idea che ASML rischierebbe la sua licenza di esportazione per armare un cliente cinese.
Amazon SageMaker AI fornisce un hosting di inferenza in tempo reale completamente gestito per modelli di machine learning. Depositi un modello su un endpoint di SageMaker supportato da una o più istanze di calcolo, e SageMaker si occupa della provisioning…
Gioca ai titoli preferiti delle biblioteche di gioco popolari, mantieni sincronizzati i progressi e torna ai sessioni di gioco su quasi qualsiasi dispositivo. Questo è il potere del cloud gaming GeForce NOW. Dalla fornitura di accesso ai titoli preferiti dei membri...
Simulando come opera il cervello, l'informatica neuromorfica può utilizzare notevolmente meno energia rispetto ai chip AI elettronici convenzionali. Tuttavia, anche i dispositivi neuromorfici più sofisticati di oggi sono ancora piuttosto semplici,...
Un anno fa al NVIDIA GTC Paris a VivaTech, la Francia ha illustrato piani per avanzare l'IA locale — da nuove fabbriche di IA e capacità di calcolo nazionale a modelli di frontiera aperti e piattaforme industriali. Ora, quella infrastruttura di IA...
Tokenmaxxing è stata la tendenza più popolare a Silicon Valley all'inizio dell'anno, con CEO che incoraggiavano i dipendenti a spingere l'uso dell'AI il più lontano possibile. Poi è arrivata la fattura. Uber avrebbe superato il proprio budget annuale AI...
Tokenmaxxing è stata la tendenza più popolare a Silicon Valley all'inizio dell'anno, con CEO che incoraggiavano i dipendenti a spingere l'uso dell'AI il più lontano possibile. Poi è arrivata la fattura. Uber avrebbe superato il proprio budget annuale di AI...
Il movimento originariamente pianificato per lunedì avrebbe aumentato significativamente i costi degli utenti intensivi.
Oggi, siamo entusiasti di annunciare la cache di immagini di container per l'inferenza di Amazon SageMaker AI, il prossimo grande passo avanti nel nostro viaggio di ottimizzazione della scalabilità più rapida. Questo riduce la latenza end-to-end di fino al 2x per genera…
Gli occhiali intelligenti sono ancora una categoria emergente, ma il produttore di chip Qualcomm sta lavorando duramente per migliorare il silicio per alimentare la prossima ondata di dispositivi XR: il Snapdragon Reality Elite. Anche se Qualcomm sta annunciando il chip oggi…
Il Dipartimento di Giustizia dice che il Pentagono ha bisogno che xAI continui a utilizzare le sue turbine a gas non autorizzate.
Un produttore di software di Silicon Valley e una società di e-commerce rivelano a WIRED come stanno navigando la sfida emergente di “tokenomics”.
Alla fine di una prima metà tesa e senza reti di una partita di calcio tra la squadra maschile inglese e la rivali Germania, milioni di britannici hanno esalato un respiro collettivo e hanno fatto ciò che spesso fanno in momenti di stress: hanno mad…
Oggi sto parlando con Adam Bry, CEO di Skydio, il principale produttore statunitense di droni autonomi. Prima di registrare questo episodio, ho avuto la possibilità di operare a distanza uno dei droni di Skydio nella Bay Area dal laptop di Adam...
Mirage, un modello di mondo video di Microsoft Research e diverse università, memorizza le informazioni sulla scena direttamente nello spazio latente invece di nuvole di punti basate su pixel. Questo riduce il tempo di calcolo e la memoria grafica mentre ke…
Anche i data center di dimensioni moderate possono avere un impatto locale enorme.
OpenAI sta negoziando per affittare un centro dati pianificato da 10 gigawatt in Ohio che potrebbe essere finanziato da Nvidia, secondo The Information. L'articolo OpenAI wants its biggest data center yet, and Nvidia would b…
Con una capacità iniziale di 24 megawatt, il centro dati innovativo utilizza l'acqua di mare come sistema di raffreddamento naturale.
Un nuovo rapporto di OpenAI dettaglia le operazioni di influenza collegate alla Cina che utilizzano l'AI per mirare ai dibattiti tecnologici negli Stati Uniti, narrazioni sui data center, tariffe e affermazioni false su ChatGPT.
Il quarto modello linguistico di grandi dimensioni (LLM) di OpenAI, GPT-4, ha impiegato circa 50 gigawattora per essere addestrato, ovvero l’equivalente del consumo energetico annuale di 5.000 case americane. Era il 2023. Da allora, le risorse computazionali...
La struttura da 168 megawatt supporta i bisogni di calcolo AI globali di Meta e può essere espansa nel tempo.
Le GPU NVIDIA con Confidential Computing vengono utilizzate per inferenze confidenziali nel Cloud Compute Privato di Apple (PCC), espandendosi oltre i data center di Apple a Google Cloud. Rivelato durante l'annuale WWDC di Apple.
Oggi a San Francisco, General Motors ha fatto una serie di annunci riguardanti le batterie EV, la storage energetica e la resilienza della rete di distribuzione di fronte alla crescente domanda di elettricità dai data center AI. Il costruttore di auto ha an…
In questo post, mostriamo come addestrare le politiche dei robot per il robot umanoide Unitree H1 con NVIDIA Isaac Lab su Amazon SageMaker AI attraverso due opzioni di calcolo: Amazon SageMaker HyperPod e Amazon SageMaker Training Jobs.
Martedì, il Consiglio comunale di Seattle voterà se attuare una moratoria di un anno sui nuovi data center, appena due mesi dopo che diverse aziende avevano proposto di costruire cinque centri su larga scala nella città. Tra i mo…
In che modo Notion utilizza Codex per specifiche one-shot, crea input vocale AI per il Web e moltiplica la potenza ingegneristica tra piccoli team.
In questo tutorial implementiamo un flusso di lavoro pratico per NVIDIA cuTile Python, un'interfaccia di programmazione GPU basata su tile per kernel in stile CUDA in Python. Prepariamo un ambiente Colab-friendly e controlliamo GPU, driver, CUDA,...
Google ha ordinato più di tre milioni di chip AI da Intel per il 2028. Nvidia sta testando la tecnologia di produzione di Intel per la sua prossima architettura Feynman. Entrambe le mosse arrivano perché TSMC non riesce a tenere il passo con la domanda di chip AI. Int…
Il team MiMo di Xiaomi, con TileRT, ha rilasciato MiMo-V2.5-Pro-UltraSpeed, una modalità di servizio per il modello MiMo-V2.5-Pro. Decodifica oltre 1000 token al secondo su un modello da 1 trilione di parametri utilizzando un singolo nodo merceologico da 8 GPU.…
Con l'accesso ai più recenti modelli di intelligenza artificiale generativa e all'elaborazione accelerata ad alte prestazioni in una domanda globale elevata, i clienti AWS hanno bisogno di strumenti per sfruttare la disponibilità e la capacità dei modelli in più regioni AWS, w...
NVIDIA e LG Group stanno costruendo una fabbrica di intelligenza artificiale per accelerare la prossima ondata di attività di LG Group basate sull’intelligenza artificiale, che spaziano dalla robotica, alla guida autonoma, alle tecnologie dei data center e ai servizi cloud GPU. La fabbrica dell’intelligenza artificiale dimostrerà…
Clive Chan, per suo conto il secondo dipendente hardware nel programma di chip personalizzati di OpenAI, si sta trasferendo ad Anthropic. Porta l'esperienza dell'ASIC Autopilot di Tesla e della partnership OpenAI-Broadcom. La mossa arriva…
Google ha rilasciato la CLI di Colab, consentendo agli sviluppatori e agli agenti di intelligenza artificiale di eseguire codice locale sul runtime di GPU e TPU Colab remoti Il post La nuova CLI di Colab di Google consente agli sviluppatori e agli agenti di intelligenza artificiale di eseguire Python su GPU e TPU di Colab remoti F...
Sakana AI ha lanciato un laboratorio di ricerca dedicato all’auto-miglioramento ricorsivo: l’intelligenza artificiale che migliora se stessa in modo iterativo. La startup giapponese, co-fondata dal coautore di Transformer Llion Jones, vede l'RSI come un'alternativa al...
Lo sviluppatore si è sentito "picchiato", senza "altra scelta" se non quella di ridurre il data center.
NVIDIA ha rilasciato Nemotron 3 Ultra, un Mamba-Transformer ibrido aperto con miscela di esperti da 550 miliardi totali (55 miliardi attivi) per agenti a lunga durata. Abbina un contesto token da 1 milione con un throughput di inferenza fino a ~6 volte superiore rispetto a compa...
Meta potrebbe aver trovato un modo per ridurre drasticamente il conto dei suoi data center: le tende.
Kevin O'Leary ha accettato di dimezzare le dimensioni del suo data center di 40.000 acri pianificato nello Utah nonostante la crescente pressione da parte di residenti e attivisti, come riportato in precedenza dall'affiliata locale ABC4. La star di Shark Tank ha inviato una lettera t...
La startup californiana ha rilasciato la quarta generazione del suo robot per l'assistenza domiciliare, Stretch.
Gli hyperscaler sono stati messi sotto esame per il loro impatto sulla qualità e sulla disponibilità dell’acqua.
I computer quantistici promettono di risolvere un giorno problemi che vanno oltre i supercomputer più potenti immaginabili. Ma spesso viene sottovalutato quanto calcolo classico sia necessario solo per far funzionare queste macchine. Come conta qubit...
La nuova capacità dei data center in diverse regioni ha facilitato la disponibilità delle GPU, contribuendo a ridurre gli indici dei costi di inferenza regionali questa settimana.
Sempre più fornitori stanno legando i prezzi di elaborazione alle condizioni energetiche locali, aggiungendo una dimensione temporale a dove e quando i carichi di lavoro dell’intelligenza artificiale sono più economici.
L'ecosistema NVIDIA AI Cloud sta accelerando la realizzazione globale dell'infrastruttura di fabbrica AI. I partner stanno espandendo la capacità di soddisfare la crescente domanda da parte di imprese, startup, nazioni, laboratori di intelligenza artificiale e sviluppatori che scalano...
Lunedì Anthropic ha rilasciato Cowork, una nuova funzionalità dell'agente AI che estende la potenza del suo strumento di grande successo Claude Code a utenti non tecnici - e secondo addetti ai lavori dell'azienda, il team ha creato l'intera funzionalità...
I riepiloghi sono aggregati solo a scopo informativo: segui il collegamento alla fonte per la storia completa. Le voci demo sono illustrative.