Suministro de computación, GPU, centros de datos y energía: la capa física que decide qué tan barato funciona la IA.
historias 182
El suministro de computación, la energía y la capacidad de los centros de datos deciden qué tan barato puede funcionar la IA. Los cambios en la infraestructura aparecen en los costos de inferencia semanas después.
En TechCrunch Disrupt 2026, la etapa de sistemas inteligentes será donde chocan la energía, la infraestructura y la tecnología, abarcando todo, desde los avances en la fusión hasta la tensión de la red que la IA está ejerciendo sobre toda la economía.
«Se recoge electricidad en el espacio y se expulsa calor al espacio. Lo único que llega a la Tierra son datos.'
La complejidad del diseño de chips modernos continúa creciendo a medida que los equipos de ingeniería trabajan para desarrollar CPU, GPU y sistemas de inteligencia artificial cada vez más sofisticados. Para ayudar a afrontar ese desafío, NVIDIA está colaborando con el líder de la industria...
En el último episodio de Equity, discutimos por qué Kimi de Moonshot AI pareció entrar en pánico en Silicon Valley y Wall Street.
Explore TileLang, un lenguaje de dominio específico de Python de alto nivel que simplifica el diseño de núcleos de GPU de alto rendimiento. Este tutorial proporciona un enfoque paso a paso para implementar cargas de trabajo complejas, incluidas las en mosaico...
Una situación cercana en el norte de Virginia reveló cuán mal responden los centros de datos a las interrupciones de la red. A continuación se explica cómo solucionar el problema.
El Samsung Galaxy Z Fold 8 Ultra es un buen teléfono, pero hay algo mucho más atractivo en el Galaxy Z Fold 8.
Con el último teléfono plegable de Samsung, la compañía ofrece cambios de diseño y software que hacen que incluso el Z Fold del año pasado parezca insuficiente.
Datalab reescribió Marker como una canalización de tres modos. La versión 2 alcanza 76.0 en olmOCR-bench y sostiene 2.9 páginas por segundo en un B200, más de 5 veces el backend de MinerU, mientras supera a Docling tanto en precisión como en velocidad. H…
Datalab reescribió Marker como una canalización de tres modos. La versión 2 alcanza 76.0 en olmOCR-bench y sostiene 2.9 páginas por segundo en un B200, más de 5 veces el backend de MinerU, mientras supera a Docling tanto en precisión como en velocidad. H…
URL del artículo: https://www.cerebras.ai/press-release/amd-and-cerebras-announce-industry-leading-ultra-low-latency-and-high-throughput-ai-inference URL de comentarios: https://news.ycombinator.com/item?id=49041347 Puntos: 17 # C…
La regla permitiría a los estados decidir cuántas aportaciones públicas (si las hay) pueden haber.
En este tutorial, creamos un flujo de trabajo completo para ejecutar el modelo Unlimited-OCR de Baidu en imágenes de documentos y archivos PDF de varias páginas. Desde la configuración del entorno de GPU hasta la comparación de inferencias y velocidades de Gundam en mosaico de alto detalle...
URL del artículo: https://www.theregister.com/ai-and-ml/2026/07/15/australia-demands-ai-companies-must-produce-more-energy-than-they-consume-stop-theft-of-content/5271535 URL de comentarios: https://news.ycombinator.com/item?id=49…
La viabilidad de los centros de datos orbitales que albergan los modelos de lenguajes grandes (LLM) más grandes y capaces sigue siendo muy discutida. Pero las enormes implementaciones que requieren miles de GPU no son la única forma en que los LLM podrían pro...
Una persona sostiene carteles durante una protesta a nivel nacional contra la expansión del centro de datos de IA frente al Peace Hall en New Port Richey, Florida. | AFP a través de Getty Images En una mañana gris y húmeda de sábado en el centro de Florida, un poco más…
El fundador y director ejecutivo de NVIDIA, Jensen Huang, visitó hoy la Escuela Naval de Postgrado en Monterey, California, para encargar un sistema NVIDIA DGX GB300, que pondrá en línea una de las plataformas de inteligencia artificial más potentes del mundo para...
URL del artículo: https://www.redfin.com/news/ai-data-centers-opposition-education-benefit/ URL de comentarios: https://news.ycombinator.com/item?id=49007525 Puntos: 39 # Comentarios: 53
El Samsung Galaxy Z Fold 8 Ultra tiene toda la potencia bruta que necesita, pero el precio y los accesorios del Google Pixel 10 Pro Fold podrían ser una mejor oferta.
OpenAI describe su compromiso con el avance de la ciencia estadounidense trabajando con el Departamento de Energía de EE. UU. y laboratorios nacionales para utilizar la IA de vanguardia para acelerar los descubrimientos.
SenseTime lanzó el Proyecto Galaxy, en colaboración con casi 20 socios para escalar la infraestructura nacional de chips de IA en China. En un discurso de apertura titulado "Transformación inteligente y simbiosis", Yang Fan, cofundador de la empresa...
El compromiso se presentó en marzo y hasta ahora ha hecho poco para calmar las preocupaciones. | Imagen: Cath Virginia / The Verge, Getty Images Ante la reacción violenta ante la preocupación de que el auge de la IA aumente las facturas de electricidad de los consumidores...
Los nuevos centros de datos construidos hasta 2033 podrían consumir tanta electricidad como la que utiliza India en la actualidad.
https://www.energy.gov/undersecretaryforscience/genesis-miss... URL de comentarios: https://news.ycombinator.com/item?id=48995074 Puntos: 84 # Comentarios: 56
La IA ha entrado en la era de la gigaescala. Las fábricas de IA más avanzadas del mundo están reuniendo cientos de miles de GPU y CPU para entrenar modelos de vanguardia, potenciar la IA agente y generar inteligencia a velocidades sin precedentes...
La plataforma Vera Rubin de Nvidia combina CPU y GPU en un solo sistema, lo que refleja la creciente ambición de la empresa de potenciar cada capa de la infraestructura de IA.
Según se informa, Alphabet, la empresa matriz de Google, está trabajando en un nuevo chip diseñado para que sus modelos Gemini funcionen de manera mucho más eficiente.
Google está desarrollando "Frozen v2", un chip de servidor que integra la arquitectura Gemini directamente en el hardware. Según fuentes internas, podría ser entre 6 y 10 veces más eficiente que las TPU actuales. Programado para 2028, el…
Esta publicación describe cómo Couchbase adoptó Amazon Bedrock para impulsar Capella iQ con la familia de modelos Claude de Anthropic, las decisiones arquitectónicas detrás de su enfoque multimodelo y los beneficios operativos obtenidos...
Microsoft está ampliando la infraestructura de inteligencia artificial de Azure con la nueva plataforma Helios de AMD, que desafiará los sistemas GPU de Nvidia en la segunda mitad de 2026. Un perfil público de GitHub sugiere que Anthropic también está probando AMD...
Erin Davis lo llama "SuperDuperPOD". Son dos cosas en un solo nombre: el gigante farmacéutico Bristol Myers Squibb (BMS) ya dirige uno de los grupos de IA más grandes en ciencias de la vida, con serios resultados que demostrar.…
Las principales empresas de inteligencia artificial de China están aumentando la presión sobre Silicon Valley, ya que Moonshot y Alibaba dieron a conocer modelos que, según afirman, pueden competir con los mejores de OpenAI y Anthropic a una fracción del costo. El rap...
Creamos un flujo de trabajo de NVIDIA NeMo AutoModel de extremo a extremo en Google Colab utilizando una sola GPU. Verificamos el hardware CUDA y el soporte de precisión, instalamos NeMo AutoModel desde la fuente y cargamos una receta oficial Qwen3-0.6B LoRA. W…
Neil Rimer, el capitalista de riesgo que cofundó Index Ventures, predice que la riqueza histórica que la IA está generando en Silicon Valley tendrá que ser redistribuida, voluntaria o involuntariamente.
Según se informa, Meta está en conversaciones con Anthropic para alquilar capacidad informática de sus centros de datos. El artículo El plan de Zuckerberg para vender el exceso de computación de IA encuentra su primer gran cliente en Anthropic apareció por primera vez en Th...
Moonshot AI ha lanzado Kimi K3, un modelo que, según las primeras evaluaciones, coincide con el Opus 4.8 de Anthropic, construido por un equipo de solo 300 personas. Incluso el estratega de OpenAI Dean W. Ball lo califica de "muy bueno", pero, por supuesto, advierte que…
El Levoit Vital 200S-P es el purificador de aire inteligente a batir, con un prefiltro lavable y una capacidad para limpiar hasta 1,800 pies cuadrados en una hora.
Un apagón real de tres días reveló problemas que nunca habría encontrado en la hoja de especificaciones de una central eléctrica.
Sarah Friar, directora financiera de OpenaAI, presenta un práctico cuadro de mando de IA para medir el retorno de la inversión a través del trabajo útil, el costo por tarea exitosa, la confiabilidad y el retorno de la computación.
<p>Sugerencia para los hiperescaladores que sienten presión por el uso del agua en los centros de datos:</p> <p>Compre algunos clubes de campo exclusivos, convierta los campos de golf en parques públicos, pague guías y binoculares para conseguir el miembro anterior...
En el Uncanny Valley de hoy, analizamos el drama actual de OpenAI, tanto legal como de reputación, y si estos desarrollos podrían dañar aún más a la compañía, particularmente en su lucha contra Anthropic.
En 107 empresas, el gasto en infraestructura de IA se está acelerando mucho más allá de la capacidad de ver o dirigir su economía. La mayoría de las organizaciones ejecutan su IA sobre una base familiar de hiperescaladores y API de proveedores de modelos, pero...
Exploramos el SDK de Patter creando un flujo de trabajo de agente de voz para un caso de uso de reserva en un restaurante. Definimos variables dinámicas de llamadas, registramos herramientas llamables para disponibilidad, reservas, horarios y transferencia humana, y establecemos...
Los robots de uso general y las máquinas autónomas están pasando de los laboratorios de investigación al despliegue en el mercado masivo del mundo real, creando una demanda de supercomputadoras de IA compactas y energéticamente eficientes capaces de ejecutar modelos básicos en...
Creado en asociación con el Centro de innovación de IA generativa de AWS (GenAIIC), el socio AND Digital de AWS y los equipos de cuentas de AWS para crear un motor de procesamiento de documentos escalable impulsado por IA que puede clasificar, dividir, extraer, evaluar...
Solix E10 de Anker hizo que la energía de respaldo fuera comprensible para este principiante, y no puedo esperar para expandir el sistema.
Nueva York se ha convertido en el primer estado en detener temporalmente la aprobación de grandes centros de datos, mientras la gobernadora Kathy Hochul sostiene que el auge de la construcción impulsado por la IA no debería producirse a expensas de mayores costos de electricidad, suministro de agua,...
La moratoria de los centros de datos de Nueva York puede convertirse en el modelo para el movimiento contra la IA.
El poder es la limitación ineludible de la infraestructura de IA. La cantidad de tokens que puede generar una fábrica de IA dentro de un presupuesto de energía fijo determina sus ingresos y rentabilidad. Debido a esto, el rendimiento por vatio, una métrica que...
Demis Hassabis, durante una mesa redonda en el Foro Económico Mundial en Davos, Suiza. | Imagen: Bloomberg a través de Getty Images Demis Hassabis cree que el mundo necesita un perro guardián de IA con el poder de frenar si llega...
URL del artículo: https://www.cbsnews.com/news/georgia-power-ai-data-centers-eminent-domain/ URL de comentarios: https://news.ycombinator.com/item?id=48901420 Puntos: 19 # Comentarios: 4
De todos los debates que se debaten sobre las posibles desventajas de la IA, hay una preocupación que causa más inquietud entre los entusiastas de la IA en Silicon Valley: que los gigantescos laboratorios de IA que venden modelos propietarios sean de alguna manera...
Probamos las mejores computadoras todo en uno que combinan la potencia de una PC de escritorio con un diseño delgado y liviano.
Un letrero en el patio opuesto a un centro de datos planificado se muestra a lo largo de la Ruta 54 en el municipio de Mount Carmel en el condado de Northumberland. | Imagen: Getty Images Este es The Stepback, un boletín semanal que analiza una historia esencial de...
En este tutorial, exploramos la programación de GPU basada en mosaicos de NVIDIA con TileGym, creando un flujo de trabajo de Colab que se ejecuta en diferentes hardware. Probamos el entorno CUDA, probamos el backend cuTile real y volvemos a Tr...
Tras el lanzamiento de ChatGPT Work y GPT-5.6 Sol, OpenAI ha reconocido problemas importantes: uso excesivo de la computadora, una transición confusa a la interfaz de escritorio para chats y proyectos, una distinción poco clara entre...
URL del artículo: https://www.noemamag.com/chinas-open-ai-models-are-advancing-its-global-soft-power/ URL de comentarios: https://news.ycombinator.com/item?id=48865717 Puntos: 17 # Comentarios: 0
En esta publicación, aprenderá cuatro patrones de implementación para tomar modelos que ya han sido cuantificados con Unsloth e implementarlos en la infraestructura de AWS. Los patrones utilizan Amazon Elastic Compute Cloud (Amazon EC2)…
Una empresa de almacenamiento de energía solar y doméstica se está expandiendo hacia los centros de datos de inteligencia artificial, pero no construyendo uno; en cambio, ofrece pagar a sus clientes para que instalen sus unidades de cómputo en sus hogares. Sunrun está lanzando un programa piloto...
Si necesita más potencia de la que pueden proporcionar los servicios de alojamiento compartido, los principales proveedores de alojamiento VPS pueden brindarle los recursos dedicados y la escalabilidad necesarios para llevar su proyecto al siguiente nivel.
La nueva familia de modelos de OpenAI seguirá impulsando el conjunto de aplicaciones de productividad y lugar de trabajo de Microsoft.
NVIDIA ha lanzado Nemotron-Labs-3-Puzzle-75B-A9B, una variante comprimida de Nemotron-3-Super. Iterative Puzzle alterna la compresión estructural basada en hardware con fases cortas de recuperación de destilación de conocimientos. El modo…
Habiendo demostrado lo valiosa que puede ser la informática, la empresa se encuentra en el centro de un mercado en el que todos quieren estar, mientras que las tecnologías más simples y las empresas menos interesantes se enriquecen al margen.
URL del artículo: https://www.proactiveinvestors.com/companies/news/1095178/deepseek-makes-pivot-that-should-put-silicon-valley-on-high-alert-1095178.html URL de comentarios: https://news.ycombinator.com/item?id=48846708 Puntos: 4…
Este jueves de GFN trae más juegos, más potencia y más formas de jugar en GeForce NOW. El servicio de juegos en la nube se está expandiendo con un nuevo servidor con tecnología GeForce RTX 5080 en Toronto, brindando alto rendimiento dedicado en...
NVIDIA ha lanzado Nemotron-Labs-3-Puzzle-75B-A9B, una variante comprimida de Nemotron-3-Super. Iterative Puzzle alterna la compresión estructural basada en hardware con fases cortas de recuperación de destilación de conocimientos. El modo…
El nuevo puesto de Kevin Weil en Stoke Space sugiere que los cohetes reutilizables son la próxima novedad en Silicon Valley.
Claro, los cables de extensión domésticos y los enchufes múltiples son útiles, pero también provocan miles de incendios evitables cada año. Aquí se explica cómo utilizarlos de forma más segura.
La reducción de las facturas de electricidad del Rust Belt amenaza el plan de fabricación de Trump.
Microsoft es el último gigante de Silicon Valley en recortar su gasto en inteligencia artificial.
La startup china Deepseek está construyendo su propio chip de inteligencia artificial, informa Reuters. El artículo Deepseek está diseñando su propio chip de IA apareció por primera vez en The Decoder.
OpenAI agregó dos modelos en tiempo real a su API. GPT-Realtime-2.1-mini es un mini modelo de razonamiento para voz, con un precio similar al del anterior gpt-realtime-mini. OpenAI también redujo la latencia de p95 en al menos un 25% mediante un almacenamiento en caché mejorado. Él…
Fable 5 de Anthropic promete un poder mítico de IA, pero las restricciones sorpresa me hacen preguntarme si es más problemático de lo que vale para el uso diario.
URL del artículo: https://xcancel.com/i/article/2072830533739192560 URL de comentarios: https://news.ycombinator.com/item?id=48792463 Puntos: 17 # Comentarios: 1
URL del artículo: https://github.com/openai/codex/issues/30364 URL de comentarios: https://news.ycombinator.com/item?id=48789428 Puntos: 131 # Comentarios: 41
URL del artículo: https://www.wsj.com/tech/ai/ai-data-centers-water-use-901e2902 URL de comentarios: https://news.ycombinator.com/item?id=48774246 Puntos: 18 # Comentarios: 6
La rápida expansión de la infraestructura de inteligencia artificial suele enmarcarse como un problema energético. Se prevé que los centros de datos consuman una proporción cada vez mayor de la demanda mundial de electricidad: la Agencia Internacional de Energía...
La noticia llega aproximadamente una semana después de que OpenAI anunciara su propio chip de IA personalizado en asociación con Broadcom.
Según se informa, Anthropic está en conversaciones con Samsung Electronics sobre la fabricación de un chip de IA personalizado. El proyecto aún es temprano, pero Anthropic ya ha contratado ingenieros de chips. Después del "Jalapeño" de OpenAI, otra IA importante...
El Eufy Omni S2 mejora a su predecesor con cuatro veces más potencia de succión y un rodillo de trapeador sin olor.
Nvidia actúa cada vez más como un banco central para las nuevas empresas de IA, dando forma activamente al mercado de la informática. El artículo Nvidia está financiando nuevas empresas de inteligencia artificial para aflojar el control de las grandes tecnologías sobre su negocio de chips apareció por primera vez en The…
Google intenta equilibrar las emisiones de los centros de datos de IA con esfuerzos de energía limpia.
URL del artículo: https://www.reuters.com/business/meta-sell-excess-ai-computing-capacity-via-cloud-business-bloomberg-news-reports-2026-07-01/ URL de comentarios: https://news.ycombinator.com/item?id=48759329 Puntos: 26 # Comentario…
A medida que la IA pasa del desarrollo de modelos a la inferencia de producción, la demanda informática se acelera y se desplaza hacia fábricas de IA en funcionamiento continuo que generan tokens a escala. Este cambio requiere acceso a gran escala...
Sound construyó su reputación a partir de apuestas concentradas y de alta convicción en laboratorios de inteligencia artificial líderes en su categoría, mientras que el nuevo fondo de Kutcher parece estar persiguiendo la capa subyacente de esas empresas: la infraestructura y la energía que impulsan...
Este artículo fue presentado por Melbourne Convention Bureau (MCB), con el apoyo de Business Events Australia. A medida que la inteligencia artificial acelera la demanda global de computación, está surgiendo una restricción paralela con igual...
Meta está desarrollando planes para un negocio de infraestructura en la nube, vendiendo acceso a modelos y potencia informática de IA. La medida lo enfrentaría a los grandes proveedores de la nube como Amazon Web Services, Google Cloud y Microsoft Az...
URL del artículo: https://www.bloomberg.com/news/articles/2026-07-01/meta-is-building-a-cloud-business-to-sell-excess-ai-compute URL de comentarios: https://news.ycombinator.com/item?id=48745966 Puntos: 15 # Comentarios: 11
"El lugar con el menor coste para instalar la IA será el espacio, y eso será cierto dentro de dos años, tal vez tres a más tardar", dijo el fundador de SpaceX, Elon Musk, en el Foro Económico Mundial de Davos en enero pasado, mientras su empresa...
Según un informe de The Information, OpenAI ha reducido los costes de inferencia de sus modelos de IA a más de la mitad. La compañía aplicó las optimizaciones a ChatGPT, donde la cantidad de GPU Nvidia necesarias se redujo a solo unas pocas...
Las ciencias biológicas han entrado en una era de escala computacional y, durante más de una década, NVIDIA ha creado la pila informática completa acelerada por GPU, que abarca hardware, marcos, bibliotecas, modelos, microservicios y dominios...
En esta publicación, exploramos cómo Outpost VFX logró velocidades de entrenamiento 8 veces más rápidas utilizando la infraestructura de AWS para transformar su flujo de trabajo de reemplazo de rostros, la arquitectura técnica que implementaron para superar el límite de una sola GPU...
Las autoridades taiwanesas han allanado las oficinas de Super Micro Computer y varias empresas asociadas locales. El artículo Taiwán allana las oficinas de Super Micro en una investigación sobre el contrabando de chips Nvidia a China apareció por primera vez en The…
URL del artículo: https://mrkt30.com/why-wont-europe-build-ai-data-centers-in-iceland/ URL de comentarios: https://news.ycombinator.com/item?id=48727538 Puntos: 27 # Comentarios: 22
A continuación le mostramos cómo aprovechar las capacidades de su central eléctrica cuando no se trata de una emergencia.
xFusion presentó modelos informáticos de IA empresarial escalables en ISC 2026, realizando la transición de hardware de dispositivos de vanguardia a centros de datos. Los compradores de tecnología empresarial que asistieron a la exposición de Hamburgo buscaban una producción práctica...
URL del artículo: https://decrypt.co/371877/ai-agent-nuclear-strike-civilization-vi-benchmark URL de comentarios: https://news.ycombinator.com/item?id=48712791 Puntos: 15 # Comentarios: 2
Conocer los hechos sobre la energía solar en el hogar puede ayudarte a tomar mejores decisiones informadas, ahorrar dinero y mantener la seguridad.
El fundador de 360, Zhou Hongyi, presenta dos herramientas de seguridad de IA diseñadas para competir con Mythos de Anthropic. Ya se han detectado 3.432 vulnerabilidades. Zhou admite que los modelos chinos están por detrás de los occidentales entre un 20 y un 30 por ciento, pero c...
No todo el mundo está comprando la visión de Elon Musk sobre los centros de datos orbitales.
Para aquellos que usan llms en macbook, ¿quieren entender en qué se diferencia el macbook de la GPU dedicada al ejecutar esos modelos? y como saber cuanto es capaz de ejecutar un macbook de un modelo? URL de comentarios: https://ne...
Nvidia ha dominado el mercado de chips de IA durante años, pero la era de dependencia total podría estar llegando a su fin. OpenAI acaba de compartir sus planes para darle vida a Jalapeño, su chip de inferencia personalizado creado con Broadcom, uniéndose a G...
Nvidia ha dominado el mercado de chips de IA durante años, pero la era de dependencia total podría estar llegando a su fin. OpenAI acaba de compartir sus planes para darle vida a Jalapeño, su chip de inferencia personalizado creado con Broadcom, uniéndose a G...
Los críticos de Anthropic argumentan que está acumulando poder rápidamente. La empresa dice que así es como se ve el desarrollo responsable del AI.
La decisión de MGM Studios, propiedad de Amazon, de abandonar el proyecto de cine de OpenAI es solo una parte de cómo la industria del cine y la inteligencia artificial se están entrelazando cada vez más. En el Valle del Temblor, analizamos hacia dónde se dirige todo esto.
Los aumentos de precios se deben a los costos en aumento de los chips de memoria y la escasez, pero aún hay ofertas disponibles si sabes dónde buscar.
Un-0 es una herramienta de sistema de generación de imágenes que por primera vez muestra cómo la tecnología de la empresa puede replicar sistemas de IA convencionales.
Es un mercado difícil para las GPU, pero aún así hay algunas buenas ofertas durante Amazon Prime Day. Aquí tienes las cinco que vale la pena revisar.
Para celebrar su nuevo estatus como N.° 1 en el ranking inicial de calidad de JD Power entre los fabricantes de automóviles convencionales, Ford está hablando sobre los desafíos que ha enfrentado en los últimos años, especialmente en torno a su dependencia de los sistemas automatizados...
Por qué la latencia organizacional se está convirtiendo en la mayor barrera para aprovechar plenamente los beneficios de la IA
Qualcomm avanza más en el mercado de los centros de datos con un nuevo procesador llamado Dragonfly C1000. El artículo Qualcomm entra en el mercado de los centros de datos con su propio procesador apareció primero en The Decoder.
Los transistores de nanostack de IBM podrían mejorar el rendimiento o la eficiencia energética de los chips.
La trayectoria financiera de OpenAI depende en gran medida de los costos de infraestructura, una realidad que impulsó el desarrollo del nuevo chip personalizado OpenAI Jalapeño. Desarrollado en colaboración con Broadcom, el chip específico de aplicación integ…
La carrera por el silicio se está calentando en medio de la lucha por mantenerse al día con la demanda.
Gradium lanzó dos modelos de traducción de voz en tiempo real, stt-translate y s2s-translate, que cubren inglés, francés, alemán, español y portugués en 20 pares de idiomas. Los modelos reducen el estándar de tres modelos…
Anuncio: https://openai.com/index/openai-broadcom-jalapeno-inference-... https://decrypt.co/371971/openai-broadcom-jalapeno-first-cus... https://www.cnn.com/2026/06/24/tech/openai-broadcom-jalapeno... Comentarios URL:…
En esta entrada, mostramos la arquitectura y el enfoque que utilizó Loka para resolver una frustración común: asistentes de voz robóticos y lentos que hacen que los clientes colguen el teléfono, dañando la reputación de la marca y aumentando los costos de soporte.
OpenAI acaba de revelar un nuevo chip de "procesador de inteligencia" para servidores de IA, fabricado en asociación con Broadcom. El chip, denominado Jalapeño, está diseñado para alimentar modelos de lenguaje grandes actuales y futuros, según un an…
OpenAI está añadiendo hardware personalizado a su stack tecnológico. El chip "Jalapeño", desarrollado con Broadcom, está diseñado para la inferencia de modelos de lenguaje grandes y está programado para funcionar a escala a finales de 2026. El artículo OpenAI y Broadcom u...
URL del artículo: https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ URL de comentarios: https://news.ycombinator.com/item?id=48659257 Puntos: 141 # Comentarios: 1
Los modelos de lenguaje pueden escribir prosa más clara que la mayoría de los humanos, pero pídale 100 argumentos sobre un tema y todos se agruparán juntos. La razón humana es mucho más diversa, dice el CEO de Pangram, Max Spero, y eso es lo que podría…
DFlash de la Universidad de California en San Diego reemplaza la elaboración autoregressive con un modelo de difusión de bloques ligeros para la decodificación especulativa. Elabora bloques de tokens completos en un solo paso hacia adelante y condiciona sobre características ocultas objetivo…
OpenAI y Broadcom introducen Jalapeño, un chip AI personalizado diseñado para la inferencia de LLM para mejorar el rendimiento, la eficiencia y la escalabilidad en los sistemas de IA.
Construir sistemas de IA a escala es exigente, requiere inferencia de baja latencia, búsqueda vectorial rápida, fuerte relación precio-desempeño de GPU y una infraestructura que pueda crecer sin multiplicar la complejidad operativa. La última w…
En este tutorial, construimos un pipeline de ASR y traducción de voz multilingüe con NVIDIA Canary-1B-v2. Cargamos el modelo en un entorno de ejecución con GPU, preparamos el audio en mono de 16 kHz y realizamos ASR en inglés. Luego traducimos…
Hola, quería compartir con todos ustedes un mapa interactivo de las restricciones económicas y físicas del despliegue de IA. Tiene motores macro, puntos de cuello de botella industrial y dónde se refleja eso en los mercados. He añadido 393 nodos...
Destacados en las Noticias: La tecnología de NVIDIA opera en el 81% del TOP500 y en el 90% de los sistemas nuevos en la lista. 26 sistemas del TOP500 adoptaron el CPU NVIDIA Grace, ocho más que en la lista anterior. Los ocho sistemas más rápidos en Gree…
El aumento global en amenazas cibernéticas de IA ya no es un problema lejano para los centros de datos corporativos, según una alerta pública urgente de la alianza de inteligencia más poderosa del mundo. El 22 de junio de 2026, la ciberseguridad...
Descubre cómo Omio utiliza OpenAI para impulsar experiencias de viaje conversacional, acelerar el desarrollo de productos y transformarse en una empresa nativa de IA.
La oposición pública contra los centros de datos ha subrayado su consumo de agua y energía, y ahora Nvidia resalta su afirmación de que el diseño de referencia de la generación Rubin para un centro de datos completamente refrigerado por líquido "elim…
Nvidia anunció un nuevo sistema de refrigeración que reduce el uso de agua dentro del centro de datos. Pero no hace nada para abordar el mayor uso de agua de la IA: las plantas de energía de combustibles fósiles.
Microsoft está construyendo un campus de centro de datos de aproximadamente 2 gigavatios en Pecos, Texas, uno de los mayores aumentos de capacidad en su historia. En una carta abierta, la empresa promete precios estables de energía y uso mínimo de agua, d…
JUPITER, el primer supercomputador exascale de Europa ubicado en el Forschungszentrum Jülich de Alemania, funciona con Superchips Grace Hopper de NVIDIA y red de comunicaciones InfiniBand Quantum-X800 de NVIDIA y ha tenido un año ocupado. Como el internacional…
Misión, Visión y Veritas — los nuevos supercomputadores del Laboratorio Nacional de Los Alamos (LANL) a ser construidos con HPE y NVIDIA — están utilizando las CPUs NVIDIA Vera para acelerar la discovery científica, desbloqueando la IA agente para la ciencia.…
La próxima era de la IA no estará definida únicamente por la computación. Su crecimiento estará determinado por la energía. A medida que la computación acelerada se escalan en fábricas de IA, IA agente, IA industrial, computación en la nube y IA física, incluid…
La gran tecnología está invirtiendo grandes cantidades de dinero en la construcción de centros de datos. A medida que aumenta la oposición nacional a estas instalaciones, algunos trabajadores comienzan a cuestionarse si realmente vale la pena.
Construimos un flujo de trabajo de pronóstico integral con TimeCopilot en un panel de datos reales de pasajeros de aerolíneas y una serie estacional sintética con anomalías inyectadas. Evaluamos estadísticos, de base y opcionales basados en GPU...
Hay una lógica comercial que contradice la idea de que ASML arriesgaría su licencia de exportación para armamento a un cliente chino.
Amazon SageMaker AI proporciona alojamiento de inferencias en tiempo real gestionado completamente para modelos de aprendizaje automático. Deploye un modelo a un punto final de SageMaker respaldado por una o más instancias de computación, y SageMaker se encarga de la provisión…
Juega a tus títulos favoritos de bibliotecas de juegos populares, mantén sincronizado tu progreso y vuelve a las sesiones de juego en prácticamente cualquier dispositivo. Eso es el poder del GeForce NOW, el juego en la nube. Desde proporcionar acceso a los títulos favoritos de los miembros...
Al imitar cómo opera el cerebro, la computación neuromorfológica puede usar significativamente menos energía que los chips de IA electrónicos convencionales. Sin embargo, incluso los dispositivos neuromorfológicos más sofisticados de hoy en día aún son bastante simples,...
Hace un año en NVIDIA GTC Paris en VivaTech, Francia presentó planes para avanzar en la IA local: desde nuevas fábricas de IA y capacidad de cómputo nacional hasta modelos fronterizos abiertos y plataformas industriales. Ahora, esa infraestructura de IA...
Tokenmaxxing fue la tendencia más caliente en Silicon Valley a principios de este año, con CEOs alentando a los empleados a usar IA tanto como fuera posible. Luego llegó la cuenta. Se informa que Uber se gastó todo su presupuesto anual en IA…
Tokenmaxxing fue la tendencia más popular en Silicon Valley a principios de este año, con CEOs que alentaban a los empleados a llevar el uso de IA lo más lejos posible. Luego llegó la cuenta. Se informó que Uber se gastó todo su presupuesto anual en IA...
El movimiento originalmente planeado para el lunes habría aumentado significativamente los costos de los usuarios poderosos.
Hoy, estamos emocionados de anunciar el almacenamiento en caché de imágenes de contenedor para la inferencia de Amazon SageMaker AI, el siguiente gran avance en nuestro viaje de optimización de escalabilidad más rápida. Esto acelera la latencia de extremo a extremo en un 2x para genera…
Las gafas inteligentes aún son una categoría emergente, pero el fabricante de chips Qualcomm está trabajando arduamente para mejorar el silicio que alimentará la próxima oleada de dispositivos XR: el Snapdragon Reality Elite. Aunque Qualcomm anuncia el chip hoy…
El departamento de Justicia dice que el Pentágono necesita que xAI siga utilizando sus turbinas de gas no permitidas.
Un fabricante de software de Silicon Valley y una empresa de comercio electrónico revelan a WIRED cómo están navegando el desafío emergente de la “tokenómica”.
Al final de la tensa y sin goles primera mitad de un partido de fútbol entre el equipo inglés y su rival Alemania, millones de británicos soltaron un suspiro colectivo y hicieron lo que tan a menudo hacen en momentos de estrés: Se...
Hoy, estoy hablando con Adam Bry, quien es el CEO de Skydio, el principal fabricante de drones autónomos de EE. UU. Antes de grabar este episodio, realmente pude operar de forma remota uno de los drones de Skydio en el Área de la Bahía desde la computadora de Adam...
Mirage, un modelo de mundo de video de Microsoft Research y varias universidades, almacena información de escena directamente en el espacio latente en lugar de en nubes de puntos basadas en píxeles. Esto reduce el tiempo de cálculo y la memoria gráfica mientras ke…
Incluso los centros de datos de tamaño moderado pueden tener un impacto local enorme.
OpenAI está negociando el arrendamiento de un centro de datos planificado de 10 gigavatios en Ohio que podría contar con el respaldo financiero de Nvidia, según The Information. El artículo OpenAI quiere su centro de datos más grande hasta el momento, y Nvidia sería...
Con una capacidad inicial de 24 megavatios, el innovador centro de datos utiliza agua de mar como sistema de refrigeración natural.
Un nuevo informe de OpenAI detalla las operaciones de influencia vinculadas a la República Popular China que utilizan IA para atacar los debates tecnológicos, las narrativas de los centros de datos, los aranceles y las afirmaciones falsas sobre ChatGPT de EE. UU.
Se estima que se necesitaron 50 gigavatios-hora para entrenar el cuarto modelo de lenguaje grande (LLM) de OpenAI, GPT-4, o el equivalente al consumo de energía anual de 5.000 hogares estadounidenses. Eso fue en 2023. Desde entonces, los recursos computacionales…
La instalación de 168 megavatios respaldará las necesidades globales de computación de IA de Meta y puede ampliarse con el tiempo.
Las GPU NVIDIA con Confidential Computing ahora se utilizan para inferencias confidenciales en Private Cloud Compute (PCC) de Apple, a medida que se expande más allá de los centros de datos de Apple hacia Google Cloud. Revelado durante la reunión anual WWDC de Apple...
En un evento celebrado hoy en San Francisco, General Motors hizo una serie de anuncios sobre las baterías de los vehículos eléctricos, el almacenamiento de energía y la resiliencia de la red frente a la creciente demanda de electricidad de los centros de datos de IA. El fabricante de automóviles y…
En esta publicación, mostramos cómo entrenar políticas de robot para el humanoide Unitree H1 con NVIDIA Isaac Lab en Amazon SageMaker AI a través de dos opciones informáticas: Amazon SageMaker HyperPod y Amazon SageMaker Training Jobs.
Cómo utiliza Notion Codex para especificaciones únicas, crear entrada de voz AI para la web y multiplicar el poder de ingeniería en equipos pequeños.
El martes, el Ayuntamiento de Seattle votará sobre la promulgación de una moratoria de un año sobre los nuevos centros de datos, sólo dos meses después de que varias empresas propusieran construir cinco centros a gran escala en la ciudad. Entre los mo…
En este tutorial, implementamos un flujo de trabajo práctico para NVIDIA cuTile Python, una interfaz de programación de GPU basada en mosaicos para núcleos estilo CUDA en Python. Preparamos un entorno compatible con Colab y comprobamos GPU, controlador, CUDA,…
Google ha encargado más de tres millones de chips de IA a Intel para 2028. Nvidia está probando la tecnología de fabricación de Intel para su próxima arquitectura Feynman. Ambos movimientos se producen cuando TSMC no puede satisfacer la demanda de chips de IA. Int…
El equipo MiMo de Xiaomi, con TileRT, lanzó MiMo-V2.5-Pro-UltraSpeed, un modo de servicio para el modelo MiMo-V2.5-Pro. Decodifica más de 1000 tokens por segundo en un modelo de 1 billón de parámetros utilizando un único nodo básico de 8 GPU.…
Con acceso a los últimos modelos de IA generativa y computación acelerada de alto rendimiento en alta demanda global, los clientes de AWS necesitan herramientas para aprovechar la disponibilidad y la capacidad del modelo en múltiples regiones de AWS, w…
NVIDIA y LG Group están construyendo una fábrica de IA para acelerar la próxima ola de negocios impulsados por IA del Grupo LG, que abarca robótica, conducción autónoma, tecnologías de centros de datos y servicios de nube GPU. La fábrica de IA demostrará…
Clive Chan, según él mismo el segundo empleado de hardware en el programa de chip personalizado de OpenAI, se mudará a Anthropic. Aporta experiencia del Autopilot ASIC de Tesla y la asociación OpenAI-Broadcom. La medida surge un…
Google lanzó Colab CLI, lo que permite a los desarrolladores y agentes de IA ejecutar código local en el tiempo de ejecución remoto de Colab GPU y TPU La publicación La nueva Colab CLI de Google permite a los desarrolladores y agentes de IA ejecutar Python en GPU y TPU de Colab remotos F...
Sakana AI ha lanzado un laboratorio de investigación dedicado a la superación personal recursiva: IA que se mejora a sí misma de forma iterativa. La startup japonesa, cofundada por el coautor de Transformer, Llion Jones, ve a RSI como una alternativa a...
El desarrollador se sintió "golpeado" y "no tuvo más remedio" que reducir el centro de datos.
NVIDIA ha lanzado Nemotron 3 Ultra, un Mamba-Transformer híbrido abierto de mezcla de expertos con un total de 550 B (55 B activos) para agentes de larga duración. Combina un contexto de 1 millón de tokens con un rendimiento de inferencia hasta ~6 veces mayor que el de la comparación...
Es posible que Meta haya encontrado una forma de reducir la enorme factura de sus centros de datos: tiendas de campaña.
Kevin O'Leary acordó reducir a la mitad el tamaño de su centro de datos planificado de 40.000 acres en Utah en medio de una creciente presión de residentes y activistas, como informó anteriormente la filial local ABC4. La estrella de Shark Tank envió una carta a...
La startup californiana lanzó la cuarta generación de su robot de asistencia en el hogar, Stretch.
Los hiperescaladores han sido objeto de escrutinio por su impacto en la calidad y disponibilidad del agua.
Las computadoras cuánticas prometen algún día resolver problemas que van más allá de las supercomputadoras más poderosas imaginables. Pero a menudo se subestima la cantidad de computación clásica que se necesita para operar estas máquinas. Como cuentan los qubits...
La nueva capacidad de los centros de datos en varias regiones facilitó la disponibilidad de GPU, lo que ayudó a reducir los índices de costos de inferencia regionales esta semana.
Cada vez más proveedores están vinculando los precios de la computación a las condiciones energéticas locales, agregando una dimensión de hora del día sobre dónde y cuándo las cargas de trabajo de IA son más baratas.
El ecosistema NVIDIA AI Cloud está acelerando la construcción global de la infraestructura de la fábrica de IA. Los socios están ampliando la capacidad para satisfacer la creciente demanda de empresas, nuevas empresas, naciones, laboratorios de inteligencia artificial y desarrolladores que escalan...
Anthropic lanzó Cowork el lunes, una nueva capacidad de agente de IA que extiende el poder de su exitosa herramienta Claude Code a usuarios no técnicos y, según expertos de la compañía, el equipo creó toda la función...
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.