Suministro de computación, GPU, centros de datos y energía: la capa física que decide qué tan barato funciona la IA.
historias 52
El suministro de computación, la energía y la capacidad de los centros de datos deciden qué tan barato puede funcionar la IA. Los cambios en la infraestructura aparecen en los costos de inferencia semanas después.
TorchServe ya no se mantiene, lo que deja a los equipos en posesión de toda la pila de inferencia de GPU. El contenedor de aprendizaje profundo AWS Ray Serve es un contenedor compatible y probado previamente con el marco, los controladores de GPU y la capa de servicio...
Kepler Computing afirma que un nuevo enfoque para el diseño de chips (y un material patentado) puede ayudar a poner fin a los cuellos de botella en el suministro que han disparado los precios de las memorias.
La Patagonia argentina está atrayendo la atención como posible sitio para grandes centros de datos de IA. El artículo La Patagonia tiene lo que quieren los centros de datos de IA, incluida ninguna resistencia hasta el momento apareció por primera vez en The Decoder.
ASML se ha ganado a Samsung, TSMC e Intel para cambiar a fotomáscaras más grandes, lo que debería aumentar el rendimiento de sus máquinas EUV más nuevas en un 40 por ciento. Mientras tanto, Huawei está orquestando la contraestrategia de China, apuntando...
El modelo de pronóstico meteorológico de inteligencia artificial más nuevo de Google predice la velocidad del viento a 100 metros sobre el suelo, aproximadamente la altura de una turbina eólica moderna. También pronostica la cobertura de nubes y cuánta luz solar llega a la superficie, y...
URL del artículo: https://newsroom.arm.com/blog/arm-mali-g2-ultra-nx-ai-native-mobile-graphics URL de comentarios: https://news.ycombinator.com/item?id=49605511 Puntos: 43 # Comentarios: 26
URL del artículo: https://www.bbc.com/news/articles/c0m39g7xzevo URL de comentarios: https://news.ycombinator.com/item?id=49604956 Puntos: 15 # Comentarios: 14
URL del artículo: https://www.ft.com/content/ea9a9dcc-b1df-49b0-b80c-f320161b9efa URL de comentarios: https://news.ycombinator.com/item?id=49593778 Puntos: 18 # Comentarios: 9
URL del artículo: https://rocm.blogs.amd.com/ecosystems-and-partners/rocm-x-blog/README.html URL de comentarios: https://news.ycombinator.com/item?id=49592508 Puntos: 15 # Comentarios: 0
Los agentes de investigación de IA pueden proponer muchos más experimentos de los que pueden permitirse realizar. Meta FAIR, Oxford y UCL presentan modelos de preferencia de investigación de IA: jueces de LLM congelados que clasifican a 15 candidatos no ejecutados y solo ejecutan...
Las encuestas muestran que una abrumadora mayoría de estadounidenses odia los centros de datos. China es un chivo expiatorio perfecto para los líderes tecnológicos y sus aliados; el único problema es la falta de pruebas.
La calidad de la recuperación en un producto de búsqueda de IA está limitada por dos cosas: qué tan bueno es el modelo de incrustación y qué tan económico se puede ejecutar en un índice. Esta semana, el equipo de Perplexity Engineering publicó Fast Embeddings en GP...
Nous Research ha reducido la configuración del modelo local en un solo clic en Hermes Desktop. La aplicación lee su hardware, compara el catálogo con su GPU, elige la versión de mayor calidad que se adapta, la descarga y con...
Deepseek quiere colocar 160.000 chips Huawei Ascend-950DT en un centro de datos de Mongolia Interior sólo para realizar inferencias, no para entrenamiento. Sería el mayor grupo de chips de Huawei conocido. Pero los cuellos de botella en la producción significan problemas para Huawei...
Quedan menos de 24 horas para postularse para organizar un evento paralelo durante TechCrunch Disrupt 2026 y dejar su huella en la escena de Silicon Valley. Presente su solicitud antes de que se cierre esta noche a la medianoche, hora del Pacífico.
El centro HomeAgent H100 Pro de Ugreen combina almacenamiento local, inteligencia artificial en el dispositivo y un nuevo asistente de voz, Uliya, para administrar su hogar inteligente. | Foto de Jennifer Pattison Tuohy / The Verge Ugreen, conocido por sus bancos de energía para teléfonos, cha...
El PAIR (Personal AI Router) de Nvidia distribuye automáticamente las solicitudes de IA locales entre todos los dispositivos disponibles en una red doméstica, lo que reduce los tiempos de espera para las tareas paralelas de los agentes. El artículo Nvidia quiere que su red doméstica funcione...
Perplexity ha enviado computación híbrida para su aplicación Mac, dividiendo una única tarea de Perplexity Computer entre modelos fronterizos en la nube y un modelo compacto que se ejecuta en la máquina del usuario. Las tareas comienzan en la nube para el mar…
Nvidia anuncia su nuevo Personal AI Router (PAIR), una herramienta gratuita que sincroniza las computadoras de su hogar para abordar tareas de inferencia de IA local con herramientas como Ollama y LM Studio. Dejemos de lado lo obvio...
Sam Altman advierte sobre "tonterías insostenibles" en la construcción global de centros de datos de IA. Demasiados proveedores de Neocloud están anunciando una capacidad masiva sin que los clientes la respalden. También admite que la caída de la informática...
El presidente Trump ha respondido con fuerza a la creciente oposición a los centros de datos de IA en todo Estados Unidos. El artículo Las protestas contra los centros de datos de IA le hacen el juego a China, dice Trump, apareció por primera vez en The Decoder.
Hace poco más de una década, dirigí el diseño de controles para un sistema de control totalmente digital, el primero de su tipo, para una planta nuclear de Estados Unidos. Era, sobre el papel, una hermosa máquina, diseñada para funcionar sola como una aerolínea moderna...
La mayoría de las pilas de voz de producción son tres sistemas unidos. Un modelo transcribe, un segundo separa a los hablantes y un detector decide cuándo el usuario dejó de hablar. Cada transferencia agrega latencia y un nuevo mo...
Los asistentes agentes tienen un problema estructural: el contexto que los hace útiles (documentos de negocios, archivos privilegiados, registros de clientes) es exactamente el contexto que los usuarios no pueden enviar a un punto final en la nube. Esta semana, Perplexity s…
Si posee un servidor en casa, una computadora para juegos o simplemente una computadora portátil que no recibe mucho cariño, escuche. Ahora puede utilizar esa potencia informática adicional y obtener algunos ingresos pasivos en el proceso. Las empresas de IA son enormes...
Nvidia lanzará oficialmente DLSS 5 esta semana, luego de un anuncio divisivo en marzo en el que comparamos la tecnología de mejora de la IA con un "filtro de IA generativo en tiempo real para videojuegos" y un "suavizado de movimiento para videojuegos...
Los agentes de voz fallan en latencia mucho antes de que fallen en inteligencia. El tiempo hasta el primer token es la métrica que utilizan la mayoría de los equipos para elegir una API de inferencia, y es el punto de partida correcto y el punto de parada incorrecto. Este banco...
La empresa está probando robots en tareas que pueden realizar los técnicos.
La nueva generación de sistemas de centros de datos está aumentando la eficiencia con un control de tráfico más inteligente en lugar de simplemente más ciclos de procesador.
La grabadora de voz Comulytic Note Pro AI incluye mucha potencia en un dispositivo del tamaño de una tarjeta de crédito. Pero su utilidad depende de ti.
Así como los nuevos centros de datos enfrentan una creciente reacción de las comunidades vecinas, la Agencia de Protección Ambiental de EE. UU. (EPA) está a punto de hacer que sea más difícil para las personas opinar sobre la contaminación que crean esos centros. La EPA…
La compañía está probando robots que pueden intercambiar cables, restablecer servidores y asumir otras tareas realizadas por técnicos, lo que genera preocupaciones entre algunos trabajadores de que sus trabajos podrían estar en riesgo.
La industria tecnológica está perpleja por el plan de Trump de ganar la carrera de la IA imponiendo impuestos a los centros de datos.
La IA de voz autohospedada conlleva un compromiso de observabilidad: los números que impulsan la planificación de la capacidad y la gestión de costos permanecen encerrados dentro del contenedor del proveedor. Deepgram cierra esa brecha en Amazon SageMaker AI con dos ca...
Ofrecer modelos de reconocimiento automático de voz (ASR) a escala es costoso cuando cada solicitud utiliza solo una fracción de una GPU. Descubra cómo el servicio multiproceso (MPS) NVIDIA CUDA con el servidor de inferencia NVIDIA Triton en Amazon EC2 G...
Google está estableciendo nuevos límites de uso de memoria para las aplicaciones de Android, ya que los centros de datos de IA contribuyen a la escasez de hardware que podría dejar a los teléfonos de menor costo con menos memoria.
Hoy en Decoder, estoy hablando con el reportero senior de IA de Verge, Hayden Field, sobre un cebo puro de Decoder: los cambios aparentemente interminables en el organigrama de OpenAI y cómo todos ellos parecen consolidar el poder bajo el cofundador Greg...
Tiene preguntas sobre los centros de datos y WIRED tiene respuestas. Únase a nuestra transmisión en vivo el 10 de septiembre y nuestro panel de expertos le dirá todo lo que necesita saber.
El nuevo Gemini 3.5 Transcribe de Google reconoce más de 85 idiomas, elimina las palabras de relleno y corrige los errores lingüísticos en tiempo real. Alcanza una tasa de error de palabras del 4,0 por ciento en modo de transmisión, con una latencia un 70 por ciento menor...
Amazon agregará otros 2 millones de chips GPU Nvidia a sus centros de datos durante los próximos dos años. Pero esta ampliación de las asociaciones va más allá de la compra de más chips.
La próxima ola de IA está imponiendo nuevas exigencias a la infraestructura. A medida que los agentes de IA y las cargas de trabajo de billones de parámetros se vuelven comunes, el rendimiento de la infraestructura de IA depende no solo de la computación, sino también de cómo la computación, la memoria...
SageMaker Python SDK v3 rediseña el modo script con clases unificadas ModelTrainer y ModelBuilder. Esta publicación analiza dos ejemplos de un extremo a otro, un Random Forest de scikit-learn y un Stable Diffusion 3.5 Lo de múltiples GPU...
No puede tratarse sólo de recolectar energía solar, sino también de almacenarla y trasladar la energía barata y fuera de las horas pico a momentos en que es más cara.
Antes de que Malone se fuera, OpenAI ya había reorganizado su organización de infraestructura, alejando su línea jerárquica del presidente Greg Brockman y poniendo al vicepresidente Sachin Katti a cargo del grupo.
URL del artículo: https://www.wsj.com/tech/ai/openais-head-of-data-centers-has-left-company-6d24fd83 URL de comentarios: https://news.ycombinator.com/item?id=49439489 Puntos: 27 # Comentarios: 9
OpenAI ha interrumpido una campaña encubierta de influencia rusa que utilizaba ChatGPT para generar publicaciones en las redes sociales al prohibir un grupo de cuentas. Los operadores accedieron a la plataforma a través de VPN desde Rusia y promocionaron la f…
OpenAI mostró "Jalapeño", su primer chip de inferencia interno, con puntos de referencia en la conferencia Hot Chips. Según las pruebas de SemiAnalysis, el chip supera al Blackwell de Nvidia e incluso al Rubin en rendimiento y eficiencia energética...
Entrenar y servir modelos de frontera es ahora un problema de red tanto como un problema de computación. Operaciones colectivas como reducción total y sincronización total de miles de aceleradores durante el entrenamiento, y el más lento...
El Mac Studio con el M5 Ultra contará con hasta 512 GB de memoria unificada y controlará hasta ocho pantallas externas.
Probado en el punto de referencia InferenceX de SemiAnalysis, Jalapeño registró más tokens por usuario y más rendimiento por kilovatio que la tecnología de punta actualmente disponible.
OpenAI dice que su nuevo chip de IA, Jalapeño, completa las tareas de manera más eficiente y devuelve respuestas más rápido que otros sistemas de IA, según una publicación de blog publicada el martes. Durante una sesión informativa con periodistas, OpenAI hardware...
URL del artículo: https://www.apple.com/newsroom/2026/08/apple-introduces-m6-and-m5-ultra-for-a-big-leap-in-performance-and-ai-compute/ URL de comentarios: https://news.ycombinator.com/item?id=49433292 Puntos: 443 # Comentarios: 364
Los resúmenes se agregan únicamente con fines informativos; siga el enlace fuente para ver la historia completa. Las entradas de demostración son ilustrativas.