El Hardware Para IA Local Acaba De Encarecerse Muchísimo
Jorge Marfil
0:00 / 0:00
El Hardware Para IA Local Acaba De Encarecerse Muchísimo
31 196 просмотров · 21 ч назад
Jorge Marfil
19,3 тыс. подписчиков
31 196 просмотров · 21 ч назад
El hardware para IA local se ha encarecido muchísimo: el Nvidia DGX Spark ha pasado de 3.999 $ en su lanzamiento a 6.950 $, un 74 % más, y un mini PC Strix Halo de 128 GB o un Mac Studio con M5 Max tampoco se quedan atrás. En este vídeo compruebo cada precio a 6 de octubre de 2026 y mido qué te da de verdad cada máquina en tokens por segundo.
CAPÍTULOS
00:00 Los precios que ya no existen
01:21 Cuánto ha subido cada máquina
02:51 La cuenta que decide la velocidad
04:54 Strix Halo, lo más barato que funciona
07:03 El Mac Studio con M5 Max
08:55 El DGX Spark, ahora a 6.950
11:31 ¿Qué pesa más en tu día, leer o escribir?
12:21 Las cuatro MI50 de 600 dólares
15:19 Lo que dan de verdad varias gráficas
16:53 ¿Hacen falta 128 GB?
18:11 Cuánto cuesta cada token por segundo
19:20 Comprar o alquilar, y de dónde salen los números
21:18 Qué compraría cada uno
¿Qué es el hardware para IA local?
El hardware para IA local es un ordenador con memoria suficiente y rápida para cargar un modelo de lenguaje grande y ejecutarlo en casa, sin ningún servicio en la nube de por medio. La capacidad de la memoria decide qué modelos caben, y su ancho de banda decide cuántos tokens por segundo consigues, así que una máquina barata con memoria lenta y otra cara con memoria rápida pueden salir igual de caras por cada token.
Qué cubre este vídeo
• Los precios del 6 de octubre de 2026 para una máquina de 128 GB: un mini PC Bosgame M5 a 3.099 $, un Mac Studio M5 Max a 5.099 $ y un DGX Spark a 6.950 $, agotado en la tienda de Nvidia.
• El DGX Spark pasó de 3.999 $ al salir a 6.950 $, un 74 % más, y la versión de 64 GB arranca en 4.999 $.
• Strix Halo tiene 256 GB/s de ancho de banda de memoria sobre el papel y unos 215 GB/s medidos, lo que limita un modelo denso de 70B de 42 GB a unos 5 tokens por segundo.
• gpt-oss-120b va a 55,57 tokens por segundo en un mini PC Strix Halo, porque es un modelo de mezcla de expertos que activa solo 5.100 millones de parámetros por token.
• El Mac Studio M5 Max tiene 614 GB/s de ancho de banda, y pasar de 64 GB a 128 GB suma 1.600 $, a 25 $ por cada giga extra.
• Leer un contexto de 30.000 tokens tarda 102 segundos en Strix Halo y 19 en el DGX Spark: 83 segundos de diferencia por turno, que en 100 turnos de un agente de programación son 2,3 horas.
• Cuatro MI50 de segunda mano limitadas a 180 W más el equipo anfitrión consumen 0,87 kW, unos 190 $ al año a cuatro horas diarias, frente a unos 38 $ de una caja Strix Halo.
• Tres RTX 3090 de segunda mano suponen 4.248 $ con la oferta más barata de hoy, frente a 3.057 $ en marzo, y todavía sin el equipo anfitrión.
• Lo que cuesta cada token por segundo con gpt-oss-120b: 55,8 $ en el Bosgame M5, 58 $ en el Mac Studio M5 Max y 68,4 $ en el Minisforum MS-S1 MAX.
Las pocas cifras que proceden de publicaciones de la comunidad son experiencias de usuarios concretos, ilustrativas, no medias.
#ialocal #dgxspark #strixhalo #macstudio #llmlocal