Перейти к содержимому

El Hardware Para IA Local Acaba De Encarecerse Muchísimo

Jorge Marfil

0:00 / 0:00

El Hardware Para IA Local Acaba De Encarecerse Muchísimo

31 196 просмотров · 21 ч назад
Jorge Marfil
19,3 тыс. подписчиков
31 196 просмотров · 21 ч назад
El hardware para IA local se ha encarecido muchísimo: el Nvidia DGX Spark ha pasado de 3.999 $ en su lanzamiento a 6.950 $, un 74 % más, y un mini PC Strix Halo de 128 GB o un Mac Studio con M5 Max tampoco se quedan atrás. En este vídeo compruebo cada precio a 6 de octubre de 2026 y mido qué te da de verdad cada máquina en tokens por segundo. CAPÍTULOS 00:00 Los precios que ya no existen 01:21 Cuánto ha subido cada máquina 02:51 La cuenta que decide la velocidad 04:54 Strix Halo, lo más barato que funciona 07:03 El Mac Studio con M5 Max 08:55 El DGX Spark, ahora a 6.950 11:31 ¿Qué pesa más en tu día, leer o escribir? 12:21 Las cuatro MI50 de 600 dólares 15:19 Lo que dan de verdad varias gráficas 16:53 ¿Hacen falta 128 GB? 18:11 Cuánto cuesta cada token por segundo 19:20 Comprar o alquilar, y de dónde salen los números 21:18 Qué compraría cada uno ¿Qué es el hardware para IA local? El hardware para IA local es un ordenador con memoria suficiente y rápida para cargar un modelo de lenguaje grande y ejecutarlo en casa, sin ningún servicio en la nube de por medio. La capacidad de la memoria decide qué modelos caben, y su ancho de banda decide cuántos tokens por segundo consigues, así que una máquina barata con memoria lenta y otra cara con memoria rápida pueden salir igual de caras por cada token. Qué cubre este vídeo • Los precios del 6 de octubre de 2026 para una máquina de 128 GB: un mini PC Bosgame M5 a 3.099 $, un Mac Studio M5 Max a 5.099 $ y un DGX Spark a 6.950 $, agotado en la tienda de Nvidia. • El DGX Spark pasó de 3.999 $ al salir a 6.950 $, un 74 % más, y la versión de 64 GB arranca en 4.999 $. • Strix Halo tiene 256 GB/s de ancho de banda de memoria sobre el papel y unos 215 GB/s medidos, lo que limita un modelo denso de 70B de 42 GB a unos 5 tokens por segundo. • gpt-oss-120b va a 55,57 tokens por segundo en un mini PC Strix Halo, porque es un modelo de mezcla de expertos que activa solo 5.100 millones de parámetros por token. • El Mac Studio M5 Max tiene 614 GB/s de ancho de banda, y pasar de 64 GB a 128 GB suma 1.600 $, a 25 $ por cada giga extra. • Leer un contexto de 30.000 tokens tarda 102 segundos en Strix Halo y 19 en el DGX Spark: 83 segundos de diferencia por turno, que en 100 turnos de un agente de programación son 2,3 horas. • Cuatro MI50 de segunda mano limitadas a 180 W más el equipo anfitrión consumen 0,87 kW, unos 190 $ al año a cuatro horas diarias, frente a unos 38 $ de una caja Strix Halo. • Tres RTX 3090 de segunda mano suponen 4.248 $ con la oferta más barata de hoy, frente a 3.057 $ en marzo, y todavía sin el equipo anfitrión. • Lo que cuesta cada token por segundo con gpt-oss-120b: 55,8 $ en el Bosgame M5, 58 $ en el Mac Studio M5 Max y 68,4 $ en el Minisforum MS-S1 MAX. Las pocas cifras que proceden de publicaciones de la comunidad son experiencias de usuarios concretos, ilustrativas, no medias. #ialocal #dgxspark #strixhalo #macstudio #llmlocal