Перейти к содержимому

Así Puedes Obtener 48GB de VRAM Para IA Local

Jorge Marfil

0:00 / 0:00

Así Puedes Obtener 48GB de VRAM Para IA Local

14 465 просмотров · 1 день назад
Jorge Marfil
18,9 тыс. подписчиков
14 465 просмотров · 1 день назад
48 GB de VRAM para IA local pueden salir de una tarjeta profesional, de dos RTX 3090, de varias gráficas pequeñas o de un ordenador con memoria compartida. Esa misma cifra describe montajes distintos: el programa y el coste del ordenador completo cambian cuál nos conviene. CAPÍTULOS 00:00 Dos tarjetas encima de la mesa 01:02 Lo que queremos meter 02:09 Memoria que cabe y memoria que responde 03:16 Una tarjeta profesional de cuarenta y ocho 04:10 Los nombres que se parecen 05:11 Dos tarjetas de veinticuatro 06:04 Cómo se reparte el modelo 07:09 Lo que cuenta un propietario 08:19 El ordenador alrededor de las tarjetas 09:24 Tres de dieciséis o cuatro de doce 10:33 Aprovechar tarjetas distintas 11:26 Las tarjetas de servidor 12:31 El coste de conservar software antiguo 13:24 Cuarenta y ocho gigas con a eme de 14:30 Una cuarenta noventa modificada 15:28 Memoria unificada en un Mac 16:35 Memoria compartida en un mini ordenador 17:43 La cuenta que cambia la compra 18:51 Probar antes de quedarse con la máquina ¿Qué es la VRAM para IA local? La VRAM es la memoria gráfica donde se guardan los pesos del modelo, la caché de contexto y las reservas de trabajo durante la inferencia. Una tarjeta tiene su memoria dedicada. Un motor compatible puede repartir un modelo entre varias tarjetas. En un Mac o un equipo con memoria compartida, el sistema operativo utiliza parte de la misma memoria: anunciar 48 GB en el ordenador no deja automáticamente 48 GB libres para el modelo. La capacidad dice cuánto cabe. El ancho de banda, el cálculo y el programa determinan cuánto esperamos al leer documentos y generar una respuesta. Por eso se comparan el procesamiento del prompt y la generación por separado, con el modelo, contexto y ajustes de cada prueba. QUÉ CUBRE ESTE VÍDEO • Un modelo denso de 70.000 millones de parámetros a cuatro bits da 35 GB decimales de pesos brutos; faltan los metadatos, la caché y el espacio del programa. • Las tarjetas de 48 GB incluyen RTX A6000, RTX 6000 Ada, Quadro RTX 8000, variantes de RTX Pro 5000 y Radeon Pro W7900. Hay que identificar generación y soporte. • Dos RTX 3090 de 24 GB suman 48 GB. También llegan tres tarjetas de 16 GB o cuatro de 12 GB, con más dispositivos que instalar y comunicar. • La RTX 5090 normal tiene 32 GB. Un reparto entre tarjetas diferentes depende de que el motor admita esa combinación y sus proporciones. • Las A40 y L40S tienen 48 GB; dos Tesla P40 de 24 GB llegan al objetivo y dos MI50 de 32 GB lo superan. La ventilación y las versiones compatibles importan. • La RTX 4090 modificada de 48 GB requiere comprobar la unidad, el programa, el driver, la garantía y las condiciones de devolución del vendedor. • La memoria unificada del Mac y la compartida de Strix Halo también alojan al sistema. La documentación de Strix Halo permite reservar hasta 48 GB para gráficos en un sistema de 64 GB. • Un presupuesto hipotético de 2.000 $ frente a una oferta de 2.600 $ deja 600 $ de diferencia. El ejemplo eléctrico da 9,60 $ al mes y 62,5 meses de recuperación. • Alquilar una A6000 a 0,33 $ o 0,53 $ por hora permite probar el trabajo antes de comprar: veinte horas dan 6,60 $ o 10,60 $, sin almacenamiento. La ejecución es remota. Las cifras de rendimiento de la comunidad son experiencias de usuarios individuales, ilustrativas y no promedios. Los presupuestos y el consumo eléctrico son supuestos para seguir el cálculo, no precios actuales de mercado. #IALocal #VRAM #RTX3090 #MemoriaUnificada #StrixHalo