Локальная нейросеть на 125 млрд параметров на видеокарте 16 ГБ: быстро, но есть ли толк?
Zero to MVP
0:00 / 0:00
Локальная нейросеть на 125 млрд параметров на видеокарте 16 ГБ: быстро, но есть ли толк?
1 735 просмотров · 3 ч назад
Zero to MVP
32,3 тыс. подписчиков
1 735 просмотров · 3 ч назад
Может ли модель со 125 миллиардами параметров работать на обычной видеокарте с 16 ГБ памяти и при этом выполнять полезную работу? Я запустил Qwen3.8-Flash-Next со Strata на RTX 4060 Ti, измерил скорость генерации и дал ей три задачи программирования возрастающей сложности, используя Raspberry Pi в качестве агента.
🖥️ Настройка
Процессор: AMD Ryzen 7
Видеокарта: RTX 4060 Ti 16 ГБ
Оперативная память: 128 ГБ
Движок: Strata (собран из исходного кода)
Агент: Pi
-------------------------------------------------------
📬 Рассылка новостей — https://weekly.blokhin.us
📋 Коллекция подсказок — https://github.com/w512/Prompt-Vault
🛠️ Strata: https://github.com/Niko1221/Strata
📺 Видео Opus 5.5 против GPT-6 Sol: • GPT-6 Sol vs Opus 5.5 — Picking My New Dai...
-------------------------------------------------------
⏱️ Таймкоды
00:00 Вступление
01:11 Как 125-байтовая модель помещается в 16 ГБ памяти Видеопамять
01:40 Начальные уровни и использование ресурсов
02:17 Скорость генерации
03:00 Сбор подсказок и агент Pi
03:21 Задача 1: Часы, секундомер, таймер
04:03 Задача 2: Пиксельный редактор
05:12 Задача 3: Иллюзия 3D-пирамиды
06:41 Впечатления
#LocalAI #LocalLLM #Qwen