Перейти к содержимому

Локальная нейросеть на 125 млрд параметров на видеокарте 16 ГБ: быстро, но есть ли толк?

Zero to MVP

0:00 / 0:00

Локальная нейросеть на 125 млрд параметров на видеокарте 16 ГБ: быстро, но есть ли толк?

1 735 просмотров · 3 ч назад
Zero to MVP
32,3 тыс. подписчиков
1 735 просмотров · 3 ч назад
Может ли модель со 125 миллиардами параметров работать на обычной видеокарте с 16 ГБ памяти и при этом выполнять полезную работу? Я запустил Qwen3.8-Flash-Next со Strata на RTX 4060 Ti, измерил скорость генерации и дал ей три задачи программирования возрастающей сложности, используя Raspberry Pi в качестве агента. 🖥️ Настройка Процессор: AMD Ryzen 7 Видеокарта: RTX 4060 Ti 16 ГБ Оперативная память: 128 ГБ Движок: Strata (собран из исходного кода) Агент: Pi ------------------------------------------------------- 📬 Рассылка новостей — https://weekly.blokhin.us 📋 Коллекция подсказок — https://github.com/w512/Prompt-Vault 🛠️ Strata: https://github.com/Niko1221/Strata 📺 Видео Opus 5.5 против GPT-6 Sol:    • GPT-6 Sol vs Opus 5.5 — Picking My New Dai...   ------------------------------------------------------- ⏱️ Таймкоды 00:00 Вступление 01:11 Как 125-байтовая модель помещается в 16 ГБ памяти Видеопамять 01:40 Начальные уровни и использование ресурсов 02:17 Скорость генерации 03:00 Сбор подсказок и агент Pi 03:21 Задача 1: Часы, секундомер, таймер 04:03 Задача 2: Пиксельный редактор 05:12 Задача 3: Иллюзия 3D-пирамиды 06:41 Впечатления #LocalAI #LocalLLM #Qwen