Gemma: какую модель выбрать на самом деле?
Samuel Gregory
0:00 / 0:00
Gemma: какую модель выбрать на самом деле?
7 827 просмотров · 2 месяца назад
Samuel Gregory
17 тыс. подписчиков
7 827 просмотров · 2 месяца назад
█▀█ █▀▀ ▄▀█ █▀▄ █▀▄▀█ █▀█ █▀█ █▀▀
█▀▄ ██▄ █▀█ █▄▀ █ ▀ █ █▄█ █▀▄ ██▄
Gemma 4 - https://deepmind.google/models/gemma/...
Перестаньте арендовать свой интеллект в облаке и начните владеть им. В этом видео рассматривается пакет Gemma от Google — набор моделей искусственного интеллекта с открытым исходным кодом, разработанных для работы на уже имеющемся у вас оборудовании. От молниеносной модели 2B для мобильных устройств до высокоинтеллектуальной модели 31B с высокой плотностью — мы разберем, какая версия подходит именно для ваших бизнес-процессов. Мы проверим их логику на сложных задачах и продемонстрируем, как настроить частный сервер ИИ на MacBook с использованием MLX и Open Web UI.
Основные выводы:
Понимание разницы между моделями Mixture of Experts (MoE) и Dense для бизнес-задач.
Почему модель 12B является оптимальным вариантом для профессиональных пользователей ноутбуков.
Как обойти проблемы конфиденциальности в облаке, разместив ИИ локально.
Сравнение производительности, показывающее, почему более крупные модели необходимы для фактической точности.
Пошаговый обзор технологического стека OMLX и Open Web UI.
Подробнее: https://samuelgregory.co.uk/videos/ev...
Руководство для начинающих по локальному ИИ -
https://samuelgregory.co.uk/videos/to...
--
Сотрудничество со мной: https://samuelgregory.co.uk
Оборудование:
14-дюймовый MacBook Pro M5 Max, 128 ГБ ОЗУ, 40-ядерный графический процессор, 2 ТБ SSD
Сервер: OpenCode / Claude Code
Сервер: oMLX
Поддержите контент: / 0x5am5
Twitter: @0x5am5
$ cat tools.txt
─────────────────────────────────
Kilo: https://samuelgregory.co.uk/kilo-code
Replit (любимый инструмент для создания Vibe Code): https://samuelgregory.co.uk/replit
Perplexity (глубокое исследование): https://samuelgregory.co.uk/perplexity
Claude Code: https://claude.ai/api/referral/jZ9vnM...
Warp Terminal: https://samuelgregory.co.uk/warp
⚒️ Подробнее на https://samuelgregory.co.uk/tools
$ cat services.txt
─────────────────────────────────
Доменные имена: https://samuelgregory.co.uk/namecheap
Хостинг: https://www.hostg.xyz/aff_c?offer_id=...
Онлайн-хранилище (кредит 200$): https://samuelgregory.co.uk/digital-o...
⚒️ Подробнее на https://samuelgregory.co.uk/tools
$ cat gear.txt
─────────────────────────────────
Sony A7c II: https://amzn.to/40qaYEJ
Объектив Sigma 16-28mm: https://amzn.to/3IaDzqx
Микрофон Samson QU2: https://amzn.to/3TkshCE
Macbook Pro M1 Max: https://amzn.to/48736M6
$ cat books.txt
────────────────────────────────
The Full Stack Agency: https://flowst8.dev/store
Lingo: Agile: https://thefullstackagency.gumroad.co...
Lingo: Startup: https://thefullstackagency.gumroad.co...
$ cat timestamps.txt
─────────────────────────────────
00:00 Jemma 4 предназначена для локального запуска
00:57 Полное семейство моделей (плотные против MoE)
03:25 Представлена 12-битная модель
04:02 Когда использовать ту или иную модель
05:52 Сравнение с Qwen
06:05 В заключение
06:40 Загрузка моделей (oMLX)
07:50 Тестирование скорости в пользовательском интерфейсе OpenWeb
10:10 Тест интеллекта всех плотных моделей
13:00 Gemma 4 26B MoE в Открытый код
#LocalAI #GoogleGemma #TechLeadership