Перейти к содержимому

Gemma: какую модель выбрать на самом деле?

Samuel Gregory

0:00 / 0:00

Gemma: какую модель выбрать на самом деле?

7 827 просмотров · 2 месяца назад
Samuel Gregory
17 тыс. подписчиков
7 827 просмотров · 2 месяца назад
█▀█ █▀▀ ▄▀█ █▀▄ █▀▄▀█ █▀█ █▀█ █▀▀ █▀▄ ██▄ █▀█ █▄▀ █ ▀ █ █▄█ █▀▄ ██▄ Gemma 4 - https://deepmind.google/models/gemma/... Перестаньте арендовать свой интеллект в облаке и начните владеть им. В этом видео рассматривается пакет Gemma от Google — набор моделей искусственного интеллекта с открытым исходным кодом, разработанных для работы на уже имеющемся у вас оборудовании. От молниеносной модели 2B для мобильных устройств до высокоинтеллектуальной модели 31B с высокой плотностью — мы разберем, какая версия подходит именно для ваших бизнес-процессов. Мы проверим их логику на сложных задачах и продемонстрируем, как настроить частный сервер ИИ на MacBook с использованием MLX и Open Web UI. Основные выводы: Понимание разницы между моделями Mixture of Experts (MoE) и Dense для бизнес-задач. Почему модель 12B является оптимальным вариантом для профессиональных пользователей ноутбуков. Как обойти проблемы конфиденциальности в облаке, разместив ИИ локально. Сравнение производительности, показывающее, почему более крупные модели необходимы для фактической точности. Пошаговый обзор технологического стека OMLX и Open Web UI. Подробнее: https://samuelgregory.co.uk/videos/ev... Руководство для начинающих по локальному ИИ - https://samuelgregory.co.uk/videos/to... -- Сотрудничество со мной: https://samuelgregory.co.uk Оборудование: 14-дюймовый MacBook Pro M5 Max, 128 ГБ ОЗУ, 40-ядерный графический процессор, 2 ТБ SSD Сервер: OpenCode / Claude Code Сервер: oMLX Поддержите контент:   / 0x5am5   Twitter: @0x5am5 $ cat tools.txt ───────────────────────────────── Kilo: https://samuelgregory.co.uk/kilo-code Replit (любимый инструмент для создания Vibe Code): https://samuelgregory.co.uk/replit Perplexity (глубокое исследование): https://samuelgregory.co.uk/perplexity Claude Code: https://claude.ai/api/referral/jZ9vnM... Warp Terminal: https://samuelgregory.co.uk/warp ⚒️ Подробнее на https://samuelgregory.co.uk/tools $ cat services.txt ───────────────────────────────── Доменные имена: https://samuelgregory.co.uk/namecheap Хостинг: https://www.hostg.xyz/aff_c?offer_id=... Онлайн-хранилище (кредит 200$): https://samuelgregory.co.uk/digital-o... ⚒️ Подробнее на https://samuelgregory.co.uk/tools $ cat gear.txt ───────────────────────────────── Sony A7c II: https://amzn.to/40qaYEJ Объектив Sigma 16-28mm: https://amzn.to/3IaDzqx Микрофон Samson QU2: https://amzn.to/3TkshCE Macbook Pro M1 Max: https://amzn.to/48736M6 $ cat books.txt ──────────────────────────────── The Full Stack Agency: https://flowst8.dev/store Lingo: Agile: https://thefullstackagency.gumroad.co... Lingo: Startup: https://thefullstackagency.gumroad.co... $ cat timestamps.txt ───────────────────────────────── 00:00 Jemma 4 предназначена для локального запуска 00:57 Полное семейство моделей (плотные против MoE) 03:25 Представлена ​​12-битная модель 04:02 Когда использовать ту или иную модель 05:52 Сравнение с Qwen 06:05 В заключение 06:40 Загрузка моделей (oMLX) 07:50 Тестирование скорости в пользовательском интерфейсе OpenWeb 10:10 Тест интеллекта всех плотных моделей 13:00 Gemma 4 26B MoE в Открытый код #LocalAI #GoogleGemma #TechLeadership