Перейти к содержимому

Выберите не ту модель Gemma 4, и вы подумаете, что она сломана | Сравнение ЧЕТЫРЕХ моделей!

DIY Smart Code

0:00 / 0:00

Выберите не ту модель Gemma 4, и вы подумаете, что она сломана | Сравнение ЧЕТЫРЕХ моделей!

56 717 просмотров · 5 месяцев назад
DIY Smart Code
29 тыс. подписчиков
56 717 просмотров · 5 месяцев назад
Gemma 4 только что вышла, и существует ЧЕТЫРЕ версии — выбрав не ту для своего оборудования, вы подумаете, что модель неисправна. В этом обзоре Gemma 4 подробно рассматриваются все четыре модели с открытым исходным кодом — E2B, E4B, средняя модель на 26 байт и флагманская модель на 31 байт — с реальными показателями памяти, сравнительными тестами и инструментами, которые вы будете использовать для запуска Gemma 4 локально на Windows, Mac, Linux или вашем телефоне. Выпущенная 2 апреля 2026 года под Apache 2.0, Gemma 4 — это самый большой шаг Google в области открытых весов: архитектура Mixture of Experts, многомодальный ввод и математический бенчмарк, в котором решается от 1 из 5 до 9 из 10 задач. Если вы ждали настоящую бесплатную альтернативу ChatGPT, которую можно запускать в автономном режиме, то это она. ---- 🚀 СООБЩЕСТВО DYNAMOUSE AI Хотите изучить агентное программирование с помощью ежедневных онлайн-мероприятий и мастер-классов? Посмотрите Dynamous AI: https://dynamous.ai/?code=646a60 Получите скидку 10% здесь 👉 https://shorturl.smartcode.diy/dynamo... ⚡ HOSTINGER — НАДЕЖНЫЙ ХОСТИНГ ДЛЯ ВАШИХ ПРОЕКТОВ Если вы используете инструменты ИИ, вы в конечном итоге развертываете их где-то. Я использую Hostinger для быстрого и доступного VPS + веб-хостинга. 👉 https://hostinger.com/DIYSMARTCODE (Партнерская ссылка — для вас это ничего не стоит, но канал поддерживается.) ---- Внутри вы найдете: Объяснение каждой версии Gemma 4 в зависимости от уровня оборудования (телефон, ноутбук с 8 ГБ, компьютер с 24 ГБ, рабочая станция) Активные и общие параметры — почему цифры расходятся Значительный скачок производительности по сравнению с прошлым годом — решено от 1 из 5 до 9 из 10 математических задач Место каждой модели Gemma 4 в независимом рейтинге LMArena Бесплатный трюк для повышения скорости на 29%, который объединяет большие и маленькие модели Какой именно инструмент — Ollama, LM Studio, llama.cpp или vLLM — использовать для каждой ОС 3 способа решения проблем с настройкой, которые отличают «отлично» от «почему у меня так медленно?» — 30-секундное дерево решений для выбора уровня 🎯 Лучшая модель Gemma 4 для вашей конфигурации: Gemma 4 на iPhone/Android — выбирайте E2B Gemma 4 на Mac (серия M, 8–16 ГБ) — E4B — оптимальный вариант Gemma 4 с Ollama на 24 ГБ видеокарты — средняя модель 26B Gemma 4 в LM Studio на рабочей станции — флагманская модель 31B Хотите работать в автономном режиме и в приватном режиме? Все четыре модели работают без подключения к интернету. 📱 Больше о Gemma на канале: Запуск Gemma на мобильном устройстве (полное руководство):    • Gemma 4 Brings Advanced AI to Your Mobile ...   Apache 2.0 — важнее, чем показывают бенчмарки:    • The Gemma Family Evolution Nobody Expected...   Это Gemma 4 (краткий обзор):    • Gemma 4 Just Released - Whats In? In 2026!   Главы 0:00 Обзор моделей Gemma 4 0:06 Почему большинство людей выбирают неправильную версию 0:29 Четыре версии, выпущенные Google (апрель 2026 г.) 0:55 E2B — та, что помещается на телефоне 1:35 E4B — та, что работает на 8 ГБ 2:13 Средняя модель 26B — скорость и качество 3:08 Флагман 31B — король бенчмарков 4:37 Бесплатная версия Трюк с 29% ускорением 5:12 Как запустить это на вашей ОС 5:52 Почему ваша ОС может работать медленнее, чем показывают бенчмарки 6:51 Выберите свой уровень менее чем за 30 секунд 7:26 Заключение и 3 коротких ролика о Gemma 🔗 Ресурсы Анонс Google Gemma 4: https://blog.google/technology/develo... Модель Gemma 4 (Google AI): https://ai.google.dev/gemma/docs/core... Ollama: https://ollama.com LM Studio: https://lmstudio.ai llama.cpp: https://github.com/ggml-org/llama.cpp vLLM: https://docs.vllm.ai Независимая таблица лидеров: https://lmarena.ai Перекванты Unsloth (HuggingFace): https://huggingface.co/unsloth Исправление токенизатора в llama.cpp (PR #21343): https://github.com/ggml-org/llama.cpp... Двойная модель (31B + E2B): Например, возможно с помощью https://lmstudio.ai/docs/app/advanced... 💬 Какую версию Gemma 4 вы используете? Флагманскую 31B, оптимальную 26B, E4B на ноутбуке или E2B на телефоне? Укажите вашу конфигурацию и количество токенов в секунду ниже. 🔔 Подписывайтесь, чтобы получать больше честных, ориентированных на спецификацию разборов моделей ИИ:    / @diysmartcode   #Gemma4 #LocalLLM #Ollama #LMStudio #OpenSourceAI #RunAILocally #OfflineAI #FreeAI #GoogleGemma #LlamaCpp #vLLM #Apache2 #MixtureOfExperts #MultimodalAI #PrivateAI #LocalChatGPT #AppleSilicon #RaspberryPi #NVIDIA #AICommunity #Unsloth #AITools2026