GLM 5.3 Flash (полное тестирование): что нужно, чтобы ЗАПУСТИТЬ ЕЁ ЛОКАЛЬНО?
AICodeKing
0:00 / 0:00
GLM 5.3 Flash (полное тестирование): что нужно, чтобы ЗАПУСТИТЬ ЕЁ ЛОКАЛЬНО?
33 933 просмотра · 2 дня назад
AICodeKing
132 тыс. подписчиков
33 933 просмотра · 2 дня назад
Посетите канал AISeeKing (второй канал с другими интересными материалами по локальному ИИ): / @aiseeking
В этом видео я расскажу вам о презентации Ox Alpha, которую Z AI официально подтвердила как GLM 5.3 Flash. Модель имеет открытые веса под лицензией MIT, чрезвычайно дешева через API и может стать одним из лучших вариантов для локального запуска модели ИИ, близкой к освоению новых технологий.
-
Основные выводы:
🚀 Z AI официально подтвердила, что скрытая модель Ox Alpha — это GLM 5.3 Flash.
🔓 GLM 5.3 Flash выпущена на Hugging Face с полными весами под лицензией MIT.
🧠 Модель представляет собой модель смешения экспертов с 320 миллиардами параметров, при этом на каждый токен приходится всего 18 миллиардов активных параметров.
💸 Цены на API чрезвычайно низкие: 15 центов за миллион входных токенов и 50 центов за миллион выходных токенов.
📊 На KingBench модель GLM 5.3 Flash набрала 63 балла из 80, что немного ниже её результата в тестовом режиме Ox Alpha.
🛠️ Она показала особенно хорошие результаты в задачах рассуждения, математики, агентного программирования и локальной тонкой настройки.
💻 Модель выглядит сильным кандидатом для локального вывода на машинах с большим объёмом памяти, таких как новые Mac и компьютеры с ИИ.
🇨🇳 Z AI подтвердила, что весь тестовый режим был запущен на китайских чипах ИИ с использованием пользовательского стека вывода на основе SGLang.
👍 В целом, GLM 5.3 Flash — впечатляющая открытая модель для недорогого использования API, локального ИИ и агентных рабочих процессов.