Перейти к содержимому

GLM 5.3 Flash (полное тестирование): что нужно, чтобы ЗАПУСТИТЬ ЕЁ ЛОКАЛЬНО?

AICodeKing

0:00 / 0:00

GLM 5.3 Flash (полное тестирование): что нужно, чтобы ЗАПУСТИТЬ ЕЁ ЛОКАЛЬНО?

33 933 просмотра · 2 дня назад
AICodeKing
132 тыс. подписчиков
33 933 просмотра · 2 дня назад
Посетите канал AISeeKing (второй канал с другими интересными материалами по локальному ИИ):    / @aiseeking   В этом видео я расскажу вам о презентации Ox Alpha, которую Z AI официально подтвердила как GLM 5.3 Flash. Модель имеет открытые веса под лицензией MIT, чрезвычайно дешева через API и может стать одним из лучших вариантов для локального запуска модели ИИ, близкой к освоению новых технологий. - Основные выводы: 🚀 Z AI официально подтвердила, что скрытая модель Ox Alpha — это GLM 5.3 Flash. 🔓 GLM 5.3 Flash выпущена на Hugging Face с полными весами под лицензией MIT. 🧠 Модель представляет собой модель смешения экспертов с 320 миллиардами параметров, при этом на каждый токен приходится всего 18 миллиардов активных параметров. 💸 Цены на API чрезвычайно низкие: 15 центов за миллион входных токенов и 50 центов за миллион выходных токенов. 📊 На KingBench модель GLM 5.3 Flash набрала 63 балла из 80, что немного ниже её результата в тестовом режиме Ox Alpha. 🛠️ Она показала особенно хорошие результаты в задачах рассуждения, математики, агентного программирования и локальной тонкой настройки. 💻 Модель выглядит сильным кандидатом для локального вывода на машинах с большим объёмом памяти, таких как новые Mac и компьютеры с ИИ. 🇨🇳 Z AI подтвердила, что весь тестовый режим был запущен на китайских чипах ИИ с использованием пользовательского стека вывода на основе SGLang. 👍 В целом, GLM 5.3 Flash — впечатляющая открытая модель для недорогого использования API, локального ИИ и агентных рабочих процессов.