GLM 5.3 Flash — лучшая агентная модель на данный момент?!
Singularity Feed | AI Models , Agents & Robotics
0:00 / 0:00
GLM 5.3 Flash — лучшая агентная модель на данный момент?!
595 просмотров · 11 дней назад
Singularity Feed | AI Models , Agents & Robotics
74 подписчика
595 просмотров · 11 дней назад
GLM-5.3-Flash от Z.ai — это модель с открытыми весами, ранее известная как Ox Alpha. В этом видео рассказывается о запуске, архитектуре модели и контекстном окне в один миллион токенов, официальных и независимых результатах бенчмарков, необычно низкой цене, компромиссе между скоростью и детализацией, а также о реальных аппаратных возможностях запуска модели масштаба 320B.
Кратко: GLM-5.3-Flash сочетает в себе мощный интеллект с открытыми весами и убедительную экономику, но «Flash» описывает стоимость более убедительно, чем измеренная задержка — и открытые веса не делают эту модель легковесной локальной моделью.
РАЗДЕЛЫ
00:00 Ox Alpha представлена как GLM-5.3-Flash
00:11 Что вы узнаете
00:25 Три главных события дня запуска
00:55 320 байт всего, 18 байт активных: архитектура
01:30 Мультимодальный ввод и контекст с 1 миллионом токенов
02:01 Веса MIT — и локальная аппаратная реальность
02:34 Шесть официальных бенчмарков Z.ai
03:15 Результаты независимого индекса интеллекта
03:44 Противоречие скорости и стоимости
04:15 Вы бы обменяли скорость на ценность?
04:28 Предостережение о многословности и общая стоимость
05:10 Заявление о китайской инфраструктуре чипов
05:42 Reddit, Hugging Face и открытая экосистема
06:15 Кому следует тестировать, а кому следует подождать
06:53 Окончательный вердикт и примечание к источнику
ОБСУЖДАЕМЫЕ КЛЮЧЕВЫЕ ПОКАЗАТЕЛИ
• Индекс интеллекта Artificial Analysis: 57
• Захваченная скорость: около 49 выходных токенов в секунду
• Цена: 0,15 долл. США / 1 млн входных токенов и 0,50 долл. США / 1 млн выходных токенов
• Стоимость одной задачи по индексу интеллекта: около 0,09 долл. США
• Выходные данные оценки: 150 млн токенов против 110 млн в среднем
• Приблизительный размер FP8 в указанном руководстве по развертыванию: 306 ГиБ
Официальные результаты бенчмаркинга и обслуживания компании указаны как предоставленные поставщиком в видео. Независимые данные предоставлены Artificial Analysis. Скриншоты показаны в контексте с видимыми метками исходного кода.
ИСХОДНЫЕ ДАННЫЕ
Публикация о запуске Z.ai: https://z.ai/blog/glm-5.3-flash
Карточка модели Hugging Face: https://huggingface.co/zai-org/GLM-5....
Примечания к модели Unsloth: https://unsloth.ai/docs/models/glm-5.3
Artificial Analysis: https://artificialanalysis.ai/models/...
Руководство по развертыванию KTransformers: https://github.com/kvcache-ai/ktransf...
The New Stack: https://thenewstack.io/glm-5-3-flash-...
TestingCatalog: https://www.testingcatalog.com/z-ai-l...
CryptoBriefing: https://cryptobriefing.com/zhipu-glm-...
Обсуждение на LocalLLaMA: / glm53flash_frontier_intelligence_flash_cost
Если эта информация вам помогла, пожалуйста, поставьте лайк, поделитесь, оставьте комментарий и подпишитесь.
#GLM53Flash #OxAlpha #OpenSourceAI