Перейти к содержимому

GLM 5.3 Flash — лучшая агентная модель на данный момент?!

Singularity Feed | AI Models , Agents & Robotics

0:00 / 0:00

GLM 5.3 Flash — лучшая агентная модель на данный момент?!

595 просмотров · 11 дней назад
Singularity Feed | AI Models , Agents & Robotics
74 подписчика
595 просмотров · 11 дней назад
GLM-5.3-Flash от Z.ai — это модель с открытыми весами, ранее известная как Ox Alpha. В этом видео рассказывается о запуске, архитектуре модели и контекстном окне в один миллион токенов, официальных и независимых результатах бенчмарков, необычно низкой цене, компромиссе между скоростью и детализацией, а также о реальных аппаратных возможностях запуска модели масштаба 320B. Кратко: GLM-5.3-Flash сочетает в себе мощный интеллект с открытыми весами и убедительную экономику, но «Flash» описывает стоимость более убедительно, чем измеренная задержка — и открытые веса не делают эту модель легковесной локальной моделью. РАЗДЕЛЫ 00:00 Ox Alpha представлена ​​как GLM-5.3-Flash 00:11 Что вы узнаете 00:25 Три главных события дня запуска 00:55 320 байт всего, 18 байт активных: архитектура 01:30 Мультимодальный ввод и контекст с 1 миллионом токенов 02:01 Веса MIT — и локальная аппаратная реальность 02:34 Шесть официальных бенчмарков Z.ai 03:15 Результаты независимого индекса интеллекта 03:44 Противоречие скорости и стоимости 04:15 Вы бы обменяли скорость на ценность? 04:28 Предостережение о многословности и общая стоимость 05:10 Заявление о китайской инфраструктуре чипов 05:42 Reddit, Hugging Face и открытая экосистема 06:15 Кому следует тестировать, а кому следует подождать 06:53 Окончательный вердикт и примечание к источнику ОБСУЖДАЕМЫЕ КЛЮЧЕВЫЕ ПОКАЗАТЕЛИ • Индекс интеллекта Artificial Analysis: 57 • Захваченная скорость: около 49 выходных токенов в секунду • Цена: 0,15 долл. США / 1 млн входных токенов и 0,50 долл. США / 1 млн выходных токенов • Стоимость одной задачи по индексу интеллекта: около 0,09 долл. США • Выходные данные оценки: 150 млн токенов против 110 млн в среднем • Приблизительный размер FP8 в указанном руководстве по развертыванию: 306 ГиБ Официальные результаты бенчмаркинга и обслуживания компании указаны как предоставленные поставщиком в видео. Независимые данные предоставлены Artificial Analysis. Скриншоты показаны в контексте с видимыми метками исходного кода. ИСХОДНЫЕ ДАННЫЕ Публикация о запуске Z.ai: https://z.ai/blog/glm-5.3-flash Карточка модели Hugging Face: https://huggingface.co/zai-org/GLM-5.... Примечания к модели Unsloth: https://unsloth.ai/docs/models/glm-5.3 Artificial Analysis: https://artificialanalysis.ai/models/... Руководство по развертыванию KTransformers: https://github.com/kvcache-ai/ktransf... The New Stack: https://thenewstack.io/glm-5-3-flash-... TestingCatalog: https://www.testingcatalog.com/z-ai-l... CryptoBriefing: https://cryptobriefing.com/zhipu-glm-... Обсуждение на LocalLLaMA:   / glm53flash_frontier_intelligence_flash_cost   Если эта информация вам помогла, пожалуйста, поставьте лайк, поделитесь, оставьте комментарий и подпишитесь. #GLM53Flash #OxAlpha #OpenSourceAI