Morgans Code — ИИ, программирование и локальные модели
Morgans Code
0:00 / 0:00
Morgans Code — ИИ, программирование и локальные модели
27 549 просмотров · 5 дней назад
Morgans Code
1,53 тыс. подписчиков
27 549 просмотров · 5 дней назад
Qwen 3.8 35B A3B — одна из самых востребованных моделей на местном рынке, и она до сих пор не появилась. Alibaba перешла на Qwen 4, и руководитель Qwen говорит, что версия 27B появится очень скоро. Так что, если вы все еще используете старый Qwen 3.6 35B, что вам следует использовать вместо него?
Я сравниваю модели, которые вы можете попробовать прямо сейчас, со старым Qwen по трем вопросам: лучше ли он, по-прежнему ли он быстрый и подходит ли он для реального агента?
РАЗДЕЛЫ
0:00 Qwen 3.8 35B, который так и не вышел
1:09 Qwen 3.8 27B: лучше, но в 3 раза медленнее
2:40 Muse Glimmer: модель использования инструментов от Meta
4:01 Ornith 1.5: мой первый выбор
4:51 Tiel-Coder: Ornith, настроенный для работы
5:38 Xing 4.0: специалист по терминалам
6:29 Qwen 3.8 Flash Next: если у вас достаточно оперативной памяти
7:09 Дистиллятные модели "Qwen 3.8 35B"
7:37 Еще четыре модели, которые не превосходят его
8:27 Окончательный вердикт: что бы я загрузил первым
В ЭТОМ ВИДЕО
• Qwen 3.8 27B: почти вдвое умнее, чем старый 35B, но более чем в 3 раза медленнее
• Muse Glimmer: отлично подходит для использования инструментов и думает гораздо меньше, но не быстрее
• Ornith 1.5: тот же размер, что и у старой Qwen, лучше по всем тестам программирования, которые перечисляет его команда
• Tiel-Coder: Ornith, упакованный для программирования, с файлом для карт памяти объемом 16 ГБ
• Xing 4.0: опережает по результатам тестов терминала и инструментов, отстает на один пункт по результатам программирования
• Qwen 3.8 Flash Next: более крупный вариант для машин с большим объемом оперативной памяти
• «Qwen 3.8 35B»: модели от сообщества, а не официальные релизы Qwen
• Четыре популярные модели, которые не превосходят старую Qwen
• Что бы я установил в первую очередь
Если ваша карта памяти меньше 16 ГБ, старая Qwen 35B по-прежнему является разумным вариантом на данный момент.
О ЦИФРАХ
Результаты получены с помощью анализа искусственного интеллекта, собственных таблиц разработчиков (Qwen, команда Ornith, команда Xing, NVIDIA, Cohere) и одного теста RTX 4090, проведенного сообществом. Бенчмарки, разработанные разработчиками, отдают предпочтение их собственным моделям. Моя рекомендация по Ornith основана на моем личном опыте использования агента; я не тестировал Tiel-Coder, Xing подробно или модели Distill.
Вы все еще используете старую Qwen 35B или перешли на другую? С чем вы ее запускаете? Расскажите мне в комментариях — это определит следующее сравнение в реальных условиях.
Подпишитесь на канал, чтобы увидеть следующий тест оборудования Flash Next и другие практические сравнения локальных агентов:
https://www.youtube.com/@MorgansCode?...
ГОЛОС И СИНТЕЗ
Оригинальный голос: CSTR VCTK Corpus 0.92, лицензия CC BY 4.0.
https://datashare.ed.ac.uk/handle/102...
Синтез речи: Chatterbox TTS от Resemble AI (MIT).
https://github.com/resemble-ai/chatte...
#Qwen #Qwen38 #LocalAI #LLM