Перейти к содержимому

Morgans Code — ИИ, программирование и локальные модели

Morgans Code

0:00 / 0:00

Morgans Code — ИИ, программирование и локальные модели

27 549 просмотров · 5 дней назад
Morgans Code
1,53 тыс. подписчиков
27 549 просмотров · 5 дней назад
Qwen 3.8 35B A3B — одна из самых востребованных моделей на местном рынке, и она до сих пор не появилась. Alibaba перешла на Qwen 4, и руководитель Qwen говорит, что версия 27B появится очень скоро. Так что, если вы все еще используете старый Qwen 3.6 35B, что вам следует использовать вместо него? Я сравниваю модели, которые вы можете попробовать прямо сейчас, со старым Qwen по трем вопросам: лучше ли он, по-прежнему ли он быстрый и подходит ли он для реального агента? РАЗДЕЛЫ 0:00 Qwen 3.8 35B, который так и не вышел 1:09 Qwen 3.8 27B: лучше, но в 3 раза медленнее 2:40 Muse Glimmer: модель использования инструментов от Meta 4:01 Ornith 1.5: мой первый выбор 4:51 Tiel-Coder: Ornith, настроенный для работы 5:38 Xing 4.0: специалист по терминалам 6:29 Qwen 3.8 Flash Next: если у вас достаточно оперативной памяти 7:09 Дистиллятные модели "Qwen 3.8 35B" 7:37 Еще четыре модели, которые не превосходят его 8:27 Окончательный вердикт: что бы я загрузил первым В ЭТОМ ВИДЕО • Qwen 3.8 27B: почти вдвое умнее, чем старый 35B, но более чем в 3 раза медленнее • Muse Glimmer: отлично подходит для использования инструментов и думает гораздо меньше, но не быстрее • Ornith 1.5: тот же размер, что и у старой Qwen, лучше по всем тестам программирования, которые перечисляет его команда • Tiel-Coder: Ornith, упакованный для программирования, с файлом для карт памяти объемом 16 ГБ • Xing 4.0: опережает по результатам тестов терминала и инструментов, отстает на один пункт по результатам программирования • Qwen 3.8 Flash Next: более крупный вариант для машин с большим объемом оперативной памяти • «Qwen 3.8 35B»: модели от сообщества, а не официальные релизы Qwen • Четыре популярные модели, которые не превосходят старую Qwen • Что бы я установил в первую очередь Если ваша карта памяти меньше 16 ГБ, старая Qwen 35B по-прежнему является разумным вариантом на данный момент. О ЦИФРАХ Результаты получены с помощью анализа искусственного интеллекта, собственных таблиц разработчиков (Qwen, команда Ornith, команда Xing, NVIDIA, Cohere) и одного теста RTX 4090, проведенного сообществом. Бенчмарки, разработанные разработчиками, отдают предпочтение их собственным моделям. Моя рекомендация по Ornith основана на моем личном опыте использования агента; я не тестировал Tiel-Coder, Xing подробно или модели Distill. Вы все еще используете старую Qwen 35B или перешли на другую? С чем вы ее запускаете? Расскажите мне в комментариях — это определит следующее сравнение в реальных условиях. Подпишитесь на канал, чтобы увидеть следующий тест оборудования Flash Next и другие практические сравнения локальных агентов: https://www.youtube.com/@MorgansCode?... ГОЛОС И СИНТЕЗ Оригинальный голос: CSTR VCTK Corpus 0.92, лицензия CC BY 4.0. https://datashare.ed.ac.uk/handle/102... Синтез речи: Chatterbox TTS от Resemble AI (MIT). https://github.com/resemble-ai/chatte... #Qwen #Qwen38 #LocalAI #LLM