Qwen 3.8 на 16 ГБ видеокарте: сможет ли он заменить вашу ИИ-подписку за $20?
Blake AI Search
0:00 / 0:00
Qwen 3.8 на 16 ГБ видеокарте: сможет ли он заменить вашу ИИ-подписку за $20?
849 просмотров · 6 дн. назад
Blake AI Search
10 подписчиков
849 просмотров · 6 дн. назад
Компания Alibaba утверждает, что её бесплатная версия Qwen 3.8 27B превосходит Claude Opus 4.6 в офисной работе и устанавливается на видеокарту с 16 ГБ памяти. Я беру обычную рабочую неделю, с понедельника по пятницу, и каждый день отдаю предпочтение тому, что работает лучше: платной подписке за 20 долларов или модели на вашей видеокарте. Электронная почта, документы, вопросы о мире, длительные рабочие задачи и личные файлы, плюс одна настройка, определяющая поведение системы.
Разделы
0:00 Двадцать в месяц
1:09 Оптимальная производительность на 16 ГБ
2:34 Поместится ли это?
4:07 Ваша неделя
8:46 Отменить или сохранить
В моем тесте я использовал RTX 4070 Ti Super с 16 ГБ памяти, LM Studio, файл Unsloth Qwen3.8-27B-UD-IQ3_XXS (10,9 ГБ на Hugging Face), дополнение для обработки изображений и диалог на 32 000 токенов, при этом оставалось около половины гигабайта видеопамяти. Более 70 токенов в секунду. Начните с низкого уровня мышления.
Данные проверены 2 октября 2026 года.
Показатели интеллекта (34, 26 и 20 для Qwen 3.8 27B при очень высоком, низком и нулевом уровне мышления; 21 для Qwen 3.6 27B; 14 для Gemma 4 12B; 47 для GPT-5.6 Sol и 56 для Claude Sonnet 5.5 при максимальных настройках) получены из Artificial Analysis Intelligence Index v4.3.2. Они проверяют полную модель через API, а не тот небольшой файл, который вы запускаете дома.
Результаты сравнений с Opus 4.6 (IFBench 79.5 против 62.5, OmniDocBench 91.1 против 86.6, OSWorld 84.3 против 72.7, Humanity's Last Exam 30.8 против 40.0, собственный CoWorkBench Alibaba 70.7 против 68.2) взяты из модельной карты Alibaba.
Ускорение прогнозирования в несколько токенов (с 26.3 до 59.5 токенов в секунду на RTX 5060 Ti 16 ГБ) — это результаты измерения одного пользователя из сообщества.
Время выполнения задачи Pelican (21 минута с учетом анализа, 137 секунд без него) — это результаты Саймона Уиллисона. 11-часовая задача по программированию — это данные одного пользователя Hacker News. Комментарии на Reddit отражают опыт отдельных пользователей.
Скриншоты, помеченные как «Иллюстрация», — это наше воссоздание, а не реальный интерфейс или результат работы модели.
Источники
Карточка модели Qwen3.8-27B: https://huggingface.co/Qwen/Qwen3.8-27B
Файлы Unsloth GGUF: https://huggingface.co/unsloth/Qwen3....
Теги Ollama, qwen3.8: https://ollama.com/library/qwen3.8/tags
LM Studio, Qwen3.8 27B: https://lmstudio.ai/models/qwen/qwen3...
Саймон Уиллисон о Qwen 3.8 27B: https://simonwillison.net/2026/Aug/16...
Artificial Analysis, Qwen3.8 27B: https://artificialanalysis.ai/models/...
Artificial Analysis, Qwen3.6 27B: https://artificialanalysis.ai/models/...
Artificial Analysis, Gemma 4 12B: https://artificialanalysis.ai/models/...
Artificial Analysis, GPT-5.6 Sol: https://artificialanalysis.ai/models/...
Artificial Analysis, Claude Sonnet 5.5: https://artificialanalysis.ai/models/...
Измерения прогнозирования нескольких токенов: https://github.com/sudoingX/qwen38-mtp
ChatGPT Plus: https://help.openai.com/en/articles/6...
Модели ChatGPT Plus: https://help.openai.com/articles/1190...
Поиск в ChatGPT: https://help.openai.com/en/articles/9...
Claude Pro: https://support.claude.com/en/article...
Веб-поиск Claude: https://support.claude.com/en/article...
Reddit, может ли он заменить подписку: / what_do_you_guys_think_of_qwen_38_27b_so_f...
Reddit, 30 дней с Qwen 3.8 27B: / i_ran_qwen_38_27b_locally_for_30_days_here...
Обсуждение на Hacker News: https://news.ycombinator.com/item?id=...