Перейти к содержимому

Qwen3.5 小模型实测:0.8B 到 35B-A3B,本地推理/视觉/OCR/编码到底有多强?

NiceKate AI

0:00 / 0:00

Qwen3.5 小模型实测:0.8B 到 35B-A3B,本地推理/视觉/OCR/编码到底有多强?

20 321 просмотр · 7 мес. назад
NiceKate AI
17,2 тыс. подписчиков
20 321 просмотр · 7 мес. назад
欢迎关注我的知识星球:https://t.zsxq.com/FF0He ​我会分享最新AI资讯、源代码、回答你的提问。 Twitter:https://x.com/nicekate8888 微信公众号:kate人不错 这期视频我实测了 Qwen3.5 中小模型在本地端的真实表现: 你会看到: 不同量化下的显存占用与推理速度差异 浏览器端 WebGPU 运行 0.8B 的体验 视觉识别/OCR 实测表现 9B 与 35B-A3B 在任务稳定性与效果上的差异 LM Studio 关闭 thinking 的实操方法 在 OpenCode / Cline 中做工具调用与编码测试的结果 如果你也在找一套“能在本地跑、质量又够用”的模型组合,这期会很有参考价值。 时间戳 00:00 Qwen3.5 中小模型简介 00:50 格式与部署 02:21 显存与速度实测 03:40 视觉/OCR能力对比 05:33 本地实战案例 11:00 工具调用与编码测试 #Qwen35 #本地大模型 #Ollama #LMStudio #千问