

问AI全文概述
WorkBuddy新增内置本地模型Qwen3.6 35B-3AB,无需额外部署工具即可一键下载使用,兼顾本地运行的隐私性与实用性,适合有高隐私工作需求、使用32G内存及以上Mac且正在使用WorkBuddy的用户选择。
适用条件
适合同时满足三类需求的用户:有高隐私要求的工作场景、使用性能较好的电脑(如内存32G及以上的Mac)、正在使用WorkBuddy。
下载与部署方式
在WorkBuddy内依次点击「设置」-「模型」,即可在模型列表中找到「本地模型」入口,支持一键下载,无需依赖ollama或llama.cpp等额外部署工具;下载过程支持断点续传,关闭对话框后下次可继续下载。
模型核心特性
属于MoE模型,总参数35B,仅激活3B参数以提升本地推理速度;经过腾讯裁剪优化后大小为15GB,比ollama平台的同类型24GB版本体积减少1/3,运行更顺畅。
实测性能表现
生成速度稳定在30–35 token/s,运行时内存占用约17G;首字延迟较高,原因是WorkBuddy系统提示和工具列表加载量可达几万token,关闭不常用的工具可改善该问题。
使用优劣势
相比云端模型,速度更慢、上下文稳定性更弱;优势在于完全本地运行、数据不出网、无按量计费成本,综合表现可满足日常使用需求,性价比很高。
