WorkBuddy、TRAE Work、千问办公、纳米 Work…… 9 款产品的深度对比与排名
撰写日期:2026 年 8 月 2 日
一、这条赛道,三个月膨胀了 3 倍
先看一组数字。
易观分析《2026 年二季度中国办公智能体平台市场洞察》显示:2026 年 6 月,17 款主流桌面端 AI 原生办公智能体平台合计访问量突破 6000 万次,而 3 月这个数字还只有约 2000 万——一个季度涨了 3 倍。
| 1 | WorkBuddy | 腾讯 | 2097 万 |
| 2 | TRAE IDE 国内版 | 字节 | 1279 万 |
| 3 | QoderWork | 阿里 | 788 万 |
阵营维度更能说明问题:腾讯系 4 款产品(WorkBuddy、CodeBuddy、QClaw、Marvis)合计 3262 万,超过大盘一半;字节系 1441 万;阿里系 919 万。三家合计 5622 万,剩下所有玩家分食约 440 万。
这已经不是「百团大战」,而是三家巨头的贴身肉搏,外加一群小玩家在缝隙里找生态位。
赛道为什么突然爆发?因为交互范式变了。过去两年,AI 办公的形态是「你问它答」——你要自己复制粘贴、自己排版、自己保存文件。2026 年这一批产品干的事完全不同:你说一句话,它自己拆解步骤、读你的本地文件、上网查资料、调工具、生成产物、存到你指定的文件夹。
一个是顾问,一个是员工。这是本质区别。
二、评测方法论:8 个维度,权重全公开
市面上大量「2026 AI 办公助手排行榜」是软文——我在调研时发现今日头条、掘金上有一批文章,评分表高度雷同、TRAE Work 恒为第一(4.84~4.88 分)、结尾统一带引流链接,其中一篇甚至把腾讯 WorkBuddy 描述成「海外热门工具」。这类内容不能作为参考。
所以我把打分规则完全摊开:
| 任务自主执行与闭环 | 20% | 能否自主拆解多步任务、调工具、跑完不掉链子 |
| 办公交付规范度 | 20% | 产物是不是 Word/Excel/PPT 该有的样子,而不是"什么都做成网页" |
| 生态与连接器 | 15% | 技能市场、专家库、MCP、能不能连你司在用的 IM 和文档 |
| 成本与积分透明度 | 12% | 贵不贵、烧得快不快、你能不能事先知道要花多少 |
| 模型自由度 | 12% | 能否切换多家模型、能否接自己的 API Key |
| 编程与工程能力 | 8% | 写代码、做网页、搭工具的水平 |
| 国内可得性与合规 | 8% | 中国大陆能不能正常用、有没有合规风险 |
| 稳定性与成熟度 | 5% | 首轮交付成功率、返工次数、崩溃与 Bug |
关于权重的说明:这套权重面向「中国大陆的普通职场用户」。如果你是纯开发者,请把「编程」拉到 25%、「办公交付」降到 5%,那么榜单会完全翻转——TRAE 和 Cursor 会冲到前两位。没有普适的第一名,只有和你场景匹配的第一名。
三、总排名
| 🥇 1 | 腾讯 WorkBuddy | 8.60 | 生态最厚、最均衡的「六边形战士」,但积分是硬伤 |
| 🥈 2 | 字节 TRAE Work | 7.92 | 工程能力天花板,交付格式却总在「水土不服」 |
| 🥉 3 | 阿里 千问办公 | 7.87 | 成品质量最好的慢工匠,模型不能换是最大遗憾 |
| 4 | 360 纳米 Work | 7.64 | 最会算账的省钱派,但入场太晚、缺第三方验证 |
| 5 | Kimi OK Computer / Kimi Work | 7.44 | 长任务续航之王,49 元的价格屠夫 |
| 6 | 智谱 AutoClaw | 7.11 | 一键安装体验好,生态太窄 |
| 7 | Claude Cowork | 6.73 | 能力顶尖,但国内不可用且有合规风险 |
| 8 | Cursor | 6.69 | 编程神器,办公场景基本无关 |
| 9 | Manus | 5.82 | 曾经的顶流,已于 2026 年 1 月退出中国 |
第 2 名和第 3 名只差 0.05 分——这不是精度问题,而是真实状况:头部三家的能力差距,远小于它们「产品性格」的差距。
完整打分表
| 自主执行 (20%) | 9.0 | 8.5 | 8.5 | 7.5 | 8.5 | 7.5 | 9.5 | 8.5 | 8.5 |
| 办公交付 (20%) | 8.5 | 6.0 | 9.0 | 7.0 | 8.0 | 6.5 | 8.0 | 3.0 | 7.0 |
| 生态连接 (15%) | 9.5 | 9.0 | 8.5 | 8.0 | 7.0 | 6.0 | 7.5 | 7.5 | 6.0 |
| 成本透明 (12%) | 6.0 | 6.0 | 6.5 | 7.5 | 8.5 | 6.5 | 5.0 | 6.0 | 4.0 |
| 模型自由 (12%) | 9.5 | 9.0 | 5.0 | 9.5 | 3.0 | 8.5 | 2.0 | 9.0 | 3.0 |
| 编程能力 (8%) | 8.0 | 9.5 | 8.5 | 6.0 | 7.5 | 7.0 | 9.5 | 10.0 | 7.5 |
| 国内可得 (8%) | 10.0 | 9.5 | 8.5 | 9.0 | 9.5 | 9.0 | 1.0 | 3.0 | 0.0 |
| 稳定性 (5%) | 7.5 | 7.0 | 7.0 | 6.0 | 7.0 | 6.5 | 8.5 | 8.5 | 7.5 |
| 加权总分 | 8.60 | 7.92 | 7.87 | 7.64 | 7.44 | 7.11 | 6.73 | 6.69 | 5.82 |
四、头部三强:三种截然不同的「打工人格」
虎嗅 AIX 财经在 2026 年 7 月 28 日做了一次六项任务实测(竞品监测周报、数据看板、多平台内容创作、PPT、Three.js 海底世界、跑酷游戏),给出的画像非常精准,我原样转述:
WorkBuddy 更像一名会主动补充观点的分析师;TRAE 带有明显的程序员思维,工程结构清晰、生成速度快,却经常不按传统办公方式交付;千问办公更像一名追求完整交付的执行者,愿意花更多时间补内容、磨细节,但效率也因此被拖慢。
🥇 第一名:腾讯 WorkBuddy —— 8.60 分
定位:全场景 AI 办公工作台,隶属腾讯云 CodeBuddy 产品线,与 CodeBuddy 同账号、积分共享。
它凭什么第一:
- 生态厚度断层领先。Ask / Plan / Craft 三种模式分层(分别对应轻问答、任务拆解、执行交付)、100+ 领域专家、技能市场、MCP 连接器、原生打通腾讯文档 / 企业微信 / QQ / 腾讯会议。对于本来就在腾讯办公生态里的公司,这是别人抄不走的护城河。
- 模型自由度接近满分。混元 Hy3、DeepSeek、GLM、Kimi、MiniMax 全都能切,还能配自己的 API Key,用自定义模型跑任务不扣积分——这条对重度用户非常关键。
- 平台覆盖最全。Windows / macOS / 鸿蒙 PC / 移动端全平台,是鸿蒙电脑首款第三方桌面办公智能体。还支持企业微信、QQ、飞书、钉钉多个 IM 远程遥控挂机任务。
- 办公任务理解力最强。虎嗅实测中,它在竞品监测、内容分析这类「需要提炼观点」的任务上表现最好,会主动补充模型参数、产品数据、竞争态势等细节。
它的问题,而且是真问题:
- 积分消耗是最大槽点,没有之一。社区里「积分刺客」的说法广泛流传:有用户充 58 元三天见底、有人一个 Python 需求烧光全部积分。核心机制问题在于按输入+输出双向计费,每轮追问会把历史对话重新计算一遍 token,改七八次就能烧掉近 200 积分。默认的 Auto 模式还经常给简单任务调用最贵的推理模型——不同模型倍率最高差 26 倍。
- 消耗不透明。任务开始前你无法预知会花多少积分,这在体验上是硬伤。
- 复杂视觉/3D 能力明显偏弱。虎嗅实测中,Three.js 海底世界任务它直接漏掉了「鱼群」这个核心要素,光影效果「像舞台灯光打在布景上」;跑酷游戏关卡设计过于简单且存在穿模。
- PPT 稳定性不足。这本该是主场,实测却出现两个图表未正常显示、缺结束页。
- 连接器登录态过期会导致功能「凭空消失」,新手容易误判为产品 Bug。
给它第一的理由:不是因为它每项最强,而是它没有短板项低于 6 分,且在权重最高的两项(自主执行 20%、办公交付 20%)上都拿到 8.5 分以上,同时生态和模型自由度接近满分。这是典型的「加权制冠军」。
避坑建议:查资料切 Ask 模式,只有要产物才开 Craft;单任务结束就新建对话;简单任务手动选 Hy3 / DeepSeek-V4-Flash 这类低倍率模型,别用 Auto。照做能省下近一半消耗。
🥈 第二名:字节 TRAE Work —— 7.92 分
重要澄清:2026 年 6 月 9 日,字节正式将 TRAE SOLO 更名为 TRAE Work,产品线一分为二:
- TRAE IDE:面向开发者的 AI 原生 IDE(VS Code 内核)
- TRAE Work:AI 原生工作空间,桌面端 + 网页 + 移动端全量上线,含 Work / Code / Design 三模式
官方原话是「TRAE IDE goes deep into software engineering. TRAE Work goes wide across professional work.」它和 WorkBuddy 的赛道重叠是真实且直接的。
优势:
- 工程能力天花板。SWE-bench Verified 曾拿到第一,生成速度三家最快。
- 生态数量惊人:支持 11,000 个 MCP,用户创建/更新了 36.5 万个自定义 Agent,有完整的 Agent 市场、sub-agent 多智能体协作、Rules、Hook 机制。
- 模型池丰富:豆包 Seed 系列、DeepSeek-V4、GLM-5 系列、Kimi-K3、MiniMax-M3、Qwen3.7 都能选,自定义模型同样不消耗积分。
- 2026 年新增记忆、Generative UI、视频生成(7 月 21 日)等能力,迭代速度很猛。
硬伤:
- 「什么都做成网页」是致命的办公不适配。虎嗅六项测试里,让它做周报,它做成网页;让它做 PPT,它做成了带快捷键切换主题的 HTML。虽然信息规范性(每条动态标注来源+可跳转链接)是三家最好的,但格式不对就是要返工,速度优势直接被抵消。
- 额度层层收紧引发大量不满。社区反馈从「不限量」→ 每日限额 → 月度总量锁死;付费 100 次「速通包」只免排队不加额度,约 1 元/次;国内版没有剩余额度进度条,官方也承认过「体验 TRAE Work 可获更多额度」的文案属误导。
- 隐私遥测争议(2025 年 7 月):有开发者实测称关闭 Telemetry 后仍持续上传数据,7 分钟约 500 次连接、26MB;官方回应称属「非敏感统计数据」,是误解。这件事至今仍是部分用户的心结。
- 生成大量冗余测试文件且不自动清理。
定价(国内版,2026 年 2 月起积分制):免费 500 积分/月 | Lite ¥49 | Pro ¥99 | Pro+ ¥239 | Ultra ¥699
🥉 第三名:阿里 千问办公 —— 7.87 分
最年轻的选手:2026 年 7 月 27 日才上线内测,由 QoderWork + 悟空 + MuleRun 三款 Agent 整合而成,钉钉新 CEO 陈宇森上任 46 天交付。
它的强项非常突出——成品质量最高:
- 虎嗅六项实测综合评分第一。PPT 视觉呈现三家最好;Three.js 海底世界任务里,鱼的建模写实、水面光影透射最自然,是唯一完整交付的;数据看板还主动加了滚动票房榜和信源跳转链接。
- 小红书笔记的语感和节奏「是三家里最自然的」——多平台内容风格区分能力最强。
- 六大能力覆盖完整:企业 IM 协作、Office 产物生成与编辑、多模态、全栈网页生成、专业数据源、13 个专家套件(投研分析/产品设计/合同管理/企业法务等)。
- 背靠钉钉 2600 万企业组织(厂商口径)。
它的问题:
- 模型不能换。目前只能用 Qwen3.8-Max-Preview,这在其他家都开放多模型的 2026 年是个显著减分项,我只给了 5.0 分。
- 慢。虎嗅实测中它每一轮都是最慢的,有网页任务耗时 1 小时 8 分。「愿意花时间磨细节」的另一面就是效率低。
- 还在 Beta。Windows/macOS Beta + 鸿蒙尝鲜版,网页端和钉钉内置版都还没上线。
- 实测存在飞书文档转换乱码、PPT 页面数字被遮挡、游戏穿模、连续弹「高危操作」确认框需手动放行等问题。
- 积分烧得也快:有实测一次任务消耗 1000 积分 ≈ 标准版半个月额度。
定价:个人免费版 ¥0 | 标准版 ¥98/月(限时连续包月 ¥78)| 高级版 ¥198/月(限时 ¥158)| 企业标准版 ¥198/月/席
五、追赶者与特殊选手
第 4 名:360 纳米 Work —— 7.64 分
2026 年 7 月 28 日才正式发布,是入场最晚的巨头玩家。策略很清晰:避开钉钉飞书占据的大中型企业,瞄准年营收千万级以下的小企业和「一人公司」(OPC)。
亮点是最会算账:16 家模型自由切换(宣称 100+ 模型自动调度),提供轻量/省钱/满血三档调度模式,宣称能省 90%/70% 成本;首批用户每人送 1 亿 Token。还有云端办公室(云电脑+AI 云盘)、7×24 定时任务、三级知识库、50000+ 技能生态。
定价(官网):轻量版 ¥69/月 | 专业版 ¥139/月 | 高级版 ¥699/月
⚠️ 注意:App Store 内购价与官网不一致(轻量版 ¥78 / 专业版 ¥98 / 高级版 ¥238),下单前建议以官网为准。
减分项:未查到任何公开月活或访问量数据,未进入易观 6 月榜单前列;发布会引用的案例(喀什早餐店 12 天成网红等)都是厂商自述,缺乏第三方验证;产品太新,稳定性存疑。
第 5 名:Kimi OK Computer / Kimi Work —— 7.44 分
长任务续航的王者:K2.6 支持 300 个子 Agent 并行、4000 协作步骤、可连续自主运行 5 天。K2.5 主打 Office 端到端(Word/PDF/Excel/PPT)。另有 Kimi Claw 云端零部署方案,接入 5000+ ClawHub 技能。
最大杀器是价格:会员 ¥49/月 和 ¥99/月两档,是头部产品里最便宜的。
最大短板是模型锁死——只能用 Kimi 自家模型,自由度只有 3.0 分。
第 6 名:智谱 AutoClaw —— 7.11 分
2026 年 3 月上线,宣称「国内首个真一键安装的本地版 OpenClaw」,预置 50+ 技能,一键接飞书。上线当日智谱(02513.HK)股价涨 12.87%。
问题是生态太窄(主要只接飞书)、积分消耗不低(南都实测一个简单简报任务耗超 400 积分)。积分包:¥29/5000 起。
第 7-8 名:Claude Cowork 与 Cursor —— 能力很强,但和你没关系
我必须把可得性和合规当成硬约束,所以这两位排名靠后。
Claude Cowork(Anthropic,2026-01 桌面预览,7 月扩展至 Web 和移动端)能力确实顶尖——Anthropic 公布的 120 万次 Cowork 会话数据显示,90% 以上用途与写代码无关,业务流程运营占 33.4%。但:
- 中国大陆无法正常访问,api.anthropic.com 屏蔽中国 IP;
- 更关键的是,2026 年 7 月 8 日工信部下属 NVDB 发布风险提示,称 Claude Code 特定版本内置监控机制,未经同意回传用户地域、身份标识等敏感信息,建议卸载或升级;
- 阿里自 2026 年 7 月 10 日起全面禁止内部员工在办公环境使用 Claude Code。
对国内企业用户来说,这已经不是「好不好用」的问题,而是能不能用的问题。
Cursor($20/月起,2026 年已到 v3.5,自研 Composer 2.5)是编程神器,办公场景基本无关;国内需科学上网、延迟 200-500ms、支付渠道说法不一。它和 WorkBuddy 其实不在一个赛道,放进来只是给需要横向参照的读者一个坐标。
顺带一提 ChatGPT Work:OpenAI 于 2026 年 7 月 9 日发布,基于 GPT-5.6、内置 Codex、可连 Slack/Teams/Google Drive。同样国内不可用,故未参与排名。
第 9 名:Manus —— 一个值得记住的退场
2025 年 3 月,Manus 邀请码被炒到 10 万元,是全球最早出圈的通用 AI Agent。然后:
- 2025 年 6 月总部迁往新加坡、裁撤国内团队;
- 2025 年 12 月 ARR 破 1 亿美元,Meta 宣布约 20 亿美元收购;
- 2026 年 1 月 5 日起全面停止中国境内服务,中国 IP 访问显示「所在地区不可用」;
- 2026 年 4 月 27 日,国家发改委外资安全审查办公室依法禁止该收购,要求撤销交易——这是《外商投资安全审查办法》实施以来首例公开叫停的 AI 领域外资收购。
它现在叫「Meta’s Manus」,海外定价 $20/$40/$200 三档。对中国用户而言,它已经是历史。
六、横向速查表
| 归属 | 腾讯 | 字节 | 阿里 | 360 | 月之暗面 |
| 免费额度 | 500 积分/月 + 每日签到 | 500 积分/月 | 有免费版 | 送 1 亿 Token | 有免费版 |
| 主力订阅价 | ¥99 / ¥199 | ¥99 | ¥98(限时 ¥78) | ¥139 | ¥49 / ¥99 |
| 旗舰档 | ¥999/月 | ¥699/月 | 企业版询价 | ¥699/月 | — |
| 多模型切换 | ✅ 5 家+ | ✅ 6 家+ | ❌ 仅 Qwen | ✅ 16 家 | ❌ 仅 Kimi |
| 自定义 API 不扣分 | ✅ | ✅ | ❓ | ❓ | ❌ |
| 本地文件读写 | ✅ | ✅ | ✅ | ✅(云端为主) | ✅ |
| 原生办公生态 | 腾讯文档/企微/QQ/会议 | 飞书 | 钉钉 | 360 云盘 | — |
| 移动端 | ✅ 含鸿蒙 | ✅ | 鸿蒙尝鲜版 | ✅ | ✅ |
| 远程遥控挂机 | ✅ 多 IM | 部分 | ❓ | ✅ | ❓ |
| 最适合 | 综合办公+腾讯生态 | 开发者+工程化交付 | 高质量成品交付 | 小微企业省成本 | 超长任务+预算有限 |
七、别看排名,看你自己是谁
选型要看场景。这是我的实操建议:
你该选 WorkBuddy,如果:
- 你司在用企业微信 / 腾讯文档 / 腾讯会议——生态打通带来的效率是别家给不了的;
- 你的日常是调研、分析、写报告、整理资料这类「需要观点」的工作;
- 你需要频繁切换模型,或者手里有自己的 API Key;
- 你用鸿蒙电脑(目前几乎没有替代选择)。
- 前提是你愿意花 10 分钟搞懂积分机制,否则你会成为下一个发帖吐槽「积分刺客」的人。
你该选 TRAE Work,如果:
- 你是开发者,或者你的「办公」本身就是搭页面、做工具、写脚本;
- 你能接受甚至喜欢网页形态的交付物(说实话,可跳转核验的信息卡片确实比 Word 好读);
- 你需要海量 MCP 和自定义 Agent 生态。
你该选千问办公,如果:
- 你对成品的视觉质量和完整度要求高于速度;
- 你司在用钉钉;
- 你能忍受它还在 Beta,以及不能换模型。
你该选纳米 Work,如果:
- 你是小微企业主 / 一人公司,成本是第一考量;
- 你需要 7×24 云端挂机跑定时任务。
你该选 Kimi,如果:
- 预算有限(¥49 是真便宜);
- 你有需要跑几天的超长任务。
你不该选 Claude Cowork / ChatGPT Work / Cursor / Manus,如果:
- 你在中国大陆正常办公。可得性和合规是硬约束,能力再强也没用。
八、四个不吹不黑的判断
判断一:所有产品的积分机制都不透明,这是全行业的原罪。
WorkBuddy 被骂「积分刺客」,TRAE 被骂「额度层层缩水」,千问办公一次任务烧掉半月额度,AutoClaw 一个简报 400 积分,Manus 被投诉「报错重跑也扣分」。没有一家能在任务开始前告诉你「这件事大概要花多少钱」。 这不是某一家的问题,是整个行业还没解决的产品设计难题。谁先解决,谁就能收割一大批被烧怕了的用户。
判断二:AI 自查的数据不可靠,任何数字都要人工复核。
虎嗅实测里最刺眼的一幕:三款产品做同一个电影票房看板,国产片占比 WorkBuddy 给 85%、千问给 92%、TRAE 给 80%,三家都没说明统计口径。这意味着——凡是要拿去汇报的数字,你必须自己核。 AI 能帮你省掉 90% 的搬砖,但那 10% 的核对,暂时还省不掉。
判断三:「产品基因」不是优势或劣势,是适配问题。
同一个能力,换个场景就从加分项变减分项。WorkBuddy 的分析能力写公众号是加分,写小红书就显得太重;TRAE 的工程思维做 PPT 是水土不服,但把口播脚本做成带画面、时长、字幕样式的分镜表格,对视频团队反而更实用。别问哪个最强,问哪个像你。
判断四:第三方评测数据要看口径,厂商自述数据要打折。
易观 6000 万的数字是PC 端网页访问量,不是 DAU、不是付费企业数,也不含移动端和插件;而且把本质是编程 IDE 的 TRAE IDE 放进办公榜本身就有争议。至于「350 万亿 Token」「8 亿职场用户」「2600 万企业组织」这类发布会数字,全部是厂商单方口径,无第三方验证。
顺便说一句,腾讯云 CodeBuddy & WorkBuddy 负责人刘毅自己的原话是:「上半年大家还是处于起步阶段,暂时跑赢半个身位而已。」——领先者自己都这么说,你就知道这个榜单的保质期有多短。
结语
2026 年上半年,这条赛道从 2000 万涨到 6000 万访问量,产品形态从「问答」变成「执行」,巨头从观望变成全部下场。
但说实话,今天所有产品都还处在「能用,但需要盯着」的阶段。它们能帮你把 8 小时的活压缩到 1 小时,但那 1 小时你得全神贯注地检查、纠正、返工。真正的「电子牛马」——你交代完就能安心去开会的那种——还没出现。
所以这份排名的真正用法不是「照着第一名下载」,而是:先想清楚你每天真正在重复的是哪三件事,然后选一个在这三件事上不返工的工具。
至于第一名是谁——三个月后再看,可能又不一样了。
参考资料
市场数据
- 易观分析:2026 年 6 月中国桌面端 AI 原生办公智能体平台访问量
- 定焦 One / 钛媒体:腾讯、阿里、字节,大战 AI 办公(2026-07-22)
- 36 氪:腾讯、阿里、字节重做 Office(2026-07-09)
第三方实测
- 虎嗅 AIX 财经:实测三款 AI 办公应用:谁是天选「电子牛马」?(2026-07-28,本文主要实测依据)
- 智东西:千问办公悄悄上线!实测 7 分钟做好财报 PPT
产品官方
- WorkBuddy 官方文档
- 腾讯云 CodeBuddy / WorkBuddy 计费概述
- TRAE 官方博客:Introducing TRAE Work
- TRAE 国内版定价 | TRAE 内置模型
- 纳米 Work 官网
- Qoder CN 产品计费
用户反馈与争议
- 腾讯云开发者社区:用了 WorkBuddy 5 个月,这 10 个坑希望你一个都别踩
- 腾讯云开发者社区:WorkBuddy 深度测评:全能 AI 办公助理的「真香」与「真坑」
- TRAE 社区:Solo 模式额度层层缩水吐槽
- IT 之家:Trae 被指「偷跑」用户数据
- 南方都市报:工信部警示 Claude Code 存安全隐患,已遭阿里禁用(2026-07-08)
- 澎湃 / 经济观察报:寻找 Manus|中国网:Manus 并购禁令
本文数据截至 2026 年 8 月 2 日。AI 产品迭代极快,请以各产品官网最新信息为准。




