最近,DeepSeek 要出自家 Harness 的消息越来越密。公布 DeepSeek-v4-flash 正式版时,官方写道:

外界普遍预期它「很强」——尤其是代码、终端操作和长链路 Agent 任务。
好家伙,这就有意思了。让我想到最近腾讯在疯狂推广的 WorkBuddy。
这里得先补个背景:WorkBuddy 是腾讯主打的 AI 工作助手,面向普通职场人的 Agent 工作台——把目标和材料丢给它,它自己规划步骤、操作文件,把结果留在工作空间里。它自己不产模型,而是接各家模型干活,DeepSeek 也是它支持的模型之一。
这一下,问题就来了:如果 DeepSeek 模型本身就强,又亲手做了最适配它的 Harness,那我为什么还要绕一圈,跑到 WorkBuddy 里去调用 DeepSeek?
这背后其实是 Agent 市场最核心的一组矛盾:
到底是「模型 + Harness 一体化」更强,还是「模型中立的平台」更有价值?

前者你多半见过或听说过:Claude Code、OpenAI Codex、阿里刚推出的千问办公(QwenWork),还有马上要来的 DeepSeek Harness——自家模型配自家 Harness,靠联合优化把能力榨到极致。后者是「模型中立派」:腾讯 WorkBuddy、开源 OpenCode,不押注单一模型,谁强用谁。
大概率是:会有人继续用 WorkBuddy,而且大概率不少。 但前提是,WorkBuddy 不能只做一个多模型聊天壳。
DeepSeek Harness 发布后,极客和程序员会先奔着原生 Harness 去;WorkBuddy 更大的机会,是面向普通人和企业做一个通用工作环境:底层模型可以换、文件和工作流保持稳定、文档表格会议和知识库统一管理,不用跟着模型榜单搬家。
所以 DeepSeek Harness 不一定能消灭 WorkBuddy。它更可能逼着 WorkBuddy 回答一个问题:
你到底是一个模型调用工具,还是一个真正的工作操作系统?
01 为什么 DeepSeek 的原生 Harness 可能很强
模型和 Harness,从来不是两个独立的模块。
一个模型适不适合做 Agent,不只看 benchmark,更看它跟执行环境的协同程度——怎么理解工具、怎么规划长任务、怎么处理失败重试、怎么改文件、怎么压上下文。DeepSeek 最清楚自己的模型在哪套提示词、哪个工具协议、哪种上下文结构下表现最好。
所以同一个 DeepSeek 模型,放进原生 Harness,大概率比放在第三方 Harness 里更能打。
这有点像苹果:芯片、系统、硬件全在自己手里,赢在联合优化。纵向一体化最大的优势,就俩字:协同。

一旦 DeepSeek Harness 能把自家模型榨到极限,技术用户自然会迁过去——他们要的是任务成功率,不是「你支持几个模型」。
02 但大多数人,并不想追着模型搬家
问题在于,绝大多数用户没兴趣每天研究哪个 Harness 更强。
过去几个月,国产模型轮番抢位:今天 Kimi 强,明天 DeepSeek 更新,后天 GLM 发新版,后面还排着 Qwen、MiniMax。难道每出一个更强模型,用户就要重新下载客户端、迁移 Skills、配置 MCP、导入文件,再重新适应一套工作方式?太折腾了。
大多数人真正想要的是:
我有一个稳定的工作台,底层模型谁强用谁,但我的文件、记忆、工具和工作习惯,都不要跟着变。

这正是 WorkBuddy 的机会。而且腾讯自己的大模型没有压倒性优势,反而让 WorkBuddy 更容易从第一天就走模型中立路线——它没有动力把 WorkBuddy 变成自家模型的销售渠道。
所以 WorkBuddy 可以把重心放在另一件事上:
不负责造最强模型,负责把不同模型变成可用的生产力。
03 DeepSeek 越强,有时反而越利好 WorkBuddy
这话听起来反直觉,但真不是抬杠。只要 WorkBuddy 能接好 DeepSeek,那么 DeepSeek 模型越强,WorkBuddy 的底层能力也跟着水涨船高。
它不需要打赢模型战争,只要做到:
-
DeepSeek 适合写代码,就调 DeepSeek; -
Kimi 擅长啃长文档,就调 Kimi; -
哪个模型生成 PPT 更好,就把活路由给谁; -
简单任务,丢给成本更低的模型。

到最后,用户甚至不用知道底层跑的是哪个模型。这时候 WorkBuddy 卖的不再是「模型下拉菜单」,而是三样东西:模型调度能力、工作流连续性、任务交付结果。 底层模型越卷,上层平台越容易吃到能力升级和降价的红利。
04 WorkBuddy 真正的壁垒,不是多模型
但话说回来,模型中立本身不构成护城河。支持一堆模型太容易了,难的是让不同模型在同一个 Harness 里都发挥出效果。
如果只是用同一套 Prompt、同一个 Agent Loop 去套所有模型,结局大概率是:什么模型都能接,但哪个模型都发挥不好。
所以多模型 Harness 必须针对每个模型做适配:不同的上下文结构、不同的工具调用协议、不同的重试机制,还要持续盯成本、速度和成功率。
更重要的是,WorkBuddy 得往工作场景的上层走。腾讯真正值钱的,不是接入了多少模型,而是腾讯文档、腾讯会议、企业微信、组织通讯录、权限体系、知识库、协作关系这一整坨。
模型可以被替换,企业的工作资产很难被替换。 当用户的文件、会议记录、模板、Skills、知识库、审批关系都沉淀在 WorkBuddy 里,迁移成本才真正形成。这也是为什么我会把 WorkBuddy 的用法整理成一本 91 页的绿皮书——它在承接真实办公文件这件事上,确实已经能干活了。
05 未来大概率是两条路线并存
我倾向于认为,未来的 Agent 市场会长期并存两种产品:
原生 Harness(Claude Code、Codex、千问办公、即将到来的 DeepSeek Harness)像苹果,单一组合性能很强;模型中立平台(WorkBuddy、OpenCode)像安卓,兼容性广,不用跟着底层供应商搬家。
所以市场不会变成「谁把谁替代」,更可能的分化是:
-
极客和程序员,用原生 Harness; -
普通个人用户,用综合工作台; -
企业用户,选与组织系统集成更深的平台; -
还有一部分人,两套一起用。
苹果和安卓吵了十几年,也没把对方吵死,对吧。
最后,回到开头那个问题
DeepSeek Harness 出来之后,还会有人用 WorkBuddy 吗?
我的答案是:会。但这不意味着可以高枕无忧。
DeepSeek Harness 会拿走一批追原生性能的技术用户,也会把第三方 Harness 的能力门槛抬高一大截。WorkBuddy 能不能留下用户,最终就看一件事:
能不能让用户在不明显损失 DeepSeek 原生能力的前提下,拿到一个更稳定、更完整、不用反复迁移的工作环境。
能做到,DeepSeek 对 WorkBuddy 来说就既是竞争对手,也是优质的底层供应商;做不到,WorkBuddy 可能真的只剩腾讯生态和企业客户。
真正决定未来格局的,不是谁手里有某一阶段最强的模型,而是谁能成为用户长期工作的入口。
模型会不断轮换。工作环境一旦养成,用户很少会轻易离开。