DeepSeek Harness 真要来了,WorkBuddy 会被干掉吗
DeepSeek Harness 即将登场,与腾讯 WorkBuddy 正面竞争。一文解析:模型+Harness一体化 vs 模型中立平台,谁将主导Agent市场?核心内容:1. DeepSeek Harness的核心优势(模型与Harness一体化协同)2. WorkBuddy的定位与挑战(模型中立平台,多模型支持)3. Agent市场核心矛盾(一体化与中立平台的价值之争)
最近,DeepSeek 要出自家 Harness 的消息越来越密。公布 DeepSeek-v4-flash 正式版时,官方写道:

外界普遍预期它「很强」——尤其是代码、终端操作和长链路 Agent 任务。
好家伙,这就有意思了。让我想到最近腾讯在疯狂推广的 WorkBuddy。
先把背景交代清楚:WorkBuddy 是腾讯重点推出的一款 AI 工作助手,定位很直接,就是面向普通职场人的 Agent 工作台。你只需要把目标和材料交给它,后面的事它会自己拆解步骤、处理文件,并把最终结果沉淀在工作空间里。它本身并不生产模型,而是接入不同厂商的模型来完成任务,DeepSeek 也在它支持的模型名单里。
这一下,问题就来了:如果 DeepSeek 模型本身就强,又亲手做了最适配它的 Harness,那我为什么还要绕一圈,跑到 WorkBuddy 里去调用 DeepSeek?
这背后其实是 Agent 市场最核心的一组矛盾:
到底是「模型 + Harness 一体化」更强,还是「模型中立的平台」更有价值?

前者你多半见过或听说过:Claude Code、OpenAI Codex、阿里刚推出的千问办公(QwenWork),还有马上要来的 DeepSeek Harness——自家模型配自家 Harness,靠联合优化把能力榨到极致。后者是「模型中立派」:腾讯 WorkBuddy、开源 OpenCode,不押注单一模型,谁强用谁。
大概率是:
会有人继续用 WorkBuddy,而且大概率不少。
DeepSeek Harness 发布后,极客和程序员会先奔着原生 Harness 去;WorkBuddy 更大的机会,是面向普通人和企业做一个通用工作环境:底层模型可以换、文件和工作流保持稳定、文档表格会议和知识库统一管理,不用跟着模型榜单搬家。
所以 DeepSeek Harness 不一定能消灭 WorkBuddy。它更可能逼着 WorkBuddy 回答一个问题:
你到底是一个模型调用工具,还是一个真正的工作操作系统?
01 为什么 DeepSeek 的原生 Harness 可能很强
模型和 Harness,从来不是两个独立的模块。
判断一个模型是否胜任 Agent 角色,基准测试(Benchmark)分数并非唯一标尺,核心在于它与执行环境的协同深度。这具体体现在:能否精准理解工具、能否有效规划长任务、能否从容处理失败重试、能否安全修改文件,以及能否高效驾驭上下文窗口。DeepSeek 对自身模型的优势边界有着极为清晰的认知——它深知在何种提示词范式、何种工具协议以及何种上下文结构下,其性能表现最为出色。
所以同一个 DeepSeek 模型,放进原生 Harness,大概率比放在第三方 Harness 里更能打。
这有点像苹果:芯片、系统、硬件全在自己手里,赢在联合优化。纵向一体化最大的优势,就俩字:
协同

一旦 DeepSeek Harness 能把自家模型榨到极限,技术用户自然会迁过去——他们要的是任务成功率,不是「你支持几个模型」。
02 但大多数人,并不想追着模型搬家
问题在于,绝大多数用户没兴趣每天研究哪个 Harness 更强。
过去几个月,国产模型轮番抢位:今天 Kimi 强,明天 DeepSeek 更新,后天 GLM 发新版,后面还排着 Qwen、MiniMax。难道每出一个更强模型,用户就要重新下载客户端、迁移 Skills、配置 MCP、导入文件,再重新适应一套工作方式?太折腾了。
大多数人真正想要的是:
我有一个稳定的工作台,底层模型谁强用谁,但我的文件、记忆、工具和工作习惯,都不要跟着变。

这正是 WorkBuddy 的机会。而且腾讯自己的大模型没有压倒性优势,反而让 WorkBuddy 更容易从第一天就走模型中立路线——它没有动力把 WorkBuddy 变成自家模型的销售渠道。
所以 WorkBuddy 可以把重心放在另一件事上:
不负责造最强模型,负责把不同模型变成可用的生产力。
03 DeepSeek 越强,有时反而越利好 WorkBuddy
这话听起来反直觉,但真不是抬杠。只要 WorkBuddy 能接好 DeepSeek,那么 DeepSeek 模型越强,WorkBuddy 的底层能力也跟着水涨船高。
它不需要打赢模型战争,只要做到:
- DeepSeek 适合写代码,就调 DeepSeek;
- Kimi 擅长啃长文档,就调 Kimi;
- 哪个模型生成 PPT 更好,就把活路由给谁;
- 简单任务,丢给成本更低的模型。

到最后,用户甚至不用知道底层跑的是哪个模型。这时候 WorkBuddy 卖的不再是「模型下拉菜单」,而是三样东西:
模型调度能力、工作流连续性、任务交付结果。
04 WorkBuddy 真正的壁垒,不是多模型
但话说回来,模型中立本身不构成护城河。支持一堆模型太容易了,难的是让不同模型在同一个 Harness 里都发挥出效果。
如果只是用同一套 Prompt、同一个 Agent Loop 去套所有模型,结局大概率是:
什么模型都能接,但哪个模型都发挥不好。
所以多模型 Harness 必须针对每个模型做适配:不同的上下文结构、不同的工具调用协议、不同的重试机制,还要持续盯成本、速度和成功率。
更重要的是,WorkBuddy 得往工作场景的上层走。腾讯真正值钱的,不是接入了多少模型,而是腾讯文档、腾讯会议、企业微信、组织通讯录、权限体系、知识库、协作关系这一整坨。
模型可以被替换,企业的工作资产很难被替换。
05 未来大概率是两条路线并存
我倾向于认为,未来的 Agent 市场会长期并存两种产品:
原生 Harness
模型中立平台
所以市场不会变成「谁把谁替代」,更可能的分化是:
- 极客和程序员,用原生 Harness;
- 普通个人用户,用综合工作台;
- 企业用户,选与组织系统集成更深的平台;
- 还有一部分人,两套一起用。
苹果和安卓吵了十几年,也没把对方吵死,对吧。
最后,回到开头那个问题
DeepSeek Harness 出来之后,还会有人用 WorkBuddy 吗?
我的答案是:会。但这不意味着可以高枕无忧。
DeepSeek Harness 会拿走一批追原生性能的技术用户,也会把第三方 Harness 的能力门槛抬高一大截。WorkBuddy 能不能留下用户,最终就看一件事:
能不能让用户在不明显损失 DeepSeek 原生能力的前提下,拿到一个更稳定、更完整、不用反复迁移的工作环境。
能做到,DeepSeek 对 WorkBuddy 来说就既是竞争对手,也是优质的底层供应商;做不到,WorkBuddy 可能真的只剩腾讯生态和企业客户。
真正决定未来格局的,不是谁手里有某一阶段最强的模型,而是谁能成为用户长期工作的入口。
模型会不断轮换。工作环境一旦养成,用户很少会轻易离开。
登录查看剩余 70% 内容
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名