半年逆袭!腾讯WorkBuddy月访量夺冠,办公Agent大战一触即发

半年逆袭:腾讯WorkBuddy月访量夺冠

半年之前,资本市场对腾讯AI多是担忧,资本开支落后同行,模型团队大换血,马化腾都承认“动作慢了”。半年后,易观Q2报告揭晓座次。2026年6月,17款主流桌面端AI办公智能体月访问量破6000万次,腾讯WorkBuddy以2097万排名第一,超第二名字节Trae和第三名阿里Qoder Work总和。若将腾讯旗下WorkBuddy、CodeBuddy、QClaw、Marvis 4款产品流量相加,达3262万,或占大盘半壁江山。

腾讯发力与对手追赶

腾讯正抓领先契机,WorkBuddy推广投放现身一线城市楼宇,内部也提升其在组织内地位,QClaw并入WorkBuddy部门。7月30日,还联合腾讯文档推出「人机双写」协同编辑能力,用户可与AI在同一文档实时协作。面对Agent产品和用户数据挑战,阿里和字节加速追赶。阿里将三款Agent合并为“千问办公”,7月27日尝鲜版上线;3天后,字节旗下豆包和飞书整合提速。

办公级Agent重估公司价值

半年间,三家大厂从ToC端投流转向Agent办公赛道。行业共识是,办公级Agent正从两维度重估公司价值。一是企业AI系统争夺。Gartner 7月预测,到2030年,智能体AI或影响2340亿美元企业应用软件支出,占企业SaaS支出20%。智能体可跨系统执行任务,冲击传统软件界面入口和收费模式。一旦Agent融入企业工作流,迁移成本将高于传统应用。IDC预计2026年保持翻倍增长,谁掌控办公Agent入口,谁就把握企业AI支出闸口。二是对AI模型的影响。1300万人每日在Agent完成任务,其工作过程或助模型变强。若如此,WorkBuddy给腾讯带来的不仅是收入预期,还有未来模型能力闭环,这或是重估办公级Agent的根本逻辑。

腾讯的发展历程与现状

过去两年,市场评价大厂AI多关注资本开支。2025年,腾讯资本开支792亿元,因GPU供应受限,节奏慢于同行。与此同时,前OpenAI研究员姚顺雨任首席AI科学家,向总裁刘炽平汇报,统领AI Infra部与大语言模型部。2026年,姚顺雨掌舵的混元团队重建预训练与强化学习基础设施,AI Lab并入混元。4月23日,混元发布重建后首个模型Hy3 Preview;2个多月后,总参数295B的Hy3正式版发布并开源,支持256K上下文。另一条线影响更大。2026年1月,腾讯云约十人的AI代码助手团队用两个通宵做出WorkBuddy原型,超2000名员工参与内部测试。3月初上线时,用户访问量远超预期,团队紧急扩容。二季度末,易观数据显示,WorkBuddy PC端月访问量破2000万,超第二名与第三名之和。花旗研报称其月活破2000万、日活破1300万。上线三个月,平台人均Token消耗增长超十倍。马化腾在Q1财报称“WorkBuddy是中国使用最广的效率AI智能体服务”。但财报中,腾讯主动披露,剔除新AI产品收入、成本及开支,2026年Q1经调整经营盈利844亿元,同比增长17%,利润率升至43.0%;包含上述因素时,同期经调整经营盈利756亿元,同比增长9%,利润率38.5%,与上年持平。Q1资本开支319亿元,同比增长16%,达上年全年的4成。刘炽平称下半年资本开支增幅更明显,汤道生表示WorkBuddy仍处投入阶段,未设商业化目标KPI。

WorkBuddy带来的价值

2026年6月5日,腾讯AI产业应用大会上,姚顺雨表示“AI下半场难点从找方法转向找好问题,模型需好的Context,缺合适工具和环境,Agent很多事无法完成”,还强调模型研发应基于真实产品和应用评测,实用性大于刷榜价值。WorkBuddy给腾讯带来的价值分三层:第一层,是中国最大的真实任务分布。两千万月活用户的需求,如写报告、整理文件等,无法由专家设计,Benchmark也无法呈现。WorkBuddy渗透率越高,腾讯对真实任务分布越清晰,它是问题发现机器。第二层,是执行轨迹与偏好信号。WorkBuddy记录执行链路,包括模型拆解任务、调用工具等情况,用户行为含大量隐性偏好数据,可用于强化学习和偏好训练。产品具备工具调用级轨迹记录与回放能力,能记录任务执行过程。第三层,是将真实工作转化为可评测任务的方法。7月23日,腾讯发布《Tencent WorkBuddy Bench》论文,这是多领域Agent评测基准,覆盖四个工作域,任务源于真实场景,数据集等全部开源。该基准将“模型能力”和“执行框架能力”分离,目的是给两者打分,契合姚顺雨学术观点,混元也借此跑通模型研发链路。

训练数据源的迁移与案例验证

“干活成为新的训练数据源”在海外已获验证。大模型训练数据来源历经三轮迁移,2026年预算转向真实世界工作数据和强化学习环境。关键是Agent任务变长,人工搭建训练环境难度增加。行业流行两种数据分类,人工构造数据和真实工作捕获数据。GitHub数据属前者,获取难度大。可行路径是从真实工作提取任务分布,构造可训练样本。WorkBuddy Bench即如此,它让占据工作入口的应用公司有训练价值。编程工具Cursor、DoorDash案例呼应验证者定律,即训练AI解决任务的难易与任务可验证性成正比。强化学习关键在于环境可重置,编码适合强化学习,但真实世界复杂,非编码场景构建可验证、可重置训练环境者将获稀缺优势。WorkBuddy渗透率提升,让腾讯更接近这一优势。

Hy3限免与竞争挑战

WorkBuddy内置多家模型供用户选择,定位为国产模型办公中转站。7月6日Hy3发布,WorkBuddy首发接入并限时免费。2天后,Hy3算力消耗达峰值,排队率超50%,团队连夜扩容。腾讯延长限免至8月5日,披露选择Hy3用户占比超60%。限免前,用户选择分散。混元强化学习需自身尝试与失败,限免使Hy3占比超6成,腾讯用推理算力换得自家模型在真实工作的探索份额。Hy3渗透加快,但面临开源模型挑战。7月27日,Kimi K3开放权重并加入营收挂钩条款,或增加WorkBuddy运营成本,但开源模型强利好WorkBuddy这类入口。限免能否持续带来高占比,取决于混元产品力。

harness价值与WorkBuddy的不足

今年编程Agent类产品执行长程任务表现优于通用办公智能体,原因是harness价值,即“驾驭大模型完成任务的控制框架”。编程Agent在该框架打磨久,执行复杂任务成功率高。办公Agent的harness尚处早期,长程任务成功率低,成本高。WorkBuddy的harness正被用户打磨,更新日志有改进痕迹。WorkBuddy Bench分离框架和模型变量,Skill生态也类似,Skill调用分布为模型和harness提供反馈。虽WorkBuddy领先,但并非完美。与Codex、Claude Code相比,它缺乏异步执行能力和复杂代码仓库上下文管理能力。社区反馈其处理复杂格式文档精细度不足,长程任务有重复执行、偏离目标问题,积分消耗透明度待提高,独立APP远程遥控功能有限。不过这些问题可通过轨迹分析改善,目前产品到模型反馈回路多在产品层。

腾讯组织收敛与重估指标

腾讯针对Agent产品组织收敛。7月20日,QClaw业务和部分团队并入WorkBuddy部门,QClaw负责人离职。年初多条产品线并行,WorkBuddy月活领先并吸并QClaw,被视为腾讯聚焦信号。接近腾讯人士称资源向WorkBuddy聚拢,但内部竞争仍存在,harness更注重效率。重估腾讯需观察5个指标:一是8月5日后Hy3选用率,若高位说明产品力驱动替代;二是企业付费坐席与活跃企业数,C端提供训练信号,B端产生收入;三是长链路任务完成率与返工率,反映harness能力;四是WorkBuddy Bench是否有真实用户轨迹子集,打通产品到训练通路;五是能力能否迁移到其他腾讯产品,避免内部产品壁垒阻断闭环。

竞争态势与市场前景

腾讯收敛资源,但对手追赶。7月27日,阿里“千问办公”尝鲜版上线,整合三款Agent,由新任钉钉CEO操盘。阿里此前布局有优势,但WorkBuddy有先发和用户惯性优势。7月30日,字节调整组织架构,整合豆包、飞书和火山引擎业务,加强企业生产力场景协同。TRAE Work与WorkBuddy直接竞争,有优势也有劣势。此外,6月企业微信推出AI Agent“大圆”内测,若落地顺利,企业微信或成“工作数据+客户连接”的Agent入口。Gartner预测智能体将替代重复性高的企业工作,谁的Agent站稳办公桌面,谁就可能成企业AI系统默认入口,迁移成本高。2025年中国AI智能体市场规模804亿元,同比增长123.2%,艾媒咨询预计2030年达6968亿元。三家大厂收拢产品线、集中资源,办公级Agent大战或一触即发,内部赛马阶段临近尾声,接下来比拼谁先让办公Agent成企业付费标配,谁能从真实工作场景提取训练价值。腾讯需将用户失败转化为模型训练燃料,这无法在财务等方面体现,只能待混元变好时被认可。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值