share_log

从“坐不上主桌”到“算力挤爆”,腾讯AI重回牌桌?

cls.cn ·  10 ก.ค. 11:39

①Hy3正式发布两天后,腾讯WorkBuddy平台上Hy3模型的算力资源被挤爆,下午排队率一度超过50%。②过去两年,腾讯在大模型战场始终“坐不上主桌”。如今服务器被“挤爆”的瞬间,比任何发布会都更能说明——腾讯AI终于有人抢着用了。

《科创板日报》7月10日讯(记者 李佳怡)7月8日上午10时, $腾讯控股 (00700.HK)$ WorkBuddy平台上混元Hy3模型的算力资源被挤爆,下午排队率一度超过50%。官方连夜调度扩容,7月9日上午公告服务恢复。

同样在7月9日,全球大模型API调用平台OpenRouter上,处于限时免费阶段的Hy3升至最受欢迎模型榜单第八名。与此同时,Hy3发布当天,腾讯股价上涨4.82%,美银证券随即给出“买入”评级,称Hy3实际表现超出预期。

过去两年,腾讯在大模型战场始终“坐不上主桌”。今年5月股东大会上,马化腾用“上了船,后来发现船漏水,现在站上去了,还坐不下去”形容腾讯AI处境。

如今排队率50%,这个服务器被“挤爆”的瞬间,比任何发布会都更能说明——腾讯AI终于有人抢着用了。

▎被“挤爆”:Hy3排队50%意味着什么?

在大模型行业,“排队”从来不是一个单纯的负面词汇。

2023年初ChatGPT爆火时的排队,是供需失衡的慌乱;2024年DeepSeek崛起时的排队,是技术突袭带来的措手不及。而腾讯Hy3这一次的排队,发生在WorkBuddy上——一个承载自动化脚本生成、工作流编排等真实复杂场景的办公智能体。

用户来到WorkBuddy调用Hy3,不是来“尝鲜”,而是为了完成真实的生产力任务。

Hy3在 7月6日正式发布,两天后就挤爆了WorkBuddy。在Hy3 preview阶段日均Token消耗便已增长20倍,WorkBuddy上自主选择Hy3 preview的用户数同样增长了6倍,直到正式版发布后的排队,不难看出市场对“Hy3”这个标签的认可度发生了质变。

排队的直接原因是调用量超出预期,用户愿意来、也愿意等。排队峰值期超过一半的请求在等待处理,用户没有大规模流失。这本身也是一种隐性的投票——Hy3的生产力价值,值得排队。

从技术路线看,Hy3走的是“小身板对标大模型”的路子。

Hy3采用MoE架构,总参数295B、激活参数仅21B,用21B的“实动兵力”跑出参数规模2到5倍旗舰模型的水平,尤其适用于Coding 与智能体(Agent)类场景。

目前,Hy3已在WorkBuddy/CodeBuddy、元宝、Marvis、ima、微信等多个业务接入,API已在腾讯云TokenHub上线,多个海外API平台也将陆续接入。

那么,Hy3在真实工作场景中的表现如何?

数据显示,270位专家基于真实工作的模型盲测中,Hy3均分2.67/4,优于GLM5.1的2.51/4,尤其在前端、数据与存储、CI/CD等类别优势显著。幻觉率从12.5%降到5.4%,常识错误率从25.4%降到12.7%。

WorkBuddy Context Engineering负责人Elden告诉《科创板日报》记者,内部测评数据显示:相比 Hy3 preview,Hy3正式版在任务解决率从 72% 跃升至 90%,平均耗时缩短34%。与此同时,高频办公任务中,Hy3 token消耗显著低于 GLM-5.2——文档处理节省 47.4%,PPT 制作节省49.0%。

在定价上,Hy3 延续了实用、普惠的模型定位,输入1元/百万tokens、输出4元/百万tokens,输入命中缓存价格0.25元/百万tokens。同时,Hy3 采用商业友好度高的Apache2.0开源协议,全球开发者均可下载和免费商用。

需要注意的是,Hy3 同样也存在偏科问题,优势集中在搜索类智能体场景。BrowseComp(AI模型评测基准)84.2分,与GPT-5.5的84.4分几乎持平。此外,在Agent 执行层面的表现同样可圈可点。

然而,在决定大模型能力上限的复杂推理、硬核代码等领域,Hy3稍显逊色。例如,SWE-bench Pro(AI编程能力评测基准)得分57.9分,落后于Claude Opus 4.8的69.2分和千问的60.6分;MathArena Apex(数学推理基准)38.7分,不到GPT-5.5的一半,也落后于千问的44.5分。

尽管有些偏科,但业内对第一梯队的认定,并非看谁更全能,而是看谁在核心赛道上卡住了绕不开的位置。Hy3在搜索智能体和Agent执行的领先,足以让它触到第一梯队的门槛。

▎姚顺雨的半年:腾讯AI如何从“背题”到“上桌”

要理解Hy3为什么能排队,得先搞清楚这个模型是怎么来的。

2025年12月,28岁的姚顺雨空降腾讯,出任“CEO/总裁办公室”首席AI科学家。他接手的混元,在腾讯内部都坐不上主桌。2026年1月腾讯内部年会上,刘炽平复盘了混元此前的发展问题,他用了一个比喻:高中生背题应考,成绩单好看,上了考场就露馅。

姚顺雨到任后的第一件事,不是急着发模型,而是推倒重来。

2026年1月底,混元启动底层基础设施全面重建,包括预训练重建、强化学习重建、数据体系重建、评估体系重建等。他的方法论叫Co-design:边训边用,让产品反馈倒逼模型迭代。3月,腾讯正式撤销成立十年的AI Lab,核心研发力量收拢至混元主线。

从1月底重建到4月23日Hy3 preview发布,再到7月6日正式版,不到半年时间,混元跑通了从底层重构到产品反哺的完整链路。姚顺雨在社交媒体表示,从Hy2到Hy3 preview再到Hy3,不到半年,又一次巨大的飞跃。

值得一提的是,据媒体报道,腾讯即将迎来混元多模态模型负责人,OpenAI研究科学家田永龙即将加入混元团队,而田是姚顺雨在OpenAI的前同事。他的到来,意味着腾讯正在补齐多模态这块最后的能力拼图。

一直以来,腾讯不缺入口,不缺场景,真正缺的是一个能支撑这些入口的模型中枢。Hy3的出现也意味着这个中枢已经补上,但与此同时,新的问题也来了。

Hy3的性价比路线正在面临双重挤压,向上,顶级大模型持续降价;向下,DeepSeek、阿里、智谱、小米等厂商都在推出更低成本、更强推理能力的模型。Hy3的价格优势在今天的市场能维持多久,还有待观望。

此外,业内普遍认为腾讯做AI最大的底牌是微信——14亿月活,全行业最丰富的场景和数据。但问题是,微信数据受隐私保护,无法直接用于模型训练。也就是说,腾讯手握全行业最厚的context,却很难把它真正灌进模型的训练闭环里。

目前来看,姚顺雨给腾讯AI立住的第一层人设,是认真打磨模型底座,Hy3也让腾讯AI终于有了一份可验证的阶段性成果。但重新上桌之后,能不能坐稳、能不能翻盘,还需持续观望。

编辑/KOKO

The above content is for informational or educational purposes only and does not constitute any investment advice related to EleBank. Although we strive to ensure the truthfulness, accuracy, and originality of all such content, we cannot guarantee it.