share_log

從「坐不上主桌」到「算力擠爆」,騰訊AI重回牌桌?

財聯社 ·  07/10 11:39

①Hy3正式發佈兩天後,騰訊WorkBuddy平台上Hy3模型的算力資源被擠爆,下午排隊率一度超過50%。②過去兩年,騰訊在大模型戰場始終「坐不上主桌」。如今服務器被「擠爆」的瞬間,比任何發佈會都更能說明——騰訊AI終於有人搶着用了。

《科創板日報》7月10日訊(記者 李佳怡)7月8日上午10時, $騰訊控股 (00700.HK)$ WorkBuddy平台上混元Hy3模型的算力資源被擠爆,下午排隊率一度超過50%。官方連夜調度擴容,7月9日上午公告服務恢復。

同樣在7月9日,全球大模型API調用平台OpenRouter上,處於限時免費階段的Hy3升至最受歡迎模型榜單第八名。與此同時,Hy3發佈當天,騰訊股價上漲4.82%,美銀證券隨即給出「買入」評級,稱Hy3實際表現超出預期。

過去兩年,騰訊在大模型戰場始終「坐不上主桌」。今年5月股東大會上,馬化騰用「上了船,後來發現船漏水,現在站上去了,還坐不下去」形容騰訊AI處境。

如今排隊率50%,這個服務器被「擠爆」的瞬間,比任何發佈會都更能說明——騰訊AI終於有人搶着用了。

▎被「擠爆」:Hy3排隊50%意味着什麼?

在大模型行業,「排隊」從來不是一個單純的負面詞彙。

2023年初ChatGPT爆火時的排隊,是供需失衡的慌亂;2024年DeepSeek崛起時的排隊,是技術突襲帶來的措手不及。而騰訊Hy3這一次的排隊,發生在WorkBuddy上——一個承載自動化腳本生成、工作流編排等真實複雜場景的辦公智能體。

用戶來到WorkBuddy調用Hy3,不是來「嚐鮮」,而是爲了完成真實的生產力任務。

Hy3在 7月6日正式發佈,兩天後就擠爆了WorkBuddy。在Hy3 preview階段日均Token消耗便已增長20倍,WorkBuddy上自主選擇Hy3 preview的用戶數同樣增長了6倍,直到正式版發佈後的排隊,不難看出市場對「Hy3」這個標籤的認可度發生了質變。

排隊的直接原因是調用量超出預期,用戶願意來、也願意等。排隊峰值期超過一半的請求在等待處理,用戶沒有大規模流失。這本身也是一種隱性的投票——Hy3的生產力價值,值得排隊。

從技術路線看,Hy3走的是「小身板對標大模型」的路子。

Hy3採用MoE架構,總參數295B、激活參數僅21B,用21B的「實動兵力」跑出參數規模2到5倍旗艦模型的水平,尤其適用於Coding 與智能體(Agent)類場景。

目前,Hy3已在WorkBuddy/CodeBuddy、元寶、Marvis、ima、微信等多個業務接入,API已在騰訊雲TokenHub上線,多個海外API平台也將陸續接入。

那麼,Hy3在真實工作場景中的表現如何?

數據顯示,270位專家基於真實工作的模型盲測中,Hy3均分2.67/4,優於GLM5.1的2.51/4,尤其在前端、數據與存儲、CI/CD等類別優勢顯著。幻覺率從12.5%降到5.4%,常識錯誤率從25.4%降到12.7%。

WorkBuddy Context Engineering負責人Elden告訴《科創板日報》記者,內部測評數據顯示:相比 Hy3 preview,Hy3正式版在任務解決率從 72% 躍升至 90%,平均耗時縮短34%。與此同時,高頻辦公任務中,Hy3 token消耗顯著低於 GLM-5.2——文檔處理節省 47.4%,PPT 製作節省49.0%。

在定價上,Hy3 延續了實用、普惠的模型定位,輸入1元/百萬tokens、輸出4元/百萬tokens,輸入命中緩存價格0.25元/百萬tokens。同時,Hy3 採用商業友好度高的Apache2.0開源協議,全球開發者均可下載和免費商用。

需要注意的是,Hy3 同樣也存在偏科問題,優勢集中在搜索類智能體場景。BrowseComp(AI模型評測基準)84.2分,與GPT-5.5的84.4分幾乎持平。此外,在Agent 執行層面的表現同樣可圈可點。

然而,在決定大模型能力上限的複雜推理、硬核代碼等領域,Hy3稍顯遜色。例如,SWE-bench Pro(AI編程能力評測基準)得分57.9分,落後於Claude Opus 4.8的69.2分和千問的60.6分;MathArena Apex(數學推理基準)38.7分,不到GPT-5.5的一半,也落後於千問的44.5分。

儘管有些偏科,但業內對第一梯隊的認定,並非看誰更全能,而是看誰在覈心賽道上卡住了繞不開的位置。Hy3在搜索智能體和Agent執行的領先,足以讓它觸到第一梯隊的門檻。

▎姚順雨的半年:騰訊AI如何從「背題」到「上桌」

要理解Hy3爲什麼能排隊,得先搞清楚這個模型是怎麼來的。

2025年12月,28歲的姚順雨空降騰訊,出任「CEO/總裁辦公室」首席AI科學家。他接手的混元,在騰訊內部都坐不上主桌。2026年1月騰訊內部年會上,劉熾平復盤了混元此前的發展問題,他用了一個比喻:高中生背題應考,成績單好看,上了考場就露餡。

姚順雨到任後的第一件事,不是急着發模型,而是推倒重來。

2026年1月底,混元啓動底層基礎設施全面重建,包括預訓練重建、強化學習重建、數據體系重建、評估體系重建等。他的方法論叫Co-design:邊訓邊用,讓產品反饋倒逼模型迭代。3月,騰訊正式撤銷成立十年的AI Lab,核心研發力量收攏至混元主線。

從1月底重建到4月23日Hy3 preview發佈,再到7月6日正式版,不到半年時間,混元跑通了從底層重構到產品反哺的完整鏈路。姚順雨在社交媒體表示,從Hy2到Hy3 preview再到Hy3,不到半年,又一次巨大的飛躍。

值得一提的是,據媒體報道,騰訊即將迎來混元多模態模型負責人,OpenAI研究科學家田永龍即將加入混元團隊,而田是姚順雨在OpenAI的前同事。他的到來,意味着騰訊正在補齊多模態這塊最後的能力拼圖。

一直以來,騰訊不缺入口,不缺場景,真正缺的是一個能支撐這些入口的模型中樞。Hy3的出現也意味着這個中樞已經補上,但與此同時,新的問題也來了。

Hy3的性價比路線正在面臨雙重擠壓,向上,頂級大模型持續降價;向下,DeepSeek、阿里、智譜、小米等廠商都在推出更低成本、更強推理能力的模型。Hy3的價格優勢在今天的市場能維持多久,還有待觀望。

此外,業內普遍認爲騰訊做AI最大的底牌是微信——14億月活,全行業最豐富的場景和數據。但問題是,微信數據受隱私保護,無法直接用於模型訓練。也就是說,騰訊手握全行業最厚的context,卻很難把它真正灌進模型的訓練閉環裏。

目前來看,姚順雨給騰訊AI立住的第一層人設,是認真打磨模型底座,Hy3也讓騰訊AI終於有了一份可驗證的階段性成果。但重新上桌之後,能不能坐穩、能不能翻盤,還需持續觀望。

編輯/KOKO

譯文內容由第三人軟體翻譯。


以上內容僅用作資訊或教育之目的,不構成與象象銀行相關的任何投資建議。象象銀行竭力但無法保證上述全部內容的真實性、準確性和原創性。