4 月 23 日,騰訊混元 Hy3 preview 語言模型發(fā)布并開源。這是一個快慢思考融合的混合專家模型,總參數(shù) 295B,激活參數(shù) 21B,最大支持 256K 上下文長度。這是混元重建后訓(xùn)練的第一個模型,也是混元迄今最智能的模型,在復(fù)雜推理、指令遵循、上下文學(xué)習(xí)、代碼、智能體等能力及推理性能上實現(xiàn)了大幅的提升。
2026 年2月,騰訊混元重建了預(yù)訓(xùn)練和強化學(xué)習(xí)的基礎(chǔ)設(shè)施,以及模型追求實用性的三個原則:
1、能力體系化: 不推崇“偏科”,因為即使是代碼智能體的單一應(yīng)用,也涉及推理、長文、指令、對話、代碼、工具等多種能力的深度協(xié)同。
2、評測真實性: 主動跳出易被“刷榜”的公開榜單,通過自建題目、最新考試、人工評測、產(chǎn)品眾測等多種方式評估和改進(jìn)模型的“真實戰(zhàn)斗力”。
3、性價比追求:實用性離不開商業(yè)合理性,深度協(xié)同模型架構(gòu)和推理框架的設(shè)計,大幅降低任務(wù)成本,讓智能用得起、用得好。
Hy3 preview可以視為混元快速探索實用性大模型、解決真實世界問題的一個開端。
騰訊首席AI科學(xué)家姚順雨表示,Hy3 preview是混元大模型重建的第一步。我們希望通過這次開源和發(fā)布,獲得來自開源社區(qū)和用戶的真實反饋,幫助我們提升 Hy3 正式版的實用性。與此同時,我們也在繼續(xù)擴大預(yù)訓(xùn)練和強化學(xué)習(xí)的規(guī)模,提升模型的智能上限,并通過與騰訊眾多產(chǎn)品的深度Co-Design,持續(xù)提升模型在真實場景中的綜合表現(xiàn),并開始探索特色模型能力。
目前,Hy3 preview 已在騰訊云、元寶、ima、CodeBuddy、WorkBuddy、QQ、QQ瀏覽器、騰訊文檔、騰訊樂享等首發(fā)上線,微信公眾號、和平精英、騰訊新聞、騰訊自選股、騰訊客服、微信讀書等多個主線產(chǎn)品也在陸續(xù)上線。另外,Hy3 preview 支持接入流行的開源智能體產(chǎn)品,如 OpenClaw、OpenCode、KiloCode 等,并已上架騰訊云大模型服務(wù)平臺 TokenHub。
據(jù)介紹,正式上線之前,Hy3 preview在騰訊主要AI 業(yè)務(wù)進(jìn)行了產(chǎn)品測試,獲得明顯正收益。比如在和平精英 AI NPC 場景評測中,和平精英團隊第一時間在Hy3 preview上線后基于 AI NPC 場景中完成接入并開展評測,整體表現(xiàn)令人印象深刻。在游戲局外的人設(shè)扮演場景中,Hy3 Preview 不僅能夠精準(zhǔn)理解角色設(shè)定,還能針對開放性問題輸出高度關(guān)聯(lián)、富有增量價值的內(nèi)容,帶來了更加真實、自然、沉浸的對話體驗。而在游戲局內(nèi)的復(fù)雜對戰(zhàn)場景中,模型回復(fù)節(jié)奏貼近真實玩家聊天體驗,展現(xiàn)出優(yōu)秀的穩(wěn)定性與出色的擬人化扮演能力,整體效果表現(xiàn)亮眼。
得益于模型和推理框架上的深度協(xié)同,以及在推理框架、算子性能、量化算法等全方面優(yōu)化,整體推理效率提升40%,Hy3 preview的成本相比上一代模型也大幅下降。
雅菲 曉風(fēng)