Hy3是什麼
Hy3 是騰訊混元開源的 295B 參數混合專家(MoE)模型。模型在 Agent 能力、推理與長上下文任務上顯著進步,多項基準比肩參數規模 2-5 倍的旗艦模型。通過強化後訓練與數據清洗,幻覺率降至 5.4%,常識錯誤率降至 12.7%。Hy3 支持代碼開發、辦公自動化、前端設計等多元生產力場景,是高性價比的可靠選擇。

Hy3的主要功能
-
智能體任務:在推理、智能體、長上下文等任務上顯著進步,多項基準比肩參數規模 2-5 倍的旗艦模型。
-
代碼開發:支持軟件開發、前端設計、CI/CD 等,在 SWE-bench 系列基準上表現優異。
-
辦公生產:支持 Excel 建模分析、PPT 製作、複雜數據彙總與聯動公式計算。
-
工具調用:增強工具調用穩定性與跨腳手架泛化性,支持 Codebuddy、Cline、KiloCode 等。
-
抗幻覺:通過細粒度數據清洗和訓練約束,顯著降低幻覺率和常識錯誤率。
-
多輪對話:優化指代消解、省略還原及多輪約束繼承,保持複雜長程交互中的意圖一致性。
Hy3的技術原理
-
後訓練優化:基於 preview 版本提升後訓練數據的質量和多樣性,擴大 RL 算力規模。
-
聯合訓練:在 SFT 與 RL 階段聯合優化指代消解、省略還原及多輪約束繼承等業務痛點。
-
數據清洗:進行細粒度的數據清洗和訓練約束,遵循”有依據纔回答、無依據明示缺失”原則。
-
軟硬協同:通過軟硬協同優化降低推理成本,提升 Token 效率。

微信關注回覆“開源”,加入AI開源項目交流羣
如何使用Hy3
- 獲取模型權重:訪問 GitHub、HuggingFace下載模型權重與代碼。
- 開通 API 服務:在騰訊雲控制檯開通 Hy3 API 服務,獲取訪問密鑰後即可通過接口調用。
- 配置運行環境:在本地或雲端配置好運行環境,加載模型並接入 Codebuddy、Cline、KiloCode 等腳手架工具。
- 調用完成任務:通過 API 或本地部署方式調用模型,完成代碼開發、辦公自動化、數據分析等任務。
Hy3的核心優勢
- 性能越級:在同尺寸模型中智能水平顯著領先,多項基準比肩參數規模 2-5 倍的旗艦模型。
- 體驗可靠:模型幻覺率從 12.5% 降至 5.4%,常識錯誤率從 25.4% 降至 12.7%,多輪問題率從 17.4% 降至 7.9%。
- 工具穩定:跨不同腳手架的 SWE Bench Verified 分數標準差控制在 4 個百分點以內,工具調用錯誤恢復能力大幅提升。
- 成本低廉:API 輸入 1 元/百萬 Tokens、輸出 4 元/百萬 Tokens,緩存命中輸入僅 0.25 元,辦公任務 Token 消耗較競品降低約 47-49%。
Hy3的項目地址
- 項目官網:https://hy.tencent.com/research/hy3
- GitHub倉庫:https://github.com/Tencent-Hunyuan/Hy3
- HuggingFace模型庫:https://huggingface.co/tencent/Hy3
Hy3的同類競品對比
| 對比維度 | Hy3 | DeepSeek-V4 pro |
|---|---|---|
| 模型架構 | 295B MoE,21B 激活參數 | 671B MoE,37B 激活參數 |
| 開源協議 | Apache 2.0 | MIT(開源可商用) |
| SWE-bench Verified | 78.0 | 80.6 |
| Terminal Bench 2.1 | 71.7 | 64.0* |
| BrowseComp | 84.2 | 83.4 |
| MCP Atlas (public) | 79.1 | 73.6* |
| ClawEval (pass*3) | 68.5 | 58.4/62.1* |
| SkillsBench (text-only) | 55.3 | 40.5* |
| HLE (with tools, text-only) | 53.2 | 48.2 |
| AA-LCR | 73.4 | 71.3* |
Hy3的應用場景
-
軟件開發:支持代碼生成、調試與 CI/CD 流程自動化,在 SWE-bench 等基準上表現優異。
-
辦公自動化:支持 Excel 建模分析、PPT 製作、複雜數據彙總與聯動公式計算。
-
前端設計:可生成可直接運行的 HTML 網頁與瀏覽器插件等前端代碼。
-
智能客服:支持 AI 分身與客服場景,能處理不完整表達並結合上下文做出合理判斷。
-
遊戲開發:支持遊戲邏輯編寫與遊戲助手接入,如《流放之路:降臨》AI 助手。
© 版權聲明
文章版权归作者所有,未经允许请勿转载。
相關文章
暫無評論...