AI前沿 | 2026年9月5日:腾讯混元 Hy4 预览版开源,7700亿 MoE 胜 Kimi K3,国产模型再卷「百万上下文」
📊 腾讯于 8 月 31 日发布并开源 Hunyuan Hy4 预览版:7700 亿 MoE 总参数、100 万+ token 上下文,203 项工程任务盲测平均 2.99/4.00,略胜 GLM-5.3 与 Kimi K3。国产开源模型军备竞赛再升级。
一、Hy4 预览版:7700 亿参数的「混元」新王
腾讯于 8 月 31 日发布并开源Hunyuan Hy4 预览版,采用专家混合(MoE)架构,总参数量 7,700 亿,上下文窗口超过100 万 token,每次文本请求约启动 490 亿活跃参数。
在腾讯内部 163 位专家参与的203 项工程任务盲测中,Hy4 预览版平均得分2.99/4.00,略高于 GLM-5.3(2.92)与 Kimi K3(2.94)。
| 关键指标 | 数值 |
|---|---|
| 架构 | MoE 专家混合 |
| 总参数 | 7700 亿 |
| 活跃参数 | ~490 亿/请求 |
| 上下文 | 100 万+ token |
| 盲测得分 | 2.99/4.00(胜 GLM-5.3 / Kimi K3) |
| 输入定价 | $0.834 / 百万 token |
| 输出定价 | $2.501 / 百万 token |
| 免费期 | WorkBuddy / CodeBuddy 两周 |
二、递归式自我改进:从「训练」到「自我优化」
Hy4 预览版首次实现训练、数据策略、评估框架和底层算子的自动化优化,建立递归式自我改进循环:模型自主分析推理系统瓶颈,在算子融合和通信优化等领域进行多轮优化,端到端吞吐量较基线提升 31.8%,在不同上下文长度和并发等级下均取得持续提升。
三、Hy4 vs 行业:国产开源「卷」向何方
| 模型 | 总参数 | 上下文 | 特点 |
|---|---|---|---|
| 腾讯 Hy4 预览版 | 7700 亿 | 100万+ | 递归自改进、工程盲测第一梯队 |
| DeepSeek V4 | 1.6T (Pro) | 100万 | DSA 稀疏注意力、开源 |
| Kimi K3 | — | 百万级 | 月之暗面旗舰 |
| 讯飞星火 X2.5 | 4B/1.7B | 100万 | 端侧唯一百万上下文 |
🎯对开发者的启示:百万上下文正在成为国产旗舰的「标配」而非「卖点」。真正的差异化已经转移到:推理效率(稀疏注意力/算子优化)、Agent 任务表现(MCP/工具调用)、成本(开源 + 免费期)。选型时别再只看参数量,要看你的场景跑在真实基准上的差距。
数据来源:Gate 新闻、腾讯官方发布等公开信息整理。AI前沿系列 · 2026年9月5日