
| 基本信息 | 详情 |
|---|---|
| 开发公司 | 腾讯(Tencent) |
| 上线时间 | 2023年首发;最新版 Hy3 正式版 2026年7月6日发布 |
| 官网 | https://hunyuan.tencent.com/ |
| 支持平台 | Web端、微信小程序、腾讯云TokenHub、桌面客户端(Windows/Mac) |
| 价格 | API输入1元/百万tokens,输出4元(缓存命中0.25元);个人专业版99元/月 |
| 核心定位 | 实用主义MoE大模型,295B总参数/21B激活,主打高性价比与规模化落地 |
腾讯混元是腾讯自研的大模型系列,覆盖文本、图像、视频、音频、3D 全模态。最新版 Hy3 在 2026 年 7 月正式发布,Preview 版在 4 月就放出来了。你可能在元宝或微信里已经用过它,不一定知道背后是同一个引擎。
Hy3 最值得注意的不是参数规模,是架构思路。它用 MoE(混合专家)架构,总参数 295B,但每次推理只激活 21B--实际计算量只有总参数的 7%。简单任务只调动少数专家模块,复杂任务才上更多算力。这种设计让推理成本大幅下降,同时保证了能力上限。官方标称推理效率比上一代提升 40%,CodeBuddy 和 WorkBuddy 场景下首 Token 延迟降低 54%。
起初我觉得腾讯在大模型赛道上起步偏慢,一直跟在百度文心和阿里通义后面。但 2025 年底腾讯重建了大模型研发架构,新设 AI Infra 部和 AI Data 部,请来姚顺雨(Vinces Yao)当首席 AI 科学家。Hy3 是重建后训练的第一个模型。从结果看,方向对了。
核心功能
快慢思考融合
Hy3 提供 no_think、think_low、think_high 三档思考模式。简单问答走 no_think 模式秒回,复杂数学或代码问题切到 think_high 慢思考。你不用换模型,一个 API 调用里切档位。这对 Agent 开发者尤其有用--可以根据任务复杂度动态分配算力。
多模态全覆盖
不只是聊天。混元支持文生图(HY Image 3.0,支持4K分辨率)、文生视频、文生3D(HY 3D 3.1)、图片理解(Hy Vision 2.0)。在元宝里你可以一句话让它生成 PPT、Word 文档、Excel 表格。腾讯内部产品的 AI 功能基本都是混元驱动的。
长上下文与复杂推理
256K 上下文长度,能处理万字报告、长合同、企业级文档。在 MATH 数学基准测试中拿到 76.28 分,大幅领先 DeepSeek-V3 的 61.6 分。SWE-Bench Verified(真实软件问题解决)得分 74.4%,比上一代混元 2.0 的 53.0% 提升超过 40%。清华数学博士资格考试中也是国内最高分。
翻译与多语言
Hy-MT2-Pro 支持 33 种语言和 5 种地区变体的翻译,在 Flores200 和 WMT25 基准上达到 SOTA。不只是翻译,还支持结构化输出、术语表强制、风格指定。做跨境电商或出海产品的团队可以直接用。
微信生态深度打通
这是混元独有的优势。与微信、公众号、视频号、企业微信深度集成,可以直接生成朋友圈文案、视频脚本、公众号文章。如果你做的是微信生态内的业务,混元的中文语义理解和文化贴合度比同级别海外模型好不少。
适合谁
适合: 已在用腾讯云服务的企业--API 接入简单,定价有竞争力,中文场景表现强。需要长文档处理、合同审核、万字报告总结的团队。做 Agent 开发的个人开发者--Hy3 的多档思考模式和低 API 价格适合高频调用。做微信生态产品的团队,混元是天然选择。
不适合: 需要英文为主的场景--Hy3 的训练重心是中文,英文能力虽有但不突出。追求绝对最强推理能力的场景--Coding 基准上仍落后于 GPT-5.5 和 Claude Opus 4.8,体感性能与 GLM-5.1 和 Kimi K2.6 也有一定差距。需要完全离线部署的团队--虽然开源了 Apache 2.0,但 295B 参数的本地部署硬件门槛不低。
同类竞品对比
| 维度 | 腾讯混元 Hy3 | 百度文心 4.5 | 阿里通义 Qwen3 | DeepSeek V4 |
|---|---|---|---|---|
| 架构 | MoE 295B/21B激活 | 未公开 | MoE | MoE |
| 上下文 | 256K | 128K | 128K | 128K |
| API输入价 | 1元/百万tokens | 约2元/百万tokens | 约0.5元/百万tokens | 约1元/百万tokens |
| 多模态 | 文/图/视频/音频/3D | 文/图 | 文/图 | 文为主 |
| 开源 | Apache 2.0 | 否 | 部分开源 | 开源 |
| 独有优势 | 微信生态+性价比 | 搜索增强 | 中英双语 | 极致低价 |
FAQ
混元 Hy3 可以免费使用吗?
可以。微信小程序和网页端有免费额度,元宝 App 里也能免费用。API 方面个人版有 Token Plan 套餐,最低 28 元/月。企业版按量计费。
Hy3 和 Hy3 Preview 有什么区别?
Preview 版 2026 年 4 月发布,正式版 7 月发布。正式版在幻觉率上降低了一半以上,WorkBuddy 任务成功率从 72% 提升到 90%,还新增了 no_think 等思考模式。
混元 Hy3 开源了吗?
是的,Apache 2.0 许可,商用免费。模型在 Hugging Face、ModelScope、腾讯云 TokenHub 都能下载。
混元支持英文吗?
支持,但训练重心是中文。Hy-MT2 翻译模型支持 33 种语言。纯英文推理任务建议对比测试 Qwen 或 Llama 系列。
腾讯混元和 DeepSeek 哪个好?
看场景。数学推理上 Hy3 明显更强(MATH 76.28 vs 61.6)。价格上两者都在国产低价梯队。DeepSeek 开源社区更活跃,混元胜在微信生态和多模态能力。
Hy3 的 295B 参数部署需要什么硬件?
自部署的话,295B 总参数的 MoE 模型需要多卡 A100 或 H100 配置。但 21B 激活参数意味着推理时的实际计算量不大。建议先用腾讯云 API 跑通业务,再考虑自部署。
更新动态
最近半年,腾讯混元动作很快。Hy3 Preview 在 4 月放出后,7 月正式版就上线了,中间只隔了三个月。正式版的核心改进是幻觉率腰斩--元宝里的常识错误率降低一半,幻觉减少超过一半。WorkBuddy 任务成功率从 72% 拉到 90%,选择 Hy3 的用户增长了六倍。7 月底还发布了 Hyra(Hunyuan Research Agent),一个能递归自我改进的研究型 Agent。
客户评论
汇总评分:在 270 位专家盲测中,Hy3 平均得分 2.67/4,超过 GLM-5.1 的 2.51。微信客服场景意图识别准确率 98.94%,和平精英 AI NPC 多轮推理成功率 92%。
评论一: "WorkBuddy 切到 Hy3 后,任务成功率从 72% 飙到 90%,任务平均完成时间降了 34%。这不是实验室数字,是真实业务场景跑出来的。"--腾讯内部产品数据(来源:腾讯混元官方博客)
评论二: "性价比是真的高。输入 1 元/百万 tokens,输出 4 元,缓存命中只要 0.25 元。对比 Kimi K2.6 的输入 6.5 元、输出 27 元,混元输入价格不到 Kimi 的五分之一。高频调 API 的团队算算账就知道差多少。"--开发者评测(来源:什么值得买)
参考来源
- ▸腾讯混元官网 | Introducing Hy3,腾讯混元官方研究页面,包含 Hy3 发布公告和技术细节
- ▸腾讯云 | 腾讯混元大模型产品页,腾讯云官方产品页,包含 API 定价、模型规格和产品路线图
- ▸互动百科 | Hy3 Preview,百科词条,含模型参数、架构和研发背景详细信息
- ▸什么值得买 | 腾讯混元Hy3价格屠夫实锤,含 Hy3 与 DeepSeek、Kimi 的价格和性能对比实测
- ▸AI D AMN | Tencent Hunyuan Hy3 Launches,Hy3 正式版发布报道,含盲测数据和应用案例
