AI万址
腾讯混元大模型

腾讯混元大模型

腾讯混元 Hy3 是采用 MoE 架构的大语言模型,295B总参数/21B激活,支持256K上下文,输入1元/百万tokens。本文详解功能、竞品对比与使用指南。

腾讯混元大模型
访问官网
基本信息详情
开发公司腾讯(Tencent)
上线时间2023年首发;最新版 Hy3 正式版 2026年7月6日发布
官网https://hunyuan.tencent.com/
支持平台Web端、微信小程序、腾讯云TokenHub、桌面客户端(Windows/Mac)
价格API输入1元/百万tokens,输出4元(缓存命中0.25元);个人专业版99元/月
核心定位实用主义MoE大模型,295B总参数/21B激活,主打高性价比与规模化落地

腾讯混元是腾讯自研的大模型系列,覆盖文本、图像、视频、音频、3D 全模态。最新版 Hy3 在 2026 年 7 月正式发布,Preview 版在 4 月就放出来了。你可能在元宝或微信里已经用过它,不一定知道背后是同一个引擎。

Hy3 最值得注意的不是参数规模,是架构思路。它用 MoE(混合专家)架构,总参数 295B,但每次推理只激活 21B--实际计算量只有总参数的 7%。简单任务只调动少数专家模块,复杂任务才上更多算力。这种设计让推理成本大幅下降,同时保证了能力上限。官方标称推理效率比上一代提升 40%,CodeBuddy 和 WorkBuddy 场景下首 Token 延迟降低 54%。

起初我觉得腾讯在大模型赛道上起步偏慢,一直跟在百度文心和阿里通义后面。但 2025 年底腾讯重建了大模型研发架构,新设 AI Infra 部和 AI Data 部,请来姚顺雨(Vinces Yao)当首席 AI 科学家。Hy3 是重建后训练的第一个模型。从结果看,方向对了。

核心功能

01

快慢思考融合

Hy3 提供 no_think、think_low、think_high 三档思考模式。简单问答走 no_think 模式秒回,复杂数学或代码问题切到 think_high 慢思考。你不用换模型,一个 API 调用里切档位。这对 Agent 开发者尤其有用--可以根据任务复杂度动态分配算力。

02

多模态全覆盖

不只是聊天。混元支持文生图(HY Image 3.0,支持4K分辨率)、文生视频、文生3D(HY 3D 3.1)、图片理解(Hy Vision 2.0)。在元宝里你可以一句话让它生成 PPT、Word 文档、Excel 表格。腾讯内部产品的 AI 功能基本都是混元驱动的。

03

长上下文与复杂推理

256K 上下文长度,能处理万字报告、长合同、企业级文档。在 MATH 数学基准测试中拿到 76.28 分,大幅领先 DeepSeek-V3 的 61.6 分。SWE-Bench Verified(真实软件问题解决)得分 74.4%,比上一代混元 2.0 的 53.0% 提升超过 40%。清华数学博士资格考试中也是国内最高分。

04

翻译与多语言

Hy-MT2-Pro 支持 33 种语言和 5 种地区变体的翻译,在 Flores200 和 WMT25 基准上达到 SOTA。不只是翻译,还支持结构化输出、术语表强制、风格指定。做跨境电商或出海产品的团队可以直接用。

05

微信生态深度打通

这是混元独有的优势。与微信、公众号、视频号、企业微信深度集成,可以直接生成朋友圈文案、视频脚本、公众号文章。如果你做的是微信生态内的业务,混元的中文语义理解和文化贴合度比同级别海外模型好不少。

适合谁

适合: 已在用腾讯云服务的企业--API 接入简单,定价有竞争力,中文场景表现强。需要长文档处理、合同审核、万字报告总结的团队。做 Agent 开发的个人开发者--Hy3 的多档思考模式和低 API 价格适合高频调用。做微信生态产品的团队,混元是天然选择。

不适合: 需要英文为主的场景--Hy3 的训练重心是中文,英文能力虽有但不突出。追求绝对最强推理能力的场景--Coding 基准上仍落后于 GPT-5.5 和 Claude Opus 4.8,体感性能与 GLM-5.1 和 Kimi K2.6 也有一定差距。需要完全离线部署的团队--虽然开源了 Apache 2.0,但 295B 参数的本地部署硬件门槛不低。

同类竞品对比

维度腾讯混元 Hy3百度文心 4.5阿里通义 Qwen3DeepSeek V4
架构MoE 295B/21B激活未公开MoEMoE
上下文256K128K128K128K
API输入价1元/百万tokens约2元/百万tokens约0.5元/百万tokens约1元/百万tokens
多模态文/图/视频/音频/3D文/图文/图文为主
开源Apache 2.0部分开源开源
独有优势微信生态+性价比搜索增强中英双语极致低价

FAQ

Q

混元 Hy3 可以免费使用吗?

A

可以。微信小程序和网页端有免费额度,元宝 App 里也能免费用。API 方面个人版有 Token Plan 套餐,最低 28 元/月。企业版按量计费。

Q

Hy3 和 Hy3 Preview 有什么区别?

A

Preview 版 2026 年 4 月发布,正式版 7 月发布。正式版在幻觉率上降低了一半以上,WorkBuddy 任务成功率从 72% 提升到 90%,还新增了 no_think 等思考模式。

Q

混元 Hy3 开源了吗?

A

是的,Apache 2.0 许可,商用免费。模型在 Hugging Face、ModelScope、腾讯云 TokenHub 都能下载。

Q

混元支持英文吗?

A

支持,但训练重心是中文。Hy-MT2 翻译模型支持 33 种语言。纯英文推理任务建议对比测试 Qwen 或 Llama 系列。

Q

腾讯混元和 DeepSeek 哪个好?

A

看场景。数学推理上 Hy3 明显更强(MATH 76.28 vs 61.6)。价格上两者都在国产低价梯队。DeepSeek 开源社区更活跃,混元胜在微信生态和多模态能力。

Q

Hy3 的 295B 参数部署需要什么硬件?

A

自部署的话,295B 总参数的 MoE 模型需要多卡 A100 或 H100 配置。但 21B 激活参数意味着推理时的实际计算量不大。建议先用腾讯云 API 跑通业务,再考虑自部署。

更新动态

最近半年,腾讯混元动作很快。Hy3 Preview 在 4 月放出后,7 月正式版就上线了,中间只隔了三个月。正式版的核心改进是幻觉率腰斩--元宝里的常识错误率降低一半,幻觉减少超过一半。WorkBuddy 任务成功率从 72% 拉到 90%,选择 Hy3 的用户增长了六倍。7 月底还发布了 Hyra(Hunyuan Research Agent),一个能递归自我改进的研究型 Agent。

客户评论

汇总评分:在 270 位专家盲测中,Hy3 平均得分 2.67/4,超过 GLM-5.1 的 2.51。微信客服场景意图识别准确率 98.94%,和平精英 AI NPC 多轮推理成功率 92%。

评论一: "WorkBuddy 切到 Hy3 后,任务成功率从 72% 飙到 90%,任务平均完成时间降了 34%。这不是实验室数字,是真实业务场景跑出来的。"--腾讯内部产品数据(来源:腾讯混元官方博客)

评论二: "性价比是真的高。输入 1 元/百万 tokens,输出 4 元,缓存命中只要 0.25 元。对比 Kimi K2.6 的输入 6.5 元、输出 27 元,混元输入价格不到 Kimi 的五分之一。高频调 API 的团队算算账就知道差多少。"--开发者评测(来源:什么值得买)

参考来源