7月6日腾讯正式发布混元Hy3大模型正式版并全量全球开源,采用MoE混合专家架构重构底层训练体系,主打超长文本理解、事实性内容降幻觉、智能体工具调用三大核心能力,专门针对公文撰写、文档汇总、批量报表处理、多轮项目复盘等办公高频场景定向优化。
模型采用Apache2.0开源协议支持免费商用,同步上线轻量化量化版本降低本地部署门槛,大幅拉低企业与开发者接入旗舰级大模型的使用与部署成本。

文章导航
一、模型基础架构与核心硬件参数
- 整体架构:总参数量295B,采用混合专家MoE架构,单次推理仅激活21B参数,在控制算力消耗的同时对标超大参数量旗舰模型综合效果。
- 上下文窗口:标配256K超长上下文输入输出,可一次性载入整本合同、百页调研报告、完整代码仓库、全年财务台账,全程留存前文约束条件,不会出现长文本遗忘、逻辑断层问题。
- 解码加速技术:搭载MTP多Token预测+投机采样双机制,长文档解析、批量文案生成速度提升34%,同等办公任务下Token资源消耗节省47%~49%。
二、幻觉错误率核心优化:降幅达44%,事实生成精准度大幅提升
1. 官方量化数据对比
前代预览版幻觉出错率12.5%,Hy3正式版降至5.4%,整体幻觉错误率下降44%;常识事实错误率从25.4%压缩至12.7%,彻底改善大模型无依据编造数据、虚构案例、张冠李戴信息的痛点。
2. 配套检索增强能力
内置联网检索增强模块,BrowseComp检索评测得分84.2,实时调取互联网权威信息校验输出内容;处理财报、行业数据、政策条文类内容时,强制溯源引用来源,杜绝凭空捏造信息,适配企业公文、合规文案、数据分析类严谨办公需求。
3. 多轮对话稳定性优化
长周期多轮任务问题出错率从17.4%降至7.9%,连续十余轮指令修改文档、迭代方案后,仍可精准记忆初始要求与格式规范,不会偏离任务设定。

三、办公场景专项能力升级细则
- 批量文档处理:支持一次性导入数十份Word、PDF、Excel文件,自动完成摘要提炼、异同对比、重点标记、数据汇总,适配周报批量归集、招投标文件筛查、合同风险逐条标注场景。
- 办公智能体落地:接入腾讯自研办公助手WorkBuddy后,复杂办公任务完成成功率由72%提升至90%,可自主串联文档整理、邮件撰写、日程规划、会议纪要生成全流程工作流。
- 格式强约束输出:可锁定公文体例、PPT大纲结构、财务报表格式、代码规范,输出内容严格匹配企业固定模板,减少人工二次修改工作量。
- 跨工具联动调用:支持自主调用表格计算、文件读写、网页爬取、接口查询工具,无需人工分步下达指令,具备独立完成复合型办公事务的Agent能力。
四、开源部署方案,多版本适配不同使用场景
- 开源授权:采用Apache 2.0宽松开源协议,个人、小微企业、商业项目均可免费商用,无二次开源强制绑定条款。
- 多平台同步上架:发布首日同步入驻Hugging Face、魔搭ModelScope两大主流开源社区,后续逐步接入OpenRouter、Hermes等海外模型分发平台。
- 轻量化量化版本(7月14日追加发布)
- 4bit量化版:接近原版满血能力,单张高端显卡即可本地部署运行;
- 1bit极限量化版:极致压缩权重体积,普通消费级主机可完成推理,适配个人本地离线办公、私有化内网部署场景。
五、云端API商业化定价策略
采用普惠级定价体系,无高额调用门槛:
- 输入Token:1元/百万Tokens,命中缓存仅0.25元/百万Tokens;
- 输出Token:4元/百万Tokens; 已全面接入腾讯元宝C端助手、企业版混元服务、微信生态内各类SaaS工具,面向企业开放私有化本地部署、集群批量部署两种交付模式。

六、代码与智能体领域拓展能力
- 代码开发:SWE基准评测表现稳定,可完成前后端项目搭建、脚本批量编写、BUG自查修复,多开发环境下效果波动极小;
- 链式Agent任务:支持多智能体分工协作拆解复杂项目,自主规划执行步骤、校验结果、修正执行偏差,降低企业搭建AI自动化工作流的开发难度。
七、行业落地与生态布局方向
- 对内生态:深度打通微信、企业微信、腾讯会议、腾讯文档全系产品,将Hy3能力内嵌至办公链路,实现会议实时转写纪要、群聊信息自动归档、待办事项智能梳理。
- 对外行业:面向金融、政务、制造、法务行业推出垂直微调版本,针对行业合规话术、专有术语、风控规则定向训练,适配政企数字化采购需求。
- 开发者生态:开放模型微调接口与数据集工具,鼓励第三方基于Hy3基座搭建细分场景应用,依托开源模式快速扩大产业落地覆盖面。
八、本次开源核心行业意义
混元Hy3跳出大模型单纯比拼参数量的内卷思路,以MoE高效架构平衡算力成本与输出效果,同时通过大幅降低幻觉、拉长上下文窗口直击企业办公最核心的实用性痛点;免费商用开源+低门槛本地部署,既降低中小团队AI转型成本,也补齐国产大模型在私有化部署、场景化落地层面的基座供给,推动通用大模型从演示试用转向常态化办公生产力工具。