先说结论
腾讯混元Hy3正式版7月6号刚发,这可能是国产大模型里最被低估的一个——不是因为它参数大(实际上只有21B激活参数),是因为它在中型参数规模上做出来的搜索能力追平了GPT-5.5。幻觉率从12.5%砍到5.4%——两个指标放在一起看:搜索追上GPT-5.5的同时,编造信息的概率只有它一半多一点。它不像Kimi和DeepSeek那样天天刷榜上热搜,但它是腾讯的底层大模型——你用的腾讯元宝、QQ浏览器AI、腾讯广告、微信读书推荐、企业微信AI——背后全是混元。免费接入,代码开源。
Hy3最狠的三个指标
第一个是搜索——BrowseComp得分84.2,追平GPT-5.5。BrowseComp测的是AI能在真实网页环境里搜索并理解信息的能力。84.2分在国产模型里排第一。腾讯在搜索底层上积累了太久——搜狗和QQ浏览器的搜索数据成了混元天然的训练优势,别的国产模型很难在这块短时间追上。
第二个是幻觉——从上一代12.5%压到5.4%,降低了57%。幻觉是AI最让人不放心的地方——你让它写公司简介,它给你编一个不存在的融资历史和获奖记录。Hy3在2B-OpenQA多文档QA评测上提升了6.6%,多语言QA提升11.2%——在需要查多个文档再回答的时候,编造概率更低了。
第三个是效率——21B激活参数、MoE架构。总共的专家参数大了很多,但每次推理只有21B参数在工作。跟千亿万亿参数的大模型比,Hy3跑一遍的成本便宜多了。腾讯用它驱动全系产品——免费给你用。
已经接入了哪些产品
腾讯元宝(日常AI助手)、WorkBuddy(办公智能体——基于Hy3复杂任务解决率从72%提到90%)、企业微信大圆、QQ浏览器AI搜索、腾讯广告系统、微信读书书评和推荐算法、腾讯云API。Hy3已开源。
基本信息
| 工具名称 | 腾讯混元 Hy3 |
| 官网 | hunyuan.tencent.com |
| 开发商 | 腾讯 |
| 发布 | 2026年7月6日 |
| 激活参数 | 21B(MoE架构) |
| BrowseComp | 84.2(追平GPT-5.5) |
| 幻觉率 | 5.4%(上一代12.5%) |
| 定价 | 免费 + 开源 |
| 接入产品 | 元宝/WorkBuddy/企微大圆/API |
相关导航
暂无评论...
