发布于2026-08-18 阅读(0)
扫一扫,手机访问
终于,腾讯混元3.0正式版(Hy3)来了。距离预览版发布已经过去74天,这也是腾讯首席AI科学家姚顺雨加入后交出的第一份正式成绩单。

7月6日,腾讯旗下AI助手元宝悄然上线了Hy3正式版。这款模型依然是快慢思考融合的MoE架构,总参数量295B,激活参数21B,最大支持256K上下文——参数规模与预览版完全一致。腾讯显然打定了主意:不追大参数,走“兼具性能和性价比”的路子,目标是成为多数业务场景落地的最优解。
在腾讯的测算里,300B参数量是能力与效率的最佳平衡点。复杂推理、长上下文理解、指令遵循这些能力,到这个量级已经释放得差不多了,再往上堆参数,边际收益明显递减——投入翻倍,能力提升往往只有个位数百分点。这笔账算得挺清楚。
相比预览版,正式版重点打磨了三件事:Coding Agent任务执行和生产力场景、复杂推理和数理能力,还修掉了一些已知问题。与此同时,价格也进一步降了下来——输入1元/百万tokens,输出4元/百万tokens,输入命中缓存只要0.25元/百万tokens。这价格放在当前市场里,竞争力肉眼可见。
目前Hy3已经在腾讯内部的WorkBuddy、CodeBuddy、元宝、Marvis、ima等多个业务上线,API也登上了腾讯云TokenHub,海外多个API平台后续会陆续接入。可以说,腾讯把这次发布当作AI下半场的一次节奏校准。
回顾2025年下半年以来,腾讯密集调整了混元大模型团队的组织架构和工作流,2026年2月又重建了包括预训练和强化学习在内的研发基础设施,数据质量也做了提升。姚顺雨曾说过,Hy3 preview只是混元大模型重建的第一步。
这次重建过程中,腾讯还确立了三个实用性原则:一是能力要体系化,不搞“偏科”;二是评测要真实,主动远离那些容易被“刷榜”的公开榜单;三是死死咬住性价比。也正是因为这样,腾讯选择先发预览版,从开源社区和用户那里拿真实反馈,再反过来打磨正式版的实用性。
数据说明效果不错。WorkBuddy上自主选择Hy3 preview的用户数涨了6倍,办公场景内部测评中,任务成功率从72%提升到90%,平均耗时缩短34%。元宝这边,长文和AI搜索场景里的幻觉问题也得到了改善——通过细粒度数据清洗和训练约束,模型学会了在复杂证据下更可靠地输出。基于元宝真实日志的评测显示,Hy3的常识错误率比预览版下降了一半,幻觉率下降了超过一半。
值得一提的还有Agent能力的大幅提升。元宝同步上线了Agent功能——只要你给的任务prompt里明确要求生成PPT、Word、Excel、PDF、HTML等文件,它就能直接输出一份完整的文件,不再是以前那种纯对话式回答。实际体验下来,这项能力确实让“助手”二字更实至名归了。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9