7 月 6 日,腾讯混元正式发布了新一代大模型 Hy3。此次发布标志着混元在“实用主义”路线上迈出关键一步,不仅在智能体(Agent)能力上实现显著跃升,更在抗幻觉、长上下文理解等核心体验上大幅优化,同时以极具竞争力的开源协议与 API 定价,为大模型应用落地注入新动力。
从“对话”到“干活”的 Agent 跃升
Hy3 最大的亮点在于 Agent 能力的全面提升。官方数据显示,Hy3 在智能水平上显著优于同尺寸模型,效果可媲美参数量大 2-5 倍的旗舰模型。在内部 270 位专家的盲测中,Hy3 均分达 2.67,优于 GLM5.1,尤其在前端开发、数据与存储、CI/CD 等复杂工程任务上表现突出。
在真实场景中,Hy3 已展现出处理复杂指令的能力,例如能从 101 个 SKU 销售数据中自动生成 Excel 建模及 30 页 PPT,或设计核聚变能源引擎概念网页。在腾讯文档 AI PPT 场景中,生成成功率提升 20%,耗时缩短 20%;在 WorkBuddy 等办公应用中,任务解决率从 72% 跃升至 90%,Token 消耗节省近 50%。
幻觉率腰斩,长对话更连贯
针对大模型“一本正经胡说八道”的痛点,Hy3 通过细粒度数据清洗和训练约束,将内部评测的幻觉率从 12.5% 降至 5.4%,常识错误率从 25.4% 降至 12.7%。在长上下文与多轮对话方面,模型优化了指代消解和意图保持,多轮问题率从 17.4% 降至 7.9%,长对话理解基准(MRCR)得分从 42.9% 升至 75.1%,显著提升了交互的自然度与准确性。
腾讯全家桶深度接入
Hy3 已全面接入腾讯核心业务,实现“模型与产品协同设计”(Co-Design)。在微信公众号后台,意图识别准确率提升至 98.94%,能精准理解“上次那个”等模糊指令;在 QQ 浏览器助手中,编程与代码输出类任务成功率提升 37.6%;在 WeGame《流放之路:降临》AI 助手中,幻觉率降至 2.8%,回答准确度大幅提高;在微信读书中,网络文学标签标注准确率提高 14.1%,推荐更精准。
极致性价比,开发者友好
腾讯混元采取开源与商业化并行策略。Hy3 已以 Apache 2.0 协议在 GitHub、HuggingFace、ModelScope 等平台全面开源,支持 vLLM、SGLang 等主流推理框架,开发者可免费商用与二次开发。
在 API 定价上,Hy3 进一步降低使用门槛:输入价格低至 1 元/百万 Tokens,输出为4元/百万 Tokens,命中缓存的输入价格仅需 0.25 元/百万 Tokens。此外,腾讯云推出个人版 Token 套餐,月费低至 28 元,支持在 OpenClaw 等智能体开发平台调用,极大降低了个人开发者和中小企业的试错成本。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.