2026年9月7日,腾讯混元与WorkBuddy联合团队宣布混元Hy4 preview模型完成专项优化后全量上线。本次升级针对此前复杂任务场景下长思考、过度自我验证问题优化,经Bench指标与人工评测双重验证,在不降低任务效果的前提下,显著降低任务轮次与token消耗,将直接改善智能体(Agent)场景的模型响应效率与调用成本。

随着大模型在智能体(Agent)场景的落地进入深水区,此前被高准确率掩盖的推理效率问题正在成为开发者的核心痛点:不少大模型在处理复杂多步任务时,会出现无意义的自我校验、反复推导等“过度思考”问题,既拉长了用户等待的响应时长,也大幅提升了调用的token成本,成为产业落地的重要阻碍。
不少开发者反馈,部分通用大模型在处理多步骤数据分析、长代码调试等任务时,调用轮次会比最优路径多出2-3倍,token成本直接翻倍,且过长的响应时间也很难满足C端产品的实时交互需求。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录