9月7日,腾讯混元联合企业协作工具WorkBuddy正式推送Hy4 preview大模型专项升级,针对此前用户反馈的复杂任务长思考、过度自我验证问题定向优化。经Bench指标与人工评测双重验证,在不损失任务效果的前提下,实现任务轮次与输入输出Token消耗双降。该770B参数级模型8月底刚开源,主打Agent、编码等高生产力场景。

当前大模型在处理多步骤推理、复杂编码等任务时,普遍存在“过度思考”问题:模型会反复验证前置条件、输出大量冗余的自我修正内容,既拖慢了响应速度,也直接推高了用户的Token使用成本,这也是高参数大模型落地企业级生产力场景的核心阻碍之一。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录