Anthropic为Claude Code上线插件评测体系 提升代码生成可靠性

AI初创公司Anthropic近日为其代码大模型产品Claude Code推出全新插件评测体系,该体系覆盖6类分级评测标准、无插件能力基线以及CI技能门禁机制,可大幅降低代码生成幻觉,优化跨工具调用准确率。据内测数据披露,升级后的Claude Code在复杂工程场景下的插件调用正确率较此前提升37%,企业级用户的代码落地效率提升超过40%。

配图

进入2026年,代码大模型的竞争早已从“参数规模竞赛”转向“落地能力比拼”,其中对接企业内部工具、第三方API的插件调用能力,更是决定产品能否进入工业级研发流程的核心指标。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。