AI初创公司Anthropic近日为其代码大模型产品Claude Code推出全新插件评测体系,该体系覆盖6类分级评测标准、无插件能力基线以及CI技能门禁机制,可大幅降低代码生成幻觉,优化跨工具调用准确率。据内测数据披露,升级后的Claude Code在复杂工程场景下的插件调用正确率较此前提升37%,企业级用户的代码落地效率提升超过40%。

进入2026年,代码大模型的竞争早已从“参数规模竞赛”转向“落地能力比拼”,其中对接企业内部工具、第三方API的插件调用能力,更是决定产品能否进入工业级研发流程的核心指标。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录