登录体验完整功能(收藏、点赞、评论等) — 已累计有 13531 人加入

DeepSeek V4 Pro编程测评夺亚 成本仅为榜首Kimi K3十四分之一

详情页推荐

CLUE团队最新发布SuperCLUE-Terminal中文智能体终端编程测评榜单,DeepSeek-V4-Pro-0813以51.52分位列第二,仅落后榜首Kimi K3,其调用成本仅为对手的十四分之一,性价比突出。该测评采用本土真实编程任务,统一以Claude Code为运行框架,单题需模型完成50至110轮交互,高度还原开发者日常工作流。

配图

国内编程大模型的能力排位再添权威参考。随着AI编程在开发者群体中的渗透率快速提升,相关测评的公正性、场景贴合度越来越受行业关注,近期发布的SuperCLUE-Terminal榜单因为完全采用本土真实开发场景设计,刚一上线就引发了开发者圈层的讨论。

和以往多采用通用编程题库的测评不同,本次SuperCLUE-Terminal测评专门面向国内开发者设计,所有考题均来自本土企业、个人开发者的真实开发需求,测评过程统一以Claude Code作为运行框架,最大程度排除了环境差异带来的得分偏差。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。