2026年6月23日,专注人工智能与教育决策研究的独立团队友松实验室发布国内首份《高考志愿AI测评基准》。本次测评以基于夸克8年高考服务数据打造的千问高考志愿填报Agent为核心对象,对照由53名平均从业年限4.6年的志愿咨询师组成的人类对照组,结果显示千问在稳定性、精确性等多维度达到并部分超过人类咨询师水平,填补了高考志愿场景AI能力评估的标准空白。

进入6月下旬,全国各省市陆续公布高考分数,志愿填报成为千万考生家庭的核心需求。近年随着大模型技术落地,各类AI志愿填报工具快速涌现,但由于缺乏统一的能力评估标准,产品质量参差不齐,“AI乱推荐导致考生滑档”的案例屡见不鲜,行业亟需一套可量化的评估体系划定AI工具的能力边界。
作为长期深耕大模型能力评估、教育场景AI应用领域的独立研究团队,友松实验室的研究成果此前已被多所国内高校、科研机构采用。本次推出的《高考志愿AI测评基准》,是国内首个针对高考志愿填报场景的AI能力评估体系,核心目标是为快速迭代的高考志愿AI产品建立一套公开、可复现、可扩展的评估规则,明确AI在志愿填报场景中能够承担的任务范围,也为考生和家长选择相关工具提供参考依据。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录