登录体验完整功能(收藏、点赞、评论等) — 已累计有 13481 人加入

新型大模型推理痕迹提取技术问世,跨境训练溯源成可能

详情页推荐

2026年8月,AI研究团队公开新型大模型推理痕迹提取技术,可从OpenAI GPT、Anthropic Claude、谷歌Gemini等主流闭源大模型中提取隐含的推理过程数据,该技术可用于溯源大模型训练数据来源,测试显示部分中国大模型产品可能存在使用美国头部大模型输出数据训练的情况。

配图

不同于以往需要获取模型参数或后台权限的黑箱破解方案,本次公开的推理痕迹提取技术仅需通过公开API输入特定结构的prompt,即可引导大模型将推理过程中的隐性信息嵌入输出内容的冗余编码位,全程不会触发模型的安全审核机制,也不会影响正常回答的生成质量。

长期以来,闭源大模型的推理过程都是不对外公开的“黑箱”,用户只能得到最终的输出结果,无法判断答案的推导逻辑是否存在漏洞、是否植入了隐性偏见,这也是AI可解释性领域长期难以突破的核心瓶颈。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。