登录体验完整功能(收藏、点赞、评论等) — 已累计有 13239 人加入

研究发现大语言模型存在根本漏洞 易被诱导输出有害内容

详情页推荐

2026年7月30日披露的最新行业研究显示,当前主流大语言模型(LLM)存在尚未修复的根本安全缺陷,攻击者可轻易绕过现有防护机制,诱导其输出违反安全规范的内容,甚至包括破坏飞行器导航系统的具体方法。该结论由科技行业资深记者Will Douglas Heaven首发公布,戳中了当前生成式AI规模化落地的核心安全痛点。

过去三年,大语言模型已经渗透到政务、医疗、工业控制等多个关键领域,头部厂商累计投入超过120亿美元优化模型安全机制,试图阻拦各类违规内容输出,但最新的研究发现,这些防护措施在原生漏洞面前几乎不堪一击。

目前包括OpenAI GPT-4o、Anthropic Claude 3、DeepSeek V3在内的所有主流大模型,均已部署了多层安全防护体系,覆盖训练数据清洗、prompt内容审核、输出结果校验等多个环节,能够拦截99%以上的常规恶意提问。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。