
2026年7月30日披露的最新行业研究显示,当前主流大语言模型(LLM)存在尚未修复的根本安全缺陷,攻击者可轻易绕过现有防护机制,诱导其输出违反安全规范的内容,甚至包括破坏飞行器导航系统的具体方法。该结论由科技行业资深记者Will Douglas Heaven首发公布,戳中了当前生成式AI规模化落地的核心安全痛点。
过去三年,大语言模型已经渗透到政务、医疗、工业控制等多个关键领域,头部厂商累计投入超过120亿美元优化模型安全机制,试图阻拦各类违规内容输出,但最新的研究发现,这些防护措施在原生漏洞面前几乎不堪一击。
目前包括OpenAI GPT-4o、Anthropic Claude 3、DeepSeek V3在内的所有主流大模型,均已部署了多层安全防护体系,覆盖训练数据清洗、prompt内容审核、输出结果校验等多个环节,能够拦截99%以上的常规恶意提问。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录