近日曝光的亚马逊内部AI成本失控事件引发行业广泛关注:该公司工程师调用Anthropic旗下Claude Sonnet模型处理电商平台作者与商品数据匹配任务,最终产生180万美元(约合人民币1215万元)账单,实际支出超原定预算860%,项目持续运行5个月未成功落地,暴露出企业AI落地过程中成本管控的普遍漏洞。这起事故直到季度财务对账时才被亚马逊后台部门察觉——此前的5个月里,存在逻辑缺陷的AI生成程序一直在后台循环调用大模型接口,没有任何预设的告警机制触发阻拦,相当于一台没有关闭的“算力水龙头”日夜不停消耗资源,最终产生的账单金额甚至比项目原定的预期价值还高出数倍。复盘报告显示,本次事故的诱因并不复杂:工程师使用Claude Sonnet生成的程序代码缺少调用频次限制,触发死循环后持续向大模型发起请求,按调用量计费的算力成本随之不断累积。更核心的问题是项目团队并未设置实时的AI成本告警机制,也没有对AI生成的代码做完整的逻辑校验,微小的漏洞在无人监管的状态下持续运行了5个月,最终出现860%的超支幅度,酿成千万元级别的浪费。随着生成式AI的普及,全球企业都在加快相关项目的落地节奏,但...