登录体验完整功能(收藏、点赞、评论等) — 已累计有 13115 人加入

谷歌发布三款Gemini Flash系列新模型 瞄准低耗智能体应用场景

详情页推荐

谷歌于近日推出三款Gemini Flash系列大模型新品,包括Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及准入制开放的Gemini 3.5 Flash Cyber。该系列新模型针对智能体工作负载优化,官方数据显示其token利用率较前代提升35%以上,调用成本最高下降50%,将为AI开发者搭建高性价比智能体应用提供新的选型方向。

配图

过去一年AI智能体赛道从概念热炒转向落地验证,从To C端的个性化助理、自动化效率工具,到To B端的企业工作流调度、多系统联动运维,大量场景都需要大模型支持高频多轮交互、连续工具调用。但此前主流大模型产品普遍针对通用生成场景设计,在智能体场景下存在token冗余消耗高、单轮调用成本昂贵的问题,中小开发者很难负担大规模部署的开支,也成为限制智能体普及的核心瓶颈之一。

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。