
谷歌于近日推出三款Gemini Flash系列大模型新品,包括Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及准入制开放的Gemini 3.5 Flash Cyber。该系列新模型针对智能体工作负载优化,官方数据显示其token利用率较前代提升35%以上,调用成本最高下降50%,将为AI开发者搭建高性价比智能体应用提供新的选型方向。

过去一年AI智能体赛道从概念热炒转向落地验证,从To C端的个性化助理、自动化效率工具,到To B端的企业工作流调度、多系统联动运维,大量场景都需要大模型支持高频多轮交互、连续工具调用。但此前主流大模型产品普遍针对通用生成场景设计,在智能体场景下存在token冗余消耗高、单轮调用成本昂贵的问题,中小开发者很难负担大规模部署的开支,也成为限制智能体普及的核心瓶颈之一。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录