
2026年6月25日,谷歌正式发布新一代大语言模型Gemini 3.5 Flash,核心升级点为深度优化的计算机操作能力,可直接接管电脑界面、自主执行跨软件工作流。官方基准测试显示,该模型编码、自主代理任务表现超越前代Gemini 3.1 Pro,响应速度大幅提升,标志着AI从问答机器向可直接代劳的执行智能体迈出关键一步。

过去用户使用AI工具时,往往要面临“AI给出方案、用户手动执行”的断层:让AI写的代码需要手动复制到编辑器,让AI整理的报表需要手动导入数据软件,繁琐的中转步骤大幅抵消了AI的效率增益。而谷歌最新发布的这款模型,恰恰补上了这最后一环的短板。
此前全球主流大语言模型的能力边界,大多停留在文本生成、信息检索、多模态内容创作层面,即便支持工具调用,也需要通过第三方插件对接特定软件,无法实现系统层面的全局操作。随着办公、科研等场景对AI效率的要求不断提升,能够直接接管设备、自主完成全流程任务的“行动型AI”,已经成为大厂技术竞速的核心方向。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录