
1 小时前
2026年7月28日,微软于旧金山发布旗下首款网络安全专用大模型MAI-Cyber-1-Flash,同步推出自研漏洞识别修复框架MDASH与智能体安全平台Perception,可实现复杂代码库隐蔽漏洞的自主挖掘与修复,在行业标准测试中表现优于Anthropic、谷歌Gemini、OpenAI旗下同类产品,直指千亿级企业网络安全服务市场。

2 小时前
2026年7月28日,微软正式发布首款网络安全专用大模型MAI-Cyber-1-Flash及全新AI安全平台Perception,该模型将为微软漏洞识别与修复工具MDASH提供核心能力支撑,可实现漏洞自动化发现、分析与修复全流程。微软AI CEO Mustafa Suleyman透露,该模型在Cyb...

20 小时前
2026年7月24日,蚂蚁集团旗下AI团队蚂蚁百灵正式发布新一代原生混合推理模型Ling-3.0-Flash。该模型总参数量124B、单次计算激活仅5.1B,核心能力对标甚至超越参数规模2-3倍的行业领先模型,目前已上线OpenRouter平台,限时免费一周后将正式开源,智效比与落地性价比优势突出。

2 天前
日本AI初创公司Sakana AI近期正式推出网络安全领域专属编排大模型Fugu-Cyber,该模型在国际通用网络安全测试基准CyberGym中得分达86.9%,在微软推出的CTI-REALM威胁情报基准测试中得分达72.1%,是目前同类型垂类编排模型中的最优表现之一,标志着AI在网络安全自动化响应场景的落地再获重要突破。

4 天前
2026年7月23日,微软正式对外发布两款自研垂直AI模型:高精度图像生成模型MAI-Image-2.5-Pro、高并发语音交互模型MAI-Voice-2-Flash,目前均已进入公开预览阶段。两款模型均采用可追溯清洁训练数据,不依赖第三方模型蒸馏,其中图像模型GPU成本最高下降84%,目前已落地Bing、PowerPoint等核心产品。

6 天前
2026年7月21日,日本AI初创企业Sakana AI发布专为网络防御场景打造的多智能体系统Fugu Cyber。该模型在CyberGym、CTI-REALM两大行业公认的网安基准测试中分别拿下86.9%、72.1%的成功率,性能超越OpenAI旗下GPT-5.5-Cyber、Anthropic旗下Claude Mythos-Preview等顶尖闭源模型,成为网安AI赛道新的性能标杆。

20 天前
2026年7月,微软正式启动AI战略调整,旗下核心办公应用Excel、Outlook率先搭载自研MAI人工智能模型,替代此前依赖的OpenAI、Anthropic第三方模型。目前两款产品每周已有数万项AI任务由MAI独立完成,微软AI模型负责人Mustafa Suleyman表示,此举旨在降低第三方模型采购成本,构建自研AI技术竞争力。

24 天前
2026年7月3日,权威文生视频盲测排行榜Video Arena更新最新排名,谷歌DeepMind推出的文生视频模型Gemini Omni Flash以1404Elo的总分登顶榜首,超越此前长期霸榜的字节跳动Seedance系列模型,二者分差达101Elo。该榜单基于用户真实盲测投票生成,此次排名变动既彰显谷歌多模态技术积累,也印证AI视频生成领域竞争正持续升温。

27 天前
2026年6月30日,华为正式开源920亿参数的openPangu-2.0-Flash大模型,同步开放模型权重、基础推理代码及训推算子,为昇腾算力提供原生训练与推理实践参考。该模型此前已在HDC2026上发布,属于openPangu2.0系列的轻量化版本,激活参数量仅60亿,兼顾高并发推理性能,将支撑长文本场景AI创新,繁荣昇腾开发者生态。

1 个月前
2026年6月谷歌正式推送Chrome 149浏览器版本,原生深度集成Gemini 3.5 Flash大模型,上线「从屏幕选择」交互功能,用户可直接框选网页局部文本、图片内容发起AI定向对话,无需切换工具或全局上传内容,浏览场景下AI交互精准度、效率均有显著提升,是桌面端浏览器AI原生能力落地的重要进展。

1 个月前
2026年6月25日,谷歌DeepMind正式宣布为旗下大语言模型Gemini 3.5 Flash集成原生计算机使用能力,开发者可依托单一模型构建支持浏览器、手机、桌面端跨平台操作的AI智能体,无需再进行多模型切换与上下文传递,可大幅降低复杂长任务的中途失败概率,显著简化AI智能体的开发流程。

1 个月前
2026年6月25日,谷歌正式发布升级后的Gemini 3.5 Flash大模型,首次将“计算机使用”工具原生集成至模型内核,全面替代此前的Gemini 2.5测试框架。该升级大幅降低AI智能代理开发门槛,可实现多场景桌面任务自动执行,标志着AI从对话交互工具向具备执行能力的“数字同事”演进,相关能力已通过Gemini API向全球开发者开放。

1 个月前
2026年6月25日,谷歌正式发布新一代大语言模型Gemini 3.5 Flash,核心升级点为深度优化的计算机操作能力,可直接接管电脑界面、自主执行跨软件工作流。官方基准测试显示,该模型编码、自主代理任务表现超越前代Gemini 3.1 Pro,响应速度大幅提升,标志着AI从问答机器向可直接代劳的执行智能体迈出关键一步。

1 个月前
2026年6月23日,OpenAI宣布升级旗下“Daybreak”网络安全计划,推出专为安全防御者打造的专用大模型GPT-5.5-Cyber,实现从漏洞发现到自动化修补的能力跃迁。该模型在CyberGym基准测试中得分达85.6%,领先Claude Mythos5、标准版GPT-5.5等竞品,重新夺回网络安全AI领域榜首位置。

1 个月前
2026年6月10日谷歌宣布对旗下AI研究与知识管理工具NotebookLM完成重大升级,新版正式接入Gemini 3.5 Flash大模型,深度整合内部Antigravity编码工具,为每个用户的笔记本配置独立云端计算机,新增AI代理驱动的深度研究功能,内部测试显示新Agent架构在65%评估场景中表现优于旧版,可支撑更复杂的学术与工程项目需求。

1 个月前
微软AI团队近期正式推出新一代多语言语音转文字模型MAI-Transcribe-1.5,该模型支持43种全球常用语言识别,人工分析场景下词错误率(WER)低至2.4%,在FLEURS公开多语言语音数据集上准确率达行业最优水平,长音频转录速度较前代产品最高提升5倍,有望大幅降低多场景下语音内容转写的人力与时间成本。

1 个月前
2026年6月,日本财务省宣布与人工智能巨头OpenAI达成深度合作,由OpenAI向日本核心金融机构开放最新GPT-5.5 Cyber模型使用权限,应对AI技术普及带来的新型网络攻击威胁。该合作是美日政府协商后的网络安全部署成果,日本财务大臣片山皋月确认,三菱日联、三井住友、瑞穗三大银行将首批接入。

1 个月前
大模型厂商StepFun近日正式发布全新多模态大模型Step 3.7 Flash,该产品为1980亿参数的稀疏混合专家(MoE)视觉语言模型,专门针对编码智能体、自动化搜索工作流等工业场景优化,在代码生成、多模态指令理解、任务链执行等维度的性能较同级别模型提升超30%,可大幅降低企业级AI工作流的落地门槛。

1 个月前
2026年5月29日,开源大模型Step 3.7 Flash正式对外发布,以Apache2.0协议开放全权重,主打AI Agent场景下的效率、可靠性与多模态执行能力,在ClawEval-1.1、SimpleVQA Search等多项行业基准测试中登顶,推理速度达400TPS,为AI Agent商业化落地提供了高性价比的全新选型。