抱歉,没有找到相关的全品类工具

1 小时前
核心性能参数公开 根据官方披露的信息,Qwen3.8-Omni-Flash的核心定位是智能体导向的全模态大模型,1M级上下文窗口是其核心亮点之一,可支撑大跨度的多模态内容关联处理。同时该模型原生具备音视频推理能力,无需额外插件即可完成音视频内容的理解、分析与信息提取,内置的工具调用模块可支撑智能体完...

4 小时前
技术架构核心突破:原生融合而非模块拼接 此次发布的Qwen3.8-Omni-Flash最大的变化并非能力参数的简单堆叠,而是处理逻辑的底层升级:它没有采用语音识别、图像识别模块简单拼接的传统方案,而是从模型层面原生融合多模态理解与AI智能体能力。阿里Qwen团队的设计目标十分明确,就是要让模型不止停...

7 小时前
核心能力覆盖多模态处理场景 Qwen3.8-Omni-Flash作为千问推出的新一代原生全模态模型,在原有编程、文本知识工作、GUI操作等通用Agentic能力基础上,着重拓展以音视频为核心的Agentic应用方向。目前该模型可覆盖视频剪辑、MV创作、影视制作与解说、音视频转图文摘要、音视频对话等多...

2 天前
评选规则凸显榜单真实参考价值 此次排名的核心特殊性在于其评价逻辑完全脱离行业通用的模型评估标准:既不参考参数规模大小,也不依托各类基准测试的跑分成绩,唯一的评选依据是Hugging Face平台开发者主动给出的点赞投票,结果直接反映开源社区对模型实际使用体验的真实偏好。 此次被Qwen3.8-27...

3 天前
项目上线初期热度与社区反馈 8月中旬DeepSeek V4 Pro正式版上线时,同步推出了官方配套客户端DeepSeek Harness,初期仅开放Web访问入口。凭借产品的可用性,该项目上线仅数天就获得了超10万GitHub Star,受到大量AI用户的关注。由于官方迟迟未推出桌面客户端,不少开发...

4 天前
2026年9月,通用人工智能企业MiniMax旗下H3视频大模型落地取得关键突破:依托vLLM-Omni架构与FastH3推理优化方案,系统端到端时延实现大幅压缩。在八卡B300硬件配置下,完整响应时延相对Diffusers降低30.8%,解决了此前多环节时延过高的落地瓶颈,为商用级实时视频生成服务的普及铺平了道路。

9 天前
2026年9月9日,蚂蚁开源团队正式推出百灵系列首个原生多模态大模型Ling-3.0-flash-VL。该模型基于MoE架构研发,总参数量达124B,单次推理仅激活5.5B参数,原生支持图像、文本、视频三类输入,上下文窗口达256K Token,其原生联合训练机制打破了“多模态训练削弱文本能力”的行业共识,可大幅提升真实场景任务执行效率。

10 天前
近日谷歌正式为旗下Gemini Flash系列大模型上线智能体(Agentic)视频理解能力,该技术通过动态筛选视频核心信息片段优化Token计算逻辑,可实现视频Token消耗量最高削减88%,对应视频理解推理成本最高下降66%,目前该功能已面向所有调用Gemini Flash API的开发者开放,将大幅降低长视频类AI应用的落地门槛。

10 天前
2026年9月,微软正式推出自主研发的AI图像生成模型轻量化变体MAI-Image-2.6-Flash,目前已通过Microsoft Foundry平台开启公开预览。测试数据显示,该模型生图速度达到GPT-Image-2-Medium的2.8倍,综合效率提升72%,单图推理成本降低逾50%,且完整继承主模型核心生成能力,主要面向高并发、低延迟的工业级应用场景。

15 天前
谷歌于2026年9月3日推出Gemini 3.8 Flash大模型,这是其六周内发布的第三款Flash系列模型。该产品主攻长周期软件工程、自主Agent及复杂企业级工作流场景,官方测试显示其在DeepSWE v1.1测试中得分71.0%,逼近Claude Opus5,HLE-Verified测试54.9%的得分更略高于前者,但实测实用性表现与跑分存在明显差距。

15 天前
近日,Google DeepMind正式推出Gemini 3.8 Flash及Gemini 3.8 Flash Cyber两款大模型产品。两款产品采用同一核心模型底座,通过差异化访问配置适配不同安全等级、算力需求的落地场景,官方同步披露了两款模型的性能基准测试数据、定价方案、访问权限限制及可选部署路径,为企业级和开发者用户提供了更灵活的选型空间。

16 天前
谷歌最快于当地时间周三推出全新大语言模型Gemini 3.8 Flash,内部开发代号为“Skimaki”。内部Jetski编程工具测试显示,工程师对其偏好度超过Anthropic旗下Opus模型,核心编程能力已显著缩小与Anthropic、OpenAI旗舰模型的差距。本次更新正值DeepMind人事调整期,联合创始人Demis Hassabis此前已卸任日常管理职务。

19 天前
谷歌AI近期正式推出多模态大模型更新版本Gemini Omni 1.1 Flash,面向视频生成场景新增三项核心能力:最长40秒的智能场景扩展、生成内容首尾帧自定义控制,以及原生4K分辨率超分处理,所有能力均已通过Gemini API面向开发者开放。该版本是谷歌在生成式AI视频赛道布局的重要产品,将大幅降低专业内容创作的技术门槛。

20 天前
国内两大AI实验室智谱AI、阿里通义千问团队近期先后推出的GLM-5.3-Flash、Qwen3.8-Flash-Next两款轻量化大模型,被证实独立研发却在核心架构上完全趋同,二者均采用混合线性注意力、2048token稀疏索引器、四路残差流设计,这一罕见的技术趋同事件,也被业内视为大模型端侧落地路径迎来明确共识的重要信号。

21 天前
2026年8月28日,蚂蚁集团联合中金公司正式发布蚂蚁百灵旗下首个金融增强大模型Ling-3.0-flash-Fin。该模型经海量金融语料训练,四大核心能力大幅提升,专业基准测试表现突出,后续将开放免费API调用并开源权重,双方打造的FinFIRST金融搜索基准也即将开源,为金融AI落地提供新支撑。

21 天前
2026年8月28日谷歌正式发布Gemini Omni 1.1 Flash视频生成AI模型,该模型最高支持4K分辨率成片输出,新增视频无缝续生成、指定首尾帧平滑运镜功能,单条视频累计最长可生成40秒内容,采用分层定价结构,4K内容生成成本为每秒0.3美元,面向专业视频制作全流程场景。

21 天前
当地时间2026年8月27日,谷歌正式推出新一代视频生成AI模型Gemini Omni 1.1 Flash,最高支持4K超高清视频输出,在场景扩展、运镜控制、生成效率等维度实现全面升级,单次可扩展10秒视频,累计生成最长可达40秒,支持3秒参考片段维持画面一致性,主要面向开发者及专业内容创作者,推动多模态视频生成向高清长时方向演进。

22 天前
2026年8月27日,千问办公正式首发上线Qwen3.8-Flash大模型及配套标准模式,全体用户均可直接体验。该模型采用全新架构,千亿参数级官方测试表现超越Claude Opus4.6,针对办公Agent场景专项调优后可覆盖95%日常办公需求,搭配后续推出的高级模式将形成双模型供给体系,大幅降低办公AI使用门槛。

22 天前
阿里通义千问团队2026年8月正式推出多模态MoE模型Qwen3.8-Flash-Next,作为Qwen4架构的早期预览版本,该模型总参数量达1250亿,搭配510亿参数N-gram嵌入表与40亿参数多token预测模块,单token实际激活参数量仅60亿,以极低计算开销实现越级性能表现,为下一代大模型落地完成核心技术验证。

22 天前
2026年8月27日,智谱AI正式发布GLM-5系列首个原生多模态大模型GLM-5.3-Flash,该模型正是此前开源社区引发广泛讨论的神秘模型“Ox-Alpha”。其第三方综合测评得分达57分,超越DeepSeek V4 Pro等主流旗舰产品,同时定价仅为每百万Token输入0.8元、输出2.8元,依托全国产算力底座成为行业性价比新标杆。