2025年AI研究报告:大厂AI密集催化,关注高壁垒应用

  • 来源:国金证券
  • 发布时间:2025/11/21
  • 浏览次数:664
  • 举报
相关深度报告REPORTS

AI研究报告:大厂AI密集催化,关注高壁垒应用.pdf

AI研究报告:大厂AI密集催化,关注高壁垒应用。计算机行业观点:11月17日,阿里正式官宣公测千问APP,对标ChatGPT5.1版本,接入阿里通义实验室最新的Qwen3-Max模型,阿里加入C端入口争夺战。1)整合阿里系C端应用生态:据晚点采访报道,千问团队正在与高德、淘宝、支付宝、闪购等在做一些联合开发的工作。我们测试发现千问APP目前已能够自然引出淘宝商品信息。2)从“用户发起需求”的超级框到“产品引导需求”的对话助手:1H25阿里曾经尝试将夸克作为AI时代的入口对外推广,本次千问APP对话框上方明确列示了更多功能模块,如AI修图、翻译、视...

1.AI 应用月度数据洞察

1.1 谁在吸引 AI 产品用户的注意力?

根据 SimilarWeb 统计及非凡产研整理,2025 年 10 月全球访问量 Top20 的 AI 应用以头 部互联网公司和 AI 大模型龙头为主,月访问量过亿的应用共 9 款。访问量排名前五的应 用分别为来自 OpenAI 的聊天机器人 ChatGPT、来自谷歌的聊天机器人 Gemini、国产大 模型产品 deepseek、生成式搜索引擎 Perplexity、xAI 的个人助理 Grok。

据全球 AI 应用访问量 Top20 月度排名,ChatGPT 在整个观测期内始终稳居榜首。排名第 二的产品在不同阶段呈现激烈竞争,Bing 曾在 2024 年 6 月至 2025 年 1 月稳居第二,但 随后被 deepseek、Gemini 等应用取代,其中 deepseek 自 2025 年 2 月起稳定跻身前三, 也是观测期内唯一长居全球前三的中国 AI。Canva 也曾长期位列前三,但在 2025 年 2 月 后逐步被新兴应用超越。值得关注的是,“豆包”自 2025 年 3 月起进入榜单并保持稳定, 腾讯元宝、百度 AI 搜索等国内应用也逐渐崭露头角,显示出本土 AI 产品在全球范围内的 渗透力提升。整体来看,全球 AI 应用市场头部格局相对稳定,但中下游竞争较为激烈。

2025 年 10 月全球访问量增速最快的应用分别为 Creati、Tunee AI 以及 Toolhouse,访问 量分别同比增长 1476%、867%、766%。其中,Creati 通过 AI 模型将爆款视频转化为病 毒视频模板,在商家上传产品图片和 URL 后,基于产品特性和定位对故事线、人物主题、 叙事背景等进行调整,最终生成个性化视频; Tunee 可完成从需求拆解、方案规划到音 乐创作的全流程,最终生成符合用户需求的音乐作品;Toolhouse 以“Agentic backend-asa-service”为定位,旨在解决智能体上云部署不稳定与提示工程门槛高两大难题。

根据 SimilarWeb 统计及非凡产研整理,2025 年 10 月国内访问量 Top20 的 AI 应用中有 9 款的访问量超过 500 万次。访问量排名前三的应用分别为 deepseek、豆包、夸克,访 问量分别为 3.4 亿次、8714 万次、8344 万次。

据国内 AI 应用访问量 Top20 月度排名,国内市场已形成“头部双强”格局:deepseek 自 2025 年 2 月起长期稳居第一,豆包稳定位列前二,展现出强劲的用户粘性与市场影响力; Kimi、百度 AI 搜索及腾讯元宝等腰部应用紧随其后,其中百度 AI 搜索在大厂生态加持下 排名稳步提升;秘塔 AI 搜索保持稳定表现,而即梦 AI、知乎直答、阿里通义等则波动明 显,体现出中腰部竞争激烈、替代性强。此外,教育、办公、翻译等实用型工具仍维持稳 定需求,显示 AI 正加速嵌入多场景工作流。

2025 年 10 月国内访问量 Top20 的 AI 应用中增速前三的应用分别为 Tunee AI、简篇、 MiniMax 开放平台,分别同比增长 867%、84%、76%。其中,Tunee 可完成从需求拆解、 方案规划到音乐创作的全流程,最终生成符合用户需求的音乐作品;只需上传图片、链接、 文件或者文本,简篇即能创作出精美的文章;MiniMax 开放平台专为 Agent 和代码而生。 为端到端开发工作流打造,在 Claude Code、Cursor、Cline、Kilo Code、Droid 等多种 应用中表现卓越。

出海类AI应用中,2025年10月访问量排名前三的应用分别为Qwen、SeaArt AI、PolyBuzz, 访问量分别为 3268 万次、3229 万次、3173 万次。其中, SeaArtAI 利用多风格生成模 型,快速生成高质量动漫、3D、油画等图片,具备文生图、图生图、智能补图,适用于创 作和设计多场景;Qwen 系列大模型由阿里巴巴研发,集成“规划—执行—总结”三阶段任 务流程,覆盖 119 种语言及方言,具备自动检索资料、结构化整理信息与生成多格式报 告的能力,支持多轮搜索与多任务并行;PolyBuzz 可以模拟动漫、影视、游戏或原创角 色的语言与性格,支持文本、语音、图像多模态交互,让用户沉浸式体验角色扮演与故事 共创。

据出海 AI 应用访问量 Top20 月度排名,PolyBuzz 自 2025 年 4 月起快速攀升并在 7–8 月 稳居首位,但 Qwen 在 10 月重回榜首;SeaArtAI 及 CrushOn.AI 亦长期位列前五。中游 应用如 manus、Fotor、KLING AI、Cutout Pro 等保持相对稳定,满足特定场景或区域需 求;Top20 下游应用则更替频繁,Monica、Gauth、123RF、HeyGen 等间歇上榜。整体 来看,中国 AI 应用出海已形成相对稳定的头部梯队与多元竞争生态。

出海榜单中,2025 年 10 月访问量 Top20 的 AI 应用中增速最快的应用分别为 Creati、Xmind、Comet API,分别同比增长 1476%、275%、155%。其中,Creati 通过 AI 模型 将爆款视频转化为病毒视频模板,在商家上传产品图片和 URL 后,基于产品特性和定位 对故事线、人物主题、叙事背景等进行调整,最终生成个性化视频;Xmind 是一款在学习、 科研、工作等领域广泛应用的思维导图工具,它以可视化、非线性的方式呈现思维过程, 能帮助用户快速梳理信息逻辑、激发创意灵感;Comet API 是 Perplexity AI 推出的一款 AI 驱动型网络浏览器,核心聚焦复杂研究任务。它能深度整合信息并支持跨平台协同, 还可依据浏览内容自动执行预约会议、发送邮件等操作。

10 月海外/国内/出海赛道访问量环比增速 Top 产品中,AI 编程、视频生成与多模态创作 类产品表现突出,约占榜单的三分之一,整体来看,面向垂类场景的智能创作与编程类产 品仍具爆款潜力。

1.2 什么样的 AI 产品变现能力最强?

根据 SimilarWeb 统计及非凡产研整理,截至 2025 年 8 月,全球 AI 产品年经常性收入 (ARR)Top20 主要集中于头部互联网科技公司和 AI 大模型厂商。其中共有 10 款产品 年收入超过 2 亿美元,排名前五的分别是 OpenAI 的 ChatGPT、Anthropic 的 Claude、 Grammarly、Anysphere 的 Cursor、Midjourney,年经常性收入分别为 174.75 亿美元、 72.68 亿美元、7.55 亿美元、6.50 亿美元、5.97 亿美元。其中,Midjourney 支持文本或 语音生成、编辑、动画化多风格图像,并具风格迁移、模型切换、任务管理,实现高效个 性化视觉创作;Cursor 基于聊天式 AI 编程,将自然语言转为代码生成、调试与项目管 理,支持多模态上下文、Agent 执行和 MCP 接入。

根据 SimilarWeb 统计及非凡产研整理,截至 2025 年 8 月,国内 AI 产品年经常性收入 (ARR)Top20 中,有 4 款产品年收入超 1 亿美元。收入排名前三的应用分别为 KLING AI、PLAUD、PictureThis,年经常性收入分别为 1.23 亿美元、1.08 亿美元、0.85 亿美 元。其中,PictureThis 集成 AI 识别与植物数据库,支持多语种互动,快速识别植物并提 供养护信息与社区交流;KLING AI 融合全新 DiT 架构,实现高精度视频图像生成、动态 捕捉与多模态创作,助用户轻松打造电影级视觉内容。

出海类 AI 应用年经常性收入 Top20 中,排名前三的应用分别为 PictureThis、Hypic、 HeyGen,收入分别为 1.23 亿、0.84 亿、0.80 亿美元。其中,HeyGen 能理解语音的节 奏、语气和情绪,自动生成拟人化表情与动作,实现从“一张照片+一句话”到“超逼真 数字人视频”的端到端生成,可支持正脸、侧脸、全身多角度输入,广泛应用于动画制作、 虚拟角色配音、播客可视化等场景。

1.3 国内 AI 大模型招投标需求如何?

2025年1-10月,国内大模型中标项目数量实现逐月快速增长,1月同比增速达到1190%, 其后同比增速虽有所下降,但始终维持在高位,证明大模型技术在国内市场的接受率大幅 提速,落地速度加快。

根据中标项目披露的中标金额数据,2025 年 1-10 月中标项目披露金额与其同比增长率在 1 月达到峰值,2 月后中标项目披露金额逐月回升,10 月中标项目的披露金额为 26.7 亿 元,相比 9 月的 20.6 亿元有所上升。

1.4 上市公司 AI 商业化进度如何?

众多计算机上市公司在 AI 商业化领域已有积极进展。在收入贡献上,部分公司 AI 业务收 入占比表现亮眼,如能科科技 AI 业务实现收入 3.4 亿元,占营收比达 30.8%;汉得信息 物理 AI 平台项目收入为 3096 万元,占营收 29.2%。同时,不少公司聚焦 AI 技术在各 行业的落地应用以推动商业化,如税友股份围绕税务场景,基于 AI 能力开发智能体;汉 得信息将 AI 融入供应链、财务等业务领域,推动企业智能化升级。

2.全球 Al 本月重大新闻

2.1 海外大模型及 AI 应用进展

OpenAI 发布 Sora 2 与首个社交 App

10 月 1 日,OpenAI 正式发布新一代 AI 视频模型 Sora 2 及首款社交应用 Sora App。Sora 2 在物理一致性、音画同步、角色连贯性等方面实现重大突破,被誉为“视频生成的 GPT3.5 时刻”。用户可通过 Sora App 将自己“投影”进任意 AI生成场景,实现互动式视频创作。Sora 2 支持多镜头、跨场景叙事及高保真音效生成,分为 Sora 2 和 Sora 2 Pro 两个版 本,前者主打快速创作,后者面向专业级内容制作。

OpenAI 开发者大会发布多项重磅更新

10 月 7 日,OpenAI 在开发者大会 2025 上发布多项重磅更新,包括 AgentKit、Codex正 式版、ChatGPT 内置应用与 Apps SDK、gpt-realtime-mini、gpt-image-1-mini、Sora 2 API 及 GPT-5 pro API。Sora 2 API 正式开放视频生成功能,支持从文本生成高质量动态 视频。OpenAI 同步开放强化微调(RFT)和新评估功能,全面提升模型能力与开发体验。

谷歌发布 Veo 3.1 视频生成模型

10 月 16 日,谷歌发布了旗舰 AI 视频生成模型 Veo 的重大更新版本 Veo 3.1,实现了 视频画面与音频 (包括对话、音效和配乐) 的原生同步生成。新版本的模型为创作者提供 了更精细的导演级,控制能力。模型的[视频延展](Extend) 功能也得到了增强,现在可以 将视频片段扩展至最长 148 秒 (超过两分半钟),并通过衔接上一片段的最后一帧来保持 故事的连续性。

World Labs 发布实时世界模型 RTFM

10 月 17 日,斯坦福大学李飞飞的创业公司 World Labs 推出生成式世界模型 RTFM (实 时帧模型)。RTFM 采用了一种与传统 3D 渲染不同的路径。该模型被视为一种学习型渲 染器,无需显式 3D 表示,能从输入的 2D 图像直接生成保持 3D 一致性的新视角图像, 并可在单个 H100 GPU 上实时运行。

OpenAl 发布 Al 浏览器 ChatGPT Atlas

10 月 22 日,OpenAl 发布 Al 浏览器 ChatGPT Atlas,提供 macOS 版本下载。该浏览器 基于 Chromium 内核构建,将 ChatGPT 的对话、记忆和智能体能力与网页浏览体验进行 了集成。该浏览器整合了「ChatGPT 记忆」和「浏览器记忆」两项功能,后者通过学习 用户访问过的网站内容,为后续的 AI 交互提供更个性化的背景信息。Atlas 还引入预览版 的「智能体模式」,目前向 Plus、Pro 和 Business 付费用户开放,该模式用于让 AI 在浏 览器中自主执行多步骤任务。

2.2 国内 AI 行业动态及重点公司新闻

腾讯混元图像 3.0 强势登顶文生图榜单

10 月 5 日,腾讯混元团队发布并开源仅一周的原生多模态文生图模型——混元图像 3.0, 超越谷歌 Nano-Banana 与字节 Seedream 4.0,位列文生图综合榜与开源榜第一。该模 型参数量达 80B(推理时激活 13B),生成效果媲美顶级闭源模型。实测显示,混元图像 3.0 具备知识理解、逻辑推理与创意生成能力,文字渲染与画面构图显著提升。

蚂蚁开源万亿参数思考模型 Ring-1T

10 月 14 日,蚂蚁集团近日开源了万亿参数思考模型 Ring-1T。Ring-1T 是一个万亿参数 规模的混合专家 (MoE) 架构模型,其设计核心是深度思考与复杂推理能力。为支撑万亿 级模型的复杂训练流程,蚂蚁自研了 ASystem 框架。该模型在数学、编程、逻辑推理等 多个基准测试中达到了开源 SOTA 水平,并在高难度 IMO (国际奥数竞赛)测试中展现出 对标人类银牌的解题能力。

百度发布 AI 视频平台功能更新

10 月 15 日,百度对其 AI 视频生成平台[百度蒸汽机](文心专精版)进行了重大更新,推 出了实时流式生成功能。为实现低延迟的实时交互,百度蒸汽机在模型架构上进行了重构, 采用了流式滑窗的自回归扩散架构。升级后的平台支持多种生成模式。在[图生视频]模式 下,用户仅需一张图片和一个提示词即可启动长视频生成。

DeepSeek 开源 DeepSeek-OCR 模型

10 月 20 日,DeepSeek Al 的研究人员近日发布论文并开源 DeepSeek-OCR,该模型提 出了一种通过视觉模态压缩文本上下文的方法,以少量视觉 Token 来表示大量文本信息。 模型基于「上下文光学压缩」的思路,将长文本渲染为图像,再通过视觉语言模型处理压 缩后的视觉表示。在文本密集型文档基准测试上,当文本 Token 数量是视觉 Token 数量 的 10 倍以内时(压缩率<10x),模型重建文本的准确率可达 97%。

北京人形机器人创新中心等开源世界模型

WoW 10 月 17 日,北京人形机器人创新中心、北京大学和香港科技大学等机构的研究人员近日 发布论文,开源世界模型 WoW,用于让 Al 通过与物理世界的交互来学习因果关系和物理规律。模型通过模拟人类与物理世界的主动交互过程来学习直觉物理,强调通过机器人 与环境的交互数据来理解物理医果,并采用「生成-评估-修正」的认知循环。

快手发布多款 AI 编程产品

10 月 23 日,快手发布 AI 编程领域的产品组合,包含自研代码大模型 KAT-Coder、智能 开发工具 CodeFlicker 以及大模型服务平台快手万擎。KAT-Coder 代码模型是快手自研的 AI 编程基础模型,CodeFlicker 是快手推出的智能开发伙伴,快手万擎 MaaS 平台是快手 「三位一体」布局的底层基础,为企业提供大模型服务。

夸克 APP 上线对话助手

10 月 24 日,夸克 APP 对其产品进行了更新,在应用内集成了「对话助手」功能,该助 手基于阿里巴巴通义千问(Qwen)系列的闭源模型,该模型的性能相较于已发布的 Qwen3-Max 有所提升,具备较强的推理能力和长文本理解能力。初步测试显示,夸克对 话助手能够执行深度信息检索、多模态理解、复杂逻辑推理等多种任务。

美团开源视频生成模型 LongCat-Video

10 月 27 日,美团近日开源了其 13.6B 参数的视频生成模型 LongCat-Video,该模型在 一个统一框架内支持文生视频图生视频以及视频续写功能,并具备生成长达数分钟视频的 能力。该模型的一个核心特性是长视频生成能力。为提升推理效率,LongCat-Video 采用 了多项优化技术。在内部基准测试中,LongCat-Video 的文生视频整体质量据称优于 PixVerse-V5 和 Wan2.2-T2V-A14B。

编辑:火腿肠
  • 相关标签
  • 相关专题
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至