2025年DeepSeek行业专题报告:重塑全球AI格局的中国力量

  • 来源:国盛证券
  • 发布时间:2025/06/03
  • 浏览次数:508
  • 举报
相关深度报告REPORTS

DeepSeek行业专题报告:重塑全球AI格局的中国力量.pdf

该文档为DeepSeek发布的行业专题报告,聚焦于中国人工智能力量在全球AI格局重塑过程中的角色与影响。报告深入分析了以DeepSeek为代表的中国AI企业在技术创新、大模型应用及产业生态构建方面的核心竞争力。内容涵盖中国AI产业的技术突破路径、全球竞争态势以及未来发展趋势,旨在揭示中国AI产业如何从跟随者转变为全球重要参与者,并对全球人工智能发展格局产生深远影响。报告为理解中国AI产业的战略地位、技术演进方向及国际竞争策略提供了重要参考。

顶尖大模型发布进展不断

DeepSeek震撼科技圈:开源、低成本倒逼OpenAI加速发布

开放的许可证和用户协议:DeepSeek-R1 统一采用标准化、宽松的 MIT License,完全开源,不限制商用,无需申请。产品协议明 确可“模型蒸馏”。 OpenAI加速发布: 2月1日,OpenAI推出o3-mini, Plus和Team用户的速率限制从原来o1-mini的每天50条消息增加3倍到o3-mini的每天150条消息。 2月3日,OpenAI发布了基于OpenAI的o3模型之上开发而成的Deep Research。能够像人类分析师一样,对复杂的任务进行逐步分 解,并在互联网上进行多轮的信息搜索与验证,直到找到最合适的答案。 2月13日,OpenAI宣布将在未来几个月内推出GPT-5,该模型将整合OpenAI的大量技术,包括o3,在GPT-5推出之前,OpenAI计 划在未来几周内先发布GPT-4.5代号“Orion”,这将是OpenAI最后一个“非思维链模型。

大厂模型持续进步:字节

字节豆包实时语音大模型情绪理解与表达能力突出。 1月20日豆包实时语音大模型在豆包 APP 全量开放,在情绪理解和情感表达方面与GPT-4O相比优势明显。豆包团队围绕拟人度、 有用性、情商、通话稳定性、对话流畅度等多个维度进行考评。整体满意度(以 5 分为满分)方面,豆包实时语音大模型评分为 4.36,GPT-4o 为 3.18。其中,50% 的测试者对豆包实时语音大模型表现打出满分。在模型优点评测中豆包实时语音大模型在情绪 理解和情感表达方面与GPT-4O相比优势明显。尤其是“一听就是 AI 与否”评测中,超过 30% 的反馈表示 GPT-4o “过于 AI ”,而豆 包实时语音大模型相应比例仅为 2% 以内。

大厂模型持续进步:阿里

阿里通义千问登顶非推理国产模型冠军。 Qwen2.5-Max 于1月29日发布,2月4日凌晨,Chatbot Arena 公布了最新的大模型盲测榜单,通义千问Qwen2.5- Max 凭借1332分的成绩,位列全球第七,并成为非推理类中国大模型的冠军。同时,Qwen2.5-Max 在数学和编 程等单项能力上排名第一 “通义”比肩美国Meta的LlaMA,影响力稳居全球开源模型的第一阵营。据阿里研究院院长袁媛介绍,Hugging Face社区上,目前全球开发者基于阿里自研“通义”开源模型二次开发的衍生模型已经突破8万个。 4月29日阿里正式发布Qwen3并全部开源8款混合推理模型,亮点包括多种思考模式&多语言&Agent能力强化。 1)思考模式下,模型会逐步推理,经过深思熟虑后给出最终答案;非思考模式下,模型提供快速、近乎即时 的响应。2)Qwen3 模型支持 119 种语言和方言。3)优化了 Qwen3 模型的 Agent 和 代码能力,同时也加强了 对 MCP 的支持。

5 月 6 日,彭博社记者马克・古尔曼表示,iOS 18.6 预计将在中国大陆启用部分 Apple Intelligence 功能,将由 阿里云和百度提供技术支持。苹果公司将与阿里巴巴合作开发审查引擎,另外还将把百度的软件与 Siri 和 Visual Intelligence 实现集成。

大厂模型持续进步:腾讯

腾讯: 2025年3月元宝同时接入DeepSeek和深度思考模型混元T1。混元 T1 采用mamba架构,能秒回、吐字快、擅 长超长文处理的强推理模型,推理能力进一步提升,深度理解长文本内容,快速提炼要点,适合论文、报告、 策划案等。 2025年4月微信上线元宝好友用户可在微信搜索“元宝”之后将其添加为好友,直接在微信聊天界面与其进行 互动。账号介绍显示其搭载混元和DeepSeek双模引擎,无缝衔接微信生态。一键解析公众号文章和任何图 片和文档,短评后奉上秒开详解,支持对解读内容做各种智能互动;支持陪伴互动,越聊越懂用户。 推出AI智能工作台ima 2024年11月15日腾讯推出AI智能工作台ima.copilot(简称ima)。ima搜索得出的答案,除开全网信源,还打通 微信公众号文章的生态。整个公众号世界里的优质知识,都可为用户所用。能为用户提供好答案和高质量的 问题相关信息,有效提升信息获取效率。除了能搜出答案,ima还有一个特点——边问边看,边搜边记,让 用户可以轻松弄懂知识点。 混元 3D 生成大模型 2.0 :2025 年 1 月 21 日,腾讯宣布开源 3D 生成大模型的 2.0 版本,并推出业界首个一 站式 3D 内容 AI 创作平台 —— 混元 3D AI 创作引擎。该版本在生成质量上有显著提升,简化了创作流程, 在几何和纹理解耦生成方面取得进步,生成效果更精细,几何结构更准确,纹理色彩更丰富。用户通过一句 话、提示词或图片即可生成 3D 模型,还可实现角色塑造、动画形成等功能。

大厂模型持续进步:华为

2024年6月22日,华为云盘古大模型迎来了新的里程碑——盘古大模型5.0。这一版本的发布,不仅标志着盘古大模型在技术上的 又一次飞跃,也预示着其在行业应用中的无限可能。盘古大模型5.0在全系列、多模态、强思维三个方面进行了全面升级。 全系列:盘古大模型5.0包含不同参数规格的模型,以适配不同的业务场景。十亿级参数的Pangu E系列可支撑手机、PC等端侧的 智能应用;百亿级参数的Pangu P系列,适用于低时延、高效率的推理场景;千亿级参数的Pangu U系列适用于处理复杂任务;万 亿级参数的Pangu S系列超级大模型能够帮助企业处理更为复杂的跨领域多任务。 多模态:盘古大模型5.0能够更好更精准地理解物理世界,包括文本、图片、视频、雷达、红外、遥感等更多模态。在图片和视频 识别方面,可支持10K超高分辨率;在内容生成方面,采用业界首创的STCG(Spatio Temporal Controllable Generation,可控时空 生成技术,聚焦自动驾驶、工业制造、建筑等多个行业场景,可生成更加符合物理规律的多模态内容。 强思维:复杂逻辑推理是大模型成为行业助手的关键。盘古大模型5.0将思维链技术与策略搜索深度结合,极大地提升了数学能力、 复杂任务规划能力以及工具调用能力。

AI 应用: MCP驱动Agent生态加速构建

MCP影响力扩大,Agent生态构建加速

当前以大语言模型为核心驱动的Agent(智能体)技术正在快速发展中,展现出理解复杂指令、自主规划、调用工具并执行多步骤任 务的强大能力。从简单的问答、文本生成,到复杂的市场分析、代码编写、差旅预订,Agent正逐渐渗透到我们工作和生活的方方 面面。

MCP(模型上下文协议)是一种开源协议,旨在标准化如何为大模型提供上下文。可以将MCP想象成 Agent的 USB-C接口:为大模型 提供了一种连接到各种工具和数据源的统一方法。 传统上将AI统连接到外部工具涉及集成多个API。每个API 集成都意味着单独的代码、文档、身份验证方法、错误处理和维护。 MCP旨在替换碎片化的Agent代码集成,从而使 AI 系统更可靠,更有效。通过建立通用标准,服务商可以基于协议来推出它们自己 服务的 AI 能力,从而支持开发者更快的构建更强大的 AI 应用。开发者也不需要重复造轮子,通过开源项目可以建立强大的Agent 生态。

传统功能性APP走向Agent化,AI来全新功能升级

传统功能性APP走向agent化,AI有望带来全新功能升级 。飞猪推出 Agent“问一问”,旅游攻略智能化体验全新升级,对着手机喊一句“带 娃游成都,预算5000”,10秒内「问一问」便召唤出机票比价师、酒 店顾问、路线规划师等多位AI助手,从直飞航班、亲子酒店到“熊猫 基地早起攻略”一键生成,费用明细精确到元,基于实时库存和真实 用户评价推荐方案。而且方案中涉及到的机票、酒店等商品,用户可 以直接一键下单预订。 飞猪Agent的关键要点: 1) 打通数据接口,实时连接最新数据。飞猪直接接入了自己的机票 报价引擎,Agent在解析完消费需求后,会通过报价引擎从航司和全 球机票分销系统获取信息,并打通了酒店、景区品类的供应链管理系 统,确保机票、酒店价格和库存等信息秒级更新。 2) 多智能体协作,多维分工提升用户体验:「问一问」采用了多智 能体协作机制打造核心决策层。系统内置了行程助手、交通顾问、酒 店管家等多个专业AI角色,每个角色负责特定领域的专业判断,方案 准确性和可用性得到了大幅度提高。

ToB垂直领域Agent落地需要连接大模型与具体行业的软件服务商

在AI Agent落地各ToB行业的过程中,连接大模型与具体行业的软件服务商是必不可少的环节。目前以互联网大厂和独角兽 创业公司为主的大模型厂商不一定在各领域具备深耕的行业know-how,另外大模型厂商的研发人员通常在软件行业内属于 较高端人才,人力成本相对较高,由其他服务商去对接具体的行业客户是更高的选择。我们认为在垂类深耕的公司以及具 备长期软件服务经验的公司有望把握Agent落地机遇,在对接大模型和具体行业的过程中深度受益。

AI应用:端侧/智驾/机器人/军工等

AI应用落地加速:端侧AI

各类智能终端(手机、耳机、眼镜等)将是AI 重要应用场景。荣耀产品线总裁方飞表示:“AI Agent应该是帮助你做你想做不会做,会做不想做的事,以及提供情感陪伴。 AI Agent将会成为你智能化的助理,你可以把它理解为‘贾维斯’”。 端侧AI应用场景按人类的基本活动生活、生产划分可大致分为:1)生活:主要覆盖衣食住行教育医疗娱乐场景,如智能家居、智能穿戴设备、智慧交通、智能出行、智慧 医疗、智慧娱乐、生活助理等;2)生产:生产主要覆盖物质生产、精神生产场景,如智慧农业、智慧制造、内容生产(游戏、音乐、影视)等。

苹果: 2024年6月10日,苹果在全球开发者大会上推出了Apple Intelligence,这是一款深度集成到 iOS 18、iPadOS 18 和 macOS Sequoia 中的个人智能系统。 Apple Intelligence 由多个功能强大的生成模型组成,这些模型专门用于用户的日常任务,并可即时适应用户当前的活动。Apple Intelligence 内置的基 础模型针对用户体验进行了微调,例如编写和优化文本、确定通知的优先级和摘要、为与家人和朋友的对话创建有趣的图像,以及执行 App 内操作以 简化跨 App 的交互。

AI应用落地加速:AI编程

编程有比较准确的评判标准,Github等社区拥有海量高质量代码数据,是大模型能较快取得进步的方向。 各类AI代码工具持续涌现,商业化进展迅速。集成大模型的IDE Cursor到2024年8月已有超过40000名企业客户;IDE插件GitHub Copilot自全面推出以来有超过77000个组织采用;国内也有阿里通义灵码AI程序员等应用 2月7日,微软CEO纳德拉宣布GitHub Copilot正all -in到智能体,并推出自主的SWE agent,用于协助软件工程师,可以执行各种开 发任务。例如生成和审查代码、重构或优化代码库、自动化测试或管道等工作流程,以及提供架构、错误故障排除和最佳实践方面 的指导。

AI驱动中国科技资产重估

DeepSeek驱动国内IT基本面质变,估值修复空间显著

2024年外部环境承压,国内IT企业估值仍处于历史低位。近年外部环境有所波动,以党政军、央国企为代表的群体IT开支景气度不 高,传导至计算机公司层面,其利润、现金流、收入增速即相对较低,估值亦处于历史低位。2024Q1-3,计算机(申万)行业营业 收入约为8498.48亿元,同比增长6.27%;归母净利润约为163.79亿元,同比下降31.55%。

1)DeepSeek 提出多项算法创新,打破了海外算力堆砌的传统大模型提升路径,展示出中国在AI领域已经具备与全球顶尖水平竞争 的实力,我们认为这将使全球投资者对中国科技企业的技术创新能力塑造新的认知,进而对中国科技资产重新进行价值评估 2)Deepseek开源+高性能+低成本显著降低应用开发门槛,应用落地方面中国优势显著。中国拥有庞大的工程师队伍,自移动互联 网时代以来已经积累了丰富的数据资源以及社交网络和电商领域完善的生态系统,DeepSeek降低了AI技术门槛,让这些资源与 AI 技术更好地结合,完善了中国 AI 产业生态,使中国在全球 AI 产业竞争中占据更有利的位置推动科技资产价值上升。 3)应用爆发带来广泛推理需求,为国内算力产业带来发展机遇。相比于模型训练,推理需求对硬件要求相对较低,集群互联的要 求也更为宽松,为国产芯片、英伟达中低端卡以及ASIC芯片等国内算力提供了有利的发展机遇。寒武纪、昇腾、沐曦、天数智芯、 摩尔线程、海光信息、壁仞科技、太初元碁、云天励飞、燧原科技、昆仑芯、灵汐科技、鲲云科技、希姆计算、算能科技、清微智 能、芯动力、龙芯中科、瀚博半导体等。 4)财政政策或更积极,IT企业增速有望进一步修复。2025年1月10日,财政部副部长廖岷表示,加积极的财政政策未来可期。财政 将围绕加快发展新质生产力,要加大对教育人才、科技攻关、乡村振兴、绿色低碳等领域的支持。在应对国际国内形势的变化上, 将保持密切跟踪,适时进行科学设计和动态调整,梯次拿出政策“后手”,为经济社会发展提供强有力支持。我们认为,自主可控、 人工智能、国产算力等作为新质生产力重要方向,未来有望得到更多支持。

AI基建带动国产算力、云厂商需求

DeepSeek日活飙升,拉动巨大算力需求

DeepSeek凭借“开源、成本低、性能高”迅速出圈火爆全球,正在 激活市场热情。 1月27日,Deepseek应用登顶苹果中国地区和美国地区应用商店免 费APP下载排行榜,在美区下载榜上超越了ChatGPT。 据AI产品榜,DeepSeek APP上线20天日活突破两千万,成为全球 增速最快AI应用。 1月DeepSeek官网多次显示,服务器繁忙/API不可用。DeepSeek 回应称可能是由于新模型发布后,用户访问量激增,服务器一时 无法满足大量用户的并发需求。

算力需求开始向推理倾斜

1月27日微软CEO在X上发帖引用“杰文斯悖论”,表示随着 AI 的效率和 可访问性越来越高,我们将看到它的使用量猛增,将其变成我们无法满 足的商品。 训练侧:业界预训练阶段Scaling边际提升放缓,目前主要精力放在后训 练。整体训练算力需求短期是否会继续扩张有一定不确定性。 DeepSeek-V3总参数为 6710 亿参数, 训练数据量14.8 万亿 token ,Llama 405B训练数据15万亿token,随着互联网文本数据的耗尽,预训练阶段的 Scaling law 出现放缓趋势。DeepSeek-V3提出预训练阶段多项优化措施。 后训练阶段,DeepSeek-R1 Zero提出只强化学习(RL)不需要监督微调 (SFT)也可以取得较好效果,但是可读性较差。R1增加了部分高质量思 维链数据做监督微调。 推理侧: 1.模型进步有助于应用落地,调用量提升 2月3日DeepSeek在全球140个市场移动下载量排行榜中位列榜首,自1月 28日以来在谷歌Play Store美国区下载量达1600万次,超过ChatGPT同期 表现。 2.DeepSeek R1这类推理模型回答时要输出大量token作为思考过程,需要 较多算力。

报告节选:

编辑:火腿肠
  • 相关标签
  • 相关专题
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至