DeepSeek大模型应用现状及产业生态介绍

DeepSeek大模型应用现状及产业生态介绍

最佳答案 匿名用户编辑于2025/03/13 14:51

到今年 1 月 27 日,其最新发布的 R1 模型就已登顶苹果 美国地区应用商店免费 APP 下载排行榜,超越了美国同类产 品 ChatGPT。

1.DeepSeek 大模型应用现状

(一)国内情况 随 着 DeepSeek 的 爆 火 , 国 产 大 模 型 云 服 务 平 台 SiliconCloud(硅基流动)开始被大家关注。 2 月 1 日,硅基流动和华为云宣布联合⾸发并上线基于 华为云昇腾云服务的 DeepSeekR1/V3 推理服务。基于自研推 理加速引擎加持,硅基流动和华为云昇腾云服务支持部署的 DeepSeek 模型可获得持平全球⾼端 GPU 部署模型的效果。 DeepSeek 对中国最大的启示,还是“开放”二字。无论是 心态上还是方法上,都要毫不动摇地坚持开放,继续开放。 DeepSeek 的胜利,就是开源打败闭源。OpenAI 以前是开源 的,后来变成闭源的,这次 DeepSeek 爆火之后,OpenAI 的 奥特曼也出来说话,承认闭源是一种战略错误。

开源不仅可以用我们举国的力量,还可以用全世界的力 量。世界的科学共同体要联合起来,遏制资本、遏制某些政 客的力量,促进人类的技术进步。中国过去很多技术成果和 产业成功都是在开放条件下取得的,今后也必须如此。长三 角、珠三角还有很多有潜力成为独角兽的企业,很多人没有 资源,但是有技术,需要来自国家的资源。所以,科技要取 9 得长足进步,金融改革也要跟上。我们不要虚拟金融、泡沫 金融,要遏制投机性的,但对新技术的投资,对真正创新的 风投,我们一定要做好。 在吴恩达看来,本周围绕 DeepSeek 的热议,让许多人清 晰地看到了几个一直存在的重要趋势:美国在 GenAI 领域的 领先地位正在被中国迎头赶上,AI 供应链格局将被重塑;开 放权重模型正在推动基础模型层商品化,为应用开发者带来 新机遇 ;扩大规模并非通往 AI 进步的唯一途径。尽管算力 备受追捧,但算法创新正在快速降低训练成本。

成立至今,DeepSeek 并未开放过外部融资,因此也并未 引起创投圈的过多关注。直至 2024 年 5 月,DeepSeek 发布 DeepSeek-V2 开源 MoE 模型,因极度降低推理成本,意外掀 起一场大模型“价格战”,开始出圈。隐秘低调,却聚集了一 群 AI 天才。据悉,DeepSeek 包括创始人梁文锋在内,仅有 130 多名工程师和研究人员。不同于其他明星创业公司, DeepSeek 鲜有海归,团队成员几乎都来自清华大学、北京大 学、中山大学、北京邮电大学等国内顶尖高校,不少还是在 读博士。去年底,雷军开出千万年薪挖角 DeepSeek 研究员罗 福莉。这一次,DeepSeek 正式浮出水面。上个月,梁文锋和 团队开发的大模型 DeepSeek-V3 正式发布。起初在 AI 发烧 友圈内流传,由于表现出色,一时轰动硅谷。2025 年 1 月 20 日,DeepSeek 正式发布 DeepSeek R1,开始席卷全球。

(二)全球情况 到今年 1 月 27 日,其最新发布的 R1 模型就已登顶苹果 美国地区应用商店免费 APP 下载排行榜,超越了美国同类产 品 ChatGPT。 DeepSeek 的成就至少让美国三种人感到尴尬。一是硅谷 的技术精英们,他们耗费巨资拿出的产品,其性能和中国公 司用“小米加步枪”的装备做出来的差不多,甚至创新性上还 棋差一招。另一类人则是华尔街的金融大佬们,近些年他们 通过炒作人工智能概念,把资产泡沫吹得五彩斑斓,但就在 DeepSeek 下载量超越 ChatGPT 之时,美国科技股遭受重创, 英伟达股价一度重挫 17%。 当然,最“愤怒”的还是美国的政客们,他们搞技术围 堵已经好几年了,但中国的高科技产品一项接一项推出。围 堵不但没能压制中国智造,反而加速了中国科技的突破,这 昭示所谓的围堵其实已经破产。当 DeepSeek 登顶下载排行 榜第二天,就遭遇了来自美国 IP 地址的持续网络攻击,并 且在随后几天,攻击量暴增百倍。而一些西方政客以各种理 由将 DeepSeek 列入“实体清单”,或要求封锁该软件。同时 他们还利用舆论,声称 DeepSeek“蒸馏”了美国技术。

DeepSeek 以更低的算力要求和更低的成本,达到了与美 国顶级 AI 大模型相当的效果,展现出了强大的技术竞争力。 11 它的出现,不仅打破了原有的市场格局,更是被认为对美国 在 AI 领域的领导地位构成了实实在在的威胁。 “DeepSeek 可能会开辟一个全新的由中国引领的技术 生态系统,这会让全球的开发者因 DeepSeek 开发的低成本、 更高效的人工智能产品而受益。”一位 TMT 领域投资人如是 说,“这种竞争从某种程度来说也将打破美国科技巨头的市 场主导地位。”

2.生态

1. Deepseek 应用 27 日登顶苹果中国地区和美国地区应 28 用商店免费 APP 下载排行榜 由国产大模型公司杭州深度求索开发的 Deepseek 应用 27 日登顶苹果中国地区和美国地区应用商店免费 APP 下载 排行榜,在美区下载榜上超越了 ChatGPT,在中国、美国的 科技圈受到广泛关注。环球时报 27 日称,Deepseek 被认为 是大模型行业的最大“黑马”,在外网被不少人称为“神秘的 东方力量”。

 

2. DeepSeek 在开源社区 GitHub 上的 Star 数首次超越 OpenAI DeepSeek 项目在 GitHub 平台上的 Star 数,已经超越了 OpenAI。热度最高的 DeepSeek-V3,Star 数如今已达 7.7 万。而DeepSeek-R1,更是仅用了3周时间,就超越了「openaicookbook」。前有 App Store 登顶,今有 GitHub 超越,网友们 高呼:永远不要低估开源社区的力量。

3. 国家超算互联网正式上线 DeepSeek 国家超算互联网平台已正式上线 DeepSeek-R1 模型的 1.5B、7B、8B、14B 版本,并将于近期陆续更新 32B、70B 等版本。DeepSeek-R1 小版本模型提供一键推理服务,无需 下载本地;还可根据私有化需求,引入专有数据,对模型进 行定制化训练和开发。 除 R1 模型外,国家超算互联网平台还上线了 DeepSeekV3、DeepSeek-v2.5 系列、DeepSeek-coder 系列、DeepSeekmath 系列(7b)和 DeepSeek-v2 系列(Lite)等模型。

4. 传 DeepSeek 正准备适配中国国产 GPU 然而,据美国科技网站 Tom’s Hardware 报道,韩国未来 资产证券在对 DeepSeek 技术论文进行分析时发现,该模型 的硬件效率之所以能比 Meta 等高出 10 倍,因为“他们从头开始重建了一切”。分析指出,DeepSeek 在使用英伟达的 H800 晶片进行训练时,使用了英伟达的底层硬件指令 PTX (Parallel Thread Execution)语言,而不是高级编程语言 CUDA。由于 CUDA 是通用型编程框架,会导致训练模型时 损失一些灵活性。中国网媒“快科技”分析,DeepSeek 的做 法相当于绕过了硬件对训练速度的限制,意味着其他模型需 要训练 10 天,而 DeepSeek 只需要五天。然而,这种编程非 常复杂且难以维护,行业通用的做法是使用 CUDA 这类高级 编程语言。快科技和腾讯网引述的消息人士指出,DeepSeek 内部拥有一些擅长写 PTX 语言的内部开发者,假如 DeepSeek 未来有意改适配中国国产的 GPU,在硬体适配方面将会更得 心应手。

5. DeepSeek 的风,火速吹遍了终端企业 近期,消费电子类、显示类终端企业“紧跟热点”,纷纷 高调宣布接入 DeepSeek,DeepSeek 的风,终于吹到了终端 领域(其他领域接入 DeepSeek 情况,请参考本报早前发表文 章《关于 DeepSeek,多家算力芯片公司宣布……》《DeepSeek 为何“多云”?》)。如此快速的“结盟”究竟是基于业务发 展的技术升级,还是蹭流量的营销动作? 华为:2 月 5 日,华为宣布,基于原生鸿蒙操作系统的 小艺助手 App 已经接入 DeepSeek。目前,纯血鸿蒙小艺智能 体已经支持 DeepSeek-R1,已升级至原生鸿蒙的华为用户可 31 以通过“小艺助手 App-发现-智能体广场”与 DeepSeek 进 行对话,实现更加无缝的 AI 体验。

荣耀:2 月 8 日,荣耀 YOYO 智能体商店上线 DeepSeekR1 尝鲜版,成为第二家与 DeepSeek 达成合作的手机厂商。 荣耀 PC 产品线总经理朱臣才发文称,2 月的新品 MagicBook Pro 14 将率先全面接入 DeepSeek。 OPPO:2 月 8 日,OPPO 宣布 OPPO 系手机将正式接入 DeepSeek-R1 人工智能推理模型。 视源股份:2 月 8 日,主营显示、交互控制的解决方案 提供商视源股份宣布,公司学习机全系列产品目前已接入 DeepSeek,希沃电脑助手、希沃白板、希沃课堂智能反馈系 统等产品也将逐步全面接入 DeepSeek。

魅族:2 月 8 日,魅族 FlymeAIOS 团队宣布:确认已完 成 DeepSeek-R1 大模型接入,魅族 21 系列、Lucky08 率先上 线尝鲜,星纪魅族 StarVAR 眼镜等 AI 生态产品将陆续接入。 洲明科技:2 月 10 日,领先的 LED 应用厂商洲明科技 宣布 Agent 平台已接入 DeepSeek 的 V3 及 R1 模型,通过结 合 DeepSeek 在自然语言处理和多模态推理上的优势,优化 教育场景的多 Agent 交互体验。 利亚德:2 月 10 日,另一家 LED 应用领头羊企业利亚 德在互动平台表示,旗下虚拟动点动作大模型 LYDIA 已正 式接入 DeepSeek。通过这一整合,LYDIA 在空间动作数据的 32 认知、感知、理解和生成能力上得到了进一步升级,尤其在 动作精准度及动作效果层面得到了进一步提升。 海信视像:2 月 11 日,海信电视宣布正式接入 DeepSeek。 海信电视正在进行用户终端的升级发布,预计 3—5 天内,所 有搭载智能体的海信电视将全面支持 DeepSeek。接下来,即 将上市的海信电视 2025 年新品也将全面支持 DeepSeek 服务

参考报告REPORT

deepseek大模型生态报告.pdf

deepseek大模型生态报告。DeepSeek,全称“杭州深度求索人工智能基础技术研究有限公司”,简称“深度求索”,于2023年7月17日由幻方量化创立,位于杭州市拱墅区,是一家创新型科技公司,专注于开发先进的大语言模型(LLM)和相关技术,法定代表人、执行董事兼总经理为裴湉。2024年1月5日,该公司发布第一个大模型DeepSeekLLM。之后,相继发布DeepSeek-Coder、DeepSeek-VL、DeepSeekV2、DeepSeekV3等模型。其中,DeepSeekV2模型因在中文综合能力评测中的出色表现,且以极低的推理成本引发行...

我来回答

快速提问

海量报告支持,行业专家解读

海量文库支持,行业专家解答

  • 相关问题
  • 最新问题
用户解答榜
分享至