AI应用与海内外大模型发展情况如何?

AI应用与海内外大模型发展情况如何?

最佳答案 匿名用户编辑于2024/07/22 15:05

AI产品百花齐放,访问量稳中有升逐渐普及。

1、 AI 应用:通过 AI 大模型开发的应用产品,应用途径百花齐放

AI 应用产品通过 AI 大模型开发而来,可满足消费者多样的需求。AI 应用是在 AI 大模型的基础上,借助 AI 大模型开发的产品。AI 应用产品从应用途径来看,可 以分为 AI 聊天机器人、AI 文本产品、AI 图像、AI 语音等应用途径,可满足消费者 多样的需求,应用途径百花齐放。

 AI 聊天机器人:应用逐渐普及,访问量持续上升

AI 聊天机器人可应用于多个领域,海内外厂商积极推出相关产品。2022 年 11 月,美国 AI 公司 OpenAI 发布旗下 AI 聊天机器人程序 ChatGPT,该程序基于大型 语言模型 GPT-3.5,是一种功能强大的自然语言处理技术,可以应用于多个领域,如 智能客服、自然语言理解、智能写作、机器翻译等。随着 ChatGPT 的推出,在随后 的时间内海内外厂商积极跟进,相继推出基于 AI 大模型的 AI 聊天机器人产品。

AI 聊天机器人应用逐渐普及,访问量持续上升。据 SimilarWeb 数据,2024 年 4 月 kimi 总访问量达 1957 万次,MoM+60.67%,文心一言总访问量达 1683 万次, MoM+13.79%,国内部分 AI 聊天机器人总访问量达 5333 万次,MoM+37.29%。

 AI 文本产品:AI 文本产品功能侧重不同,访问量稳中有升

AI 文本产品功能侧重不同,访问量稳中有升。从 AI 文本产品的功能来看,NotionAI 具有辅助写手(修改文本、生成文本、续写文本)、语气修改、文本处理、文字秘 书等功能;秘塔写作猫具有智能文本纠错、改写润色、自动续写、智能配图等功能; Grammarly 具有单词错误拼写纠正、英语语法校正、标点符号纠正等功能; LanguageTool 具有语法检测、风格检测等功能。2024M5 部分 AI 文本工具 Web 总访 问量达 2.47 亿次,从 2023M12 到 2024M5 来看,部分 AI 文本工具 Web 月度总访问 量稳中有升。

 AI 图像赛道:AI 图像产品用途多样,月度总访问量维稳

AI 图像产品用途多样,月度总访问量维稳。Canva 具有海报、LOGO、简历等 多场景图像设计功能,Fotor 具有图片编辑、拼图等功能,可帮助使用者完成各种图 片编辑需求,SeaArt 可以生成各种风格和场景的图片,支持生成二次元、卡通、游 戏、摄影等不同风格的图像。据 SimilarWeb 数据,2024M5 部分 AI 图像工具 Web 总访问量达 295 万次,接近 300 万次。

2、 AI 大模型:链接算力和应用的核心,向着多模态、端侧模 型发展

2.1、 AI 大模型:AI 大模型是神经网络模型,是链接算力和应用的核心

AI 大模型是具有数以亿计参数的神经网络模型,是链接底层算力和上层应用的 重要一环。AI 大模型通常指的是具有数以亿计参数的神经网络模型,它们可以在大 规模数据集上学习复杂的表示和知识,从而实现高度自动化的智能功能;而从 AI 产 业结构来看,据中商产业研究院,产业链上游为基础层,包括算力等,中游为算法 和模型层,下游为应用层,大模型是链接上游算力和下游应用的核心。

2.2、 海外大模型发展情况:向着多模态、端侧模型发展

2.2.1、 OpenAI:已发布多模态大模型 GPT-4o,向着多模态、端侧应用发展

已发布多模态大模型 GPT-4o,人机交互更接近人与人的自然交流。2024 年 5 月 14 日,美国人工智能研究公司 OpenAI 推出新旗舰模型“GPT-4o”,其中“o”代 表“omni”(是全面、全能的意思),该模型是一个多模态模型,可以支持文字、图 像、语音和视频的输入和输出,甚至是 GPT-5 的一个未完成版。“GPT-4o”将向所 有用户开放,同时语音延迟将大幅降低,能在 232 毫秒内回应音频输入,平均为 320 毫秒,此前使用语音模式与 ChatGPT 进行交流,平均延迟为 2.8 秒(GPT-3.5)和 5.4 秒(GPT-4)。

GPT-4o 向着端侧应用发展。据钛媒体报道,在 2024 年 5 月 OpenAI 春季发布 会上,OpenAI 运用了大量的篇幅,去介绍 GPT-4o 在移动端与人类交互的先进程度; 同时,据 21 世纪经济报报道,在此次发布会上,OpenAI 发布会呈现的新模型多基 于手机端场景,并且 IDC 中国研究总监卢言霞表示,GPT-4o 意味着大模型在端侧的 落地更进一步。

2.2.2、 Google:多模态大模型进一步拓展,拓展至 200 万 tokens

多模态大模型进一步升级,推出 Gemini 1.5 Pro。Google 于 2023 年发布多模态 大模型 Gemini,2024 年 2 月,Google 发布了 Gemini 1.5 Pro,Gemini 1.5 Pro 是一个 多模态模型,可以上传各种文件、图片、视频等文件,并最高支持 100 万 tokens 的 上下文,2024 年 5 月,Google 突破上下文窗口限制,将 Gemini 1.5 Pro 的上下文窗 口拓展至 200 万 tokens。

2.2.3、 Meta:发布多模态 AI 模型 Chameleon,引领多模态革命

Meta 发布多模态 AI 模型 Chameleon,引领多模态革命。2024 年 5 月,Meta 团队发布了“混合模态”AI 大模型 Chameleon,最大特点在于采用统一的 Transformer 架构,将文本、图像和代码等不同模态的信息作为离散标记进行处理,与以往的模 型不同,Chameleon 摒弃了针对不同模态的单独编码器或解码器,通过“早期融合” 方法将所有模态从一开始就投影到一个共同的表示空间中,实现了跨模态的无缝推理和生成,并刷新了当前的技术标准(SOTA)。

2.3、 国内大模型:正处于快速发展期,加速追赶海外大模型

国内大模型正处于快速发展期。自 2022 年 11 月 30 日 ChatGPT 发布以来,AI 大模型在全球范围内掀起了有史以来规模最大的人工智能浪潮。国内学术和产业界 在过去一年也有了实质性的突破,大致可以分为三个阶段:准备期(ChatGPT 发布 后国内产学研迅速形成大模型共识)、成长期(国内大模型数量和质量开始逐渐增长)、 快速发展期(各行各业开源闭源大模型层出不穷,形成百模大战的竞争态势)。

国内大模型发展迅速,持续追赶海外头部大模型。中文通用大模型综合性测评 基准(SuperCLUE)是针对中文可用的通用大模型的一个测评基准,据 SuperCLUE 测试结果,海外大模型 GPT-4 Turbo 以 79.13 分的优势领跑基准测试,同时,国内大 模型发展迅速,但与 GPT-4 仍存在差距,例如百度文心一言 4.0、Baichuan3 和 GLM-4 与 GPT-4 Turbo 均相差 5 分以上。

参考报告REPORT

半导体行业分析报告:AI终端加速创新发展,关注上游产业链核心增量.pdf

半导体行业分析报告:AI终端加速创新发展,关注上游产业链核心增量。AI模型、AI应用、AI硬件协同发展,加速推动AI终端创新发展。AI应用是基于AI大模型的基础上,借助AI大模型开发的产品。从应用方向来看,AI应用产品百花齐放,可以应用于AI聊天机器人、AI文本、AI图像等方向;从普及程度看,AI应用访问量稳中有升,AI应用普及有望提速。AI模型是链接AI应用和AI硬件的核心,海外AI大模型向着多模态、端侧发展,国内AI大模型正处于快速发展期,正加速追赶海外AI大模型。AI硬件是支持AI大模型及AI应用的算力底座,目前各AI硬件厂商均已推出搭载算力的AI硬件,并持续向着提供高算力发展。AI终端...

我来回答

快速提问

海量报告支持,行业专家解读

海量文库支持,行业专家解答

  • 相关问题
  • 最新问题
用户解答榜
分享至