2025年人工智能行业专题报告:国产AI Agent的崛起

  • 来源:华福证券
  • 发布时间:2025/07/30
  • 浏览次数:315
  • 举报
相关深度报告REPORTS

人工智能行业专题报告:国产AI Agent的崛起.pdf

人工智能行业专题报告:国产AIAgent的崛起。AIAgent框架:Coding模型+AI编程平台。Agent应用的落地逻辑,是优秀的Coding模型和AI编程平台协调配合。AIIDE并未抛弃传统IDE的核心功能(代码编辑、调试、版本控制等仍是基础),而是通过AI能力降低开发门槛、提升效率。从AI的角度重新把IDE和编码平台做一遍,让底层逻辑更加适配AI行为,提前会进行与预先调控和流程规划,让大模型使用多工具的路径更流畅更丝滑。ClaudeCode:推动Agent进入新阶段。Anthropic借助Claude大模型在Coding赛道成为Coding模型标杆,借助ClaudeCode切入AI编程...

一、AI Agent框架:Coding模型+AI编程平台

Agent应用的落地逻辑:优秀的Coding模型和AI编程平台协调配合

为什么需要Coding模型?

根据Anthropic的研究报告指出:编码代理用于更高的自动化。Claude Code上79% 的对话被确定为“自动化”(人工智能直接执行任务),而不是“增强”(人工智能与人类协作并增强能力)(21%)。相比之下,只有 49% 的对话Claude.ai 被归类为自动化。这可能意味着,随着AI 代理变得越来越普遍,以及随着更多代理AI产品的构建,任务自动化将更多。

工具调用的底层依赖于强大的代码能力,特别是其中的Tool Use和Agentic规划能力。

为什么需要AI编程平台?

IDE是开发者用于编写、调试和管理代码的工具集合。IDE就相当于程序员的“工作台”,能将流程都集中在一个高效的环境中。

AI IDE是在此基础上引入大模型、智能体等AI能力,就像是给IDE加上了“大脑”和“助手”,使得开发过程从“手写+低效”转向“智能+协作”,大幅提升效率。

以及随着编程门槛的降低,逐步从“开发者”向“创作者”过渡。AI应用开发者在平台上构建智能体、复用工具和服务。

AI编程平台:Cursor为什么崛起?

1、基础模型能力:  与Claude深度绑定的Cursor,用户可以配置 API 密钥直接调用 Anthropic 的Claude 模型,理论上接近“满血性能”。

2、代码索引上下文理解能力:具备强大代码索引系统,用户可以直接引用特定文件或函数,AI 会根据索引生成相关代码。上下文索引能力强,适合大型项目开发。

3、代码审查能力: Cursor开发错误查找器功能(Bug Finder),可以扫描代码并在编辑器中直接Debug。

4、工程化集成能力: Cursor 将其 AI 功能直接扩展到终端,可以直接在终端中将自然语言描述转换为实际命令,使复杂的命令行作更易于访问。

Coding模型:Claude模型为什么适合Agent

1、Claude 3.7 Sonnet 在 TAU 工作 台上实现了先进的性能,TAU 工作台 是一个框架,通过用户和工具交互在 复杂的实际任务上测试 AI agent。

2、Claude 3.7能够处理从前端(HTML、CSS、JavaScript、React)到后端(Node.js、Python Flask、Java Spring)和数据库(SQL、NoSQL)的全栈开发任务。

二、Claude Code:推动Agent进入新阶段

Coding模型:Claude 4 Sonet领跑

Anthropic借助Claude大模型在Coding赛道成为Coding模型标杆,借助Claude Code切入AI编程平台。

Claude Code 切入AI编程平台

优势在于: 需求理解与计划制定模块:Claude Code能够从简单的英语描述中理解开发需求,自动制定实现计划、编写代码并确保其正常工作。 全局代码库感知系统:ClaudeCode具备对整个项目结构的全局感知能力,可以回答针对团队代码库的任意查询。自动化调试与修复引擎:Claude Code能够分析代码库,识别问题并自动实施修复。 工作流自动化系统:自动修复复杂的lint问题、解决合并冲突并编写发布说明。

三、国产Coding模型:Kimi K2和Qwen Coder崛起

非推理模型的强coding模型:Kimi K2

Kimi K2:7月11日,发布大模型Kimi K2,一款具备更强代码能力、更擅长通用Agent任务的基础模型。 爆发原因:1、开源万亿参数大模型;2、具有优秀Agent能力的非推理模型。

在自主编程(Agentic Coding)、工具调用(Tool Use)和数学推理(Math & Reasoning)这三个能力维度上,Kimi K2的表现超过了DeepSeek-V3-0324、Qwen-235B-A22B等模型,但在部分基准测试中略逊于Claude 4 Opus、OpenAIGPT-4.1等模型。

Qwen3非推理通用模型: Qwen3-2507

Qwen3-2507:定位贴近V3和GPT-4类非推理通用模型。7月22日凌晨,阿里巴巴发布推出Qwen3-235B-A22B-FP8非思考模式的更新版本Qwen3-235B-A22B-Instruct-2507是前代模型Qwen3-235B-A22B在非思考模式下的一次升级迭代,对“混合架构”的拆分。它是一个纯非推理模型,不再走思维链,主打响应速度、稳定表现。

在 GPQA(知识推理)、AIME25(数学)、LiveCodeBench(编程)、Arena-Hard(对齐)、BFCL(Agent 工具使用)这五项测试中,在几乎所有指标中,2507 都拿下了非推理模型的最高分。

Qwen3垂类代码模型:Qwen3-Coder

阿里巴巴发布MOE架构的垂类代码模型:7月23日阿里继续上新Qwen 3系列模型——Qwen3-Coder-480B-A35B-Instruct,简称Qwen3-Coder。该模型是千问系列模型中首个采用混合专家MoE架构的代码模型,总参数达480B,激活35B参数。特点如下: 训练数据规模高达7.5 万亿tokens,70%都是代码。 引入强化学习 RL 后,它还能在多轮交互、工具调用、任务反馈中学会自己解决问题。 Qwen3-Coder还原生支持256K token的上下文,并可通过技术手段扩展至1M长度。

四、国产AI编程平台:字节、腾讯和阿里

字节:注重全栈开发能力,升级Trae 2.0

TRAE与 AI 深度集成,提供智能问答、代码自动补全以及基于智能体的 AI 自动编程能力。 Solo模式:SOLO 模式是一种高度自动化的开发方式,以AI 为主导,自动规划并执行从需求理解、代码生成、测试,到成果预览的全流程。

腾讯:重视产品开发部署,Codebuddy

腾讯Codebuddy:可以简单理解为Cursor+Replit。2025年7月22日,腾讯发布全新AIIDE工具CodeBuddy,定位为“产设研一体”的AI全栈工程师平台,偏向于侧重实现产品一站式开发的AI IDE。 产品阶段:自动生成产品文档,完成页面结构搭建+界面输出+后端部署的一站式路径; 设计阶段:内置Figma,视觉稿一键还原代码; 研发阶段:内置BaaS服务,开箱即用后端服务。

阿里:专门适配Qwen3-Coder,Qwen Code

Qwen-code的前身:谷歌推出 的一款开源的(基于 Apache 2.0 许可证开源)、能够运行 在终端 AI 智能体,用户以自 然语言命令的形式就可以直接 在终端上执行。 Qwen-code:针对Qwen3-Coder 模型进行了优化,具有增强的 解析器支持和工具支持。1、查 询和编辑超出通常限制的大型 代码库。 2、自动执行管理拉 取请求和复杂的 rebase 等任 务。

报告节选:

编辑:火腿肠
  • 相关标签
  • 相关专题
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至