在大模型应用浪潮中,软件开发的智能化转型正成为企业提升软件产品竞争力的关键因素,通过智能化能力的注入,为软件开发的价值提升带来巨大动力。
1.智能开发发展现状
开发是软件工程全生命周期中的核心环节,开发人员大约有三分之二的工作时间与开发代码直接相关7,应用大模型助力软件开发具有得天独厚的优势。一方面开发人员对新技术的接纳度较高,能够更快地适应开发新范式;另一方面各类编程语言对业务的依赖度不是非常高,使得代码生成能力的普适性较强。因此软件开发是大模型率先应用落地的领域之一,Gartner 已将“AI 增强软件开发”列入 2024 年十大战略技术趋势之一8。 智能开发工具市场迅速发展,国内外百花齐放。国外,截止2024 年 4 月微软的 GitHub Copilot 拥有180 万付费订阅用户,近60%财富 500 强公司使用 Copilot AI 工具9,GitHub Copilot 的市场占有率达到 64.5%10。亚马逊的 CodeWhisperer、谷歌的Project IDX等产品虽难以并肩,但依靠其强大的用户规模基础,仍具备较强竞争力。国内,智能化软件开发工具已发布近40 余款11,如华为、阿里、百度等提供的智能开发工具产品,其核心功能较为同质化,但工具的性能、工程化能力、用户体验度、整体准确度等方面存在差异。
智能开发工具能力持续提升,应用行业更加多元化。智能开发工具重点聚焦于代码生成、代码补全、代码注释、代码检查、智能单测等能力。一方面代码大模型能力的持续提升为工具提供了更强的 AI 底座,根据智源大模型排行榜显示,榜首大模型在HumanEval 数据集上的 Pass@112从 2023 年 8 月的24.4%提升至2024 年8月的81.1%13;另一方面通过 RAG、自学习、AI Agent 等技术的加持,为工具提供了更强的工程化能力,如微软的Copilot WorkSpace 作为AI 辅助的下一代开发工具,为工程级代码提供了更优的理解和生成能力。随着能力的持续提升,智能开发工具被越来越多行业所接受和应用,包括如互联网等科技行业的成熟落地,金融、电信、软件服务等行业的逐步落地,能源、零售、教育、制造、物流等领域的试点试行,未来智能开发工具将为各行各业的软件研发提供强有力支撑。 应用需求快速增长,编码阶段提效显著。无论个人还是企业开发者,使用智能开发工具的人数和频次越来越多。根据StackOverflow 2024 年的全球开发者调研显示,76%的受访者正在或计划使用 AI 工具进行软件开发,使用 AI 工具的开发者数量占比从去年44%提升至 62%14。根据 CSDN 2024 年的调查显示,48.6%开发者每天使用智能开发工具15。根据 Deloitte 报告指出,超过60%的金融机构正在探索或已经实施了智能开发工具以加速创新。智能开发工具的使用助力开发人员编码效率提升明显。根据GitHub 报告显示,使用 GitHub Copilot 的开发者编码速度提升55%,编写代码量增加46%16。根据中国信通院 2024 年初调研问卷数据显示,受访者在开发阶段使用 AI 工具的提效最为明显,人效提升达到约40%。
2.智能开发价值显现
在大模型应用浪潮中,软件开发的智能化转型正成为企业提升软件产品竞争力的关键因素,通过智能化能力的注入,为软件开发的价值提升带来巨大动力。 提升开发效率,降低项目风险。通过代码生成、代码补全和问答等能力,开发人员能够更迅速地编写高质量代码,显著减少手动调试和错误修复时间。同时可降低项目对开发人员的依赖,通过智能开发工具的学习和记忆能力,一方面可辅助新的开发人员快速开发出符合项目需求和规范的代码,另一方面可帮助开发人员快速学习新的编程语言,从而减少人员流动带来的项目风险。根据BIS年度经济报告显示,智能开发工具对程序员的生产力提升超过50%,且其中仅有小部分来自于代码的直接生成,而更多是通过与机器交互的过程激发了程序员的创造力17。 改善代码质量,提高产品稳定性。通过代码质量检查和智能单测等能力,开发人员能够快速进行代码验证和测试,及时发现并修复潜在的问题和漏洞,如代码缺陷、代码异常、代码风险等,从而帮助开发人员编写出更高质量的代码,降低软件发布后的故障率,提升软件的稳定性和性能。例如,GitHub Copilot 可帮助开发人员在编码过程中解决超过三分之二的漏洞18。
加速产品创新迭代,增强企业竞争力。通过提升开发效率和改善产品质量,企业能够更快地推出创新产品,抢占市场先机,从而在激烈的市场竞争中脱颖而出。一方面,智能化的软件开发流程使开发周期缩短,企业能够更灵活地适应市场变化,加快产品迭代速率;另一方面,智能开发工具的辅助使得开发人员能够从重复性的繁琐的低端编码工作中释放出来,从而拥有更多时间投入创新相关工作,提升企业创新能力。例如,2023 年5 月GitHub 首席执行官在全球网络峰会(Web Summit)上,演示GitHub Copilot X实现简单的贪吃蛇小游戏用时为 18 分钟,而 2024 年8 月通过真实操作,使用 Deepseek 开发助手(V2)仅需 2 分钟左右,开发时长大幅减少,开发人员将有更多时间思考产品创新。
3.智能开发落地挑战
随着智能化技术在软件开发领域的广泛应用,其带来的质效提升日益显著。然而,企业在推进软件开发的智能化能力建设和落地时,仍面临诸多挑战,涵盖组织、技术、应用落地及安全等多个层面。 组织变革和转型的挑战。软件开发的智能化转型首先带来的是组织变革,一是组织文化的重塑,其落地要求组织具备开放合作、持续学习和创新的文化氛围,促进跨部门沟通与协作,打破信息孤岛;二是全员认知水平的提升,自顶向下每位员工都应深刻理解智能化的潜力与挑战,客观且正确地了解大模型等人工智能技术及其作用;三是人才结构的调整与补充,由于数据治理及模型训练调优等过程需要专业技术人员参与,因此补充人才,或调整或融合AI 团队和软件工程团队的结构,方能匹配能力建设和应用的需求。
模型技术迭代及与工具融合的挑战。当前智能开发能力建设的核心技术是大模型,因此围绕大模型面临着技术迭代的挑战。一是大模型的技术能力仍以较快速度迭代更新,企业需配备良好的维护更新机制,以保证智能开发工具的底座AI 能力;二是智能开发能力如何与现有软件研发工具集有效融合或改造,从而提升软件工程全流程能力水平。 产品选型与应用场景落地的挑战。企业需根据自身行业特点、业务需求及已有 AI 能力,选择适合的业务场景,合理规划落地路径和方案。然而,一方面现有代码大模型和智能开发工具数量繁多,如何建设或选择出一款合适的模型或工具,如何评价模型或工具的能力,均是落地时考虑的重点;另一方面不同业务场景的编程语言可能不尽相同,或代码数据集或规范不一致,如何选择最优场景试点落地,如何优化模型或工具使其满足多场景需求,同样面临挑战。
代码数据、模型和工具的安全性挑战。生成式代码可能会带来更多不可控的风险,因此企业应从数据、模型和工具多维度构筑风险防线,以应对安全挑战。第一道数据防线,面向模型训练和调优阶段所需的代码数据集,可能面临敏感代码数据的泄露、未经许可代码的训练、非法代码的推理等问题;第二道模型防线,面向代码大模型在推理和管理阶段,可能面临暴力攻击、非法套取、非法提问、敏感内容推理、被恶意使用生成恶意软件代码或攻击脚本等问题;第三道工具防线,对智能开发工具的输入输出进行检查和处理,并关注关联代码库、第三方软件开发工具的数据传输和集成安全,构筑最后一层安全围栏减少应用风险。
4.智能开发落地原则
智能化软件开发落地是指应用方企业通过采购或自研等方式,构建智能化能力,包括代码大模型能力和智能开发工具能力,并将其应用落地于软件开发过程。作为大模型应用的重要场景,根据中国信息通信研究院对金融、软件、电信等行业关于智能开发落地实践的调查显示,智能开发能力的落地通常考虑以下主要原则。目标导向原则,以企业战略定位为首要目标,落地策略和方案应在该目标指导下完成。如是否落地智能开发,落地范围预计多大,预期目标是什么,都应遵循企业组织级的人工智能战略目标。
因地制宜原则,从企业实际情况出发,清晰了解已有AI 基础及成本预算,从而制定合适的策略。如企业自身的科技实力、人才储备、AI 基础设施能力、资金支持等情况,应作为落地基础进行考虑。应用优先原则,从业务实际需求出发,明确亟需解决的问题,以及为业务赋能的目标。如软件开发过程中面临的最大问题是什么,最耗成本和资源的环节是哪些等。 标准化原则,参考行业标准开展能力构建,以保证数据质量、模型性能及工具可塑性。如代码数据如何处理如何配比,模型如何调优,工程化能力如何建设,推理准确性应达到何等水平,均可以行业标准为依据,少走弯路,提高建设质量。安全性原则,围绕能力建设全过程构建安全保障机制,降低新工具引入的风险,提升安全治理能力。如代码大模型推理安全、数据安全、安全围栏建设等。 持续改进原则,构建持续反馈机制和数据驱动流程,通过效能指标数据推动工具和流程的持续改进。如面临模型退化、新项目新代码数据等情况,应通过持续改进从而保证代码大模型的能力稳定性。
5.智能开发落地步骤
落地智能化能力是一个全面且系统化的过程,尤其面向已成体系的软件开发过程,构建清晰明确的落地步骤,将为有效落地提供良好指引。智能开发落地过程可划分为自我诊断、方案设计、部署实施、持续优化四个关键步骤。

开展多维度自我诊断,科学客观定位自身能力。诊断维度上,通过应用场景诊断,明确智能开发能力在企业内部的落地场景,帮助梳理当前需求和未来规划的需求;通过技术能力诊断,明晰企业在人工智能领域的优势和不足,明确是否具备足够技术储备开发或维护代码大模型或智能开发工具的能力;通过基础设施诊断,深入了解企业现有算力资源、存储资源、数据资源等,帮助企业做好基础性准备;通过安全可信诊断,明确企业自身对安全可信的要求,如代码数据安全性要求、用户安全性要求、研发场景安全性要求等,从而便于制定安全保障机制。能力定位上,企业根据战略规划、基础设施、数据资产、人才储备、经费预算等方面的能力现状,并结合安全可信要求,综合研判自身已有智能化能力等级,可划分五个不同等级。
根据自我诊断及能力定位结果,选择合适的实施方案。L1企业适宜采用低成本的智能开发工具 SaaS 服务,以便快速达到应用效果;L2 企业可采购软硬件集成的智能开发工具(如智能编码一体机),以实现智能开发能力的本地化部署,形成一体化解决方案;L3企业可采购包含代码大模型的智能开发工具进行私有化部署,保障企业级代码资产的安全,并通过采购模型调优和升级等服务,保证大模型能力的稳定;L4 企业可采购解耦的代码大模型和智能开发工具或者选用高性能大模型训练微调成自有代码大模型,构建定制化的智能开发能力;L5 企业依托丰富的算力、数据、人才等基础,可考虑自主研发代码大模型,并依此构建软件工程领域的工程化能力,全面赋能软件开发流程,引领行业创新。
根据实施方案按计划部署和实施。一是明确项目的时间节点、资源配置、任务分工等,并制定风险管理计划;二是根据能力等级开展必要的软硬件采购与资源配置,确保相关工具和平台能够满足落地要求;三是开展代码大模型和智能开发工具的部署、评估和测试,确保其准确性、稳定性、安全性和可靠性;四是对使用人员进行培训并提供技术支持,选定试点项目或团队;五是根据试点结果进行优化调整,并逐步宣贯和拓展至更多团队。根据实施效果持续优化和改进。建立有效的指标体系和监控机制,一方面持续地自动化监测大模型推理效果和应用成效,如推理准确率、代码采纳率、代码修复率、代码生成占比等指标;另一方面定期收集用户反馈,根据数据分析结果明确问题和优化方向。构建大模型维护更新机制,通过获取和生成高质量代码数据集,开展模型的定期训练或调优,持续优化代码大模型质量。