国产大模型在长程任务与编程能力上的最新突破及其对算力需求的影响

随着智谱GLM-5.2等国产大模型的发布,国产AI技术在长程任务处理和编程能力上取得了显著进展。请结合行业报告,分析国产大模型在上下文长度、架构优化及编程基准测试中的具体表现,并探讨这些能力迭代如何驱动Token消耗量的增长。同时,分析在头部厂商加大资本开支及海外算力受限背景下,国产算力基础设施面临的机遇与挑战。

最佳答案 匿名用户编辑于2026/06/22 07:55

国产大模型在长程任务与编程能力上实现了显著突破,标志着行业逐步进入“好用”阶段。智谱GLM-5.2作为面向长任务时代的旗舰模型,首次提供了扎实的100万token上下文,能够稳定承载项目级工程上下文,使长程任务执行更稳定。在架构优化方面,GLM-5.2引入了IndexShare机制,在每四个稀疏注意力层之间复用相同的索引器,在100万上下文长度下将每个token的FLOPs降低2.9倍,并改进MTP层以支持推测解码,使接受长度提升20%。在编程能力上,GLM-5.2在主流编程基准上保持开源SOTA,与Claude Opus 4.8处于可比区间,在Terminal-Bench 2.1等评测中表现优异,显示出比肩海外同类产品的能力。

这些能力的迭代直接驱动了Token消耗量的快速增长。根据火山引擎官方消息,豆包大模型日均Tokens调用量从2024年5月的约1200亿提升至2026年3月的约120万亿,两年间提升约1000倍。Token使用量的高速增长主要受AI视频创作爆发与AI智能体加速普及驱动。随着大模型能力的提升,下游应用企业功能上线速度加快,用户规模扩大、推理轮次增加及私有化部署需求增长,有望持续拉动算力基础设施建设需求。

在算力供给方面,当下全球层面算力供应呈现紧张态势,国内因国际贸易原因处于海外算力供给受限状态。然而,国产算力伴随国内先进制程发展,有望逐步承接推理侧相关需求。字节跳动正与国产GPU厂商天数智芯洽谈采购AI芯片,预计今年至少交付5万颗,主要用于支撑豆包的推理运算。阿里也在接触天数智芯,表明头部大模型厂商有望加大采购国产算力。从需求侧看,伴随国内大模型Token消耗量快速提升,相关厂商资本开支投入不断加大,整体市场总容量有望持续扩张。国产算力有望长期保持景气度上行,逐步扩大自身份额。

参考报告REPORT

计算机行业周报:国产大模型逐步进入“好用”阶段.pdf

2026年6月计算机行业周报指出,国产大模型能力持续迭代,逐步进入“好用”阶段。智谱GLM-5.2上线并开源,支持100万token上下文,编程能力比肩海外同类产品。字节跳动原动力大会即将召开,豆包大模型及Agent应用有望更新。国产大模型Token消耗量保持快速提升态势,豆包大模型日均调用量两年提升约1000倍。阿里、腾讯等头部厂商持续加大AI基建投入,字节跳动洽谈采购天数智芯芯片,国产算力有望承接推理需求,长期景气度上行。计算机行业本周表现优于大盘,推荐关注AI大模型及应用及算力基础设施相关标的。

我来回答

快速提问

海量报告支持,行业专家解读

海量文库支持,行业专家解答

用户解答榜
分享至