人工智能行业半月报2026年9月第1期:板块持续调整,前沿大模型快速迭代

  • 来源:国元证券
  • 发布时间:2026/09/19
  • 浏览次数:20
  • 举报
相关深度报告REPORTS

人工智能行业半月报2026年9月第1期:板块持续调整,前沿大模型快速迭代.pdf

2026年9月上半月,全球人工智能板块经历深度调整,但底层技术迭代与基础设施建设并未放缓。中证人工智能产业指数下跌6.58%,恒生港股通人工智能主题指数下跌14.22%,资本市场对单纯的技术叙事趋于审慎,转而更加关注商业模式的可行性与中长期业绩兑现能力。大模型调用与竞争格局大模型调用量持续攀升,单周Token调用量创下127万亿的新高。OpenAI以23.6%的市场份额重新夺回榜首,终结了DeepSeek连续五周的领先。在智能水平测评方面,基于最新AAIIv4.3标准,Anthropic与OpenAI继续保持总体领先,国产模型中Qwen3.8Max位列第一。开源大模型KimiK3以2.8万亿总...

指数表现与市场回调

2026年9月上半月,人工智能板块整体步入回调阶段。内地市场方面,2026年9月1日至15日,中证人工智能产业指数下跌6.58%,跌幅相比8月下半月有所扩大,跑输沪深300指数2.80个百分点。同一时间段内,国证AI应用指数下跌7.12%,上证科创板人工智能指数下跌9.39%。从年初至今的累计表现来看,中证人工智能产业指数累计上涨12.90%,跑赢沪深300指数16.79个百分点;而国证AI应用指数累计下跌24.59%,上证科创板人工智能指数累计下跌6.56%。

香港市场方面,同期恒生港股通人工智能主题指数下跌14.22%,跌幅相比8月下半月有所增加,跑输恒生指数10.71个百分点。今年以来,恒生港股通人工智能主题指数累计下跌36.52%,跑输恒生指数32.76个百分点。恒生科技指数累计下跌22.20%,恒生港股通指数累计下跌6.40%。相关企业仅凭研发投入扩张、模型技术领先乃至ARR增长的叙事已难以满足当下投资者的诉求,市场愈发看重相关企业的商业模式是否可行、中长期业务前景是否清晰,以及其业绩表现能否兑现预期。

大模型调用量创新高与智能水平测评

据OpenRouter统计数据显示,按token计算的大模型周调用量在2026年9月7日至9月13日的整周中继续创新高,达到127万亿tokens,较上一个整周的115万亿tokens有所上升。该周调用排名前五的大模型分别为OpenAI的GPT-5.6 Luna、腾讯的Hy4 preview、智谱的GLM 5.3 Flash、DeepSeek的DeepSeek V4 Flash 0731以及小米的MiMo-V2.5。

以文本请求为衡量标准,在最近过去的一个整周中,市场份额排名首位的是OpenAI,占比23.6%,排名第二的是DeepSeek,占比22.6%。这意味着DeepSeek连续五周位居市场份额榜首的纪录就此终结。谷歌、腾讯以及智谱在相应市场份额上排名三到五位。

在智能水平测评方面,Artificial Analysis于当地时间2026年9月7日发布了AAII v4.3版。在新版AAII纳入的评测中,Terminal-Bench由2.1版升级至4.0版,τ³-Banking被AutomationBench-AA替代。各评测领域在新版AAII计算中的权重保持不变:智能体占30%、编程占20%、通用占30%、科学推理占20%。综合测评结果看,截至9月17日,Anthropic Claude与OpenAI GPT系列模型的智能水平总体上领先。当前智能水平排名前三的国产大模型分别为Qwen3.8 Max (0902)、GLM-5.3(max)以及Kimi K3(max)。以AAII为智能水平的衡量标准,自2022年11月以来,最前沿语言模型的地位始终被美国大模型厂商占据。新加坡大模型厂商Sapiens AI挤进前十,成为排名前十的大模型厂商中唯一中美以外的大模型厂商。

在开源大模型参数规模方面,当前总参数量最高的大模型为Kimi K3,其在max和low思考强度模式下的总参数量分别为2.8万亿和2.78万亿。

应用软件与智能体调用跟踪

编程智能体与生产力工具的调用量均呈现上升趋势。据OpenRouter统计数据显示,在2026年9月7日至9月13日的整周中,编程智能体的调用总量为25.3万亿tokens,较上一个整周的24.3万亿tokens有所上升。周调用量排名前三的分别为Nous Research的Hermes Agent、Anthropic的Claude Code以及Kilo Code。

从生产力工具的角度考虑,在同一周期内,生产力工具的调用总量为9.57万亿tokens,较上一个整周的9.38万亿tokens有所上升。周调用量排名前三的分别为Nous Research的Hermes Agent、OpenClaw以及Open WebUI。与编程智能体相比,按token计算,用户对生产力工具的偏好更为集中。

前沿大模型密集迭代发布

2026年9月上半月,全球头部大模型企业密集发布新一代模型,技术迭代速度进一步加快。Anthropic发布新一代旗舰模型Fable 5.1,并面向拥有受信任访问计划权限的用户推出Mythos 5.1,进一步提升了编程、知识工作和长时间任务求解能力。Fable 5.1缓存读取成本降低了75%,即每百万token缓存读取0.25美元,其AAII得分为53。

OpenAI正式发布新一代旗舰模型GPT-6 Astra,汇聚了公司多年来在预训练、强化学习和对齐领域的研究成果与重大投入,在计算机操作、网页浏览、软件工程、网络安全、科学和专业工作领域均处于领先水平。API标准定价为每百万token输入10美元、输出50美元,其AAII得分同为53。此外,OpenAI还发布了新一代图像生成模型ChatGPT Images 2.5,目前用户每周通过ChatGPT与API生成超30亿张图片。

Meta发布新旗舰模型Muse Spark 1.3,主攻长上下文与编程领域,定价与前代持平,其AAII得分为48,是截至9月17日非Anthropic、非OpenAI模型中得分最高者。DeepSeek正式发布552B参数MoE模型V4.1 Flash,采用全新Causal-Encoder-Decoder非对称结构,大幅压缩KV Cache,对HBM需求降至上一代四分之一、SSD需求降至八分之一,显著降低Agent类任务的缓存命中成本。月之暗面全量上线K2.8 Preview,综合性能接近旗舰K3,编码与智能体能力全面提升。

在企业融资动态方面,智谱发布公告称根据一般授权配售新H股,并建议同步发行人民币201.4亿元于2027年到期的美元结算零息可换股债券。本轮融资所得款项净额约60%将用于下一代GLM基础模型及完全自训练体系的研发,以及大规模训练、生产推理、算力资源及相关技术基础设施的部署及升级;约15%将用于支持业务拓展计划、战略投资及潜在并购;约25%将用于优化资本结构、补充日常运营所需营运资金及其他一般企业用途。

底层算力基础设施加速布局

算力基础设施端的资本开支与技术演进持续推进。英伟达宣布以129.303亿美元收购开源社区平台Hugging Face,该平台已聚集超1800万开发者、300万个模型、50万个数据集与100万个应用,逾20万家公司在此选型、测试并落地AI。英伟达承诺维持开放定位,继续支持多云与多加速器。

存储芯片领域,三星电子正在开发第八代HBM5,其性能是第七代高带宽存储器HBM4E的两倍,并计划推出zHBM,性能最高可提升至8倍,热阻最高可降低90%。美光宣布已在多个服务器平台上成功演示全球首款512GB DDR5模组,采用硅通孔技术,单台配备24个内存插槽的双路服务器可实现高达12TB的DDR5 DRAM容量。

光刻技术方面,阿斯麦接连发布三条公告,宣布与台积电、三星电子及英特尔推进下一代高数值孔径极紫外光刻技术应用。Arm正式推出第二代移动终端计算子系统CSS for Mobile 2,在单一计算平台中实现对智能体AI和AI原生图形技术的全面支持。谷歌宣布计划在未来两年向芬兰的数字基础设施投资至少130亿欧元,这是其在欧洲最大的一笔单笔投资。

人工智能实践应用多点开花

在应用端,各类AI产品与智能体加速落地。腾讯WorkBuddy开放平台正式上线,首批引入超百家生态伙伴,面向智能硬件、行业应用与开发者开放Agent底层能力,已接入智能眼镜、录音卡片、耳机等十余个品类、超30个品牌。千问办公推出“多人工作台”,具备角色权限、云端数据库、管理后台和在线发布四项核心能力,可承载多人参与的业务流程。

Meta推出个人AI智能体Muse,运行在一台专用的安全计算机Muse Secure VM上,同时承载智能体和个人数据。OpenAI一天发布Agents API、GPT-Live-1 API、Data agent与ChatGPT for Financial Services四条产品线,其中Agents API正式开放公测,开发者只需指定任务、模型、工具与运行环境即可创建Agent。

在垂直领域应用中,英伟达正式发布DLSS 5,以像素空间扩散Transformer实现3D引导神经网络渲染。宇树公开60亿参数具身智能模型UnifoLM-WLA-1.0,用约2500小时高质量真机数据训练,一套模型完成10项全身操作与54项桌面操作任务。谷歌DeepMind推出AlphaGenome Atlas,用AlphaGenome模型预计算人类基因组全部90亿个单字母遗传变化的调控影响,规模达1PB。

政策法规与安全性体系逐步完善

政策端持续发力规范与支持人工智能产业发展。工业和信息化部等十部门印发《促进中小企业发展“十五五”规划》,提出推动普惠算力赋能中小企业发展,降低中小企业用算成本,鼓励中小企业参与国家级人工智能开源社区建设。

最高人民法院公开发布《关于依法审理涉人工智能纠纷案件的意见》,这是首部由国家最高审判机构发布的涉人工智能司法裁判规则文件,聚焦社会各界广泛关注的涉人工智能审判中的突出问题,在划清法律“红线”的同时支持人工智能技术创新发展。

工业和信息化部印发《信息通信行业发展“十五五”规划》,将打造高效协同的算力设施列为重点任务之一,提出构建“枢纽-区域-边缘”多层次算力设施体系,有序部署万卡、十万卡及以上智算集群。此外,工信部印发《“人工智能+软件”专项行动实施方案》,提出到2028年推广应用覆盖2万家规模以上软件企业,累计组织实施100项软件企业智能化技改项目;到2030年关键软件全面实现智能化升级,智能编程、智能体软件及智能服务等新业态成为产业新增长极。

投资策略与建议

以企业级智能体领域为例,单纯的算力比拼与概念验证已无法支撑高昂的算力开销与企业的投资回报预期,智能体能否在生产环境中创造可计量、可归因的真实业务价值,成为衡量其商业化成败的根本标尺。建议继续围绕人工智能应用端与基础设施端布局:应用端,重点关注已初步验证商业模式,或在中长期具备较清晰商业闭环前景的上市公司;基础设施端,优先关注能有效承接算力需求增长,产品与服务迭代有序推进,且盈利提升能见度较高的上市公司。需警惕大模型技术迭代不及预期、人工智能基础设施及应用需求不及预期、宏观经济表现不及预期、行业竞争加剧以及相关政策落地不及预期等风险。

编辑:流星雨
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至