AI端侧落地进展如何?

AI端侧落地进展如何?

    标签
  • AI
最佳答案 匿名用户编辑于2025/07/17 10:42

AI 眼镜与智驾加速落地,果链生态持续向 AI 转型。

1.AI 眼镜加速迭代,2H25 AR 拐点有望到来

长期来看,我们认为 AI 眼镜终端有望成为 AI 时代全新的人机交互平台。眼镜本身具有 1) 轻量级,2)佩戴无感化、全天候,3)高频响应等显著优点,且作为最靠近人体三大重要 感官(眼、耳、嘴)的穿戴设备,能同时融合声音和视觉交互。因此,我们认为 AI 眼镜一 方面天然适用于处理短平快的临时任务,打造个人助手;另一方面,结合显示功能的智能 眼镜有望充分应用于社交、办公、垂类行业等多领域,进而成为 AI 时代的通用人机交互平 台。 AI 智能眼镜新品密集发布,巨头陆续入局,产业链加速迭代。2024 年 10 月以来,包括百 度、回车科技、Rokid、影目、闪极在内的多家公司加入智能眼镜战场,纷纷发布自家新品。 2H25 多家科技巨头的 AI 眼镜新品有望陆续亮相。根据彭博社信息,苹果也在内部启动关 于智能眼镜的新项目,最早或将于 2026 年发布新品。我们看好 AI 眼镜产业链迎来蓬勃发 展期。截至 1Q25,全球 AI 眼镜单季度销量达到 60 万台,同比增长 216%。根据 Wellsenn 预测,2025 年全球 AI 眼镜出货量有望达到 550 万台,同比增长 262%;远期(2030 年) 有望达到 9000 万台。

AI+AR 眼镜拐点在即,关注光学显示环节投资机会。2025 年以来,AR 眼镜产业端进展积 极,雷鸟、Rokid、中国移动、传音等多家企业发布了带 AR 显示模组的智能眼镜。此外, 据彭博社信息,Meta 等大厂的消费级 AR 眼镜有望在 2H25 陆续发布。 雷鸟:2025 年 5 月正式上市全新 AR 眼镜雷鸟 X3 Pro。该眼镜搭载了雷鸟创新自主研发的 萤火光引擎,是目前业内最小的可量产彩色 MicroLED 光引擎,光机体积仅 0.36cc,相比 上一代产品缩小了 40%,却能够实现高达 5000nits 的峰值亮度,即使在户外强光下,用户 也能获得清晰明亮的视觉体验。该眼镜采用了全球首个可量产的表面浮雕光栅刻蚀光波导 技术,有效减少了 95%的彩虹纹现象,显著提升了视觉舒适度,减少了视觉干扰。眼镜内 置高通骁龙 AR1 旗舰级芯片,并结合阿里独家定制的多模态大模型,支持实时语音和图像 翻译、自动音频纪要、智能问答、物体识别等多模态 AI 功能,极大地提升了用户在各种复 杂环境下的工作效能和体验。在拍照方面,X3 Pro 的镜片上能够呈现出对焦点和预览图片, 用户只需通过语音指令或右镜腿的可配置快捷键,即可完成拍照或视频录制。

Rokid:Rokid Glasses(AR 眼镜)最早于 2024 年 11 月发布,又于 2025 年 3 月 10 日再 次进化并发布。该眼镜采用双目衍射单色光波导方案,搭载骁龙 AR1 芯片与 2GB RAM+32GB ROM 存储组合,还配备了 160mAh 电池,具备卓越的续航表现。功能方面, 除搭载阿里通义大模型外,还集成了 DeepSeek、豆包、智谱清言、纳米搜索等多个大模型。 此外,凭借自研的意图分类模型,Rokid Glasses 能在 2 毫秒内完成对意图的分类,再将请 求智能分发给不同模型,实现了快速、准确的响应,提升了交互体验的流畅度。应用场景 方面,支持信息提示、接听电话、第一视角抓拍、AI 问答搜索、多模态 AI 交互、AI 拍照答 题、AI 多语种翻译等。尤其在演讲场景中表现出色,其提词器功能通过多模态语音识别引 擎系统、动态语速适配算法和多场景演讲匹配算法,实现了与演讲者语速和节奏的自动匹 配,解决了传统提词器的诸多痛点。 Meta:根据彭博社,Meta 有望于 2H25 发布其下一代智能眼镜 Hypernova,最大的升级是 其独特的单目显示屏,位于右镜片的右下角区域。用户在视线向下时可以获得最佳观看效 果,启动时屏幕上会呈现一个主界面,图标以水平方式排列。这种设计在功耗、成本与日 常穿戴性之间取得平衡。这款产品内置了拍照、查看照片、地图导航等专属应用,还能显 示从手机选择性接收的通知,比如 Messenger 和 WhatsApp 的实时消息。

2.果链:关注苹果等厂商带动 AI 落地节奏

苹果尝试在端侧落地现有 AI 技术,AI-Siri 或于 26 年落地

市场上大多数投资者对苹果 WWDC25 大会的解读为“期待有限,失望有限”,反应在苹果 股价上为会后小幅走低。但我们认为此次大会实际意义大于市场认知,是苹果最大化现有 AI 技术在手机端侧应用的一次尝试,或是苹果在 AI 上承前启后的一步。 WWDC25 大会主要围绕两条主线推出新功能:1)AI 功能的落地。包括开启与第三方的合 作基础(基础模型框架)、探索端侧的应用场景(电话、翻译、屏幕视觉智能等),打造系 统级 Agent 的雏形(MacOS 对 Shortcuts 和 Spotlight 功能升级),2)设计语言的统一,采 用“液态玻璃”(Liquid Glass)相关设计。 我们认为市场的关注点仍在综合 AI 助理 Siri 是否推出、是否有强大的 AI 模型,但忽视了在 目前通用 Agent 尚未成熟的状态下,苹果最大化在手机端侧应用现有技术的努力。苹果高 管在接受采访时也承认外界当前认为 Apple 在 AI 领域落后,但公司内部对当前产品和技术 充满信心,认为苹果与其他公司在 AI 开发理念上存在差异,不是在做聊天机器人,而是 让产品体验越来越好,让 AI 成为“强化”这些体验的工具。

苹果 AI 战略:不走传统聊天机器人赛道,专注系统集成。公司高管表示,AI 是变革性技术, 大语言模型及其衍生架构的影响或将持续数十年,如同互联网和移动技术一样,它将重塑 行业、经济,也将影响苹果的产品及其他领域。苹果的任务是思考在为用户提供的体验中, 哪些 AI 应用场景是恰当的,并确保技术安全、透明、易懂,让大众可及。苹果不会涉足所 有领域,但会专注于那些最能融入用户生活的场景,不会打造聊天机器人,而是希望将智 能深度集成到所有平台的体验中,以 “随需而现” 的方式服务用户,而不是让用户进入 某个聊天界面才能完成任务。此次 WWDC 大会公司展示的就是将 AI 作为赋能技术,提升 现有产品和功能的体验的行动。

Siri 功能展望:通过集成化设计,使其随时待命,根据上下文提供相关服务。用户无需切 换场景,就能直接使用所需工具完成任务。公司有信心基于设备端的大型语言模型、私有 云计算,以及设备端语义索引的知识检索能力,打造更出色的 Siri。当前 Siri 已经能够实现 一系列目标,包括更好地处理语言不流畅的情况(例如用户说错话后自我纠正时,Siri 能 更精准理解)、优化对话上下文逻辑、升级用户界面、支持文本输入交互,增强产品知识储 备等。并正在拓展其他功能,比如通过 APP 意图调用,让 Siri 在设备上实现更广泛的操作 编排,使其能完成更多任务,同时利用语义索引中的个人知识找到相关内容,并通过 APP 意图执行操作。 Siri 进展:迭代至 V2 版本,或于 26 年发布。公司高管表示,在 WWDC24 之前,第一个 版本(V1)已基本成型,公司曾在视频中演示过他的运行情况,并花了数月时间优化,使 其支持更多 APP 意图和搜索场景,但最终发现,V1 架构的局限性无法达到公司和用户期 望的质量标准,即便不断投入时间优化,它的状态也难以满足苹果的品质要求,因此公司 决定转向 V2 架构,更深度的端到端架构。因此 2025 年春季,公司告知该功能将推迟, 会专注于迁移到新架构并继续开发。当前已能在内部演示 V2 架构的运行,但它尚未达到公 司认为能成为优秀苹果功能的质量水平,因此不公布具体发布时间,会在准备好进行测试 版推送、确保大家能实际体验时再宣布。公司表示 V1 架构可以说是 V2 的“半程版本”, V2 在 V1 的基础上进行构建,但通过更完整的扩展,更统一的端到端架构将带来更高的质 量和更强的能力,预计或将于 26 年发布。

Foundation Models 开发者框架:拥抱第三方合作

发布 Foundation Models 框架,或催生大量具有“苹果特色”AI 功能的应用。苹果多次 强调,Foundation Models 提供的模型具备强大、快速、私密且可离线运行的特性。公司将 允许第三方开发者免费通过 Swift 调用苹果设备端模型的基础框架,在 APP 中为特定场景 集成 AI 能力,并自动与 Swift 应用的数据结构融合,或为开发者与生态发展创造更多可能。 加快了外部模型的引入和适配。苹果与 OpenAI 的合作再进一步,将 ChatGPT 用于 Image Playground的增强,并允许Siri在处理复杂查询时调用ChatGPT。Xcode也内置了ChatGPT。

探索端侧的应用场景

苹果在会上展示了将成熟的 AI 功能融入到用户日常使用的各个细节中: 1) 电话 App 能屏蔽掉大概率是推销和骚扰的电话,只留下静默的语音信箱留言,如果 AI 识别出来这个陌生电话是重要电话,比如外卖等,会自动生成留言总结并打开铃声。 2) 实时翻译(Live Translation)首次集成消息、FaceTime 和电话,实现文本及语音的即 时多语言翻译,且全部基于本地模型保障隐私,允许跨 iPhone 及非 iPhone 设备通话。 3) 地图 App 智能学习日常路线,推送交通拥堵通知和提供替代路线;新增“已访问地点” 隐私加密管理。 4) 通过 AI 增强消息生成表情(Genmoji)和图像创作能力,支持混合 Emoji 及文本描述 产生自定义形象,开放 Image Playground 新 API 供开发者使用。 5) 视觉智能(Visual Intelligence)一键视觉搜索,支持跨 App 内容识别与操作,如图片 搜索相似商品、日程自动添加、知识问答等,开放 App Intents 集成。

打造系统级 Agent 的雏形

MacOS 尝试创造 AI 入口。1)新的“智能操作 Shortcut”功能允许用户通过更自然的语言 创建自动化流程,这实际上是让每个用户都能创建自己的小型 AI 助手,2)Spotlight 从简 单的搜索工具转变为强大的操作中心,用户可以直接在 Spotlight 中执行数百种操作,无需 切换应用,比如能统一搜索结果,智能排序,支持搜索第三方云盘文档,结合个性化推荐 和快捷键功能,甚至可以直接用它来对 App 内的内容进行自然语言的操作,比如对文档中 的图片做背景去除。通过应用升级尝试打造“超级 AI 入口”的雏形。

参考报告REPORT

科技行业分析:电子,关注AI主线演进新阶段.pdf

科技行业分析:电子,关注AI主线演进新阶段。电子2H25:关注算力景气度延续+制造国产化率提升+AI端侧落地展望2H25电子板块我们建议关注:1)大模型架构持续迭代,ScalingLaw有望再次加速叠加推理需求的增长,有望延续算力链高景气;2)自主可控方面,国内制造端先进工艺产能持续推进,关注新产能持续开出为国产设备商带来的国产化率提升机会,模拟芯片也有望在下游重启备货带动下加速国产化;3)AI端侧方面,下半年AI眼镜有望迎来拐点,智驾领域在价格带持续下探带动下产业趋势有望加速。算力链:训练+推理需求持续增长,高景气延续AI大模型训练端,我们观察到在预训练阶段的探索没有停滞,OpenAI、xA...

我来回答

快速提问

海量报告支持,行业专家解读

海量文库支持,行业专家解答

  • 相关问题
  • 最新问题
用户解答榜
分享至