Open AI有哪些方面的更新?

Open AI有哪些方面的更新?

最佳答案 匿名用户编辑于2025/06/19 08:56

Open AI 的一系列更新既延续了 Open AI 技术突破的基因,也显现出其在产业落 地和商业模式上的成熟思考。

1. Codex 向应用层延伸,占据开发者工作流的关键节点

Codex CLI 与 Codex 云端智能体展现了 OpenAI 在开发者工具领域的双向布局: 前者作为轻量化终端工具,通过自然语言驱动的代码生成与任务执行(如文件操 作、依赖安装等),直击终端环境下快速原型开发与碎片化问题处理的效率痛点, 且凭借开源策略(Apache 2.0 许可证)快速吸引社区生态,GitHub 首日获 1.4 万 星,并默认适配 o3、o4-mini 等最新模型,让开发者直接受益于模型升级;后者则 定位全栈工程平台,瞄准企业级市场,整合需求分析至部署的软件工程全流程, 支持团队协作与复杂项目管理,其自动化测试和智能部署功能可减少人工干预、 提升规模化项目交付效率。

1)Codex CLI:作为一款可从终端运行的轻量级编码代理工具,允许开发者直接 在命令行中通过自然语言生成代码、执行任务(如文件操作、依赖安装、测试运 行等),解决了终端环境下快速原型开发和碎片化问题处理的痛点。其设计目标是 通过本地化部署模式,最大化释放 OpenAI o3、o4-mini 等模型的推理能力,并为 后续 GPT-4.1 等 API 模型的接入提供兼容性支持。该工具具备终端级运行特性, 可直接在用户计算机本地执行,通过构建极简交互接口,实现模型能力与用户开 发环境的深度耦合。Codex CLI 支持 suggest、auto-edit 和 full-auto 三种审批模式,允许开发者灵活控 制自动化程度,兼顾自动化效率与操作安全。所有操作均在本地执行,保障代码 隐私和数据安全。此外,Codex CLI 支持多模态输入,开发者可通过命令行上传截 图或草图等视觉 prompt 信息,结合本地代码访问权限,形成“视觉输入+代码执 行”的闭环工作流,显著提升跨模态任务处理能力。 上个月,Open AI 宣布 Codex CLI 完全开源,这一举措标志着 OpenAI 在工具层面 向开发者社区的深度开放——通过开源代码的形式,允许开发者根据自身需求进 行功能扩展或本地化定制,从而构建多样化的应用场景。Codex CLI 采用 Apache 2.0 许可证开源,并配套百万美元开源基金计划(Codex Open Source Fund),单个 项目可获得最高 2.5 万美元 API 积分,旨在激励开发者基于 CLI 和 OpenAI 模型 持续创新,推动模型能力在实际生产场景的转化,形成“工具开源-应用创新-生态 反哺”的正向循环。

Codex CLI 作为终端级轻量编码代理,将多模态推理能力有机嵌入开发者工作流, 为企业和开发者提供了更高的自主可控性和定制灵活性。依托本地化代码访问机 制,结合对多个模型(o3,o4-mini)与 API 的持续适配,并叠加模型本身的持续 升级,OpenAI 实质上构建了 AI 能力向开发环境渗透的新范式。其配套的百万美 元资助计划形成技术生态闭环,在激励开发者共创的同时,加速模型能力的落地 转化。 2)Codex:Codex 作为一款云端软件工程智能体,具备并行处理多项任务的能力。 Codex 能够为用户执行多种操作,例如编写功能代码、解答代码库相关问题、修 复程序错误以及提出供审核的拉取请求等;每项任务均在预加载代码库的专属云 沙盒环境中运行。 Codex 的云端代码 Agent 支持代码工程任务的批量分派与并行执行,用户可通过 自然语言指令灵活调度类似“外包型”任务,每次交付成果均带有可审查的操作 日志与变更报告,便于团队在标准化软件开发流程下快速验收和返工。

Codex 由 codex-1 模型驱动,该模型是 OpenAI o3 的一个版本,针对软件工程进行 了优化。它通过强化学习,在多种环境中针对真实编码任务进行训练,生成的代 码能够高度反映人类编程风格和拉取请求偏好,精确遵循指令,并且可以迭代运 行测试直至获得通过结果。OpenAI 已开始向 ChatGPT Pro、Enterprise 和 Team 用 户推出 Codex,即将支持 Plus 和 Edu 用户。 OpenAI 推出的 Codex 作为一款代码生成工具,其工程化任务处理流程清晰且高 效。用户可通过 ChatGPT 侧边栏访问 Codex,输入自然语言指令后点击“Code” 即可触发代码生成任务,或点击“Ask”查询代码库相关问题,每个任务都会在独 立的、预先加载了用户代码库及所需依赖的云沙盒环境中执行。Codex 支持文件 读写操作,并能执行包括测试框架、代码检查工具、类型校验器等在内的各类命 令,任务完成时间因复杂程度不同而在 1 至 30 分钟之间,用户可实时监控任务的 执行进度,同时系统会自动记录终端日志、测试输出等执行证据以便用户对每一 步操作进行溯源。任务完成后,Codex 会在沙盒环境中提交变更,并以可供审查 的代码变更集合、附带详细执行证据的操作报告等形式交付结果,还支持一键生 成 GitHub 拉取请求或将变更直接同步至本地开发环境。此外,用户可通过在仓库 根目录放置类似README的配置说明文档AGENTS.md文件对Codex进行指导, 明确代码库的导航逻辑、设定测试命令与环境配置要求、规范项目特定的开发规 范与最佳实践。内部测试数据表明,即便未配置 AGENTS.md 文件,codex-1 模型 在标准编码评估中的表现也显著优于同类工具,其工程化能力在微服务架构实现、 测试用例生成等场景中尤为突出,在 HumanEval 基准测试中代码生成准确率高达 72.3%。

Codex 当前不支持联网访问外部资源,所有任务均在安全隔离的云沙盒环境中运 行,这保障了代码安全,也限制了对外部依赖自动拉取等复杂跨平台集成能力。 同时,Codex 也缺乏图像输入、任务中实时修正等功能,Open AI 未来计划引入交 互式代理工作流,深化与 IDE、CI 系统等工具的集成,进一步提升工程自动化与 人机协作水平。

2. API 进一步开放,持续维护开发者生态建设

在模型部署方面,OpenAI 持续探索合理策略,以平衡商业用户需求与公众教育价 值。模型选择器的更新与工具支持的强化,可能加速企业级用户的 AI adoption 进 程。 对于开发者群体,o3 和 o4-mini 已通过 Chat Completions API 和 Responses API 开 放访问(部分组织需完成验证流程)。其中,Responses API 新增推理摘要功能,可 在函数调用过程中保留推理标记,优化性能表现。此外,该接口即将支持内置工 具在模型推理中的应用,包括网页搜索、文件搜索和代码解释器等,进一步拓展 API 的实用性边界。这种能力扩展标志着 OpenAI 在开发者生态建设上的深化— —通过开放更强大的模型与工具整合能力,赋能开发者构建智能化应用,推动 AI 技术向垂直领域渗透。

3. 用户体验创新上 OpenAI 积极探索新的应用场景拓展

在用户体验创新方面,OpenAI 积极探索新的应用场景拓展。 购物体验升级:在购物体验优化上,OpenAI 致力于让产品查找、比较与购买流程 更为便捷。自宣布日起,当用户进行产品搜索时,ChatGPT 会主动提供产品推荐。 不仅展示产品的图片和用户评论,还直接提供指向可购买产品网页的链接。目前, OpenAI 正积极拓展覆盖品类,涵盖时尚、美妆、家居用品和电子产品等领域,旨 在满足用户多样化的购物需求。 交互方式拓展:交互方式上,ChatGPT 新增了 WhatsApp 搜索入口。用户可通过 向号码 1-800-ChatGPT(+1-800-242-8478)发送消息,实现与 ChatGPT 的直接互 动。借助该渠道,用户能够便捷获取最新信息查询服务,以及实时体育比分等内 容,拓宽了信息获取途径。 引用功能强化:为便于用户核实信息并深入探究,ChatGPT 对引用功能进行了升 级。一方面,支持多重引用,单个回答中可包含多个来源引用,使信息来源更为 丰富全面;另一方面,新增高亮 UI 设计,用户通过新的高亮界面,能清晰分辨 回答中各部分内容对应的引用来源,增强了信息的可追溯性与可信度。 搜索效率提高:在搜索效率提升方面,ChatGPT 搜索界面增添了实用功能。“热门 搜索趋势 (Trending searches)”可让用户快速了解当下热门搜索方向,把握信息潮 流;“搜索建议自动补全(Autocomplete suggestions)”则能辅助用户更快找到所需信 息,减少输入时间与搜索误差,优化了搜索交互体验。同时,ChatGPT 的 Deep Search 功能可直接对接 GitHub,开发者实现直接针对代码库和技术文档向 ChatGPT 提问。除了回答有关代码库的问题,该功能还允许 ChatGPT 总结代码结 构和模式,并了解如何使用真实的代码示例实现新的 API。

参考报告REPORT

AI产业深度分析:OpenAI阵痛后的新生,从单纯技术驱动的模型竞赛到积极的工程化落地以支持AI产业更好的商业化生态.pdf

AI产业深度分析:OpenAI阵痛后的新生,从单纯技术驱动的模型竞赛到积极的工程化落地以支持AI产业更好的商业化生态。e_Summary]自2025年4月以来,OpenAI在LLM领域动作频繁,考虑到GPT-4.5“高价低效”的市场评价,将旗舰模型刚发布不到2个月GPT-4.5下线,随后发布对GPT-4.5的访谈视频,回顾其从构思到训练完成的历程,并反思局限性与最终效果。紧接着迅速推出o3与o4-mini两款头部推理模型以及新一代旗舰模型GPT-4.1,并推出一系列优化升级。这些动作表明OpenAI在经历一段时间的探索与沉淀后,正积极通过产品优化与创新,提升用户体验,降...

我来回答
分享至