扩展阅读

Codex 升级介绍 | OpenAI

OpenAI·2026/7/21·8 阅读

Codex 升级介绍 | OpenAI

来源: https://openai.com/index/introducing-upgrades-to-codex/ 抓取时间: 2026-07-21 16:25:39


2025年9月15日 发布产品

Codex 升级介绍

Codex 变得更快、更可靠,并且在实时协作和独立处理任务方面表现更好——无论您是通过终端、IDE、Web 还是手机进行开发。 开始使用 $ npm i -g @openai/codex 漂浮的代码片段在柔和的蓝色背景上带有模糊的花朵形状,中央状态框显示绿色的"打开"标签,带有 +27 个添加和 -15 个删除。 加载中… 分享 GPT-5-Codex

  • GPT-5-Codex

  • Codex 更新

    • Codex CLI
    • Codex IDE 扩展
    • Codex 云端
    • 代码审查
  • 构建安全可信的 AI 智能体

  • 定价和可用性

  • GPT-5-Codex

  • Codex 更新

    • Codex CLI
    • Codex IDE 扩展
    • Codex 云端
    • 代码审查
  • 构建安全可信的 AI 智能体

  • 定价和可用性

2025 年 9 月 23 日更新 _:_GPT‑5‑Codex 现在可供通过 API 密钥使用 Codex 的开发者使用(除了通过 ChatGPT 订阅使用 Codex 的开发者)。GPT‑5 Codex 的价格与 GPT‑5 相同,仅在 Responses API 中可用。底层模型快照将定期更新。查看 Codex 开发者文档 ⁠(在新窗口中打开) 更新日志 ⁠(在新窗口中打开)了解更多详细信息。 今天,我们发布了 GPT‑5‑Codex——这是 GPT‑5 的一个版本,针对 Codex 中的智能体编码进行了进一步优化。GPT‑5‑Codex 的训练专注于现实世界的软件工程工作;它同样精通快速交互式会话和独立完成长期复杂任务。其代码审查功能可以在关键缺陷发布之前捕捉到它们。GPT‑5‑Codex 在您使用 Codex 的任何地方都可用——它是云任务和代码审查的默认选项,开发者可以选择通过 Codex CLI 和 IDE 扩展将其用于本地任务。 自从我们 4 月首次推出 Codex CLI ⁠(在新窗口中打开)和 5 月推出 Codex Web 版以来,Codex 已稳步发展成为一个更有效的代码协作伙伴。两周前,我们将 Codex 统一为由您的 ChatGPT 账户连接的单一产品体验,使您能够在本地环境和云端之间无缝移动工作而不会丢失上下文。Codex 现在可以在您开发的地方工作——在您的终端或 IDE 中、在 Web 上、在 GitHub 中,甚至在 ChatGPT iOS 应用中。Codex 包含在 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 计划中。 通过这些更新,Codex 更接近我们一直以来的目标——一个理解您的上下文、与您并肩工作并可靠地为您的团队承担工作的队友。

GPT‑5‑Codex

GPT‑5‑Codex 是 GPT‑5 的一个版本,针对 Codex 中的智能体软件工程进行了进一步优化。它是在复杂的现实世界工程任务上训练的,例如从零开始构建完整项目、添加功能和测试、调试、执行大规模重构以及进行代码审查。它更易于引导,更好地遵守 AGENTS.md ⁠(在新窗口中打开)指令,并生成更高质量的代码——只需告诉它您需要什么,而无需编写关于风格或代码整洁性的长篇指令。 SWE-bench 验证:历史上,包括在 GPT‑5 发布时,我们报告了 477 个 SWE-bench 验证任务的结果,因为某些任务无法在我们的基础设施中运行。我们已修复此问题,现在报告全部 500 个任务。 代码重构任务:我们的代码重构评估包含来自大型成熟存储库的重构风格任务,包括 Python、Go 甚至 OCaml 中的任务。一个示例任务是 Gitea 的以下拉取请求 ⁠(在新窗口中打开),它更改了 232 个文件和 3,541 行,以在整个应用程序逻辑中传递 ctx 变量。 GPT‑5‑Codex 根据任务的复杂性更动态地调整其思考时间。该模型结合了编码智能体的两个基本技能:在交互式会话中与开发者配对,以及在长期任务上持久独立执行。这意味着 Codex 在小型、定义明确的请求上或当您与它聊天时会感觉更敏捷,并且在复杂任务(如大型重构)上工作更长时间。在测试期间,我们看到 GPT‑5‑Codex 一次独立工作超过 7 小时来处理大型复杂任务,迭代其实现、修复测试失败,并最终交付成功的实现。 在 OpenAI 员工流量上,我们看到,对于按模型生成的令牌(包括隐藏推理和最终输出)排序的最后 10% 用户轮次,GPT‑5‑Codex 比 GPT‑5 使用的令牌少 93.7%。相反,对于前 10%,GPT‑5‑Codex 思考更多,花费两倍的时间进行推理、编辑和测试代码以及迭代。 GPT‑5‑Codex 是专门为进行代码审查和发现关键缺陷而训练的。在审查时,它会浏览您的代码库,分析依赖关系,并运行您的代码和测试以验证正确性。我们在流行开源存储库的最新提交上评估了代码审查性能。对于每个提交,经验丰富的软件工程师评估了审查评论的正确性和重要性。我们发现,GPT‑5‑Codex 的评论不太可能是不正确或不重要的,从而将更多的用户注意力留给了关键问题。 GPT‑5‑Codex 是前端任务的可靠合作伙伴。除了创建美观的桌面应用程序外,GPT‑5‑Codex 在创建移动网站时的人类偏好评估中也显示出显著改进。在云端工作时,它可以查看您提供的图像或屏幕截图作为输入,目视检查其进度,并向您显示其工作的屏幕截图。 GPT‑5‑Codex 是为 Codex CLI、Codex IDE 扩展、Codex 云环境以及在 GitHub 中工作而专门构建的,还支持多种工具使用。与作为通用模型的 GPT‑5 不同,我们建议仅将 GPT‑5‑Codex 用于 Codex 或类似 Codex 环境中的智能体编码任务。

Codex 更新

我们最近还进行了一些更新,使 Codex 成为更好的结对程序员,包括改进的 Codex CLI 和新的 Codex IDE 扩展。

Codex CLI

Codex CLI 是开源的,过去几个月的社区反馈对塑造其发展至关重要。通过这些反馈,我们围绕智能体编码工作流重建了 Codex CLI,以将我们的模型转化为更能干和更可靠的合作伙伴。您现在可以直接在 CLI 中附加和共享图像——屏幕截图、线框图和图表——以建立关于设计决策的共享上下文,并准确获得您想要的内容。在执行更复杂的工作时,Codex 现在使用待办事项列表跟踪进度,并包括用于连接外部系统的工具,如 Web 搜索和 MCP,整体工具使用更准确。 终端 UI 也已升级:工具调用和差异的格式更好,更容易遵循。批准模式简化为三个级别:具有明确批准的只读、具有完整工作区访问权限但需要工作区外批准的自动,以及能够在任何地方读取文件并运行具有网络访问权限的命令的完全访问。它还支持压缩对话状态,使更长的会话更容易管理。 查看 Codex CLI 快速入门 ⁠(在新窗口中打开)了解更多信息。

Codex IDE 扩展

Codex 在您已经工作的地方与您会面,包括在您的 IDE 中。IDE 扩展将 Codex 智能体引入 VS Code、Cursor 和其他 VS Code 分支,因此您可以与 Codex 无缝预览本地更改和编辑代码。当您在 IDE 中使用 Codex 时,您可以编写更短的提示并获得更快的结果,因为 Codex 可以使用上下文,例如您已打开的文件或您选择的代码。 Codex IDE 扩展还允许您在云端和本地环境之间顺畅地移动工作。您可以创建新的云任务,跟踪进行中的工作,并在不离开编辑器的情况下查看已完成的任务。为了进行最后的润色,您可以在 IDE 中打开云任务,Codex 会保持上下文。在 快速入门 ⁠(在新窗口中打开)中了解更多关于如何充分利用 IDE 扩展的信息。

Codex 云端

除了 Codex CLI 之外,新的 IDE 扩展和 GitHub 集成使 Codex 云智能体更接近开发者工作流,因此您现在可以委派任务而无需切换编辑器或 GitHub。 在幕后,我们还一直在持续改进云基础设施性能。通过缓存容器,我们将新任务和后续任务的中位数完成时间缩短了 90%。Codex 现在还可以通过扫描常见设置脚本并执行它们来自动设置自己的环境,并且通过可配置的互联网访问,可以在运行时运行 pip install 等命令来获取所需的依赖项。 与 CLI 和 IDE 扩展一样,您现在可以使用图像来共享前端设计规范或解释 UI 错误。在为您构建时,Codex 可以启动自己的浏览器,查看它构建的内容,迭代,并将结果的屏幕截图附加到任务和 GitHub PR。有关更多详细信息,请查看 文档 ⁠(在新窗口中打开)

代码审查

Codex 现在还包含经过训练以捕获关键缺陷的代码审查功能。与静态分析工具不同,它将 PR 的陈述意图与实际差异进行匹配,分析整个代码库和依赖关系,并执行代码和测试以验证行为。只有最彻底的人类审查者才会在他们审查的每个 PR 上投入这种程度的努力,因此 Codex 填补了这一空白——帮助团队更早地发现问题,减少审查者负担,并更有信心地发布。 一旦为 GitHub 存储库打开,Codex 会在 PR 从草稿变为就绪时自动审查 PR,在 PR 上发布其分析。如果它建议编辑,您可以留在同一个线程中并要求 Codex 实现它们。您还可以通过在 PR 中提及"@codex review"来明确要求审查,并给它额外的指导,例如"@codex 审查安全漏洞"或"@codex 审查过时的依赖项"。查看 快速入门 ⁠(在新窗口中打开)了解如何为您的存储库设置代码审查。 在 OpenAI,Codex 现在审查我们绝大多数的 PR,每天捕获数百个问题——通常在人工审查开始之前。这一直是让 Codex 团队更有信心快速前进的关键。

开发者如何使用 Codex

Cisco MerakiDuolingoRampVantaVirgin AtlanticGap

"我需要更新另一个团队拥有的代码库以进行功能发布。[...] 使用 Codex,我将重构和测试生成工作转移出去,同时专注于其他优先事项。它生成了高质量、经过充分测试的代码,我可以快速交回——使功能按计划进行而不会增加风险。" Tres Wong-Godfrey,Cisco Meraki 技术主管

构建安全可信的 AI 智能体

我们正在构建 Codex,重点是保护代码和数据不被泄露,并防范滥用。默认情况下,Codex 在沙盒环境中运行,网络访问 ⁠(在新窗口中打开)被禁用,无论是本地还是云端。这有助于确保 Codex 无法对您的计算机采取有害行动,并降低来自不受信任来源的提示注入风险。 Codex 可以在潜在危险行动之前请求许可,并被训练运行命令以验证其输出。开发者可以自定义安全设置以匹配他们的风险承受能力。在云端,您可以将网络访问限制为可信域。在 CLI 和 IDE 扩展中,开发者可以批准以完全访问权限运行的命令,或允许智能体使用 Web 搜索并连接到 MCP 服务器。这可以扩展智能体的能力,同时增加风险——在 这里 ⁠(在新窗口中打开)了解更多关于如何安全操作和管理 Codex 的信息。 我们始终鼓励开发者在进行更改或部署到生产环境之前审查智能体的工作。Codex 为每个任务提供引用、终端日志和测试结果,以帮助进行此操作。虽然 Codex 代码审查有助于减少部署到生产环境的危险问题的风险,但无论是由人类还是智能体创建的,我们始终建议使用 Codex 作为额外的审查者——而不是人类审查的替代品。 与我们对 GPT‑5 的方法一致,我们已决定将 GPT‑5‑Codex 视为在生物和化学领域具有高能力,并已实施保障措施以最小化相关风险。在 系统卡附录⁠中阅读更多关于我们的评估和强大安全方法的信息。

定价和可用性

Codex 包含在 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 计划中。使用量随您的计划而扩展:Plus、Edu 和 Business 席位每周可以覆盖几个专注的编码会话,而 Pro 可以支持跨多个项目的完整工作周。 商业计划可以购买积分,使开发者能够超出其包含的限制,而企业计划提供共享积分池,因此您只需为开发者使用的内容付费。在 这里 ⁠(在新窗口中打开)了解更多关于 ChatGPT 中使用限制的信息。 对于通过 API 密钥使用 Codex CLI 的开发者,我们计划很快在 API 中提供 GPT‑5‑Codex。 Codex 正在成为我们一直设想的编码合作伙伴——一个更快、更可靠,并且深入集成到您已使用的工具中的合作伙伴。我们很高兴看到您用它构建什么,并将继续改进 Codex,使其成为您最雄心勃勃项目的更好队友。

作者

OpenAI

继续阅读

查看全部 GPT-5.6 现在是 Microsoft 365 Copilot 中的首选模型 > 封面图片 GPT-5.6 现在是 Microsoft 365 Copilot 中的首选模型产品2026年7月9日 GPT 5-6 > 卡片 GPT-5.6:与您的雄心一起扩展的前沿智能产品2026年7月9日 ChatGPT 现在是您最雄心勃勃工作的伙伴产品2026年7月9日

评论 (0)

暂无评论,快来抢沙发吧!

91学AI

© 2026 91学AI · 按岗位学 AI 与大数据. All rights reserved.