OpenClaw
← 返回 Agent 目录

OpenAI / Software engineering agent

Codex

OpenAI 的软件工程 Agent,面向代码编写、修复、测试、审查和并行开发任务。

打开官方文档 ↗打开官方网站 ↗查看价格或开通入口 ↗

Agent 介绍

Codex 面向软件工程任务,强调让 Agent 在项目环境中理解需求、编写代码、运行验证并交付可审查结果。它适合从 issue、任务描述或自然语言需求开始,逐步形成补丁和测试证据。

产品功能、模型可用性、价格和区域入口可能变化,上线前请以官方文档和控制台的最新信息为准。

核心能力

  • 需求到补丁把 issue、任务描述或自然语言需求转成代码变更。
  • 测试与验证执行测试、检查构建结果并报告失败原因。
  • 代码审查识别潜在缺陷、回归风险和缺失测试。
  • 并行工作流把相互独立的工程任务分配到隔离环境。

推荐工作流

  1. 先提供仓库约定、测试命令和不可修改的目录。
  2. 将复杂任务拆为可独立验证的小任务,并为每个任务定义验收条件。
  3. 在合并前要求人工审查 diff、测试输出和依赖变化。

评测与选型

建议同时测试功能正确率、回归率、测试覆盖变化、依赖安全、修复一次任务所需的交互次数和端到端延迟。

建议使用固定的脱敏任务集,在同一环境中比较成功率、延迟、成本、工具调用可靠性和人工介入次数。

安全与治理

将 Codex 连接到代码库或执行环境时,应限制网络、文件系统和凭据访问,并为自动提交、发布和基础设施变更设置审批。

与 OpenClaw 集成

可以将该 Agent 作为 OpenClaw 旁路的编码或编排组件。明确模型调用、工具、凭据、日志和审批边界,让整个工作流保持可观测、可回滚。

AGENT_SLUG=codex

常见问题

Codex 适合什么工作?

Codex 适合将代码、工具调用或 Agent 编排纳入可审查的开发工作流。实际效果取决于任务集、权限、模型版本和环境配置。

如何评测 Codex?

使用真实任务集固定提示词、工具、重试和预算,记录成功率、延迟、成本、失败原因和人工介入次数。

Codex 能直接用于生产吗?

上线前应完成权限隔离、日志审计、依赖检查、回滚设计和人工审批,并以官方文档与控制台的最新状态为准。

资料来源:厂商官方网站与开发文档。产品名称、可用性、价格和能力应在部署前再次核对。