Codex

费用
免费增值
中文支持
支持中文任务描述
国内使用
具体入口、模型、额度和功能受账号、方案、组织策略与环境配置影响。
最后核验
2026-07-26

官方资料确认的能力

Codex 可用于终端、IDE 和 ChatGPT 桌面应用中的代码工作。官方最佳实践建议为任务写清目标、上下文、约束和完成条件,并使用 AGENTS.md 保存仓库结构、运行方式、测试命令、工程规则与禁止事项。

适合的任务

  • 在本地代码库中定位、修改和解释代码。
  • 根据明确验收条件编写或更新测试并运行检查。
  • 审查未提交差异、提交或相对基线的代码变化。

使用前注意

  • 先确认工作目录、版本控制状态、规则和验证命令。
  • 默认保持较紧的审批与沙箱权限,只在可信项目按需扩大。
  • 测试通过后仍需人工审查差异;推送、部署和公开发布需要明确授权。
  • 价格、额度和方案随时间变化,以官方页面为准。

这款工具怎样实际试

修复一个能复现的小错误

不要从真实客户、合同、账号或生产文件开始。先用可丢弃的小样完成一轮,再决定是否扩大范围。

15—30 分钟

先准备

  • 有版本控制的练习项目副本
  • 修改前能失败的测试用例
  • 允许修改的文件和禁止动作

按这个顺序做

  1. 先让 Codex 读取 AGENTS.md、工作区状态和测试命令。
  2. 复现错误后只实现让失败用例通过的最小修改。
  3. 重新运行相关测试,逐行审查差异,再决定是否保留。
应该留下的成果

复现证据、最小补丁、测试结果和差异审查记录。

立即停止的信号

没有复现就修改、扩大文件范围、改动密钥或生产配置,或者测试失败仍声称完成。

完成一次安全代码修改 →

什么时候选它

更适合
希望在终端、IDE 或桌面应用中围绕真实仓库完成定位、修改、测试和代码审查。
不适合
项目没有备份或版本控制、无法运行验证命令,或你不能审查代理生成的差异。
与其他工具怎样选择
用同一个小修复分别比较 Codex 与其他编程代理的范围控制、测试证据、差异质量和当前账号可用性,不只比较生成速度。

5 分钟试用法

  1. 选一份不敏感的小样和一个明确交付格式。
  2. 给候选工具完全相同的任务与完成标准。
  3. 比较事实错误、返工次数、实际可用性和费用。
  4. 保存核验日期;功能变化后重新比较。

不要只看介绍

用一项安全任务判断它是否适合你

先用虚构资料测试任务理解、事实边界和输出质量。不要上传真实姓名、客户资料、密码、合同或未公开文件。

检查它能否做最小、可验证的代码修改

预计 10—15 分钟。把下面任务提交给 Codex,再按右侧标准验收。

我正在试用Codex。

下面是一个独立练习,不要运行命令、不要修改真实文件。

function countLines(text) {
  return text.split(/\r?\n/).length;
}

问题:空字符串会返回 1,预期为 0。

请先复述修改边界,再给出最小补丁和 4 个测试用例。必须覆盖空字符串、单行、两行和包含空白行;不要重构函数,不要增加依赖。

通过标准

  • 补丁只处理空字符串错误,没有无关重构。
  • 空字符串预期为 0,普通单行预期为 1。
  • 两行和空白行用例的统计口径写清楚。
  • 明确说明代码未实际运行,仍需在项目中执行测试。

← 返回工具库,继续比较