Codex AI 编程新王者, 5 大理由让你彻底爱上 Codex - YouTube
GPT-4代码重构能力
Section titled “GPT-4代码重构能力”- 管理多个goroutine通信:通读代码后提出新流程
- 一边接入新流程到旧过程(不影响功能)
- 一边淘汰旧逻辑,并移动到新流程
- 整个过程无需手动编写代码,非常丝滑
- 补充大量测试
- 修复隐藏bug
- 印象:Codex具备架构师眼光(超越简单增删改查)
Codex 的精准维护能力
Section titled “Codex 的精准维护能力”- 不常维护代码的比喻:高速路上车突然爆胎,车速不变,只换爆胎难度极高(像医生手术)
Codex 整体评价
Section titled “Codex 整体评价”- 又稳又准又狠:即便大代码仓库,智商在线,有架构师眼光和外科医生操作
- 不谄媚、真办事,像人狠话不多的代码大神
- 刚开始使用不适应:不夸人(每月花200多刀),甚至不提供代码也能秀操作
代码分析优点
Section titled “代码分析优点”- 1. 无缝迁移,兼容性强:设置 ANTHROPIC_BASE_URL 环境变量,将 Anthropic Claude 流量定向到 Moonshot AI 的 Kimi 服务
- 无需改代码,通过命令直接用 Kimi,无痛平替降低切换成本
- 2. 简洁明了,易于上手:每行只做一事,变量名自解释(如 AUTH_TOKEN, BASE_URL),复制粘贴即用,无学习门槛
- 3. 跨平台周全:提供 macOS, Linux CMD, Windows CMD (set) 命令,考虑各种场景
Codex 与用户的智力碰撞
Section titled “Codex 与用户的智力碰撞”- 情商到位,不丢人:不顺着用户说,而是经常讲道理争论,绝对有依据
- 很多大模型预测下一个token时会顺从人,Codex完全没有这种感觉
- 争论过程提升代码:针对具体问题争论
- 有时Codex赢,有时用户赢
- 每次争论都让程序/代码更优雅清晰
- 对比Claude Code:难以体会这种智力碰撞的感觉
- Codex有时调研几分钟只写几行代码,起初以为摸鱼,但判断往往正确
- 示例:尝试编辑器离线渲染改动,技术上实现不了
Codex 的据理力争风格
Section titled “Codex 的据理力争风格”- 坚持技术判断:讨论项目将渲染放到worker线程,Codex认为三个改动太大且不可行,拒绝支持
- 用户坚持让其执行验证,花3-4小时层层检查
- 最终证实底部依赖技术上无法放到worker中
- 有效反馈价值:沮丧但开心,获得真实技术验证
- 优于总是附和“你是对的”同事
- 更喜欢事论事、据理力争的合作风格
SPEC 文档的作用
Section titled “SPEC 文档的作用”- 当改动涉及多个文件时,会写一个简单的
SPEC文档。 - 这个
SPEC文档是对功能或改动的大致描述,并非严格等同于软件工程的SPEC文档。 - **
SPEC&
- 理清思路:帮助自己理清改动的逻辑。
- 评估 AI 能力:让 AI 提交报告,以此判断 AI 能否完成该功能,评估其当前水平。
- 提供上下文:让 AI 获取更多上下文信息。
Codex在这种方案下表现非常好,尽管该方案最初是为Claude Code量身定制的。
Codex分析诊断方法
Section titled “Codex分析诊断方法”- 多数据来源易出bug:先写清楚Spec文档(目标、数据流、事务镜像等),再交给Codex分析诊断
- 成功率明显高很多
- 此方法有效,但非本期重点,下期详解
同模型下Codex更强
Section titled “同模型下Codex更强”- 相同Kimi模型对比:Claude Code + Kimi vs Codex + Kimi
- 指令不清晰时,Claude Code的Kimi说场面话(情商高)
- Codex的Kimi更冷静具体:列出版本号、配置细节
- 配置示例(macOS/Linux/Windows)
# Claude Code + Kimi export ANTHROPIC_BASE_URL=https://api.moonshot.chat/anthropic export ANTHROPIC_MODEL=kimi-k2-0905-turbo-preview claude --dangerously-skip-permissions
# Codex + Kimi export K2_API_KEY=sk-your-token codex --dangerously-bypass-approvals-and-sandbox --model kimi-k2-0905-turbo-preview- 意识到:即使相同模型,Codex表现更佳
Codex 与 Claude Code 价格对比
Section titled “Codex 与 Claude Code 价格对比”- Codex 系统提示词和工程设计:让 Codex 更实用
20美元价位性价比分析
Section titled “20美元价位性价比分析”- 价格相同:Codex (ChatGPT Plus) $20/月 vs Claude Code (Claude Pro) $20/月 (年付约 $17/月)
- 模型:Codex 用 T0 模型 GPT-5 High;Claude Code 用 T0 模型 Opus 4
- 额度:
- Codex:Codex CLI 约 30-150/5小时;云端任务预定 5小时
- Claude Code:聊天约 45/5小时,Claude Code 约 10-40/5小时 (与聊天共享)
- 限制差异:Codex 用完额度不影响 Web 端;Claude Code 用完无法使用 Web 端
- 其他功能:Codex 有最深度 Deep Research、Agent、生图、Sora;Claude Code 有 Research、Google Workspace
| Codex - ChatGPT Plus | Claude Code - Claude Pro | |
|---|---|---|
| 价格 | $20/月 | $20/月 (或年付折合 $17/月) |
| 模型 | T0 模型 GPT-5 High | T0 模型 Opus 4 |
| 额度 | Codex CLI 约 30-150/5 小时; 云端任务预定 5 小时 | 聊天约 45/5 小时, Claude Code 约 10-40/5 小时 (共享) |
| 限制 | 用完不影响 Web 端 | 用完无法使用 Web 端 |
| 其它功能 | 最深度的 Deep Research, Agent, 生图, Sora | Research, Google Workspace |
- 个人倾向:20美元下选 Codex,返工率低、能力更好,大概率是本赛季唯一答案
Codex 使用预算与账号建议
Section titled “Codex 使用预算与账号建议”- 需求不大:GPT Plus 就够了
- 经常超额:
- 开两个账号
- 或买第三方服务
- 避免浪费:工具真正节省时间、提升效率才值得
- 预算充足可拉满
- 最重要:一定月付,不要年付
整体总结与不足
Section titled “整体总结与不足”- 一个多月后依然使用Codex的5个理由
- 非各方面完美:如 GPT-5 High 速度偏慢
- 但返工率才是最大痛点(慢不是主要问题)
- 历史类比:程序员从胶卷时代向数码时代前进
- 数码相机1990年就上架,但真正超越胶卷需时
AI进程加速与胶片时代类比
Section titled “AI进程加速与胶片时代类比”- 2004年柯达停止胶片相机销售:标志传统摄影结束,转向数码
- GPT-5和Codex出现后:编程进程比预期早得多,像胶片到数码的瞬间转变
Codex vs Claude Code 调试差异
Section titled “Codex vs Claude Code 调试差异”- Claude Code:约20%代码需要反复调整
- Codex:调试都在调需求的SPEC,非代码本身
Vibe Coding 的价值
Section titled “Vibe Coding 的价值”- 很多人认为Vibe Coding会毁掉软件工程
- 实际:Vibe Coding 会让软件工程再次伟大
- SPEC驱动开发