跳转到内容

Codex AI 编程新王者, 5 大理由让你彻底爱上 Codex - YouTube

  • 管理多个goroutine通信:通读代码后提出新流程
  • 一边接入新流程到旧过程(不影响功能)
  • 一边淘汰旧逻辑,并移动到新流程
  • 整个过程无需手动编写代码,非常丝滑
  • 补充大量测试
  • 修复隐藏bug
  • 印象:Codex具备架构师眼光(超越简单增删改查)
  • 不常维护代码的比喻:高速路上车突然爆胎,车速不变,只换爆胎难度极高(像医生手术)
  • 又稳又准又狠:即便大代码仓库,智商在线,有架构师眼光外科医生操作
  • 不谄媚、真办事,像人狠话不多的代码大神
  • 刚开始使用不适应:不夸人(每月花200多刀),甚至不提供代码也能秀操作
  • 1. 无缝迁移,兼容性强:设置 ANTHROPIC_BASE_URL 环境变量,将 Anthropic Claude 流量定向到 Moonshot AI 的 Kimi 服务
  • 无需改代码,通过命令直接用 Kimi,无痛平替降低切换成本
  • 2. 简洁明了,易于上手:每行只做一事,变量名自解释(如 AUTH_TOKEN, BASE_URL),复制粘贴即用,无学习门槛
  • 3. 跨平台周全:提供 macOS, Linux CMD, Windows CMD (set) 命令,考虑各种场景
  • 情商到位,不丢人:不顺着用户说,而是经常讲道理争论,绝对有依据
  • 很多大模型预测下一个token时会顺从人,Codex完全没有这种感觉
  • 争论过程提升代码:针对具体问题争论
  • 有时Codex赢,有时用户赢
  • 每次争论都让程序/代码更优雅清晰
  • 对比Claude Code:难以体会这种智力碰撞的感觉
  • Codex有时调研几分钟只写几行代码,起初以为摸鱼,但判断往往正确
  • 示例:尝试编辑器离线渲染改动,技术上实现不了
  • 坚持技术判断:讨论项目将渲染放到worker线程,Codex认为三个改动太大且不可行,拒绝支持
  • 用户坚持让其执行验证,花3-4小时层层检查
  • 最终证实底部依赖技术上无法放到worker中
  • 有效反馈价值:沮丧但开心,获得真实技术验证
  • 优于总是附和“你是对的”同事
  • 更喜欢事论事、据理力争的合作风格
  • 当改动涉及多个文件时,会写一个简单的 SPEC 文档。
  • 这个 SPEC 文档是对功能或改动的大致描述,并非严格等同于软件工程的 SPEC 文档。
  • **SPEC&
  1. 理清思路:帮助自己理清改动的逻辑。
  2. 评估 AI 能力:让 AI 提交报告,以此判断 AI 能否完成该功能,评估其当前水平。
  3. 提供上下文:让 AI 获取更多上下文信息。
  • Codex 在这种方案下表现非常好,尽管该方案最初是为 Claude Code 量身定制的。

00:06 00:06:24

  • 多数据来源易出bug:先写清楚Spec文档(目标、数据流、事务镜像等),再交给Codex分析诊断
  • 成功率明显高很多
  • 此方法有效,但非本期重点,下期详解
  • 相同Kimi模型对比:Claude Code + Kimi vs Codex + Kimi
  • 指令不清晰时,Claude Code的Kimi说场面话(情商高)
  • Codex的Kimi更冷静具体:列出版本号、配置细节
  • 配置示例(macOS/Linux/Windows)
Terminal window
# Claude Code + Kimi
export ANTHROPIC_BASE_URL=https://api.moonshot.chat/anthropic
export ANTHROPIC_MODEL=kimi-k2-0905-turbo-preview
claude --dangerously-skip-permissions
# Codex + Kimi
export K2_API_KEY=sk-your-token
codex --dangerously-bypass-approvals-and-sandbox --model kimi-k2-0905-turbo-preview
  • 意识到:即使相同模型,Codex表现更佳

00:07 00:07:27

  • Codex 系统提示词和工程设计:让 Codex 更实用
  • 价格相同:Codex (ChatGPT Plus) $20/月 vs Claude Code (Claude Pro) $20/月 (年付约 $17/月)
  • 模型:Codex 用 T0 模型 GPT-5 High;Claude Code 用 T0 模型 Opus 4
  • 额度
  • Codex:Codex CLI 约 30-150/5小时;云端任务预定 5小时
  • Claude Code:聊天约 45/5小时,Claude Code 约 10-40/5小时 (与聊天共享)
  • 限制差异:Codex 用完额度不影响 Web 端;Claude Code 用完无法使用 Web 端
  • 其他功能:Codex 有最深度 Deep Research、Agent、生图、Sora;Claude Code 有 Research、Google Workspace
Codex - ChatGPT Plus Claude Code - Claude Pro
价格 $20/月 $20/月 (或年付折合 $17/月)
模型 T0 模型 GPT-5 High T0 模型 Opus 4
额度 Codex CLI 约 30-150/5 小时; 云端任务预定 5 小时 聊天约 45/5 小时, Claude Code 约 10-40/5 小时 (共享)
限制 用完不影响 Web 端 用完无法使用 Web 端
其它功能 最深度的 Deep Research, Agent, 生图, Sora Research, Google Workspace
  • 个人倾向:20美元下选 Codex,返工率低、能力更好,大概率是本赛季唯一答案
  • 需求不大:GPT Plus 就够了
  • 经常超额
  • 开两个账号
  • 或买第三方服务
  • 避免浪费:工具真正节省时间、提升效率才值得
  • 预算充足可拉满
  • 最重要:一定月付,不要年付
  • 一个多月后依然使用Codex的5个理由
  • 非各方面完美:如 GPT-5 High 速度偏慢
  • 返工率才是最大痛点(慢不是主要问题)
  • 历史类比:程序员从胶卷时代数码时代前进
  • 数码相机1990年就上架,但真正超越胶卷需时
  • 2004年柯达停止胶片相机销售:标志传统摄影结束,转向数码
  • GPT-5和Codex出现后:编程进程比预期早得多,像胶片到数码的瞬间转变
  • Claude Code:约20%代码需要反复调整
  • Codex:调试都在调需求的SPEC,非代码本身
  • 很多人认为Vibe Coding会毁掉软件工程
  • 实际:Vibe Coding 会让软件工程再次伟大
  • SPEC驱动开发