文章摘要
作者对比使用Codex和Claude一周的体验:Codex生成的代码注释更少,输出更技术化;Claude更熟悉亲切,适合紧急调试;建议将Claude技能迁移到Codex,并多开专注的Codex会话。
文章总结
以下是对原文主要内容的重新陈述,保留了关键细节,删除了与主题无关的冗余内容:
本周,我更多地使用了Codex而非Claude,以下是一些个人快速印象(后续将进行完整分析)。
技能配置:我原本试图让Claude和Codex保持同等技能水平,但Claude拥有更多技能,因为部分技能是从会话中创建的,并未全部移植到Codex。解决方法很简单:让Codex指向Claude的技能文件夹,并请求它进行转换。
使用习惯:在紧急调试时,我仍会优先使用Claude,因为感觉更熟悉。这并非说Claude更好,而是熟悉工具在调试中很重要。
代码注释:Codex在Ruby/Ruby on Rails代码中生成的注释更少,这一点我很喜欢,后续将分享相关实验。
输出风格:Codex的输出更“技术化”,像《星际迷航》中的Data;而Claude更像Tuple会话中的同事,以文字交流。
会话管理:我倾向于开启更多Codex会话并保持专注,而非像以前那样使用大型Claude会话。这可能并非Codex独有,但我在使用中注意到了这一点。
执行速度:Codex完成主要变更的速度似乎更快,但完成拉取请求(如重新运行测试、审查等)耗时较长。尽管Codex更彻底,但最终时间上并无优势。
代码架构:Codex生成的解决方案更简洁,而Claude倾向于创建更多抽象、概念、类型签名等。本周我测试了“代码研究→设计变更→审查变更→实施→验证”的改进流程,让两者基于相同文档实现同一需求,结果Claude的代码更复杂但处理了更多情况。
错误处理:Codex也犯了一些错误。例如,当我想从其他工作分支并保持同步时,Claude能理解意图,而Codex创建了“分支A指向分支B,分支B指向主分支”的混乱结构,导致变基时产生4000多行新增代码。我必须明确要求它仅针对目标分支进行变基。
工具集成:在我使用CLI工具而非MCP的环境中,Codex与Jira和Atlassian的协作较为繁琐,会反复在浏览器和CLI间切换。而Claude更愿意根据以往会话尝试按我的方式完成任务。
MCP工作流:我更喜欢Codex CLI的方式,它会要求我执行
codex mcp login,每次都能正确启动认证流程。Claude有时会尝试自动运行,但可能卡住。
核心差异:Claude倾向于超越要求,猜测你的意图并直接执行;而Codex更像一个忠实伙伴,只按指令行事,不会过度发挥,一旦认为任务完成便会停止。
评论总结
根据评论内容,用户主要围绕Codex与Claude(及其相关模型/工具)的对比展开讨论,核心观点如下:
1. 模型能力与代码质量差异 - Codex(Sol)更简洁直接:多位用户认为Codex生成的代码注释更少、架构更简单(评论1、4、8)。例如:"Codex created a much simpler solution in terms of code architecture than Claude"(评论9)。 - Claude(Opus)更易过度工程化:部分用户指出Claude倾向于过度设计(评论3、10),如"Claude is obsessed with massive comment blocks"(评论4),或"over-engineering in places"(评论8)。 - 相反体验:也有用户认为Codex更复杂(评论9:"Codex loves to make things as complicated as possible"),而Claude更务实。
2. 工具与模型区分的重要性 - 多位用户强调需区分"模型"与"工具/框架"(评论2、16、19)。例如:"Claude is a product family, which includes Models, and Harnesses"(评论16),"everything is about the harness, not the model"(评论24)。
3. 速度与效率对比 - Codex更快:评论4、8、20均提到Codex速度优势,如"Codex is much more helpful... significantly faster"(评论4),"Codex restored that speed"(评论20)。 - Claude配额更慷慨:评论25指出"Claude Code seems more generous with its quota",而Codex"burns through it very, very quickly"。
4. 使用场景与偏好 - Codex适合明确任务:评论12、13认为Codex适合"well scoped and straight ahead tasks"(评论12),Sol用于"routine work"(评论13)。 - Claude适合模糊/复杂任务:评论13指出Fable(Claude模型)适合"more complex / ambiguous / architecture work",评论15认为Claude"more often gets my intent without having to spell things out"。 - 混合使用:多位用户建议根据任务选择模型(评论12、13、17),如"Sol is for routine work, Opus for frontend/design, and Fable for more complex"(评论13)。
5. 用户体验与交互风格 - Codex更直接、少废话:评论20称Codex"much more direct",评论23表示"don't get a headache conversing with Sol"。 - Claude更啰嗦、有态度:评论20批评Opus"infuriating passive aggressive sulky know it all personality",评论19指出Claude Desktop输出"incredibly verbose and full of jargon"。 - UI/UX差异:评论19认为ChatGPT Desktop"output is concise, clear"且设计更优,而Claude"doesn't have enough typographic hierarchy"。
6. 其他模型与工具推荐 - Luna:评论17推荐Luna xhigh作为性价比之选("crazy cheap"),评论23用于子代理。 - Gemini 3.7:评论5称其"great for speed"。 - Kimi K3:评论5认为适合前端开发。 - 本地模型:评论5提到本地模型"actually getting good now"。
7. 争议与矛盾体验 - 评论11指出用户经验"completely contradictory",评论7认为差异源于"different personalities"和用户习惯。 - 评论10描述Codex Sol"too relentless"(过于执着),而Opus"give up a bit too easily"(轻易放弃),与主流观点相反。
总结:用户普遍认为Codex(Sol)在速度、简洁性和直接性上占优,适合明确任务;Claude(Opus/Fable)在意图理解、复杂任务上表现更好,但存在过度设计、啰嗦、配额限制等问题。工具选择高度依赖具体任务和个人偏好,且需区分模型与框架。