Codex 加上图像生成以后,这两个东西确实越来越容易让人搞混。因为表面上看,现在都是输入一句话,然后让 AI 给你生成图片,甚至已有图片也都可以继续改。OpenAI 目前的官方说明里也明确写了,ChatGPT 可以创建、编辑图片,而 Codex 现在同样支持生成和编辑图像。
但我自己理解下来,两边最大的区别其实不在“谁会画图”,而在于你为什么要生成这张图。
如果我只是想做一张微信公众号封面、文章配图、海报,或者拿一张现成照片让 AI 帮我换背景、改文字,我基本不会想到 Codex,直接在 ChatGPT 里面做最省事。现在 ChatGPT 的图像功能已经做得很像一个单独的创作工具了,可以选比例、传参考图、局部修改,也可以用模板继续改。比如我说“做一张 2.35:1 的微信公众号封面,把左边留给标题”,这种需求放在 ChatGPT 里很顺手,生成之后觉得文字太挤,再说一句“标题往左移一点,人物不要动”就行。官方现在的 ChatGPT Images 也支持任意宽高比、局部选择编辑和模板这些功能。
Codex 的感觉就不太一样了。它现在虽然也能生图,但这个功能明显是往“做项目”里面塞的。OpenAI 自己举的场景也是产品原型、前端设计、视觉效果和游戏开发,而且它可以把图像和代码、项目文件、截图放在同一个工作流里处理。 这点实际挺有意思,比如你让 Codex 做一个网站,它写完首页之后发现缺一张 Hero Banner,你可以直接让它生成,然后把图片放进项目目录、改页面代码引用它,再启动网页看看效果。觉得不对,再让它改图或者顺便调 CSS。这里的图片不是最后的作品,更像整个开发任务里面的一个素材。
所以如果让我用一个比较土的方式区分,我会说 ChatGPT 更像是“我要一张图”,Codex 更像是“我要把这个东西做出来,过程中刚好需要几张图”。当然这两句话也不能理解得太死,现在能力已经有不少重叠了,只是使用习惯确实差很多。
还有个容易被忽略的地方,就是 Codex 对“上下文”利用得更偏项目。假设你已经有一个 React 项目,里面有 logo、配色、页面截图和现成组件,你让 Codex 继续做一个登录页面,它可以一边看代码一边处理视觉素材。以后这种能力继续加强的话,我觉得对做前端、独立开发、小游戏的人会比单纯提高一点生图质量更有价值。你不是来回在 ChatGPT、PS、VS Code 几个窗口之间倒腾,而是直接告诉它“按照现在这个页面风格再做一张背景图,然后放进去看看”。
反过来,如果你就是普通用户,想生成头像、商品图、公众号封面、知乎配图,我目前还是觉得 ChatGPT 用起来舒服得多。特别是现在 ChatGPT Images 已经更新到 2.5,官方重点就在更清晰的细节、更精准的编辑和更快的生成速度,而且 Plus、Pro、Business 这些付费套餐还可以使用带思考的图像功能。 对这种“我脑子里有个画面,但又说不太清楚”的需求,直接聊天慢慢改,学习成本很低。
所以如果有人因为图像能力纠结 ChatGPT Plus 和 Pro,我反而觉得没必要把这件事想得太复杂。ChatGPT 的图像功能目前所有方案都可以使用,Plus、Pro 和 Business 的一些图像能力会更完整;要不要升级 Pro,更应该看你整体的使用强度,包括 Codex 的额度、长任务、模型使用量这些,而不是因为“Pro 画出来一定比 Plus 好很多”就去购买更贵的套餐。 有些人还会把 ChatGPT 会员、Codex、credits 混在一起,以为充值一个套餐以后所有额度都是一回事,其实订阅和 API credits 这种东西最好分开看,不然很容易在付款的时候搞混。
我现在自己的判断很简单:想“做图”,优先打开 ChatGPT;想“做网站、做应用、改项目,同时需要它顺手把图也做了”,Codex 更有意思。
比如同样一句“帮我做一个咖啡店官网”,我在 ChatGPT 里更可能拿到一张咖啡店网站的概念效果图;而我打开 Codex,期待的是它给我建项目、写页面、生成需要的图片素材,然后真的把这个网站跑起来。这大概就是目前两边图像能力最容易感受到的区别。