Codex完全指南:从AI问答助手到智能体工作台

从问答助手到智能体工作台:Codex到底改变了什么
OpenAI推出的Codex,正在重新定义我们对AI工具的认知。如果说传统的ChatGPT类工具更像一个"问答助手"——你提问,它回答——那么Codex则是一个真正意义上的智能体工作台(Agent Workspace)。
用一句话概括:Codex把AI从"回答问题"推进到了"完成任务"。它不止和你对话,而是围绕一个真实的任务,读取文件、修改文件、运行命令、调用插件,最终生成可检查、可继续修改的结果。
这个区别至关重要。写文案、做内容总结这类任务,普通AI工具就能胜任;但当任务涉及进入项目真实目录、持续修改文件、跑命令写代码时,Codex这种"能参与工作流程"的智能体才能真正发挥价值。它的能力边界不再局限于聊天框,而是延伸到了你的整个工作环境。
Codex安装与三大核心界面区域
Codex的安装过程与普通软件无异:打开官网,选择系统对应版本下载,首次打开时用ChatGPT账号登录即可。对新手而言,关键不是记住所有按钮,而是理清界面的三个核心区域:
- 左侧导航区:管理聊天记录、项目、插件市场和自动化入口
- 中间对话区:下达任务、上传附件、选择模型与推理等级
- 右侧结果区(工作区):显示文件预览和生成结果
一个适合新手的入门案例:给Codex发送"帮我创建一个Markdown文件,用三句话解释Codex和普通聊天工具的区别"。你会看到,它不只是在聊天框里给出文字回答,而是在项目目录下真实地创建了一个文件。

这个看似简单的操作,正是Codex后续所有能力的基础——它拥有一个真实的工作区,可以在其中读写文件、执行操作。
Chat与Project:两种工作模式详解
Codex提供两种核心工作方式,理解它们的区别是高效使用的前提。
Chat模式:适合临时对话
Chat模式更像普通聊天,适合临时问问题。比如问"解释一下MCP是什么",Codex会像普通AI工具一样直接给出回答。这类任务不需要长期文件,也不会在本地产生持久化结果。
Project模式:产生持久化文件结果
Project模式面向正式任务。只要任务会产生文件——比如做网页、修改PPT、做表格、写代码,或需要读取资料、持续修改、跑命令、调用插件——就应该用Project模式。

创建项目时,你可以选择"新建空白项目"(相当于创建一个新文件夹)或"使用现有文件夹"。每个项目都对应着一个真实的工作目录,你可以右击重命名或查看真实路径。简单记忆:Chat是临时对话,Project是会产生持久化结果的正式工作。
模型选择、推理等级与权限设置
这三项设置决定了Codex的"大脑"、"思考深度"和"行动自由度"。
模型选择是Codex的大脑,在输入框右下角可选择GPT-5.5、5.4、5.3、5.2等不同版本。新手无需纠结,默认模型即可完成大部分任务。
推理等级分为低、中、高、超高四档。等级越高,花费时间越多,越适合规划大型项目、分析大量文件等复杂任务。此外还有速度选项——快速模式比默认快1.5倍,但token用量会翻倍。
权限管理是最需要谨慎对待的设置。Codex执行任务时可能读写文件、运行命令、联网、安装依赖甚至操作浏览器和电脑,这些动作都需要授权。这里有个重要提醒:权限不是越高越好。权限越高,Codex越自由,但你也越需要看清它做了什么。
实测中,当指令要求在当前目录之外(如download目录)创建文件时,默认权限下Codex会弹窗请求确认。这说明默认状态下它只能访问当前目录。建议新手前期使用默认权限或自动评审权限,遇到弹窗不要无脑点击,先看清它要访问哪里、执行什么命令。
Codex插件市场:扩展专业能力的工具箱
Plugins(插件市场)是Codex的"工具箱",安装后能让它处理更专业的任务。以最实用的办公三件套插件为例:
- Documents插件:创建和编辑Word文档
- Spreadsheets插件:处理Excel、CSV表格
- Presentations插件:生成和修改PPT
实战案例中,给Codex一份"AI工具学习资料"文档,并要求"整理成三种产物:Word学习笔记、Excel工具对照表、PPT课程大纲",它会自动调用对应的三个插件,一次性生成三种格式的文件。当然,你也可以通过点击"+"手动显式调用指定插件。
Plan模式:先规划再执行,避免返工
面对复杂任务,Codex提供了Plan(计划)模式,遵循"理解→拆解→确认→执行"四步流程。
举个典型场景:你想做一个个人博客。如果让Codex直接动手,它做出的技术栈、代码结构、页面风格很可能不符合你的预期。而Plan模式的核心不是"慢一点",而是让Codex先把任务拆开,告诉你它准备怎么做,你确认后再执行。

在博客案例中,Codex会先弹框让你选择博客定位、实现方式、视觉风格,然后列出完整计划。你满意后点击"实施此计划",它才开始生成。Plan模式特别适合你对结果有明确要求、不希望AI自由发挥的场景。
Skill与MCP:说明书与外部连接器
这是Codex中容易混淆但极为重要的两个概念。
Skill:给Codex的工作说明书
Skill就像一份操作说明书,告诉Codex执行某类任务应遵循哪些步骤、注意哪些规则、使用哪些资源。比如生成图片有图片Skill,处理文档有文档Skill。GitHub上有大量现成的Skill,涵盖开发、写作、数据分析等领域。
安装方式很简单:在"技能"面板中点击安装推荐的Skill;也可通过终端复制第三方Skill的安装命令一键安装;甚至可以点击"Skill Create"自己创建,来描述专属的工作流程。
MCP:连接外部工具的标准接口
MCP(Model Context Protocol)是连接外部工具和服务的标准接口,让Codex能够连接浏览器自动化、数据库、设计工具、项目管理等外部系统。

配置MCP可以通过终端命令codex mcp add加地址完成,也可以直接在输入框发送"帮我安装Figma MCP"。以Figma为例,配置后Codex就能读取你在Figma上的设计稿,实现从设计到代码的打通。
一句话区分二者:Skill是教Codex怎么做,MCP是让Codex能连接外部系统。
自动化与Computer Use:Codex的进阶能力
**Automations(自动化)**解决的是重复性任务。比如设置"每天晚上8点从社交平台获取Codex的最新新闻,生成Markdown文件"。Codex会自动执行定时任务,你可以在自动化面板查看任务状态、下次运行时间,随时开始、暂停或删除。
**Computer Use(电脑操作)**则是Codex的顶级能力——授权后它能直接操作电脑,比如在软件中点击、输入、截图、读取界面信息。演示案例中,Codex甚至能打开电脑上的国际象棋并与之对弈。但这类能力权限极高,新手务必谨慎使用。
用好Codex的关键思维
真正用好Codex,关键不在于记住每个按钮,而在于掌握一套核心思维:把任务说清楚——要它做什么、参考什么资料、最后怎么检查结果。
只要掌握这个思路,无论是写作、办公、学习还是编程场景,Codex都能帮你节约大量重复劳动。它代表的不只是又一款AI工具,而是AI从"对话"走向"行动"的一次范式跃迁。
相关推荐

AI Agent框架的治理盲区:从原型到生产的安全挑战
AI Agent框架让原型搭建变得简单,但权限管理、多租户隔离、审计追踪等生产级治理问题常被忽视。本文分析生产环境中的真实风险场景,探讨AgentZ等治理优先架构如何解决从原型到生产的平滑过渡难题。

Java工程师AI转型:Python大模型开发完整实战路线
专为Java工程师设计的AI转型指南,从Python基础到大模型Agent开发的7大模块实战路线。掌握Jupyter、Hugging Face、Gradio等核心工具,突破硬件限制,快速构建AI应用交付能力。

GitHub开源项目贡献指南:找到值得参与的优质Issue
想参与开源但找不到合适项目?本文分享实用策略,包括GitHub高级搜索技巧、聚合工具推荐、活跃度判断方法,帮你高效找到值得贡献的开源Issue。