从零上手 ChatGPT 与 Codex:安装、注册与进阶使用全指南

一篇从安装到进阶设置的 Codex + ChatGPT 整合客户端完整上手指南。
本文基于 B 站视频整理,系统讲解了 OpenAI 将 Codex 与 ChatGPT 合并后的整套使用路径。核心前提是理解两种模式的分工:ChatGPT 模式用于快速对话,Codex 模式用于长时间自主执行任务。文章涵盖安装登录、第三方会员开通、界面按钮拆解、权限与模型选择、目标/计划/分支等进阶功能,以及常规、个性化、电脑操控三类关键设置和模拟点击插件的推荐。此外还介绍了将默认 20 万上下文扩展至 100 万的配置方法,并以制作桌面宠物作为入门练手项目。全文以"量力而行、谨慎开启高风险功能"为基调收尾。
OpenAI 将 Codex 与 ChatGPT 深度整合后,很多用户第一次打开客户端会被两套逻辑、一堆陌生按钮搞懵。这篇教程基于一份 B站保姆级视频整理,把下载安装、账号登录、会员开通到 Codex 的进阶设置串成一条清晰的路径,帮你少走弯路。
说明:本文涉及的账号注册与第三方充值内容仅作信息整理,实际操作请自行评估合规与安全风险。
Codex 与 ChatGPT 已经合并
视频作者反复强调的一个核心事实是:Codex 和 ChatGPT 已经整合到同一个客户端里,所谓下载 Codex 其实就是下载 ChatGPT 的桌面应用。
安装流程本身没有难点——打开官网,点击页面中间的下载按钮,等待下载完成后在文件夹里双击安装包,跟着提示一步步点下去即可。真正需要理解的是安装完成后,客户端内会出现 Codex 和 ChatGPT 两个切换项,它们对应两种完全不同的任务处理逻辑:
- ChatGPT 模式:适合简单对话和快速问答,回答通常十几秒就能出结果;
- Codex 模式:适合让它"具体去干一件事",比如写代码、处理文件,执行时间往往需要 3 到 60 分钟。
理解这个区别,是用好整套工具的前提。对话谁都会用,真正值得花时间学的是 Codex。
Codex 最初是 OpenAI 于 2021 年推出的独立代码生成模型,基于 GPT-3 架构针对编程任务微调而来,是 GitHub Copilot 的底层引擎。此后 OpenAI 将代码能力逐步融入 GPT-4 系列主模型,使得独立的 Codex API 于 2023 年正式下线。2025 年 OpenAI 重新启用"Codex"这一品牌名,指代集成在 ChatGPT 客户端中的自主编程智能体(Coding Agent)——它不再只是"补全代码",而是能在沙盒环境中自主运行代码、读写文件、调用工具,完成端到端的开发任务。因此现在语境中的 Codex 与早期的 Codex API 是两代完全不同的产品,理解这一演变有助于正确设定使用预期。
账号登录与会员开通
登录环节,作者推荐用谷歌账号一键登录,因为主流海外 AI 基本都支持谷歌账号,一号多用能省去反复注册的麻烦。注册谷歌账号时用谷歌浏览器操作,流程与常规注册一致,需要留意的是账号归属地会跟随网络环境自动判定。
关于会员开通,视频提到目前主要通过第三方代充网站完成,支持微信支付,以 ChatGPT Plus / Pro 为例,充值时需要在已登录账号的官网页面获取一段授权代码,粘贴回充值界面核验邮箱后创建订单,支付后一两分钟即可到账。刷新客户端后头像旁出现 Plus 标识,即代表开通成功。

这里要提醒的是,第三方代充存在账号安全和汇率溢价(视频提到比官网多约一刀手续费)等问题,是否采用需自行判断。开通后的账号可直接在 Codex 中登录,解锁全部能力。
Codex 的核心功能与使用技巧
新建一个 Codex 对话后,界面上会出现不少陌生按钮,作者逐一做了拆解:
权限与模型选择
界面上最显眼的"完全访问"(红色)用来决定 Codex 执行操作时是否需要你逐次批准,作者默认拉满以提升效率,但建议新手先用一两天熟悉后再开启。模型选择遵循"越高级越好"的原则,但对普通会员来说,日常任务用中等档位即可,复杂任务再往上调,避免额度消耗过快。
项目、目标与计划模式
- 项目:指定一个文件夹,Codex 产生的文件都存留其中,每次执行也会优先读取该文件夹内容;
- 目标模式:给 Codex 设一个目标,不达成绝不罢休。作者转述推特上一个案例——有人开了这个模式后,Codex 为了叫醒需要输入密码的用户,直接写程序让电脑发声,可见该模式行为可能相当"极端",建议只在明确可达成的目标下使用;
- 计划模式:把任务拆成十几个步骤执行,对复杂任务可手动修改步骤,提升成功率。
目标模式的底层逻辑源自"自主智能体(Agentic AI)"设计范式:系统会持续评估当前状态与目标之间的差距,并自主选择工具和行动来弥合差距,直到判定目标已完成为止。与普通的单轮或多轮对话不同,目标模式下模型拥有主动发起下一步行动的权力,这意味着它可能在无人干预的情况下连续调用文件系统、执行脚本甚至触发外部程序。这种架构带来了极高的自动化潜力,但也引入了"失控风险":一旦目标定义模糊或执行环境边界不清晰,模型可能采取超出预期的手段来"完成"任务。因此在使用目标模式前,建议明确定义成功标准,并为 Codex 设置必要的权限边界。
录制技能与分支功能
录制技能是让 Codex 观察你的录屏,总结出一套可复用的操作技能,适合网站后台等固定重复、可以沉淀成 SOP 的场景;但一旦任务涉及现实层面的信息交互,效果就会打折扣。
作者认为最实用的是分支功能——在每条对话下方可以创建分支,一次性开十几个分支让 Codex 并行处理任务的不同阶段,效率成倍提升。代价是额度消耗也会同比例上升。

必开设置与推荐插件
合理的设置能让 Codex 发挥完整性能。进入左下角头像的设置页,重点集中在"常规配置"、"个性化"和"电脑操控"三处:
- 常规:建议开启自动审核权限以节省精力;完整访问权限建议熟悉一天后再开;打开"上下文窗口使用情况"按钮,随时掌握剩余上下文与压缩时机;在配置里打开网页搜索能增强任务能力。
- 个性化:勾选"启用本地记忆"和"允许基于工具生成记忆",会略增额度消耗,但会让工具越用越顺手。
- 电脑操控:把屏幕相关的勾选项都安装,可增强 Codex 处理任务的能力。

插件方面,作者的定位很清晰:插件是针对特定场景的技能,比如 Excel 插件能强化文档制作与分析能力,按需安装即可。其中特别推荐所有人都装上模拟点击插件,它能让 Codex 用鼠标精准操控电脑,任务结果更可靠。

进阶:把上下文从 20 万扩展到 100 万
Codex 对话默认上下文容量是 20 万,超出后会自动压缩,而压缩往往会削弱任务执行效果。作者给出的解法是打开官方默认关闭的百万上下文:直接让 Codex 打开配置文件,在文件管理系统中用记事本打开该文件,粘贴一段官方指令后保存,重启客户端即可生效。验证方式是随便问一个问题,右下角上下文容量会显示接近 824K 的数值。
需要权衡的是,百万上下文虽然能承载更长任务,但额度消耗同样夸张,作者建议"斟酌性开启",而非默认长期打开。
上下文窗口(Context Window)是指大语言模型在单次推理中能够"看到"的最大 Token 数量,涵盖对话历史、上传文件、工具返回结果等所有输入内容。Token 并非等同于字符,中文约 1–2 个字符对应 1 个 Token,代码则因结构密集往往消耗更多。当输入超过上下文上限时,模型必须丢弃或压缩早期内容,这会导致它"遗忘"任务的早期约束或中间结果,进而降低长流程任务的一致性。将上下文从 20 万扩展至约 82 万 Token,理论上可以让 Codex 在不丢失信息的前提下处理一个大型代码仓库或超长文档。代价是每次推理需要处理的 Token 量大幅增加,API 计费与本地推理资源消耗均会成比例上升,这正是作者建议"斟酌性开启"的原因。
练手项目:做一个桌面宠物
教程最后给出一个上手练习——用 Codex 做桌面宠物。操作路径是头像 → Codex 设置 → 宠物 → 创建,在弹出的对话框中提出需求并上传素材,Codex 就会生成一个桌宠。作者展示的示例甚至接入了大模型对话能力,可实时读取电脑信息并互动,剩下的就交给想象力发挥。
小结
整体来看,这份教程的价值在于把 Codex 那些容易被忽略的设置与逻辑讲透:搞清 ChatGPT 与 Codex 两种模式的分工、善用分支并行、按需装插件、谨慎开启目标模式和百万上下文。工具再强也要量力而行——作者最后也提醒,功能虽多,切勿贪杯,注意合理使用。
相关推荐

从《时差5小时3》海报认人:一场趣味观察实验
《时差5小时3》即将开播,一位UP主对着系列海报逐一认人却连自己都认不出。本文以这段趣味素材为切口,观察高相似度图像下人类如何依赖道具、发色、群体关联进行识别,并附播出时间信息。

Gemini 4 Pro现身Arena灰测:3D与物理能力全面升级
谷歌 Gemini 4 Pro 疑似以内部代号 Argon 现身 Arena 幽灵测试,社区实测其 3D 空间理解、物理模拟与交互式内容生成能力大幅提升,输出上限达 256K,传闻支持 2M 上下文,对标 Astra 与 Fable 5.1。

用Claude Code是什么体验?开发者们的集体共鸣
一则关于"使用Claude Code是什么体验"的Reddit热帖引发开发者集体共鸣。从用AI给div居中的调侃,到对CSS、技术栈和token成本的反思,本文解读AI编程工具时代开发者的真实心态与文档习惯变迁。