01自动化 Automation
自动化就是让 Codex 不只是"听你指挥",而是能按规则定期帮你巡查项目、发现问题、处理问题。给它配好规则后,它可以在你离开时继续工作,回来直接看结果。
可以这样理解:给项目请了一个"AI 值班工程师"——平时不打扰你,有问题来提醒你,简单问题它先尝试修,最后让你审核决定。常见场景:资讯简报、竞品监控、定期巡检、日报周报、会话复盘。
自动化的几种触发方式
| 触发方式 | 适合做什么 | 简单理解 |
|---|---|---|
| 一次性 | 现在跑一次就结束 | 临时任务,比如"今天就整理一次周报" |
| 按计划 | 每天 / 每周定时跑 | 早 9 点的 AI 行业简报 |
| 事件触发 | 某个动作发生后跑 | 代码合并后自动跑测试 |
| 持续监控 | 盯着变化一直跑 | 监控竞品网站有没有更新 |
示例:让 Codex 每周自动复盘你的会话
下面这条提示词来自原书,能让 Codex 定期检查你最近的会话记录与执行日志,沉淀成一份可复用的工作流档案,越用越顺手:
请检索并复盘最近一周的 Codex 会话记录与执行日志,维护一份 "Codex 会话复盘与个人风格档案"。 要求: 1. 优先使用可用的会话历史检索能力;如需读取日志,只做搜索、元数据 提取和相关片段抽取,不要整文件载入大型 session 文件。 2. 不要复现原始日志、隐私内容、密钥、内部 reasoning 或长对话原文。 3. 总结执行经验:哪些做法导致了问题,最终正确做法是什么,适合什么 场景复用。 4. 总结我的偏好:UI 设计偏好、产品理念、交互原则、内容系统偏好和 工作流偏好。 5. 整理可复用规则清单:把复盘结论改写成后续 Codex 会话可以遵循的 简洁规则。 6. 更新文档时去重、合并相近规则,保留日期范围或任务类型作为来源线索。 7. 如有适合长期复用的规则,请建议是否加入项目级或用户级 AGENTS.md。
合并后的调度任务可在你离开时继续推进工作;调度运行历史还支持批量操作(批量标记已读 / 归档)。自动化跑完后,记得回来看一眼结论,再决定要不要采纳它的修改。
第一次用自动化,先从"只读、只生成报告"的任务开始(比如上面这条复盘提示词),不要一上来就让它自动改代码、自动合并 PR。低风险练手,熟练后再放开权限。
02插件 Plugin:能力安装包
Codex 本身已经能读代码、改代码、运行命令;插件是在这个基础上,让它连接更多工具、使用固定流程,或获得某些专项能力。比如 Gmail 插件可总结邮件、草拟回复;Chrome 插件可操作浏览器、检查页面。
很多 AI 编码工具止步于"在编辑器里帮你补代码"。Codex 的插件体系让它真正跨出编辑器,进入你每天在用的真实软件——Gmail、Chrome、Google Drive、Slack、Figma、Notion、GitHub……并在这些工具里替你行动,而不只是生成一段文本。
这正是 Codex 与"纯代码补全"类工具的本质区别,也是它最值得花时间深挖的能力:
| 维度 | 普通代码助手 | Codex + 插件 |
|---|---|---|
| 作用范围 | 编辑器内补全 / 改文件 | 连接真实 SaaS 与本地应用,端到端把事办成 |
| 能否操作真实账号 | 不能(最多读写本地代码) | 经 OAuth 授权后,可总结邮件、发 Slack、读 Drive、建 PR |
| 操作任意软件 | 只能编辑代码 | Computer Use 能"看屏幕、点按钮",操作任何桌面应用 |
| 非开发任务 | 基本做不了 | 做 PPT、生成视频、分析表格、跑数据分析,一句话搞定 |
一句话总结:插件把 Codex 从"会写代码的助手"升级成"能替你把事办成的同事"。下面先建立插件生态的全局印象,再讲安装与实战。
插件生态全景(按领域分组)
Codex 插件覆盖从开发到办公、从浏览器到创意生产的全链路。下面列出代表性插件与"它能帮你做成什么",先有全局地图,后面再深入安装与实战。
| 领域 | 代表插件 | 典型用法 |
|---|---|---|
| 浏览器 / 电脑操作 | Chrome、Computer Use | 自动打开网页、点按钮、截图检查、像人一样操作任意桌面软件 |
| 沟通协作 | Gmail、Slack | 总结收件箱与频道、草拟回复、按你的语气代发 |
| 办公交付 | Documents、Presentations、Spreadsheets | 生成文档 / PPT / 报表,整理分析 Excel 数据 |
| 前端与设计 | Build Web Apps、Figma | 一句话出网页 / Demo,设计稿转前端代码 |
| 代码与 CI | GitHub | 读仓库、处理 issue、改代码、建 PR、跑 CI |
| 安全 | Security | 检查代码安全隐患、给出加固建议 |
| 视频创意 | HyperFrames、Remotion | 用 HTML / 代码生成动画视频(详见 P05 · R1-4) |
| 岗位专用 | 六大岗位插件 | 数据分析 / 创意 / 销售 / 产品设计 / 股权投资 / 投行,内置工具连接 + 领域知识 |
插件能做什么(常见类型)
| 插件类型 | 能让 Codex 做什么 |
|---|---|
| Chrome 插件 | 打开网页、检查页面、配合浏览器调试 |
| Gmail 插件 | 总结邮件、草拟回复 |
| Google Drive 插件 | 读取文档、表格、幻灯片 |
| Slack 插件 | 总结频道消息、草拟团队回复 |
| Security 插件 | 检查代码安全问题 |
| Computer Use 插件 | 操作电脑上的应用(看屏幕、点按钮) |
在 Codex App 里安装插件
- 打开 Codex App;
- 搜索或浏览插件;
- 点开插件详情;
- 点击
Add to Codex或添加按钮; - 安装完成后,新开一个 thread 再使用。
在 Codex CLI 里安装插件
进入项目目录后先启动 Codex:
cd 项目目录 codex
进入 Codex CLI 后输入 /plugins,打开插件列表后你可以:
| 操作 | 说明 |
|---|---|
| 搜索插件 | 找你需要的插件 |
| 查看详情 | 看插件能做什么、需要什么权限 |
| Install plugin | 安装插件 |
| Uninstall plugin | 卸载插件 |
| Space | 对已安装插件启用或停用 |
常见插件与能力方向
| 类型 | 包含插件 | 适合做什么 |
|---|---|---|
| 浏览器与电脑操作 | Chrome、Computer Use | 网页测试、自动点击、软件操作 |
| 代码与项目协作 | GitHub | 管理仓库、修 bug、创建 PR |
| 前端与设计 | Build Web Apps、Figma | 生成网页、设计稿转代码 |
| 办公交付 | Documents、Presentations、Spreadsheets | 文档、PPT、表格分析 |
| 视频生成 | HyperFrames、Remotion | 用代码或 HTML 生成视频 |
十个高频插件一览
| 序号 | 插件 / 能力 | 主要作用 | 简单来说 |
|---|---|---|---|
| 1 | Chrome | 让 Codex 直接操作浏览器 | 打开网页、点按钮、检查页面效果、测试功能 |
| 2 | GitHub | 代码仓库管理与协作 | 读取仓库、处理 issue、改代码、创建 PR |
| 3 | Computer Use | 让 Codex 操作电脑 | 像人一样看屏幕、点按钮、操作软件(权限较高) |
| 4 | Build Web Apps | 一句话生成前端网页应用 | 输入需求,生成网页、小工具、落地页、Demo |
| 5 | Figma | 设计稿转代码与原型设计 | 把 Figma 设计稿变成前端页面 |
| 6 | Documents | AI 帮你交付正式文档 | 生成 README、项目说明、教程文档、产品文档 |
| 7 | Presentations | AI 生成高质量 PPT | 根据内容生成汇报、课程、产品介绍、方案型 PPT |
| 8 | Spreadsheets | 数据分析与表格处理 | 整理 Excel、分析数据、生成表格结论 |
| 9 | HyperFrames | HTML 直接生成视频 | 用网页 / HTML 结构生成视频内容 |
| 10 | Remotion | 用代码生成高质量视频 | 用 React / 代码方式生成更专业的视频 |
插件目录会随 Codex 版本、工作区和账号权限变化,实际可安装内容以你当前 Codex 插件页显示为准。安装前先看"详情"里的权限要求,越高的权限(如 Computer Use)越要谨慎授权。
合并后上线六款面向岗位的专属插件:数据分析、创意制作、销售、产品设计、股权投资、投资银行,合计接入 62 个主流企业应用(Salesforce、Snowflake、Figma、Canva 等)、内置 110 项技能。每款内置该岗位的工具连接、领域知识与操作流程,非专业人员也能上手。例如数据分析插件:用自然语言提问 → 自动连数据源、写并运行 SQL、生成图表和交互式报告,还能一键转成 PPT。
插件实战速览:以 HyperFrames 为例
插件到底怎么把"非开发任务"变成一句话?以 HyperFrames 为例:它属于"视频创意"类插件,用 HTML / CSS / JS 就能生成动画视频(同类还有用 React 的 Remotion)。你只要把一本书或一段内容丢给它,它就会自动调用该插件生成视频,并在完成后返回本地文件地址,点击即可查看。
本质上它是先生成若干张 JPEG 图片,再把图片组装成视频。首稿通常不完美,需要你沿"画面表现 / 具体效果 / 每页文案配色背景"等方向多次迭代;最实用的技巧:把一段你心仪的目标视频发给它,让它照着模仿,成品更贴需求。
完整步骤、提示词与迭代技巧见 P05 · R1-4 HyperFrames 案例。GitHub / Figma / Notion 插件的同类实战分别见 P05 的 R3(GitHub)/ R2(Figma、Notion)。
高价值插件实战 · GitHub / Figma / Notion
三个插件都在桌面 App 左侧「插件和技能」里搜索名称一键安装;装好后首次使用会引导你授权对应的第三方账号。授权范围越小越好——能用只读就别开写。
① GitHub 插件 · 让 Codex 直接在你的仓库里干活
授权后 Codex 能读 Issue、列 PR、做 Code Review,甚至按 Issue 直接开分支改代码,把"需求 → 代码 → PR"一条龙交给它。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 修 Issue | 帮我把 GitHub 上这个 issue #123 修掉,跑通测试后开一个 PR | 需写权限;先在分支验证 |
| Code Review | review 一下我刚开的 PR #456,重点看边界情况和安全 | 只读即可 |
| 写周报 | 把这周我仓库里的 merged PR 按功能归类,写一段周报 | 只读即可 |
更多 GitHub 实战(DKFile、远程修 Bug、GitHub Actions)见 P05 · R3。
② Figma 插件 · 设计稿直接变前端代码
连接 Figma 后,Codex 能读取画板、提取设计变量(颜色 / 字号 / 间距)并生成可运行的前端组件,最适合"照着设计图写页面"。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 实现组件 | 按这个 Figma 链接,把"登录卡片"实现成 React + Tailwind,严格还原间距和圆角 | 只读即可 |
| 对齐规范 | 读取我设计系统的主色和字体,检查当前页面哪里没遵守 | 只读即可 |
完整 Figma 案例见 P05 · R2。
③ Notion 插件 · 把文档库变成可操作的工作台
授权后 Codex 能读写 Notion 页面与数据库,可自动整理会议纪要、生成周报、把对话结论回填到知识库。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 生成周报 | 读取我 Notion 的"周会纪要"数据库,生成本周进展摘要并写入"周报"页 | 需写权限;限定到具体库 |
| 知识沉淀 | 把我们刚才讨论的接入方案,整理成一篇文档存进 Notion 的"技术方案"库 | 需写权限 |
完整 Notion 案例见 P05 · R2。
| 等级 | 典型插件 | 风险点 | 授权原则 |
|---|---|---|---|
| ① 低 | HyperFrames、本地图片生成、只读 Figma | 基本不出本地,最多生成文件 | 可放心开 |
| ② 中 | 只读 GitHub、Figma 提取变量 | 只读第三方数据,泄漏面小 | 默认给只读 |
| ③ 高 | GitHub 写 PR、Notion 写库、邮件草拟 | 会以你身份改内容 / 发消息 | 限定仓库 / 页面,开审批 |
| ④ 极高 | 支付 / 合同 / 可删库类、跨多系统编排 | 不可逆,涉及钱或生产环境 | 每步人工确认,禁用全自动 |
① 最小范围:只授权要用到的仓库 / 页面,别给"全部资料";② 默认只读:能用只读完成的绝不开写;③ 关键动作人工确认:高 / 极高级插件把审批策略设为 on-request 或 never,让每次敏感操作都过你这一关。
插件实战库 · 10 个高价值插件(可直接照做)
以下 10 个都是"装好授权就能一句话驱动真实软件"的高价值插件。标注「✓ 官方 90+ 名单」的说明它来自 2026 年官方那批插件(Atlassian Rovo / CircleCI / Neon 等);其余为生态中常见的高价值类型,具体名称与是否在你的商店里,以应用内「插件和技能」搜索结果为准。每个都给了可直接丢给 Codex 的提示词。
连接 Slack 工作区后,Codex 能读频道历史、总结讨论、起草回复,甚至按对话里冒出的需求直接建任务。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 总结讨论 | 把 #产品-评审 频道今天的内容总结成 5 条结论和待办 | 只读即可 |
| 起草回复 | 针对 @我 的那条需求,草拟一段回复,语气专业简洁,我确认后再发 | 发消息需确认 |
授权后 Codex 能读邮件、总结未读、草拟回复、按邮件内容建任务或写文档。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 清理收件箱 | 总结我本周未读邮件,按"需要回复 / 仅需知悉 / 可忽略"分类 | 只读即可 |
| 起草并发送 | 给供应商老王写一封确认交期的邮件,草拟后等我确认再发 | 发送需确认 |
连接 Jira 后,Codex 能读需求、按 ticket 开分支改代码、更新状态,把"需求 → 代码"打通。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 认领并开发 | 把 Jira 上 PROJ-123 这个需求实现掉,开一个分支并写测试 | 需写权限,限定项目 |
| 状态流转 | 把我刚合并的 PR 对应的 Jira 工单状态改为 Done | 需写权限 |
授权后 Codex 能读 Drive 里的文档、把产出直接写成 Google Doc,省去复制粘贴。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 落盘文档 | 把我们刚讨论的方案整理成一篇 Google Doc,存进"技术方案"文件夹 | 需写权限,限定文件夹 |
| 读后总结 | 读我 Drive 里"竞品调研"这份文档,提炼 10 个要点 | 只读即可 |
Neon 是无服务器 Postgres。授权后 Codex 能连库、写并运行 SQL、做数据查询和表迁移。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 查数据 | 连我的 Neon 库,统计上周新增用户数,按渠道分组 | 只读查询即可 |
| 做迁移 | 给 users 表加一个 last_login 字段,生成迁移 SQL 并先在分支跑 | 写库需确认 |
Supabase 是开源 BaaS。授权后 Codex 能建表、写 RLS 安全策略、生成 API 和 Edge Function。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 建数据模型 | 给"待办"功能设计 Supabase 表结构 + RLS 策略,保证只有本人能看自己的数据 | 写库 + 安全,需确认 |
| 生成接口 | 基于刚建的表生成 CRUD 的 Edge Function | 需写权限 |
Stripe 插件能查账单、订阅、对账。涉及资金与不可逆操作,必须设 never 全自动禁用。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 对账 | 列出上月所有退款,按原因汇总成表格 | 只读即可 |
| 排查 | 这个 customer 为什么被重复扣费?只分析,不要做任何改动 | 只读,禁写 |
Rovo 能跨 Jira、Confluence、Drive 等做企业级语义搜索与问答,让 Codex 站在公司知识上回答。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 找资料 | 我们公司关于"onboarding 流程"的规范在哪?引用来源链接 | 只读即可 |
| 跨工具问答 | 上季度客户投诉最多的功能是什么?综合 Jira 和工单回答 | 只读即可 |
CircleCI 插件能看构建状态、读失败日志、重跑流水线,甚至按失败原因改代码再提 PR。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 救火 | 看下刚失败的 CircleCI 流水线,定位原因并修掉,开 PR | 重跑 + 写需确认 |
| 看状态 | 我们主分支最近的构建成功率怎么样 | 只读即可 |
授权后 Codex 能读你的 Zap、按自然语言改触发条件和动作,把跨应用重复流程自动化。
| 场景 | 直接给 Codex 的提示词 | 权限提醒 |
|---|---|---|
| 改流程 | 把"新邮件带附件 → 存 Drive → 发 Slack 通知"这个 Zap 加上"转 PDF"一步 | 改自动化需确认 |
| 新建 | 做一个 Zap:表单提交后自动建 Notion 页 | 需写权限 |
03Skill:把稳定流程沉淀成能力
Skill 就是给 Codex 准备的一套"固定工作方法"。它本身会读代码、改代码、运行命令;但如果你经常让它做同一类任务(写 README、做代码 Review、生成网页、整理文档),就可以把这套流程做成 Skill,以后一句话触发,不用每次重新解释规则。
Skill 由什么组成
| 概念 | 简单来说 |
|---|---|
| Skill | 一套固定工作方法 |
| Prompt | 这一次任务的提示词 |
| Workflow | 做事流程 |
| Template | 固定模板 |
| Instruction | 给 Codex 的长期规则 |
| Resource | Skill 里附带的参考资料 |
| Script | Skill 里可选的自动化脚本 |
Skill 和普通提示词有什么区别
| 对比维度 | 普通提示词 | Skill |
|---|---|---|
| 使用方式 | 每次手动输入 | 保存成固定能力,一句话触发 |
| 稳定性 | 容易漏要求 | 更稳定 |
| 适合场景 | 临时任务 | 重复任务 |
| 复用性 | 低 | 高 |
| 内容结构 | 一段提示词 | 指令、模板、资料、脚本 |
| 适合谁 | 所有人 | 经常重复做同类任务的人 |
只做一次的任务 = 直接写提示词;经常重复做的任务 = 适合做 Skill。
Skill 适合什么时候用
| 情况 | 是否适合做 Skill |
|---|---|
| 同一类任务经常重复做 | 适合 |
| 每次都要写一堆规则 | 适合 |
| 想让 Codex 输出更稳定 | 适合 |
| 团队里多人要用同一套流程 | 适合 |
| 一次性小任务 | 不一定需要 |
| 临时改一句文案 / 只是问一个概念 | 不需要 |
一个 Skill 通常包含什么
| 内容 | 作用 |
|---|---|
| instructions | 告诉 Codex 怎么做 |
| resources | 放参考资料、模板、标准 |
| scripts | 可选脚本,用来自动处理任务 |
| examples | 示例输入和示例输出 |
| checklist | 检查清单,防止漏步骤 |
一个最简单的 SKILL.md
# README 生成 Skill
## 适用场景
这个 Skill 适合用来为项目自动生成 README。
## 工作目标
Codex 最终交付一份结构完整、命令可用的 README.md。
## 工作流程
1. 阅读项目结构
2. 判断项目类型
3. 生成安装、启动、使用说明
4. 不编造不存在的命令,不确定的信息要标注
## 输出格式
使用 Markdown 格式。
## 注意事项
不要编造不存在的功能;不确定的地方要明确标注。三种添加 Skill 的方式
| 方式 | 适合谁 | 简单来说 | 推荐程度 |
|---|---|---|---|
| 使用已有 Skill | 刚入门用户 | 直接调用现成技能 | 推荐 |
| 用 $skill-creator 创建 | 想把提示词变成 Skill 的人 | 让 Codex 帮你整理 Skill | 最推荐 |
| 手动创建 SKILL.md | 熟悉文件结构的人 | 自己写 Skill 文件 | 进阶 |
方式一:使用已有 Skill
进入项目目录启动 codex 后,输入 /skills 打开列表;也可以直接输入 $ 快速选择,或在任务里点名使用:
| 用法 | 示例 | 适合场景 |
|---|---|---|
/skills | 打开 Skill 列表 | 不知道有哪些 Skill 时 |
输入 $ | 快速选择 Skill | 想快速调用时 |
$skill-name | $readme-skill | 明确知道 Skill 名称时 |
| 自然语言描述 | 请用手 README Skill 写项目说明 | 不确定具体名称时 |
方式二:用 $skill-creator 创建(最推荐)
$skill-creator 相当于一个 Skill 创建助手,会问你几个问题,把一套重复流程整理成 Skill 文件。
| 步骤 | 操作 | 目的 |
|---|---|---|
| 1 | 进入项目目录 | 确保 Skill 生成在正确项目里 |
| 2 | 运行 codex | 打开 Codex CLI |
| 3 | 输入 $skill-creator | 启动 Skill 创建助手 |
| 4 | 描述 Skill 用途 | 告诉它要做什么 |
| 5 | 补充触发场景 | 告诉它什么时候用 |
| 6 | 补充工作流程 | 固定 Codex 的执行步骤 |
| 7 | 补充输出格式 | 保证结果稳定 |
| 8 | 检查生成结果 | 确认 SKILL.md 是否合理 |
| 9 | 重新打开或继续使用 | 测试 Skill 是否生效 |
它会问你的关键问题:这个 Skill 是做什么的(明确用途)、什么时候触发(适用场景)、要不要包含脚本(是否指令型)、输出格式是什么(保证稳定)、有哪些限制(避免乱改乱编)。
$skill-creator 请帮我创建一个 README Skill。 作用:根据当前项目自动生成适合小白阅读的 README。 触发场景:当我说"生成 README""写项目说明""整理项目文档" "写安装教程"时使用。 工作流程: 1. 先阅读项目结构 2. 查看 package.json、README、入口文件 3. 判断项目类型 4. 生成项目简介 5. 写安装步骤 6. 写启动命令 7. 说明主要文件夹作用 8. 补充常见问题 9. 不确定的地方不要编造 输出格式:使用 Markdown,必须包含:项目简介、功能特点、安装步骤、 启动命令、文件结构、常见问题、后续优化方向。 注意事项:不要编造不存在的功能;不要读取或输出 API Key、密码、 token、私钥。
方式三:手动创建 SKILL.md 文件
Skill 本质上是一个文件夹,里面必须有一个 SKILL.md。最简结构:
.agents
└── skills
└── readme-skill
└── SKILL.md也可以放脚本、参考资料和资源文件:
.agents
└── skills
└── readme-skill
├── SKILL.md
├── scripts
├── references
└── assets| 文件 / 文件夹 | 是否必须 | 作用 |
|---|---|---|
| SKILL.md | 必须 | 写 Skill 的名称、描述和具体指令 |
| scripts/ | 可选 | 放可执行脚本 |
| references/ | 可选 | 放参考文档、标准、说明 |
| assets/ | 可选 | 放模板、图片、资源文件 |
带 frontmatter 的最简 SKILL.md(description 写清楚,Codex 才能自动判断何时调用):
--- name: readme-skill description: 当用户需要生成 README、项目说明、安装教程、启动步骤时使用。 --- 你是一个 README 文档生成助手。 任务:根据当前项目生成一份适合新手阅读的 README。 工作流程: 1. 阅读项目结构 2. 查看 package.json、README、入口文件 3. 判断项目类型 4. 生成项目介绍 5. 写安装步骤 6. 写启动命令 7. 说明文件结构 8. 补充常见问题 9. 不确定的地方不要编造 输出格式:使用 Markdown,必须包含:项目简介、功能特点、安装步骤、 启动命令、文件结构、常见问题、后续优化方向。
推荐写清楚:"当用户需要生成 README、项目说明、安装教程、启动步骤时使用。" 不要写得太模糊,比如 "帮我写东西"——这样 Codex 不知道什么时候该调用它。
Skill 放在哪里更合适
| 放置位置 | 适合场景 | 简单来说 |
|---|---|---|
| 项目里的 .agents/skills | 只给当前项目用 | 项目专属 Skill |
| 用户级 Skill 目录 | 自己多个项目都想用 | 个人通用 Skill |
| 团队 / 管理员配置 | 团队成员统一使用 | 团队共享 Skill |
| 插件里 | 想打包分发给别人安装 | 正式能力包 |
推荐安装的社区 Skill
| Skill / 项目 | 主要作用 | GitHub 地址 |
|---|---|---|
| Superpowers | 给 Coding Agent 加一整套软件开发方法论:先澄清需求、写规格、做实现计划,再按 TDD / 任务拆分推进开发 | github.com/obra/superpowers |
| skill-creator | 创建 Skill 的辅助 Skill(Codex 内置或可用,以当前环境显示为准) | 以当前 Codex Skill 列表为准 |
| baoyu-skills | 宝玉整理的一组实用 Skills,偏内容创作和日常效率:小红书图文、文章配图、漫画、公众号发布等 | github.com/JimLiu/baoyu-skills |
| Agent Reach | 给 Agent 装"联网能力":读网页、YouTube、RSS、GitHub、X、B站、小红书等 | github.com/Panniantong/Agent-Reach |
| find-skills | "找 Skill 的 Skill",帮你搜索、发现、安装 Agent Skills | github.com/vercel-labs/skills |
新手必装的 9 个 Skill(社区高频清单)
很多新手"裸装" Codex 后觉得不好用,其实差的就是几个常用 Skill。下面 9 个是社区里出现频率最高、覆盖写作 / 设计 / 科研 / 数据的"即装即用"清单,按场景挑着装即可:
| # | Skill | 解决什么 | 典型场景 |
|---|---|---|---|
| 1 | humanizer | 去除 AI 生成痕迹,文字更像真人写 | 社媒文案、邮件润色、文章改写 |
| 2 | claude-design | 一句话生成 UI 界面原型 | App 界面、网页、原型制作 |
| 3 | research-paper-writing | 自动检索文献 + 生成论文框架 | 学术论文、研究报告、文献综述 |
| 4 | arxiv | 自动追踪 arXiv 最新论文 | 文献阅读、研究方向追踪 |
| 5 | jupyter-live-kernel | 对话里直接跑 Python | 数据分析、机器学习、科学计算 |
| 6 | writing-plans | 梳理选题大纲,规划写作 | 内容创作、选题规划 |
| 7 | powerpoint | 一键生成演示文稿 | 工作汇报、方案提案 |
| 8 | popular-web | 审美灵感库,规范网页设计 | 网页设计、UI 审美提升 |
| 9 | ideation | 选题灵感,破解创意枯竭 | 选题、头脑风暴 |
在 Codex 里输入 /skills 或 $ 打开列表搜索安装;也可通过 $skill-creator 把自己常用的流程沉淀成专属 Skill。装完重新开一个 thread 再使用。
04MCP:连接外部工具的接口
MCP(Model Context Protocol)让 Codex 连接外部工具与数据源,把公司系统、数据库、第三方 API 接进工程流,扩展它的工作边界。可以理解为:
Codex = 一个会干活的人;MCP = 给他接上不同工具的插座;MCP Server = 插在插座上的工具箱;Tool = 工具箱里的具体工具。
核心概念
| 概念 | 简单来说 |
|---|---|
| MCP | 连接外部工具的标准接口 |
| MCP Server | 提供工具能力的服务 |
| Tool | Codex 可以调用的具体功能 |
| Config | MCP 的配置文件 |
| STDIO Server | 通过本地命令启动的 MCP 服务 |
| HTTP Server | 通过网址连接的 MCP 服务 |
| Context | 外部工具提供给 Codex 的上下文信息 |
MCP 适合做什么
| 场景 | MCP 可以怎么用 |
|---|---|
| 查开发文档 | 连接文档 MCP,让 Codex 查新版本 API |
| 连接数据库 | 让 Codex 查询数据库结构或测试数据 |
| 连接设计工具 | 让 Codex 读取设计稿、组件信息 |
| 连接项目管理工具 | 读取 issue、任务、需求说明 |
| 连接内部系统 | 调用公司内部工具或数据源 |
| 连接知识库 | 让 Codex 根据团队文档工作 |
普通写代码,不一定需要 MCP;需要 Codex 访问外部工具或外部数据时,才考虑 MCP。用 MCP 同样遵循最小授权原则:只连需要的服务。iOS 上还支持按任务或跨任务的 MCP 审批选择。
常见 MCP Server 类型
| MCP Server 类型 | 能提供什么 |
|---|---|
| 文档 MCP | 查询开发文档、API 文档 |
| 数据库 MCP | 查询表结构、读取测试数据 |
| GitHub MCP | 读取 issue、PR、仓库信息 |
| Figma MCP | 读取设计稿信息 |
| Notion MCP | 读取知识库页面 |
| 浏览器 MCP | 访问网页、获取页面信息 |
| 内部工具 MCP | 连接公司自己的系统 |
在 Codex App 里使用 MCP
| 步骤 | 操作 | 简单来说 |
|---|---|---|
| 1 | 打开 Codex App | 进入桌面版 Codex |
| 2 | 进入 Settings | 打开设置 |
| 3 | 找到 MCP servers | 进入 MCP 工具管理区 |
| 4 | 查看 recommended servers | 看官方或系统推荐的 MCP |
| 5 | 添加 custom server | 添加自己的 MCP server |
| 6 | 按提示完成授权 | 有些 MCP 需要登录外部账号 |
| 7 | 回到项目 thread | 在任务里调用 MCP |
| 8 | 查看结果和权限请求 | 确认 Codex 调用了什么工具 |
添加 MCP 时通常需要填:Name(名字)、Command / URL(启动命令或服务地址)、Type(本地命令型或远程 HTTP 型)、Env(放 token、配置项)、Auth(是否需要登录)、Enabled tools(只打开需要的功能)。
添加完回到 thread,直接描述任务即可,例如:
请使用可用的 MCP 文档工具,查询 Next.js App Router 的最新用法, 然后告诉我当前项目应该怎么修改。
在 Codex CLI 里使用 MCP
| 步骤 | 操作 | 简单来说 |
|---|---|---|
| 1 | 打开终端 | PowerShell / Terminal |
| 2 | 进入项目目录 | 让 Codex 知道当前项目 |
| 3 | 添加 MCP server | 给 Codex 接入外部工具 |
| 4 | 检查是否添加成功 | 确认工具已可用 |
| 5 | 启动 Codex CLI | 进入 Codex 对话界面 |
| 6 | 用 /mcp 查看工具 | 看当前能调用哪些 MCP |
| 7 | 在任务里调用 MCP | 让 Codex 使用外部工具 |
| 8 | 查看结果和权限提示 | 确认是否安全 |
常用 MCP 终端命令
| 命令 | 作用 |
|---|---|
codex mcp --help | 查看 MCP 命令帮助 |
codex mcp list | 查看已配置 MCP server |
codex mcp add | 添加 MCP server |
codex mcp remove | 删除 MCP server |
codex mcp get | 查看某个 MCP server 详情 |
codex mcp login | 登录需要授权的 MCP |
codex mcp logout | 退出某个 MCP 授权 |
/mcp | 在会话里查看 MCP 工具 |
添加 MCP 的基本格式与示例
# 基本格式:codex mcp add 名称 -- 启动命令
codex mcp add context7 -- npx -y @upstash/context7-mcp这条命令的意思是:给 Codex 添加一个叫 context7 的 MCP,它通过 npx 启动 @upstash/context7-mcp 这个工具。添加后运行 codex mcp list 确认已写入;进入项目目录启动 codex 后输入 /mcp 查看当前会话可用的工具。
可能原因:① codex mcp add 命令失败(没添加成功);② 依赖没装或命令错误(启动失败);③ 调用时写错 server 名;④ 还没登录外部服务(需要授权);⑤ 配置没刷新(重启 Codex CLI)。
MCP 配置文件在哪里
Codex 的 MCP 配置会写进 ~/.codex/config.toml,里面会有类似这样的配置:
[mcp_servers.context7] command = "npx" args = ["-y", "@upstash/context7-mcp"]
如果你不熟悉配置文件,前期不要手动乱改,优先使用 codex mcp add / list / remove 这些命令。
远程 MCP 与清理
有些 MCP 不是本地命令启动,而是通过网址连接(远程 / HTTP MCP),可能需要 URL、Auth、Token、OAuth。需要登录时用 codex mcp login MCP名称,不用了用 codex mcp logout MCP名称。删除某个 MCP:
codex mcp remove context7
codex mcp list # 确认已不在列表先用不需要复杂授权的文档类 MCP(如 context7)练手,后面再尝试需要登录的远程 MCP。
05插件 / Skill / MCP 三者关系速记与选型
插件、Skill、MCP 是本篇最容易混淆的三个概念。它们不是互相替代,而是各管一层。下面这张总表请先记住,前几节已经分别展开,这里做一次合订。
| 对比 | 插件 Plugin | Skill | MCP |
|---|---|---|---|
| 一句话 | 能力安装包 | 一套固定工作方法 | 连接外部工具的接口 |
| 解决什么问题 | 安装、打包、分发能力 | 同类任务"怎么做" | "连接什么工具或数据" |
| 范围 | 最大,可打包 Skill、MCP 等 | 较小,单类任务的流程 | 单个外部工具或数据源的连接 |
| 类比 | 工具箱 | 工具箱里的说明书 | 给工具箱接电的插座 |
| 谁来用 | 普通用户也能一键安装 | 普通用户也能用 | 更偏开发者和团队配置 |
| 举例 | GitHub 插件、Figma 插件 | README Skill、代码 Review Skill | 数据库 MCP、文档 MCP |
插件可以把 Skill 和 MCP 打包成更容易安装的能力包;Skill 管"怎么做",MCP 管"连什么工具"。
选型决策:到底用哪个
| 你的需求 | 用 Skill 还是 MCP |
|---|---|
| 写 README、固定文档输出格式 | Skill |
| 做代码 Review、UI Review | Skill |
| 生成落地页、把修 bug 流程标准化 | Skill |
| 查最新开发文档、新版本 API | MCP |
| 连接数据库 | MCP |
| 读取 Figma 设计稿 | MCP |
| 读取 GitHub issue / PR | MCP |
| 连接 Notion、内部知识库、公司内部工具 | MCP |
06代码管理:Git 与 GitHub
用 Codex 做真实项目时,一定要懂一点 Git 和 GitHub。一句话:Git 负责记录代码变化,GitHub 负责远程保存和协作,Codex 负责帮你完成具体编程任务。
Git 与 GitHub 的区别
| 对比 | Git | GitHub |
|---|---|---|
| 简单来说 | 本地版本管理工具 | 代码云盘 + 协作平台 |
| 主要作用 | 记录代码每次改了什么 | 远程保存代码、团队协作 |
| 使用位置 | 你的电脑里 | 浏览器 / 云端 |
| 核心能力 | commit、branch、diff、merge | repository、issue、pull request |
| 是否必须联网 | 不需要 | 需要 |
小白必须先懂的 Git 概念
| 概念 | 简单来说 | 作用 |
|---|---|---|
| Repository | 一个代码仓库 | 存放整个项目 |
| Commit | 一次代码存档 | 记录这次改了什么 |
| Branch | 分支 | 在不影响主线的情况下改代码 |
| Diff | 改动对比 | 看新增、删除、修改了什么 |
| Stage | 暂存区 | 准备把哪些改动保存进 commit |
| Merge | 合并 | 把一个分支的改动合到另一个分支 |
| Conflict | 冲突 | 两边改了同一处代码,需手动选择 |
| Push | 推送 | 把本地代码上传到 GitHub |
| Pull | 拉取 | 把 GitHub 上的新代码同步到本地 |
| Clone | 克隆 | 从 GitHub 下载一个项目到本地 |
小白必须先懂的 GitHub 概念
| 概念 | 简单来说 | 作用 |
|---|---|---|
| Repository | GitHub 上的项目仓库 | 存代码 |
| Issue | 问题 / 需求记录 | 记录 bug、需求、任务 |
| Pull Request / PR | 代码合并申请 | 改完代码后申请合并 |
| Main Branch | 主分支 | 项目的稳定版本 |
| Feature Branch | 功能分支 | 用来开发新功能 |
| Review | 代码检查 | 合并前检查代码 |
| Actions | 自动化流程 | 自动测试、构建、部署 |
| README | 项目说明书 | 告诉别人项目怎么用 |
| .gitignore | 忽略文件清单 | 防止上传无关或敏感文件 |
为什么用 Codex 更需要 Git
| 场景 | 为什么需要 Git |
|---|---|
| Codex 改了很多代码 | 可以查看具体改了哪里 |
| Codex 改错了 | 可以回退到之前版本 |
| Codex 删除了不该删的内容 | 可以用 Git 找回 |
| 多次让 Codex 修改 | 每次 commit 保存一个阶段 |
| 想让 Codex 大胆试方案 | 用 branch 或 worktree 隔离风险 |
| 要把项目放到 GitHub | 需要 push 到远程仓库 |
| 团队协作 | 需要 PR、review、merge |
没有 Git,Codex 改错了你很难回退;有了 Git,Codex 可以放心试,你可以随时检查和恢复。
在 Codex 中使用 Git 的 10 步
- 初始化 Git(让项目开始被 Git 管理);
- 写好
.gitignore(防止上传垃圾文件和密钥); - 先 commit 一次(保存干净版本);
- 新建分支(给 Codex 一个安全实验区);
- 让 Codex 修改代码(完成具体任务);
- 查看 diff(检查 Codex 改了什么);
- 运行项目 / 构建(确认没出错);
- 满意后 commit(保存这次修改);
- push 到 GitHub(上传远程仓库);
- 创建 PR(合并前再检查一次)。
你可以直接在 Codex 对话框里输入:把项目初始化成一个 Git 工程,并排除不需要的文件,Codex 会帮你直接写好 .gitignore。
标准上传 GitHub 流程
- 在 GitHub 新建仓库(创建一个远程项目空间);
- 复制仓库地址(后面要连接本地项目);
- 将地址复制给 Codex(让 Codex 知道要上传到哪个仓库);
- 推送到 GitHub(正式上传代码)。
代码回滚
先让 Codex 修改代码 → 提交到 Git 保存好当前版本 → 继续修改 → 打开 IDE 查看代码、复制版本号 → 把版本号复制给 Codex,让它回退代码到指定版本。这样即使改坏了也能随时回到干净状态。
Git Worktree:给项目开一个独立副本
普通 Git 分支虽然可以切换,但每次只能在一个文件夹里操作一个分支。Worktree 相当于一个草稿本:给同一个 Git 项目额外开一个独立工作副本,效果满意后再合并回正式项目。
| 场景 | Worktree 的作用 |
|---|---|
| 想让 Codex 大胆改代码 | 给它单独开一个副本 |
| 不想影响当前项目 | 主项目保持不动 |
| 想同时做多个任务 | 每个任务一个 worktree |
| 想比较多个方案 | 方案 A / B / C 分开放 |
| 改坏了不想要 | 直接丢掉 worktree |
| 做大改动 / 重构 | 降低污染主项目的风险 |
使用流程:创建 Worktree → 使用分支进行任务 → 检查效果满意后,合并回主干并删除该分支。
不要随便授权不信任的账号或组织;只授权需要的仓库;不要让 Codex 自动合并 PR;PR 一定看 diff,看不懂不合并,满意后再 merge;不要把 .env、API Key、密码、token 写进任务或提交到仓库。
07云端运行
云端运行本质上是把任务放到云端环境执行,不占用本地电脑。把代码任务交给 Codex,让它在云端环境里自己跑——适合你不在电脑前、长时间、批量的任务。
| 模式 | 运行位置 | 简单来说 |
|---|---|---|
| Local | 你的电脑本地项目 | Codex 直接改你电脑里的代码 |
| Worktree | 你的电脑本地副本 | Codex 在安全副本里改代码 |
| Cloud | OpenAI 云端环境 | Codex 在云端拉取 GitHub 仓库并处理任务 |
云端运行是什么
| 内容 | 说明 |
|---|---|
| 运行环境 | 云端容器 |
| 代码来源 | GitHub 仓库 |
| 工作方式 | Codex 在云端读取、修改、运行、验证代码 |
| 最终结果 | 生成修改结果、diff,必要时创建 PR |
| 适合任务 | 修 bug、改功能、写文档、代码 review、处理 issue |
| 不适合任务 | 本地私密文件、没上传 GitHub 的项目、高风险生产操作 |
云端 vs 本地
| 对比 | 本地运行 Local / Worktree | 云端运行 Cloud |
|---|---|---|
| 代码位置 | 你电脑里 | GitHub 仓库 |
| 运行位置 | 你的电脑 | 云端容器 |
| 是否占用电脑 | 会占用 | 基本不占用 |
| 是否需要 GitHub | 不一定 | 通常需要 |
| 是否适合后台任务 | 一般 | 很适合 |
| 是否适合并行任务 | 一般 | 很适合 |
任务与其 Git 状态可在本地电脑与已连接的远程主机之间接力:Codex 在目标端创建或复用 worktree、转移任务,从匹配的项目继续跑。换台机器也能无缝续上。Codex Web 与 Codex Cloud 可以理解为:Web 是你在网页上操作的界面,Cloud 是背后帮你跑任务的云端能力。
08记忆系统:AGENTS.md
AGENTS.md 是写给 Codex 看的项目 / 全局规则文件,是它的"长期记忆"和上下文基础设施。分两级:
| 级别 | 放置位置 | 作用范围 |
|---|---|---|
| 项目级 | 项目根目录 | 只对当前项目生效:技术栈、风格、禁止事项 |
| 全局级 | 设置 → 个性化 | 跨项目生效:通用安全规则、命令偏好 |
# AGENTS.md ## 项目说明 一个宠物零食品牌官网。 ## 技术栈 - React - Vite ## 风格约定 - 按钮、卡片、标题、留白要统一 - 移动端要基本可用 ## 禁止事项 - 不要删除已有核心功能 - 不要随意新增大型依赖 - 不要直接改动和当前任务无关的文件
在设置的个性化里,可写"禁止批量删除文件或目录,不要使用 del /s、rd /s"这类跨项目安全规则,防止 Codex 顺手删掉它觉得"没用"的东西。AGENTS.md 写得越清楚,Codex 越不容易"自由发挥"出你不要的改动。
一份可直接照抄的完整模板
# AGENTS.md ## 项目概览 - 项目类型: - 主要语言: - 关键目录: - 不要修改的目录: ## 常用命令 - 安装依赖: - 本地开发: - 运行测试: - 类型检查: - 格式化: ## 代码规范 - 遵循现有代码风格。 - 不做无关重构。 - 新增功能必须补充或更新测试。 ## 安全边界 - 不读取或提交 .env、密钥和私有凭据。 - 不执行删除生产数据的命令。 - 修改数据库迁移前先说明影响。 ## 交付要求 - 说明改动文件。 - 说明验证命令和结果。 - 说明未验证项和剩余风险。
放在哪里、怎么被读取
| 级别 | 位置 | 作用域 |
|---|---|---|
| 项目级 | 仓库根目录 AGENTS.md | 处理任务前自动读取 |
| 全局级 | ~/.codex/AGENTS.md | 跨项目生效 |
① 文件名必须大写 AGENTS.md,大小写错 Codex 不识别;② 合并到上下文的内容有大小上限(约 32 KiB),尽量精简,过长部分可能不进上下文。
读取顺序:先读全局,再从 Git 根目录逐层走到当前目录,每层尝试读取;同目录里 AGENTS.override.md 优先于 AGENTS.md;越靠近当前目录越具体。
三个相关文件怎么分工
| 文件 | 作用 | 是否提交 Git |
|---|---|---|
AGENTS.md | 团队共享规则、命令、边界、交付要求 | 可以提交 |
AGENTS.override.md | 临时覆盖同目录规则 | 通常不提交 |
AGENTS.local.md | 个人本地偏好、私有路径、临时规则 | 应加入 .gitignore |
写「运行测试:pnpm test」比「记得自己检查一遍代码」有用得多;确保不与其他规范文档冲突;勤于更新命令与时俱进;AGENTS.md 还能承担"导航"作用——告诉 Codex 文档阅读目录清单,而不是把整篇文档塞进 AGENTS.md。
08·b沙盒与审批:Codex 的安全护栏
Codex 能读文件、改文件、跑命令,所以必须有一套"围栏"。三个核心概念可以这样类比:
| 概念 | 类比 | 你要决定什么 |
|---|---|---|
| 沙盒 Sandbox | 实验室的墙和门禁:能碰哪些设备、能否连外网、能否写项目外文件夹 | 运行边界 |
| 审批策略 Approval Policy | 门禁触发规则:每次请求确认 / 越界才确认 / 完全不请求 | 触发条件 |
| 审批人 Reviewer | 谁来回答门禁:你自己,还是 Auto-Review 智能门禁 | 谁来放行 |
有 Git 版本控制的目录:Auto = workspace-write + on-request;没有 Git 的目录:read-only。日常开发最常用组合:沙盒 = 工作区写入,批准 = 按请求。
沙盒三模式
| 模式 | 范围 | 审批触发 |
|---|---|---|
| 只读 read-only | 主要读文件、回答问题;命令也受只读边界 | 改文件 / 联网时触发 |
| 工作区写入 workspace-write | 项目内读、写、运行常规命令 | 联网或写项目外时触发 |
| 完全访问 danger-full-access | 无沙盒限制,可访问任何位置 | 取决于审批策略 |
--dangerously-bypass-approvals-and-sandbox(别名 --yolo)即完全访问模式。即使在「工作区」模式,.git / .agents / .codex 目录默认只读保护。
审批策略四档
| 策略 | 触发条件 | 说明 |
|---|---|---|
| untrusted | 命令不属于已知安全读操作 | 只自动执行已知安全读,其余需确认 |
| on-failure | 命令执行失败时 | 先尝试,失败再请求确认 |
| on-request | 操作越过沙盒边界 | 默认推荐:沙盒内自动,越界时问你 |
| never | 不触发 | Codex 在既有权限内自行处理 |
never 不等于"自动变安全":read-only + never 安全,但 danger-full-access + never 是官方标注的高风险组合。新手用 on-request 最稳。
开启 Auto-Review(智能门禁)
default_permissions = ":workspace" approval_policy = "on-request" approvals_reviewer = "auto_review"
沙盒内操作不经过 Auto-Review;越界请求先交 reviewer agent 判断,有风险会被拒绝。
网络权限边界
联网常见用途:npm install / pip install、查资料、调 GitHub API、测本地服务器。风险则包括提示词注入、数据外发(代码 / 密钥 / .env 泄露)、供应链风险。建议:非必要不给网络;优先用受控 web search;联网前让 Codex 说明目标域名与用途;永远不要把 .env / token / cookie / 私钥交给会联网的命令。
动手前先让它说明计划(谨慎提示词)
请在动手前先说明你计划运行的命令和可能影响的文件。不要读取 .env、密钥、 token、cookie 或任何私有凭据。不要执行删除数据、发布、部署或迁移命令, 除非我明确确认。
判断一次操作要不要谨慎,问自己三句:① 有无不可逆副作用?② 是否涉及敏感数据?③ 是否影响项目外?高风险操作(删目录、数据库迁移、改认证 / 支付、访问生产服务器、部署发布)先让 Codex 说明计划再放行。
新人最常误解的权限问题
一个常见误解是:"我只给 Codex 打开了一个项目文件夹,所以它只能看到和改这个文件夹。"这两件事都不完全对。
| 误解 | 实际 |
|---|---|
| "项目文件夹 = 可见范围" | 在 Windows 沙箱下,Codex 拥有接近当前用户的可读能力,C/D/E 盘里你本用户可读的普通文件大多能被列出;项目文件夹只是默认可写范围,不是可见边界。 |
| "把文件移出项目 / 设只读 / 改名'敏感'文件夹"就安全了 | 文件夹名、只读属性都不等于权限隔离;只要仍在当前用户可读范围内,仍可能可见。真正隔离要用独立账户权限、加密或单独虚拟机。 |
| "本地沙箱 = 数据不出域" | 本地沙箱管的是"命令在哪跑、哪些位置能写、网络要不要许可";需要理解内容时,相关内容仍可能被服务处理,要看数据控制设置。 |
| "不开 Full Access 就干不了活" | 普通用户绝大多数办公 / 开发任务都不需要 Full Access;没有明确需求时,能不开就别开。 |
给 Codex 处理文件时,单独建一个工作文件夹,只放任务需要的副本,涉及合同 / 财务 / 隐私照片时额外加系统权限或加密。下面是一次任务前可照着打勾的安全边界检查表:
| 检查项 | 预期 |
|---|---|
| 是否先列出操作计划 | 必须先计划,等待你确认 |
| 是否限定工作目录 | 不访问工作目录外 |
| 是否修改原始文件 | 原始文件保持不变(改副本) |
| 是否访问敏感资料 | 禁止打开或摘要 |
| 是否永久删除文件 | 不允许永久删除 |
| 是否把输出放入指定目录 | 只能写入指定输出目录 |
| 是否留下完整操作日志 | 每一项变化均可追溯 |
08·cVS Code 插件:在编辑器里用 Codex
习惯在编辑器里工作的开发者,可以直接在 VS Code 中安装 Codex 插件(OpenAI 官方的 ChatGPT 插件),把对话与代码辅助嵌进编辑器。
- 打开 VS Code → 左侧「扩展」→ 搜索
Codex→ 选第一个结果 → 点「安装」; - 打开任意项目文件 → 右上角出现 ChatGPT 图标 → 点击展开右侧 Codex 对话窗口;
- 直接输入需求;在对话框输入
@后选择具体文件,可让 Codex 精确定位文件,比全局搜索更快更准(任务目标明确时优先用@)。
| 维度 | 桌面 App | VS Code 插件 |
|---|---|---|
| 适合场景 | 多任务管理、Skills、Automations | 边写代码边调用,贴编辑器 |
| 文件结构可见性 | 需要切换界面 | 直接在编辑器里看修改前后对比 |
| 推荐用户 | 需要并行任务或插件协作 | 日常编码开发者 |
重任务在桌面 App 跑,零散修改在 VS Code 里即时问,项目规则、Skills、AGENTS.md 在两端通用。
08·d移动端协同:手机跟进桌面任务
用手机端 ChatGPT App 可以扫码配对桌面 Codex,在手机上查看 / 管理桌面任务,并可选择性开启 Computer Use。适合桌面无人值守跑任务、你在外出时用手机查看进度。
连接前 6 项准备
| 条件 | 说明 |
|---|---|
| Codex App 最新版 | 检查电脑端更新提示 |
| 电脑端已装并登录 Codex | 能正常使用 |
| 手机装 ChatGPT App | 应用商店下载 |
| 同一 ChatGPT 账号 | 两端登录同一账号,非常重要 |
| 同一网络(同 WiFi) | 前提条件 |
| 电脑联网且保持唤醒 | 勿睡眠 |
手机端需先开启多因素验证:ChatGPT App → 头像 → 安全 → 验证器应用 → 用 Google / Microsoft Authenticator 绑定 6 位动态码。这是连接移动端的必要条件。
连接步骤与授权三开关
- Codex → 左侧「设置 Codex 移动版」→「开始设置」;
- 选「安卓」→ 手机扫码 → 点「我已在桌面端登录」;
- 连接建立后点「授权此设备」;
- 可选开关:保持唤醒(建议开)、Computer Use(可操作电脑应用,敏感、新手先别开)、Chrome 扩展(涉及账号安全、谨慎开)。
账号:必须两端同一 ChatGPT 账号。网络:同 WiFi 是前提,Mac 防火墙可能拦截。授权:Computer Use 可控制你的电脑,不懂勿开;Chrome 扩展在账号 / 支付等敏感页面须格外小心。电脑须保持唤醒联网,否则任务中断、手机看不到项目。
09Sites 与 Annotations(2026 新增)
把想法、分析、计划一句话转成可托管的交互式网页应用:仪表盘、规划器、评审工作区、项目看板、作品集、轻量工具。生成 URL 直接分享给同一 workspace 的人,还能随细节变化持续更新——不再把产出硬塞进文档 / 表格 / PPT。目前面向商业与企业客户开放预览。
圈选需要修改的局部,Codex 只改选中内容、不动其余部分。已从代码扩展到文档、表格、幻灯片。协作从"重新提需求让它改"变成"随手圈一下就调",保留工作流连续性。
此外还有面向调试的 Browser Developer mode(受控访问 Chrome DevTools Protocol,检查网络 / 控制台 / 运行时错误,使用前需你显式批准),以及 /init 一键生成项目说明、迁移导入其他 coding agent 配置等改进。
10演示即生成 Skill:Record & Replay(26.616+)
OpenAI 在桌面端 26.616 起上线了 Record & Replay(录制与回放):你只要在电脑上把一套操作流程手动演示一遍,Codex 就会在后台记录每一步动作与决策节点,自动抽象成一个结构化的、可复用的 Skill。下次遇到同类任务,直接调用这个 Skill,不用再从头描述需求。
| 亮点 | 对你意味着什么 |
|---|---|
| 演示一遍即生成技能 | 打开项目、执行命令、改文件、跑测试……全程录制,零代码、零 YAML |
| 与自动化历史打通 | 生成的 Skill 出现在自动化运行历史,支持批量标记已读 / 归档,沉淀成"验证过的操作流程库" |
| 跨主机线程交接 | 配合 Thread Handoff,本地录制的 Skill 可无缝传给远程主机继续执行 |
目前先在 macOS 可用(部分区域暂未开放),需要提前开启 Computer Use 权限。一句话理解:当"做一遍"等于"写了一个自动化脚本",Codex 正把重复劳动从"写代码指挥 AI"推进到"自己演示一遍"。