刚闲下来,后台就有很多读者催老科尽快出一期初级小白 Codex 教程。
熬夜爆肝两天,今天它来了。
先简单介绍一下每一天大概要学哪些东西。
第一天,让 Codex 读懂你的文件夹。
第二天,拿一份材料做出一篇读后感。
第三天,直接交付一份可以继续编辑的 PPT。
第四天,我们专门拿出一天讲 Skill,看看它为什么能让 Codex 记住一套做事方法。
再往后,我们会一起做小游戏、查问题、改 Bug,最后完成一次真正的综合任务。
你不会写代码也没关系。
这 7 天的目标,也不是把你训练成程序员。
我们只做一件事。
学会把自己的想法交给 Codex,让它读材料、改文件、运行检查,再把一个能用的结果交回来。
每天留出 30 到 90 分钟,跟着案例跑一遍就行。
建议先收藏,每天学习一遍。
Day 1 进入项目
今天只掌握三个词:项目、任务、权限。
这三个词搞清楚以后,
你就知道 Codex 为什么能帮你改文件,什么时候应该让它停下来问你。
首先来介绍项目。
你可以把项目理解为一张长期使用的书桌,书桌上放着材料、半成品、规则和已经做完的文件。
任务则是你今天坐下来要完成的一件事,比如整理读书笔记、做 6 页汇报,或者修复小游戏的计时问题。
一个项目可以有多个任务,但一个任务最好只盯住一个结果。
如果你在同一个任务里连续要求做不同的任务,结果肯定不是你所满意的。
稳妥的做法是把相关材料放在同一项目里,再为不同成果开不同任务。
接着是权限。
Codex 可以读取文件、编辑文件和运行命令,这也是它与普通 AI 聊天回答最明显的差别。
能力越接近真实电脑操作,边界就越重要。
在请求审批模式下,
Codex 通常可以在当前工作区内完成常规操作,越过边界时会停下来请求确认。
安全访问模式会扩大它可以操作的范围,也会放大误删文件、泄露数据和执行意外命令的风险。
刚开始学习时,把练习材料复制到独立文件夹,再使用请求审批模式,已经足够完成本文所有案例。
接下来,我用一个例子来讲解。
我们可以先在桌面或文档目录创建一个文件夹,名字可以叫:
在里面放三份你愿意拿来练习的材料,
比如一篇 PDF、一份课程笔记和一张图片,别放和你有关的隐私信息。
把这个文件夹添加为本地项目后,新建一个任务,发送下面这段话:
请只读取当前项目,不要修改原文件。
先告诉我这里有哪些文件,再按文件名、类型、主要内容、可能用途和是否需要进一步确认整理成一张表。
最后建议我先处理一个文件并说明原因。
这个提示词里有四个关键点。
只读取限制了动作范围。
不要修改原文件保护了材料。
按固定字段整理规定了输出结构。
最后只给一个建议让你不用面对一长串同时开始的任务。
接着,我们看看最后的结果。
合格结果至少应该列出真实存在的文件,不虚构文件名,也不把图片里的猜测写成确定事实。
如果 Codex 只说某个 PDF 主要介绍了某个主题,你可以让它补充页码或原文位置。
如果它读不到文件,先检查项目是否选对,再检查文件是否仍在原路径。
如果它一上来就开始改名或移动文件,你就需要警醒并直接说:
停止修改,恢复到只读检查。
先列出你已经执行的动作和受影响文件,再等待我确认。
完成标准
把帮我整理资料这句话改成下面这样:
整理完成的标准:
1. 列出全部 3 个文件。
2. 每个文件有一句准确摘要。
3. 标出不能确认的内容。
4. 给出一个下一步。
5. 不修改原文件。
你会发现,完成标准越清楚,后面检查结果越容易。
三个卡点
第一个卡点是选错项目,表现为 Codex 一直说找不到文件。
第二个卡点是材料太多,表现为它花很久扫描,却没有先告诉你准备怎么做。
第三个卡点是权限太大,表现为你只是想让它分析,它却顺手重命名或生成了一堆文件。
解决方法都很朴素:缩小文件夹、明确只读、先列计划、写完完成标准再执行。
今日自测
青铜:你能让 Codex 正确列出项目里的文件。
白银:你能要求它标注不确定内容,并给出来源位置。
黄金:你能把一个模糊要求改写成五条可检查的完成标准。
Day 2 提示词工程
今天要学会写提示词,完成一篇 600 字左右的读后感。
提示词不用写得像合同,要让 Codex 知道材料结果等等详细要点。
提示词四要素
1. 为什么要做这件事。
2. 允许它使用哪些材料。
3. 交付物。
4. 验收。
我们在日常编码时经常只做到第三点,
比如,给我写一份请假条等等简单的命令。
Codex 当然可以写,它只能自己猜篇幅、读者、重点和语气。
猜得越多,结果越像一篇没有主人经历的通用作文。
先准备一份 300 到 800 字的学习笔记,
内容可以很乱,最好包含两类信息。
一类是材料中的具体观点或事件,另一类是你自己的反应。
比如哪里赞同、哪里困惑、准备怎么做。
如果暂时没有材料,可以复制下面这份练习笔记:
我读完一篇关于深度工作的文章,记住了两个观点。
第一个观点是,注意力会被频繁切换消耗,每次切回原任务都要重新建立上下文。
第二个观点是,开始工作前先定义一个可见成果,比写一张很长的待办清单更容易进入状态。
我以前学习时会同时打开课程、聊天软件和资料搜索,表面上很忙,真正完成的内容很少。
我准备尝试每天先做一个 25 分钟单元,开始前写下这次要留下的文件,结束时记录下一步。
我仍然不确定的是:遇到临时消息时,完全不回复是否现实。
然后发送:
请根据当前项目中的学习笔记,写一篇 600 字左右的读后感。
读者是正在学习 AI 工具的大学生。
文章要保留笔记里的两个具体观点、我的旧习惯、准备尝试的方法和一个尚未解决的问题。
不要增加我没有经历过的故事,不要虚构书名、作者、研究数据和名人名言。
先写初稿,再附一张自检表,逐项说明四个要求有没有完成。
先查问题
各位读者认真阅读发话就可以发现,
请润色一下这种语句仍然是一个很模糊的要求,Codex 可能会把原本清楚的句子改得更华丽,也可能加入你没有说过的情绪。
更具体的修改方式是:
请做第二轮修改,只处理以下问题:
1. 删除没有信息量的开头。
2. 每段只讲一个意思。
3. 把我学到了很多改成具体变化。
4. 保留最后那个尚未解决的问题。
5. 列出你删除或重写的三处内容及理由。
用到这一步才算你初步理解提示词的相关应用。
检查初稿
先搜索文章里有没有材料中不存在的人名、数字、书名和研究结论。
再检查经历是否仍然来自原始笔记。
最后看文章有没有真的回答提示词中的问题。
如果文章事实没错但读起来很空,可以追问:
请标出全文中只有态度、没有事实或动作的句子。
每句给一个更具体的替换建议,但不要添加新经历。
改写练习
让 Codex 把同一份笔记分别整理成 100 字朋友圈、600 字读后感和 5 分钟分享稿。
你会直观看到,输入材料不变时,交付物和读者会怎样改变结构。
今日自测
青铜:你的提示词写清了输入材料和交付物。
白银:你给文章加上了可检查的完成标准。
黄金:你能指出初稿中的一处虚构、一处空话和一处结构问题,并让 Codex 分别修改。
Day 3 制作 PPT
今天要把一页原始笔记变成 6 页演示文稿,并学会检查文件生成和文件能用之间的差别。
先说结论
一份演示文稿如果同时想讲所有问题,很容易变成六页字墙。
我给练习案例准备了一页一周学习复盘原始笔记,里面有目标、每天完成量、有效做法、遇到的问题和下周计划。
这份 PPT 要说明一个判断。
本周多完成的一个专注单元与更清楚的任务边界有关。
后面的内容都围绕这个判断展开。
为了减少此类问题,我们就要用到第二天学习的提示词工程了:
我们先看需求
目标:完成 5 个 25 分钟专注单元。
实际:周一 1 个,周二 0 个,周三 2 个,周四 1 个,周五 2 个。
有效做法:开始前只写一个交付物;结束时记录下一步;卡住 10 分钟后整理错误和尝试。
问题:周二被会议打断;周五因为没有完成标准返工一次。
下周:保留 6 个单元,每个任务补完成标准,周五复盘。
结合需求,再根据各位读者大大的聪明才智我们得到以下提示词:
请把当前项目中的周学习复盘笔记做成 6 页、16:9 的可编辑 PPT。
读者是一起学习 AI 工具的同学,汇报时间 5 分钟。
第 1 页封面,第 2 页目标与实际,第 3 页用可编辑柱状图展示每天完成量,第 4 页讲有效做法,第 5 页讲返工原因,第 6 页给下周计划。
标题直接说明每页主题,正文不要写满整页。
所有数字必须来自原始笔记,不要补造数据。
完成后请检查页数、文字是否越界、图表是否可编辑,并告诉我尚未验证的兼容性。
这个案例里,我实际得到了一份 6 页文件,第三页柱状图包含 5 个数据点,演示文件的结构、页数和布局检查都通过。
第一次渲染后,第 2 页把 1 个拆到了两行,第 5 页把句号单独留在下一行。
这两个问题没有影响文件生成, 却会明显影响读者观感。
我继续调整文案和文本框宽度,第三版里这两个问题都消失了。
交付前检查
1.检查页数和数字。
2.检查图表能否编辑。
3.检查页面是否错位。
4.打开 PowerPoint 或 WPS 亲手修改。
Codex 可以帮你完成前三类。
第四点则需要自己确认。
继续修改
如果文件打不开,
不要只说 PPT 坏了。
把完整文件名、使用的软件、报错内容和刚才执行的步骤一起告诉 Codex。
如果某页很难看,
可以只截这一页,
并指出你最在意的一个问题,
比如标题换成三行了或图表太挤等问题。
如果图表无法编辑,
让 Codex 检查它生成的是原生图表还是一张图片。
一次修一个主要问题,
比同时说把你想要的东西丢给它更容易验证。
今日自测
青铜:你得到了一份页数正确的 PPT。
白银:你逐页检查了渲染图,并找到至少一个具体排版问题。
黄金:你在 PowerPoint 或 WPS 中修改了一条图表数据,确认图表仍可编辑。
Day 4 学习 Skill
经过三天的学习,我相信各位对于codex有一个更好的了解了。
我们今天来学习如何让自己的codex更聪明好用。
今天不做新文件,我们的核心目标是只弄懂 Skill 是什么,以及 Skill 的制作和使用。
Skill 是 Codex 里的复用模块,它负责把一套已经跑通的做法固定下来。
遇到重复任务时,更能显出它的价值。
Skill 是什么
OpenAI 官方把 Skill 定义为面向特定任务或工作流的可复用指导,
它可以把指令和配套资源打包在一起。
你可以把它理解成一份给 Codex 使用的工作手册。
手册里写了一系列的注意事项。
当任务与用途匹配时,Codex 会自动选择匹配的 Skill。
你也可以在 Codex 中用 $技能名 显式指定。
Skill 不会给模型凭空增加知识,也不会自动取得新的文件权限。
它主要是让 Codex 按照你的方式工作。
长提示词的问题
长提示词当然能工作,但你每次都要复制一遍,也很容易漏掉某条规则。
如果团队里有三个人,三个人还可能各自保留一个不同版本。
Skill 适合那些经常重复、步骤相对稳定、对格式有明确要求的任务。
比如,写周报表格等等这种繁琐的事情,也可以是你总结了一套自己的代码风格。
它的价值在于把提示词和零散经验整理成一条完整的工作流。
Skill 和插件
比起提示词,Skill 更像一份聚焦任务的说明书,重点是可复用指令和资源。
插件是一种可安装的能力包,可以同时包含 Skill、连接器或其他工具。
当你只想让 Codex 固定一种写作或检查流程时,Skill 通常已经够用。
当任务还需要连接 GitHub、Google Drive 或其他服务时,插件更适合承载整套能力。
对照测试
接下来我要展示的是用同一份提示词,和有无skill的对比。
我今天需要修改简历、准备面试、投递 5 个岗位,但不知道先做什么,请帮我安排。
我们可以看到,默认回答并不混乱,它有编号、有时间估算,也给出了开始动作。
这点必须写清楚,否则很容易把模型原本就会做的事情全部归功于 Skill。
启用 $i-have-adhd 后,回答把第一行动放在最前面,使用了具体时间段,为每个阶段补上完成标准。
完成以后,留下现在打开简历并另存副本一个下一步。
这次对照中,差异主要出现在四个地方。
第一,启用后的版本一开头就要求执行一个动作。
第二,时间从 60 分钟变成了更具体的时间区间。
第三,每个阶段增加了可见的完成标准。
第四,结尾把注意力收回当前一步,没有继续补充更多建议。
图中的变化
两次回答都给出了清楚的任务顺序。
启用 Skill 后的版本更强调当前动作和完成标准。
这次变化说明 Skill 调整了回答方式。
它不代表模型变得更聪明。
它也不能证明效率一定提高。
两次生成还会受到随机性影响。
复现时需要固定模型和提示词并多跑几次。
文章只记录这次测试看到的变化。
复现测试
只测试一次不能说明什么,
接下来请各位读者大大和我一次进行重复测试,
skill地址是github.com/ayghri/i-have-adhd,目前已经有 39.2K Star。
只需复制给codex,输入帮我安装这个skill即可。
第一步是在新任务中发送原始提示词。
第二步是在另一个新任务中启用 $技能名 并发送相同提示词。
第三步是对比两次回答。
第四步是把求职换成考试再试一次。
第五步是保存失败结果。
值得保留的 Skill
一个skill到底值不值得使用,能不能方便用户,
每个人都会有不同想法,我说说我的想法:
第一,它解决的任务会重复出现。
第二,它真正改变了 Codex 的行为习惯。
第三,它的规则足够具体,可以判断有没有执行。
第四,它没有把简单任务变得过度僵硬。
第五,过一段时间后,你仍然知道怎样更新里面的旧规则。
五个skill常见问题
1 触发太宽
不相关任务也会套用同一流程。
2 规则太多
简单问题也会变成长清单。
3 示例太死
新任务容易照抄旧答案。
4 资料过期
旧界面和旧限制会继续进入结果。
5 规则冲突
回到当前任务挑出最重要的规则。
试用现成 Skill
先从你已经安装的 Skill 中选一个用途最清楚的。
它可以负责写作、检查文件,也可以像本文案例一样帮你收住下一步。
在新任务里用 $技能名 显式调用,再交给它一份真实材料。
做完后换一份同类材料再跑一次,第二次仍然能减少重复说明和漏项,这个 Skill 才值得继续使用。
如果任务变得更加繁琐和重复,相信我,直接删掉这个害人的skill。
今日自测
青铜:你能用一句话解释 Skill 与普通提示词的区别。
白银:你完成了一次同提示词 A/B 测试,并记录四个可观察指标。
黄金:你用第二个任务再次测试 Skill,并写出一条适用场景和一条限制。
Day 5 制作小游戏
能坚持学习到今天,我相信各位老铁一定是很有毅力的。
我们今天做一个名叫专注翻翻乐,玩家每次翻两张卡片,找出 6 组相同符号。
你可以把需求写成下面这样:
游戏名:专注翻翻乐。
玩法:页面有 12 张卡片,共 6 组;每次翻两张;相同则保持打开,不同则自动盖回。
显示:步数、用时、已配对数量。
操作:支持重新开始。
完成标准:电脑和手机都能显示;按钮可以用键盘聚焦;完成全部配对后显示结果;刷新页面不会报错。
交给 Codex
在练习项目中新建 game 文件夹,再开一个独立任务,
复制一下提示词:
请在当前项目的 game 文件夹里制作专注翻翻乐。
使用原生 HTML、CSS 和 JavaScript,不安装框架。
先给我一份不超过 5 步的计划,再创建 index.html、styles.css 和 app.js。
页面使用暖橙色和蓝色,正文至少 16px,所有按钮至少 44px 高,键盘聚焦时要有清楚轮廓,并支持 prefers-reduced-motion。
完成后先做 JavaScript 语法检查,再告诉我需要在浏览器里人工验证的动作。
游戏成品
页面可以看到 12 张卡片,步数和用时也会同步显示。
继续测试
页面出现后继续在同一个任务里发送下面这段话。
请打开刚才生成的游戏并完成以下检查。
1. 页面能正常显示 12 张卡片。
2. 两张不同卡片会自动盖回。
3. 两张相同卡片会保持打开。
4. 重新开始后所有数字归零。
检查完成后先汇报结果。
发现问题时先告诉我再修改。
这一步会让 Codex 从制作进入检查,页面打不开时直接把截图发回当前任务。
今日自测
青铜:你让 Codex 创建并打开了小游戏。
白银:你让 Codex 按要求检查了四个动作。
黄金:你让 Codex 修好一个问题并重新测试。
Day 6 检查结果
今天不换项目,继续在昨天的基础上。
增添一些小功能,真正能长期使用的工作方式,通常都包含一个闭环:
先说完成标准并运行检查,记录哪些地方有问题,注意每次只修一个主要问题,再重新验证。
先读再改
在昨天的任务里发送:
请先不要修改代码。
阅读 game 文件夹里的三个文件,对照下面的验收条件做检查:
1. 12 张卡片必须形成 6 组。
2. 连续快速点击时不能翻开第三张。
3. 重新开始后步数、计时和配对数归零。
4. 游戏完成后计时停止。
5. 键盘焦点和状态反馈可见。
请把结果分成代码可确认、必须在浏览器验证和当前发现的问题三部分。
请给每项标注证据位置。
Codex 先列出能从文件里确认的结果。
接着它单独列出需要打开浏览器验证的动作。
这样就能看出哪些结果已经确认,剩下的部分需要继续操作。
测试矩阵
测试矩阵不用复杂,五行就够:
让 Codex 把这张表保存到 game/TESTING.md,每完成一项就填实际结果,实际结果一栏不能提前填写通过。
修改 Bug
当我测试的时候快速点三张卡,发现第三张也被翻开了。
此时我们就要继续找coedx聊天了,打开对话框,我们不要直接说修一下翻牌 Bug,要谨记第二天学习的知识。
提供可以复现的步骤提示词:
我在 Chrome 中连续快速点击第 1、2、3 张卡。
预期:第 2 张打开后锁定操作,直到两张卡完成比较。
实际:第 3 张有时也会打开。
请先定位控制点击锁定的代码,说明现有逻辑为什么可能出现这个现象。
只修这个问题,修改后给出差异摘要和重新测试步骤,不要同时调整样式。
只修这个问题可以限制改动范围。
差异摘要会列出改动位置,重新测试步骤用于确认问题已经解决。
看懂变更
变更是修改前后的差异。
以红色围绕的代码行通常表示删除,
以绿色围绕的代码行通常表示新增。
你只需要检查三个地方,第一看改动是否围绕当前问题,第二看原有功能有没有被删,第三看有没有偷偷加入新功能。
如果改动范围远大于问题范围,可以让 Codex 解释每一组改动的必要性,并撤回无关部分。
测试证据
一条可靠的完成报告应该说明执行了什么命令、检查了哪些行为、结果是什么、还剩什么没检查。
只写全部完成或一切正常没有验收价值。
你可以固定使用下面的收尾格式:
请按四部分收尾:
1. 已修改:列文件和主要变化。
2. 已验证:列命令或人工操作及结果。
3. 未验证:列当前环境无法确认的内容。
4. 下一步:只给一个最值得继续的动作。
制造错误
现在的codex在制作这种小型demo时基本不会出错,为了各位支持我的读者。
我特地把 index.html 中的 app.js 临时改成 apps.js,
刷新页面,记录控制台错误,把错误交给 Codex,看看codex是否能快速找到问题错误。
今日自测
青铜:你有一张包含预期结果和实际结果的测试表。
白银:你能把一个 Bug 拆成环境、操作、预期和实际四部分。
黄金:你检查了一次 diff,拒绝了一项与当前问题无关的修改。
Day 7 完成工作流
最后一天我们不再学习新按钮,我们需要把前六天的方法用于一个真实任务。
我选择求职冲刺作为综合案例,它同时包含资料整理、文本修改、任务推进和结果检查。
各位老铁也可以把它换成论文汇报、课程作业、社团活动或个人项目发布。
求职冲刺
先在项目里建立四个文件夹:
把准备投递的岗位说明保存到 01-岗位,
把简历副本放到 02-简历。
不要把身份证、银行卡、账号密码或其他无关隐私放进项目。
第一轮只让 Codex 读取材料并建立清单:
请读取 01-岗位 和 02-简历,不要修改原文件,也不要替我发送任何申请。
先列出岗位名称、截止时间、重复出现的关键词和我当前简历中最相关的经历。
无法确认的信息标为待确认。
完成标准:得到 5 个岗位的对照表,并明确今天先处理哪个岗位。
第二轮再修改简历副本:
请为优先级最高的岗位修改简历副本,只调整求职目标、技能关键词和最相关的两段经历。
不得虚构项目、职责、数字和获奖情况。
每处修改都列出原文、修改后和修改理由。
完成后检查岗位关键词是否自然出现,并把仍需我补充的事实集中列出。
第三轮准备面试:
根据岗位要求和简历中的真实经历,准备 5 个高概率问题。
每个问题只给回答结构和需要引用的真实材料,不替我编造完整故事。
其中两个问题用于验证岗位核心能力,一个问题专门追问简历中的量化结果。
第四轮建立进度记录:
请在 04-记录 中创建投递记录,字段包括公司、岗位、链接、截止时间、简历版本、状态、下一步和跟进日期。
本轮只创建记录文件,不提交表单、不发送邮件、不登录网站。
这四轮任务把分析、修改、准备和记录拆开。
每轮都有一个独立结果,都能在项目文件夹里留下证据。
投递要确认
投递简历会向第三方发送个人信息,也代表你对外做出申请行为。
这种动作应该在提交前,必须由你亲自检查岗位、附件、联系方式和隐私范围。
Codex 可以帮你准备材料、检查表单和记录进度,最终提交要保留明确授权和人工确认。
同样的原则也适用于发送邮件、发布公众号、删除文件、付款和修改账号权限。
检查漏项
前面四轮做完以后,别急着关掉任务。
让 Codex 回到最初的岗位材料,对照当前文件做一次交付检查。
请回到最初的 5 份岗位说明,检查当前项目是否已经完成今天的求职准备。
只检查,不新增内容,也不替我发送任何申请。
请列出已经完成的文件、仍缺少的事实、需要我亲自确认的内容,以及最值得继续的一步。
每项判断都注明对应文件,不能确认的地方直接写待确认。
这一步会把 Codex 从执行者切换成检查者。
它需要重新对照原始要求,而不是只复述自己刚才做过什么。
今日自测
青铜:你用 Codex 完成一个真实任务,并留下了可继续使用的文件。
白银:你把任务拆成独立阶段,每一阶段都有完成标准和证据。
黄金:你让 Codex 回到原始材料做交付检查,并亲自处理最后的确认项。
最后想说的话
或许以前你看到别人用 AI 写读后感、做 PPT、开发小游戏,觉得很厉害,离自己很远。
现在,你已经亲手做过一次了。
你会发现,AI其实也不难上手,Skill 其实没有想象中那么复杂。
这 7 天学习虽然结束了。
真正的实践,才刚刚开始。
如果,你不想被AI时代淘汰。
从今天开始,少围观,多动手。
未来真正拉开人与人差距,是谁能把 AI 用进每天的工作和生活里。
持续解决真实的问题,创造真实的价值。
你的AI应用能力或许直接决定你的收入。
希望,某一天。
你可以站到山顶。
可以对自己说。
我赢了。