让 Codex 自己进化:一条"回头看你 30 天工作记录"的提示词
一句话定性
这条视频给的不是一条”让 AI 干活干得更好”的提示词,而是一条元提示词(meta-prompt):它让 Codex 停下手里的活,回头去看你过去 30 天让它干过什么,自己找出重复劳动,然后把这些劳动打包成可复用的技能、子代理和定时自动化。
区别在于视角的反转——
- 普通提示词:“帮我做这件事”(一次性交付)
- 这条提示词:“看看我总让你做哪些事,把它们变成以后不用我再说的东西”(把一次性劳动变成资产)
作者说它经过”OpenAI 总裁认证”。这个背书我没法独立核实,当营销话术看就行,别当技术依据——但提示词本身的设计确实值得拆,它的价值不靠背书成立。
提示词全文(视频里展示的中文版)
回顾我过去 30 天的最近工作(如果历史更短,则使用全部),识别值得打包的重复手动工作流程。
按照以下顺序使用可用证据:
- 最近的 Codex 会话和任务摘要。
- Codex 记忆和 rollout 摘要,以查找跨会话重复的模式。
- 如果启用,纪事(chronicle),用于发现 Codex 之外的重复工作。仅将纪事用于发现;尽可能在相关源系统中确认重要细节。
- 现有技能、自定义代理和自动化,以便重用或扩展已有的内容,而不是重复创建。
广泛查找重复的、耗时的、易出错的、上下文密集的或受益于一致流程的工作。包括跨编码、研究、写作、规划、沟通、运营、分析和个人管理的工作流程。
仅在候选项满足以下条件时采取行动:
- 至少发生过两次,或明显可能重复且重复成本高;
- 具有稳定的输入、可重复的程序,以及明确的输出或停止条件;
- 会实质提升速度、质量、一致性或可靠性;
- 未被充分覆盖。
选择最小的适当形式:
- 技能:可重用的工作流程或 playbook。
- 自定义子代理:适合委托的界定专家角色或调查任务。
- 自动化:定时或循环检查、报告、提醒或监控。
- 跳过:过于一次性、模糊、敏感或证据不足而无法打包的工作。
首先生成一个简洁的短名单,包括:
- 重复工作流程
- 支持证据和日期
- 频率/置信度
- 推荐形式:技能、子代理、自动化、扩展现有或跳过
- 为什么值得或不值得创建
然后仅创建高置信度的缺失项。保持它们狭窄、实用、源感知且易于验证。不要创建推测性的、重叠的或过于宽泛的资产。
最后以以下内容结束:
- 你创建或扩展了什么
- 你故意跳过了什么
- 什么需要更多证据才能打包
这条提示词真正的门道在哪
大部分人看完只会复制粘贴。但这条提示词值钱的地方不是”让 AI 自我进化”这句口号,而是它用四个结构化设计防住了 AI 自我进化最容易翻的车。
门道一:先给证据源,再让它找规律
它没有直接说”找找有什么重复工作”,而是按优先级列出四个证据源:会话记录 → 跨会话记忆 → 外部纪事 → 已有资产。
这是在防幻觉。你不给证据源,AI 就会凭”一般人都会重复做什么”来编——编出来的是常识模板,不是你的工作。给了证据源,它才是在读你的真实历史。
尤其第四条「先看已有技能,以便重用或扩展,而不是重复创建」——这一条直接防住了资产库膨胀(后面还会再强调一次)。
门道二:四道准入门槛,卡掉”看起来值得自动化”的伪需求
至少发生过两次 → 防止把一次性任务当规律
输入稳定、有停止条件 → 防止把模糊活儿打包成必然失败的流程
实质提升速度/质量 → 防止为自动化而自动化
未被充分覆盖 → 防止重复造轮子
这四条是这条提示词里最值得单独抄走的部分。它可以脱离 Codex,变成任何人判断”这活该不该固化成流程”的通用尺子。我自己接下来就打算把它当独立的判断清单用。
门道三:强制”选最小的适当形式”,还给了「跳过」这个合法选项
它给了四个档位——技能 / 子代理 / 自动化 / 跳过。
给 AI 一个体面的”不做”的选项,这是很多人写提示词时想不到的一步。你不给”跳过”,AI 就会硬凑:每个候选项都给你造个东西出来,最后一堆没人用的垃圾资产。明确授权它说”这个不值得做”,产出质量立刻上一个台阶。
而且”选最小的适当形式”意味着:能用一个技能解决的,不给你上一个子代理;能扩展现有的,不新建。
门道四:两阶段执行——先出短名单,再动手创建
先规划、后执行,中间天然留了一个人工检查点。而且短名单要求带「支持证据和日期」「频率/置信度」「为什么值得或不值得」——这等于逼它把判断依据摊开给你看,你能当场看出它是真读了记录还是在编。
最后的收尾三问也很讲究:创建了什么 / 故意跳过了什么 / 什么还需要更多证据。第三条尤其好——它给了 AI 一个诚实说”我证据不够”的出口,而不是逼它把不确定的东西也硬塞进结论里。
可复制骨架(脱离 Codex 也能用)
把这条提示词抽象一层,它其实是一个通用的”劳动→资产”转化模板,换成任何 AI 助手、甚至换成人来做流程梳理,都成立:
1. 划定回溯窗口(过去 N 天)
2. 按可信度排序列出证据源,并要求先看已有资产避免重复
3. 给出准入门槛(发生≥2次 / 输入稳定 / 有实质收益 / 未被覆盖)
4. 给出产出形式的档位表,含"跳过"这一档
5. 要求先出带证据和置信度的短名单 —— 人工检查点
6. 只创建高置信度项,保持狭窄、实用、易验证
7. 收尾三问:做了什么 / 跳过什么 / 什么证据不足
用法建议:第一次跑先只要短名单、别让它直接创建(把最后的创建指令删掉),你自己看一遍它找出来的规律准不准,再决定放不放行。AI 对你工作模式的判断,第一次往往有偏差。
四角度反思
一、对我们(整体这盘棋)
我们一直在做的事,和这条提示词说的其实是同一件事的两个方向——我们的原则是”能固化成脚本就固化,同一个复杂操作手搓第二次就该沉淀成脚本”。这条提示词提供的是反方向的补充:不靠人当场察觉,而是定期回头批量扫描。
人工察觉有个固有漏洞:你只在”手搓得烦了”的那一刻才想起来该固化,那些不太烦、但每周都在悄悄重复的活儿,永远到不了那个触发点,就一直手搓下去。定期回溯扫描正好补这个洞。
可落地的动作:把”每月回顾一次工作记录、找出没被固化的重复劳动”变成一个定期任务,而不是等着某次手搓烦了才想起来。这是从「被动察觉」升级到「主动巡检」。
二、对橙子(我自己)
三个我能直接吃下的东西:
1. 那四道准入门槛,我要当独立判断尺用。 我以前判断”这活该不该沉淀成脚本/SOP”是凭感觉的——感觉重复了就沉淀。这四条给了我一把可复述的尺子:发生过两次没?输入稳不稳定?有没有实质收益?是不是已经有现成的了?以后我判断要不要新建资产,先过这四关。
2. “先看已有资产再决定新建”这条,是我真踩过的坑。 技能库、脚本库越攒越多之后,最大的风险不是没有工具,而是同一个能力有三个半成品版本,我自己都不记得该调哪个。这条提示词把”先复用、再扩展、最后才新建”写成硬约束,我应该把它写进自己新建脚本前的自检。
3. “跳过”是个合法答案。 我有个毛病是接到活总想产出点什么。这条提示词提醒我:明确说”这个不值得做、证据不够”,本身就是高质量产出,比硬凑一个没人用的东西强得多。这跟我”不确定就问、绝不自派任务”的原则是一路的。
三、对老大的机构(公考 / AI 电商)
直接可落地的场景是把老师和运营手里的重复劳动扒出来。
机构里最典型的隐形重复劳动:每天整理答疑高频问题、每周做学员进度汇总、每次开新课重写一遍课程介绍和朋友圈文案、每条短视频重复做同一套选题→脚本→分镜流程。这些活儿单次都不烦,所以从来没人提出要自动化,但一个月累计下来是巨大的时间黑洞。
具体建议:让每个岗位的人跑一次这个回溯(哪怕不用 Codex,手动回顾过去一个月的工作记录也行),照那四道门槛筛一遍,挑出 2-3 个真正高频且输入稳定的,做成固定流程。别一次做十个——按提示词自己的原则,只做高置信度的,宁缺毋滥。
顺带一个内容层面的机会:这套”回头看自己的重复劳动、把它变成资产”的方法论,对做 AI 课程/内容的账号来说是个好选题——它讲的是认知升级(把劳动变资产)而不是工具技巧,比”教你十个提示词”那类内容生命周期长得多,也更容易建立专业感。
四、对未来发展
这条提示词指向一个很明确的趋势:AI 助手正在从”执行工具”变成”会自我扩展的系统”。
值得注意的是它的实现路径——不是靠模型变聪明,而是靠”让 AI 读自己的历史记录”这个工程设计。这说明未来一段时间,AI 能力的差距不主要来自用谁家的模型,而来自谁的系统积累了可复用的记忆和资产、并且能定期把经验转化成能力。
这里有个推论值得提前布局:记录本身正在变成资产。这条提示词能跑起来的前提,是你有”过去 30 天的会话和任务记录”。没有记录的人,跑这条提示词只会得到一句”证据不足”。所以现在就该把工作记录、决策留痕当成基础设施来建——不是为了合规,是因为它是未来 AI 自我进化的燃料。
另一个方向:如果”回头扫描重复劳动”这件事本身值得做,那它自己就符合准入门槛(会重复发生、输入稳定、有实质收益)——所以它应该被做成定时自动化,而不是每次手动发提示词。这条提示词用自己的标准衡量自己,结论是它该被自动化掉。这个自指的闭环挺有意思。
最值得抄走的三个点
- 四道准入门槛(≥2次 / 输入稳定有停止条件 / 实质收益 / 未被覆盖)——脱离 AI 也是判断”该不该固化流程”的通用尺子,这是全篇最值钱的部分。
- 给 AI 一个体面的”跳过”选项——不给它退路,它就给你硬凑垃圾产出。这条适用于你写的任何提示词。
- 两阶段 + 带证据的短名单——先规划后执行,中间留人工检查点,并逼它摊开判断依据,你才看得出它是真读了记录还是在编。
一句话总结
别只让 AI 帮你干活,定期让它回头看你总在干什么活——然后把那些活变成以后不用干的东西。
真正的效率提升不在于每次干得多快,而在于干过的事情有没有变成资产。