方法论专栏
从任务单到挽具:AI 用得好不好,差在哪一层
问不出好答案、资料一变它就不可靠、答得对却还得自己动手——这三件事不是三个毛病,是同一条路上的三级台阶。看懂你卡在哪一级,就知道下一步该学什么。
你是不是也遇到过
同一个问题,别人问出来的答案能直接用,你问出来的用不了
—— 你会说"它就是不懂我要什么"
好不容易问对了,第二天换条对话,背景又得从头说一遍
—— 你开始在备忘录里存一段"开场白",每次粘贴
资料明明传给它了,它答的还是旧版本,而且毫无察觉
—— 你甚至是被客户指出来才发现的
它答得又快又对,可最后那步——写进文档、更新到系统——还是你自己动手
—— 一个字一个字搬
同事和你用的是同一个 AI,产出却天差地别
—— 你怀疑是不是他买了更贵的版本
这五件事看着散,其实是同一条路上的三级台阶。每上一级,解决的都是上一级留下的那个坑。
为什么值得先看这张地图:绝大多数"AI 不好用"的抱怨,都不是模型不行,而是站在第一级的位置上,去要第三级才能给的东西。看懂自己站在哪一级,比再多试十个工具都管用。
三级台阶
第一级 · 把话说清楚
(Prompt Engineering / 提示词工程)
从哪来:最开始,所有人的问题都一样——它没听懂我要什么。
一句话:这一级的功夫全在"你怎么问"。
比喻:给临时工的任务单。任务单写得糊,活就干得糊。你不会指望一个第一天上班的临时工靠猜就把活干对,AI 也一样。
这一级最常见的误判:以为问题出在"话术"——于是到处收集"万能提示词模板"。模板能解决的是你不知道该交代哪几件事,解决不了这些事每次都得重新交代。收集到第三十个模板还是累,就说明卡点根本不在这儿。
做到什么算过关:一次问清背景、要求、格式、边界,不靠追问三轮才对。
这一级的天花板:任务单写得再漂亮,它也只在这一条对话里有效。明天换条对话,你的行业、你的客户、你的规矩,全部要重说一遍。
到顶的信号:你的备忘录里开始存"每次都要粘的那一段"。那一刻你已经在手工干第二级的活了——只是用的是最笨的办法。
第二级 · 让它看见该看见的
(Context Engineering / 上下文工程)
从哪来:上一级的痛是"每次都要重说背景"。解法不是把任务单写得更长,是换个地方放背景。
一句话:这一级的功夫在"它眼前摆着什么"。
比喻:只有一块台面的裁缝。你说的每句话、贴的每份文件都是布料,台面就那么大,堆满了,最早的布料就被悄悄收走——它不是变笨了,是台面满了。所以要给它配档案柜:常用的资料归档进去,用的时候取,不占台面。
这一级最常见的误判:以为"资料传得越多越好",把几十份文件一股脑塞进去。柜子塞满的结果不是它更懂你,是它取错——该取的没取到,不相关的倒翻出来了。档案柜的价值在于归得清楚,不在于装得多。
做到什么算过关:常用背景资料有固定的存放处,不靠每次粘贴;知道对话什么时候该重开;知道哪些东西该进档案柜、哪些该留在台面上。
这一级的天花板——两个,都很硬:
- 档案柜里的是复印件,会过时。你改了源头那份资料,它读的还是入柜那天的旧快照,而且答得理直气壮。它没错,它忠实地读了柜子里那份东西——错在让复印件当了权威。这个坑最阴的地方是它不会报错:过时的答案和正确的答案,长得一模一样。
- 它只能动嘴。答得再对,最后一步——写进文档、更新到系统——还是你自己干。资料备齐之后你会发现,省下的是"想"的时间,没省下"搬"的时间,而后者往往更多。
到顶的信号:你开始不敢完全信它的答案,每次都要回源头核一遍——那么它其实只是个"建议生成器",没真正接进你的活里。
第三级 · 给它装挽具
(Harness Engineering / 配置工程)
从哪来:上一级的两个坑——复印件过时、它只能动嘴——换个更强的模型解决不了,得换结构。
一句话:这一级的功夫在模型之外的一切配置:资料放哪、记忆怎么留、分工怎么定、边界怎么划。
比喻:赛马的挽具。同一匹马,冠军和事故的差别全在挽具怎么装。模型决定上限,配置决定你能用出几成——同事和你产出天差地别,差的从来不是模型。
这一级具体在配三样东西:
事实源(档案馆里的原件)
唯一权威版本,其余全是复印件,信息只能从它往外流
治好了:复印件过时——让它直接读原件,不读快照
记忆(交接班的工作笔记)
状态写进文件,不留在对话里
治好了:换条对话就失忆——笔记在,接班的人几分钟就想起上次干到哪
分工(军师与施工队)
判断的不动手,动手的不判断;一份东西同时只有一个执笔者
治好了:它只能动嘴——让另一个角色去动手,但不让它自己拍板
三条规矩把这三样锁住:
- 原件只有一份。其他都是复印件,信息单向往外流——这就是"资料过时"的根治法。
- 判断的不动手,动手的不判断。两个 AI 不同时改一份东西,谁执笔谁负责,另一个只看只提。
- 危险动作必须人点头。删除、改线上、任何不可逆的操作——AI 再聪明,拍板永远是人。
这一级最常见的误判:以为这是"技术活、得会写代码"。三样配置里没有一样是技术问题——哪份是原件是管理问题,记什么、记在哪是流程问题,谁能动什么是权责问题。它们在你没有 AI 的时候就存在,AI 只是让它们变得无法回避。
做到什么算过关:换一条对话、换一个人接手,工作照样能接上;出了错能查到是哪一环断的;你敢让它动手,是因为你知道它动不了哪些东西。
注意这一级的过关标准变了:前两级问的是"它给的东西对不对",这一级问的是这套东西离了你还转不转。这是从"会用 AI"到"用 AI 干生产"的分水岭。
你现在在哪一级
按顺序问自己,第一个答"是"的地方,就是你该补的那一级:
问一 · 换条对话,背景要重说一遍吗?
答"是"的典型样子:你有一段固定开场白存在备忘录里,每开新对话就粘一次;或者你干脆不敢关那条聊了三个月的对话。
→ 你在第一级,该往第二级走。别再优化那段开场白了,该给它配柜子了。
问二 · 源头资料改了,它知道吗?
答"不知道"的典型样子:价格调了、流程改了、规则变了,你得记着回去把传过的那份也换掉——而且经常忘。
→ 你在第二级,该往第三级走。问题不在你记性差,在于你让复印件当了权威。
问三 · 它答完,最后一步还是你自己动手吗?
答"是"的典型样子:它把内容写得很好,你复制、粘贴、改格式、存到该存的地方——每天重复十几次。
→ 你卡在第二级到第三级之间,缺的是分工,不是资料。再多传十份文件也解决不了。
三问都过了,你要面对的是新问题:怎么让这套配置稳定地跑下去、并且能交给别人——那时候你要找的已经不是"更好用的 AI",而是"更清楚的规矩"。
四条守则(比层级更重要)
守则一 · 别跳级
第三级的配置搭在第二级的资料之上,第二级的资料喂给第一级的任务单。跳过前两级直接搭配置,等于给一匹还不听指令的马装挽具——挽具越精密,翻车越难看。见过最典型的一种浪费:连自己的常用资料都没归好,先去搭一套能自动跑的流程,结果流程跑得飞快,喂进去的全是错料。
守则二 · 每一级的"过关"都是行为,不是知识
知道台面会满,和真的会在该重开的时候重开,是两回事。上面三个自检问句问的都是你实际怎么干,不是你知道什么——所以这张地图看一遍没用,得对着自己这周的活答一遍。
守则三 · 上一级的坑不会消失,只是被接住了
装了挽具不等于任务单可以写得糊——它只是让写糊的代价不再是灾难。每一级都在为下一级兜底,不是替代它。所以你会发现:越往上走,越回头感谢第一级的功夫。
守则四 · 三级不是三种人,是同一个人的三个阶段
没有谁"天生属于第三级"。同一个人,做熟悉的活可能在第三级,换个新领域立刻掉回第一级——这很正常,甚至是对的。地图的用处不是给自己贴标签,是每接一件新活,快速判断这次该从哪一级起步。
再往前一步(新兴动向,看看就好)
三级之外,业界正在讨论第四种说法——把多个"检查—修正—再来一遍"的回路叠起来(有人称之为 Loop Engineering)。它还没有成为定论,目前更像是第三级里"反馈回路"那部分的展开。
放在这里只为一件事:你听到新词的时候,能把它挂到坐标系上,而不是又一次从零追新。遇到没听过的新概念,先问一句——它治的是哪一级的痛?答得出来,它就有坐标;答不出来,多半是包装。
伴读词条 · 概念词典