方法论专栏

从任务单到挽具:AI 用得好不好,差在哪一层

问不出好答案、资料一变它就不可靠、答得对却还得自己动手——这三件事不是三个毛病,是同一条路上的三级台阶。看懂你卡在哪一级,就知道下一步该学什么。

你是不是也遇到过

同一个问题,别人问出来的答案能直接用,你问出来的用不了

—— 你会说"它就是不懂我要什么"

好不容易问对了,第二天换条对话,背景又得从头说一遍

—— 你开始在备忘录里存一段"开场白",每次粘贴

资料明明传给它了,它答的还是旧版本,而且毫无察觉

—— 你甚至是被客户指出来才发现的

它答得又快又对,可最后那步——写进文档、更新到系统——还是你自己动手

—— 一个字一个字搬

同事和你用的是同一个 AI,产出却天差地别

—— 你怀疑是不是他买了更贵的版本

这五件事看着散,其实是同一条路上的三级台阶。每上一级,解决的都是上一级留下的那个坑。

为什么值得先看这张地图:绝大多数"AI 不好用"的抱怨,都不是模型不行,而是站在第一级的位置上,去要第三级才能给的东西。看懂自己站在哪一级,比再多试十个工具都管用。

三级台阶

第一级 · 把话说清楚

Prompt Engineering / 提示词工程

从哪来:最开始,所有人的问题都一样——它没听懂我要什么。

一句话:这一级的功夫全在"你怎么问"。

比喻:给临时工的任务单。任务单写得糊,活就干得糊。你不会指望一个第一天上班的临时工靠猜就把活干对,AI 也一样。

这一级最常见的误判:以为问题出在"话术"——于是到处收集"万能提示词模板"。模板能解决的是你不知道该交代哪几件事,解决不了这些事每次都得重新交代。收集到第三十个模板还是累,就说明卡点根本不在这儿。

做到什么算过关:一次问清背景、要求、格式、边界,不靠追问三轮才对。

这一级的天花板:任务单写得再漂亮,它也只在这一条对话里有效。明天换条对话,你的行业、你的客户、你的规矩,全部要重说一遍。

到顶的信号:你的备忘录里开始存"每次都要粘的那一段"。那一刻你已经在手工干第二级的活了——只是用的是最笨的办法。

第二级 · 让它看见该看见的

Context Engineering / 上下文工程

从哪来:上一级的痛是"每次都要重说背景"。解法不是把任务单写得更长,是换个地方放背景。

一句话:这一级的功夫在"它眼前摆着什么"。

比喻:只有一块台面的裁缝。你说的每句话、贴的每份文件都是布料,台面就那么大,堆满了,最早的布料就被悄悄收走——它不是变笨了,是台面满了。所以要给它配档案柜:常用的资料归档进去,用的时候取,不占台面。

这一级最常见的误判:以为"资料传得越多越好",把几十份文件一股脑塞进去。柜子塞满的结果不是它更懂你,是它取错——该取的没取到,不相关的倒翻出来了。档案柜的价值在于归得清楚,不在于装得多。

做到什么算过关:常用背景资料有固定的存放处,不靠每次粘贴;知道对话什么时候该重开;知道哪些东西该进档案柜、哪些该留在台面上。

这一级的天花板——两个,都很硬:

  1. 档案柜里的是复印件,会过时你改了源头那份资料,它读的还是入柜那天的旧快照,而且答得理直气壮。它没错,它忠实地读了柜子里那份东西——错在让复印件当了权威。这个坑最阴的地方是它不会报错:过时的答案和正确的答案,长得一模一样。
  2. 它只能动嘴答得再对,最后一步——写进文档、更新到系统——还是你自己干。资料备齐之后你会发现,省下的是"想"的时间,没省下"搬"的时间,而后者往往更多。

到顶的信号:你开始不敢完全信它的答案,每次都要回源头核一遍——那么它其实只是个"建议生成器",没真正接进你的活里。

第三级 · 给它装挽具

Harness Engineering / 配置工程

从哪来:上一级的两个坑——复印件过时、它只能动嘴——换个更强的模型解决不了,得换结构。

一句话:这一级的功夫在模型之外的一切配置:资料放哪、记忆怎么留、分工怎么定、边界怎么划。

比喻:赛马的挽具。同一匹马,冠军和事故的差别全在挽具怎么装。模型决定上限,配置决定你能用出几成——同事和你产出天差地别,差的从来不是模型。

这一级具体在配三样东西:

事实源档案馆里的原件

唯一权威版本,其余全是复印件,信息只能从它往外流

治好了:复印件过时——让它直接读原件,不读快照

记忆交接班的工作笔记

状态写进文件,不留在对话里

治好了:换条对话就失忆——笔记在,接班的人几分钟就想起上次干到哪

分工军师与施工队

判断的不动手,动手的不判断;一份东西同时只有一个执笔者

治好了:它只能动嘴——让另一个角色去动手,但不让它自己拍板

三条规矩把这三样锁住:

  1. 原件只有一份。其他都是复印件,信息单向往外流——这就是"资料过时"的根治法。
  2. 判断的不动手,动手的不判断。两个 AI 不同时改一份东西,谁执笔谁负责,另一个只看只提。
  3. 危险动作必须人点头。删除、改线上、任何不可逆的操作——AI 再聪明,拍板永远是人。

这一级最常见的误判:以为这是"技术活、得会写代码"。三样配置里没有一样是技术问题——哪份是原件是管理问题,记什么、记在哪是流程问题,谁能动什么是权责问题。它们在你没有 AI 的时候就存在,AI 只是让它们变得无法回避。

做到什么算过关:换一条对话、换一个人接手,工作照样能接上;出了错能查到是哪一环断的;你敢让它动手,是因为你知道它动不了哪些东西。

注意这一级的过关标准变了:前两级问的是"它给的东西对不对",这一级问的是这套东西离了你还转不转。这是从"会用 AI"到"用 AI 干生产"的分水岭。

你现在在哪一级

按顺序问自己,第一个答"是"的地方,就是你该补的那一级

问一 · 换条对话,背景要重说一遍吗?

答"是"的典型样子:你有一段固定开场白存在备忘录里,每开新对话就粘一次;或者你干脆不敢关那条聊了三个月的对话。

你在第一级,该往第二级走。别再优化那段开场白了,该给它配柜子了。

问二 · 源头资料改了,它知道吗?

答"不知道"的典型样子:价格调了、流程改了、规则变了,你得记着回去把传过的那份也换掉——而且经常忘。

你在第二级,该往第三级走。问题不在你记性差,在于你让复印件当了权威。

问三 · 它答完,最后一步还是你自己动手吗?

答"是"的典型样子:它把内容写得很好,你复制、粘贴、改格式、存到该存的地方——每天重复十几次。

你卡在第二级到第三级之间,缺的是分工,不是资料。再多传十份文件也解决不了。

三问都过了,你要面对的是新问题:怎么让这套配置稳定地跑下去、并且能交给别人——那时候你要找的已经不是"更好用的 AI",而是"更清楚的规矩"。

四条守则(比层级更重要)

守则一 · 别跳级

第三级的配置搭在第二级的资料之上,第二级的资料喂给第一级的任务单。跳过前两级直接搭配置,等于给一匹还不听指令的马装挽具——挽具越精密,翻车越难看。见过最典型的一种浪费:连自己的常用资料都没归好,先去搭一套能自动跑的流程,结果流程跑得飞快,喂进去的全是错料。

守则二 · 每一级的"过关"都是行为,不是知识

知道台面会满,和真的会在该重开的时候重开,是两回事。上面三个自检问句问的都是你实际怎么干,不是你知道什么——所以这张地图看一遍没用,得对着自己这周的活答一遍。

守则三 · 上一级的坑不会消失,只是被接住了

装了挽具不等于任务单可以写得糊——它只是让写糊的代价不再是灾难。每一级都在为下一级兜底,不是替代它。所以你会发现:越往上走,越回头感谢第一级的功夫。

守则四 · 三级不是三种人,是同一个人的三个阶段

没有谁"天生属于第三级"。同一个人,做熟悉的活可能在第三级,换个新领域立刻掉回第一级——这很正常,甚至是对的。地图的用处不是给自己贴标签,是每接一件新活,快速判断这次该从哪一级起步。

再往前一步(新兴动向,看看就好)

三级之外,业界正在讨论第四种说法——把多个"检查—修正—再来一遍"的回路叠起来(有人称之为 Loop Engineering)。它还没有成为定论,目前更像是第三级里"反馈回路"那部分的展开。

放在这里只为一件事:你听到新词的时候,能把它挂到坐标系上,而不是又一次从零追新。遇到没听过的新概念,先问一句——它治的是哪一级的痛?答得出来,它就有坐标;答不出来,多半是包装。

伴读词条 · 概念词典

下一步

自己学的下一步

想看清这些工具本身是怎么一步步长成今天这样的?主线一给你另一套坐标——工具演进的驱动逻辑。

看工具演进坐标系

找我们做

看懂了自己卡在第三级,但不想自己一样样试出来——把事实源、记忆、分工配对,正是我们做的事。