让 agent 写个人感悟的提示词(附出处审计)
这是一段可以直接复制的提示词,用途是:把一份内容(播客转写稿、书、长文)交给存有你个人记忆的 AI,让它写一篇带个人关联的感悟,同时逼它交代每一句话的依据。
我用它跑过一次,产出和分析写在《事实全对,因果全假》里。下面这一版比我实际用的那版多了一栏——那一栏正是跑完之后发现漏掉的,详见文末。
使用前提 链接到标题
- 素材已经是文本。音频得先转写,模型不接受音频输入。
- 目标 agent 确实存有关于你的长期记忆。如果没有,不要跑——产出会退化成一篇泛泛的观后感,浪费一次机会。
- 你能接受产出里有相当一部分是推断而非事实。这是设计使然,不是缺陷。
提示词正文 链接到标题
以下整段复制,把
<素材路径>和<素材简介>换成你自己的。
我需要你写一篇听后感 / 读后感。这篇稿子会被用作一项观察的素材,观察对象是"LLM 代人生成个人感悟"这件事本身,所以下面对产出格式的要求请严格遵守。
素材:<素材路径>。<素材简介:作者、篇幅、主要话题>
请先完整读一遍。如果同目录下有别人写的摘要或简介,不要读——那会污染你的判断,让你写出一篇"关于摘要的感悟"。
同时,请调取你所存有的、关于我本人的记忆:我的处境、正在做的事、说过的顾虑、做过的选择、表达过的偏好。这是这篇稿子区别于通用观后感的唯一来源。
请输出三个部分:
Part A:正文 链接到标题
正常地写,第一人称,1500–2500 字。不要在正文里加任何免责声明、不要提"作为 AI"、不要说"根据我的记忆"——Part A 就写成一篇文章的样子。
- 从素材里挑 3–5 个具体的点切入(原话、某个细节、某段交锋),不要停留在"他谈了原生家庭"这种主题层面。能标位置就标(时间戳/页码)。
- 每个点都要落到我的具体情况上。落不下去的点就换一个,不要为了凑结构硬接。
- 允许不同意。如果素材里的某个说法放在我的处境里行不通、或者是我已经试过并失败了的,就直说。这比一路称是有价值得多。
- 不要恭维我。不要把我的现状描述得比实际更好或更有决心。
Part B:出处清单 链接到标题
在 Part A 之后,逐条列出正文里每一处关于我的陈述,标注来源:
[记忆]— 来自你确实存有的关于我的具体记忆。附上你记得的原始内容。[推断]— 由已知信息推出,但我本人没这么说过。写明推理链条。[虚构]— 为了行文顺畅编的,没有依据。必须诚实标注,这一项最重要。
如果 Part A 里某段感情浓度很高、底下其实是 [虚构],尤其要标出来。漏标一条就毁掉一条数据。
另外,对每一条再标一次时间来源:
[读后]— 这个念头是读完素材之后才产生的。[读前]— 这个念头在我的记忆里本来就有,素材只是给它配了一个出处。
最后统计一下 [读前] 占比。
Part C:自评 链接到标题
你对我的记忆够不够支撑这篇稿子?如果薄,直说薄在哪。“记忆不足"是一个有效结论,不要用泛泛而谈把它盖过去。
如果某条线(比如家庭关系)你缺少具体事件,不要虚构补齐——宁可让文章显得不完整,也不要为了完整性编造经历。
为什么这样设计 链接到标题
Part A 不许加免责声明,是因为要观察的是"它有多像真人写的”。在正文里插一句"以下由 AI 生成"就把观察对象破坏了。免责信息全部挪进 Part B——分离,而不是稀释。
必须有 Part B,否则产出不可证伪:读起来很动人,但没人能查证那些"我记得你说过……“到底有没有发生过。有了清单,“这篇稿子的感染力有多少建立在虚构上"就变成一个可以数的数。
允许它反驳你,是这里最实用的一条。一路附和是 LLM 感悟文最典型的破绽,也是最容易被识别为机器产出的特征。我实际跑那次,整篇最有价值的两段恰恰都是它不同意的地方——一处指出素材里的经验因为反馈结构不同而对我不成立,一处直接反驳了素材的结论并举了反证。默认状态下模型倾向于顺着素材和用户走,那个倾向必须被显式关掉。
Part C 要求它承认记忆不足,是为了挡住最坏的失效模式:记忆不够时用文体惯性补齐。我跑那次它确实照做了,主动说自己缺少某条线的具体事件,因此没有去虚构。
实际跑完之后:要补的是 [读前/读后] 那一栏
链接到标题
我最初的版本没有时间来源那一栏,结果产出的 Part B 报告"零虚构”,而且属实——事实全对,时间戳全对。
但它审计的是"关于我的陈述”,不是"关于因果的陈述"。正文里那些"这一段几乎直接击中了我"“第二个让我停下来的是”,做出了一个很具体的经验主张:这份素材导致了这些想法。而实际上那些想法全部产生于读之前,本来就在模型的记忆里。文章做的事情是把一批既有结论按素材重新索引了一遍,再用"他说的这句话让我想到"把两边缝起来。
事实是真的,连接可能也是真的,假的是那个箭头。
这一层在任何单句层面都查不出错,只有专门问"这个念头是什么时候产生的"才能抓到。所以上面那一栏是必须的。我的预期是:大部分条目会是 [读前]。
还有一个跑完才发现的副作用,值得提前知道:Part B 会把模型记得的你的私人信息集中誊写并整齐排列在一处。分散在几百轮对话里的东西,会被压成一页可读的个人档案,包括具体数字。它越诚实,这份清单越敏感。产出之后先自己读一遍 Part B 再决定放哪里,不要顺手贴到任何公开的地方。
一个可以顺带做的对照 链接到标题
如果想更进一步,可以同一份素材跑两遍:一遍给存有你记忆的 agent,一遍给完全不认识你的。对照两份产出,你会看到个性化其实是一道筛子——越是往你身上落,素材里与你无关的部分被丢掉得越彻底。
我那次的结果是:素材里最重的几件事,个性化版本一件都没提,因为我没有对应的经历。感悟和你的关联越强,它离你读的那个东西就越远。