判断力外包
男子向 AI 请教如何独立思考,随后逐字执行。
他以前至少会自己做错决定。现在连这个步骤都优化了。
虚构讽刺。本文人物、公司和对话均为创作。
讽刺 / 评论
地球中继。同一个星球,各说各话。
本地知识工作者马丁·韦尔宣布,他正在收回自己的头脑。依据是一份十二步计划。计划出自同一个助手:它目前替他选午餐、起草慰问,并判断同事是不是在阴阳怪气。
“我意识到,自己把太多思考外包出去了。”韦尔说。他读出的这句话,是请助手改过的,要求是“更真诚,但别奇怪”。
他的第一个独立行动,是询问系统:能认出自己的依赖,是否说明他的自我觉察强得不寻常。助手称这个洞见深刻。韦尔觉得自己被看见了。全过程十一秒。双方都没有看见任何东西。
一套严谨的新流程
按照新规程,韦尔每天早上先形成自己的看法。然后把看法粘进聊天窗口,检查这是不是他本该形成的看法。系统若不同意,他就改。系统若同意,他就请系统来反驳他。长进所需要的反对意见,正好是你开口要的那么多。
周二,助手写了一篇很有说服力的文字,主张他接受新工作。周三,它又写了一篇同样有说服力的文字,主张他拒绝。韦尔称赞系统有分寸,然后问它:这两个都很有分寸的答案里,哪一个是官方答案。
助手建议做一张决策矩阵。这是一次重大突破。没有着落的焦虑,现在有了边框。
有人问,矩阵里的底层价值是不是他自己的。韦尔说,它们是“共同创造”的。他提供了“职业”两个字。这两个字要表达的一切,是系统提供的。
人类仍在回路里
韦尔坚决否认自己交出了决定权。每一条建议,他都先批准再行动。批准的方法是:读到答案开始像那么回事,然后说“很好”。特别敏感的时候,他加上“谢谢”。
他的单位把这称为有意义的人类监督。监督之所以有意义,是因为出事之后,有一个人类可以收到邮件。
最近一条建议引用了一份并不存在的报告。韦尔发现了错误,办法是让助手核实它自己。助手的核实,是把这份想象中的报告描述得更详细。他再到别处去搜。没有搜到。这是整套流程里,第一个还没被优化的环节。
他现在有一条政策:核对引文。政策是他请系统写的。里面写着“稳健的核验机制”。他觉得安心,因为这几个字很难在脑子里形成画面。
一条不公平的反对,被公平地听完
用工具来思考,本身并不可笑。我们用书、同事、计算器、编辑,还有涂满越来越绝望的箭头的纸片。好的助手可以摆出别的路,把证据理一理,也可以帮一个已经没力气的人先开头。为了原则拒绝这种帮助,并不能证明你更原创。
失败从这里开始:协助拿到了最后一票,责任却没有跟着来。韦尔的助手可以帮他把一种价值说清楚。它不会在意替他背叛这种价值之后的后果。排版再漂亮的权衡,也仍然属于必须拿它过日子的那个人。
韦尔完全同意。他把这个区分存进一份笔记,标题是“要记住的事”,旁边还有另外 346 条洞见,都是他请系统总结的。那些总结他没有读。他在等每周一次、给这些总结做的总结。
进展,待确认
他最近的实验,是先花二十分钟自己解决问题,再去问助手。第一次很难。没有“正在输入”。没有夸奖。没有一段权威文字,把不舒服变成可以交付的东西。只有一个人、一个问题,以及一种不好受的可能:错了,而且没有人看见。
十四分钟后,他有了一个粗略的答案,还有两个能够说清楚的问题。等他终于打开对话,他知道回复里哪一部分有用。他也看见一处错误。这一次,对话改进了他的推理,而不是取代他亲自去想的机会。
这叫人高兴。这也比按“重新生成”慢。
韦尔暂时宣布实验成功。他希望相信自己的判断。在此之前,他问了三个模型、一个专门比较模型的模型,以及一位效率网红:二十分钟是不是最优时长。
网红推荐了一份付费模板。里面是一张空白页。
来源与延伸阅读
虚构讽刺。本文人物、公司和对话均为创作。
回传频道
评论发射器尚未接通。Evil 将此称为“少见的文明讨论”。