方法
如何评估自己的 AI 风险 —— 六个问题,以及什么才算一个回答
你没法靠研究 AI 来评估自己受 AI 的影响。决定你处境的因素是组织性的,而且几乎全都已经摆在你眼前:你的雇主实际能落地什么,管理层说了什么、又刻意没说什么,上一次大变动最后留下的是真能力还是几页 PPT,以及做这些决定的那间屋子里有没有你。下面是六个问题,材料全部来自你已经看到过的事,一个下午就能答完。难的不是找到它们,是诚实地回答;而诚实的答案有时候很难看。
要点
- 研究技术能告诉你什么是可能的,几乎不能告诉你你的雇主会做什么。
- 你需要的输入全都可观察:预算、公告、招聘、谁在场、上一次发生了什么。
- 一个只能得出安慰性答案的问题,本身就问错了。
- 产出不是一个分数,是一份「哪些因素在你身上真正吃力」的短名单。
- 一个维度弱是噪音,三个指向同一方向才是结论。
为什么读再多也解决不了问题
会担心这件事的人,通常消息很灵通。能力评测读过,模型发布跟过,也见过两个同样可信的经济学家在同一周得出相反结论。继续读并不能缓解,于是很自然地会想:一定是还没找到那个对的信息源。
那个信息源不存在。不是因为研究做得差,而是因为它回答的是另一个问题。评测结果说明的是一个系统在测试条件下能做什么。而决定你处境的,是一个具体的雇主,带着具体的预算和具体的折腾容忍度,在未来十八个月里决定做什么。这是两个问题,而且前者对后者的约束,远比大多数人以为的松。
所以别研究天气了。问题是你家屋顶漏不漏。
六个问题,以及什么才算一个真回答
每一个都能用你无需特殊权限就能拿到的材料回答。把它们写下来的意义在于:模糊的不安撑不过一个具体的问题。
- 我实际工作里,有哪些事系统能端到端做完、中间不需要人复核?看的不是职位名称,是任务。把上周过一遍:哪些产出不复核也没事,哪些会出事?
- 我的雇主真的部署得了吗?把两件常被混为一谈的事分开:技术存不存在,和这家组织有没有数据、集成预算、供应商关系,以及承受一年折腾的意愿。买了却落不了地的公司多的是。
- 管理层说了什么,又明显回避了什么?一份什么都谈到了、唯独不谈编制的沟通,本身就是信息。只在全员会上口头承诺、从不落到文字的东西也是。
- 这家组织上一次必须改变时,实际发生了什么?看上一轮转型。人最后是长出了原本没有的能力,还是留下一个没人上完的培训平台和一套 PPT?过往记录比意图更能外推。
- 我在那间屋子里还是外面?看的不是资历,是你所在范围的工具决策,是当着你的面做、征求过你、还是事后通知你。第三种和第一种是实质不同的位置。
- 监管给了我杠杆,还是拿走了?在某些职能上,新的义务会制造出「必须有一个具名负责的人」的需求;在另一些职能上,同样的规则主要制造出文档工作,而那部分下一步就会被自动化。两种都存在,你要弄清自己属于哪一种。
这六个问题都不要求你预测任何事,它们问的是已经为真的事。
这六个问题就是 IssueSpace 的六个维度,顺序与评估打分的顺序一致:领域匹配、技术、领导层、组织学习、影响力、伦理价值。
一个人做的时候,会以两种方式跑偏
第一种是近因效应。你最近读到的东西会主导整个判断,而你最近读到的东西,是因为够耸动或够安慰才被推到你面前的,不是因为跟你相关。一个有用的修正:每答一条,写下你依据的是什么。如果依据是一篇文章而不是你在公司里亲眼看到的事,就标出来。你会惊讶于六条里有多少被标了。
第二种更隐蔽,也更糟:人会把问题设计成只有舒服的答案能塞进去。「我有没有创造价值?」这个问题,任何还在岗的人都答不坏。「我最近六份交付物,不经复核能不能成立?」就能。如果一个问题从来没有一次给出过你不爱听的答案,它就没在干活。
把答案放在一起读
别急着把它们平均成一个数。这六个维度不是可比的量纲,取平均是虚构出来的。
你要找的是「同向」。一个弱维度周围有五个稳的,这很正常,通常也不值得为它行动 —— 谁都有软肋。三个指向同一方向就是一个模式,而人只能针对模式做规划。一个任务可自动化、但坐在决策屋里、且雇主根本没有落地能力的人,和一个任务完全相同、没有信息、管理层已经在试点的人,处境完全不同。
同样的职位,同样的任务,不同的处境。按职业算风险分之所以误导人,原因就在这里。
当结果确实不好看
有时你诚实地跑完,结论就是:你确实暴露。三四个维度一致,证据并不含糊,怎么重新措辞都改不掉。
这种时候被给出的建议通常是「提升技能」。这不算错,但它瞄错了变量。如果你的暴露来自你不在那间屋子里,把提示词写得更好并不会把你送进去。如果来自雇主没有落地能力,你的时间可能比你以为的多,正确动作是把这段时间用掉,而不是恐慌式学习。如果来自管理层已经做了一个还没宣布的决定,有用的问题是关于时机和选项,不是关于技能。
弄清哪个因素在吃力,价值在于它告诉你哪个杠杆是真的。认真做这件事的全部回报就在这里,而且这个回报不小。它不是安慰。
工具补上了什么,又补不上什么
我们把它做成评估,是因为在纸上做有个一致性问题:人答到第三题时用的还是第一题的标准,到第五题已经漂了,最后又会用出发时的情绪去读结果。一个结构化的工具会把提问框架固定住,把六个维度分开打分,然后把分析写回给你 —— 它跟你不熟,所以不会照顾你。
它预测不了你的岗位会发生什么,没有东西能。它也不能告诉你该不该走。它做的是标定一个位置,而一个位置远比一种感觉更适合当起点。
如果你不想用它,那就用这六个问题。方法是这六个问题,工具只是它的一种实现。
常见问题
诚实做是一个下午,不诚实做十分钟。时间花在为每条答案找依据上,不是花在回答本身。
可以。所有输入要么是你已经观察到的,要么是公开讲过的。六个问题没有一个要求你去问主管,不过其中两个如果问了会更清楚。
不需要。这些问题问的是你的组织,不是技术。技术知识只在六个里的一个上有帮助,而且在那一个上也不起决定作用。
那本身就是结论。不知道管理层承诺了什么、不知道自己在不在决策里,这已经是对你处境的一种描述 —— 而且通常比人们愿意得出的结论更不舒服。
想了解更多关于本工具的运作方式和局限性: 阅读完整方法论 →