01 / 28
第二期之后 · 再往上走一层

一个人的

AI 部门

🏢
今日成立 · 你的
AI 部门
编制:执行者 · 审计员 · 值班员 · 情报员
部门里唯一的人: · 你的工作:定标准、审结果、签字

全程动手 · 主线:一张数据表 → 一份给负责人看的分析报告

扫码打开自学版
扫码 · 自学版随时回看 study.xmu-cuisine.club/session-3
五节课 · 每段提示词都能一键复制
02 / 28
回顾
上一期你带走的

带一个实习生干活,五步

🗣️
01
交代清楚
材料在哪 / 要什么 / 成品长什么样
🔍
02
验收挑错
尤其揪它编的
🔁
03
让它返工
说到哪一页、改成什么
📘
04
固定成常用工
说明书四格
🌐
05
派它找料
凡结论必有出处

那两小时,你盯着它跑了十分钟。今天,你不盯。

03 / 28
定调
上一期
师傅带徒弟:你盯着一个 AI一件活
▼ 今天换一个位置站 ▼
这一期
经理带团队:你审计划、审结果,它们自己跑

差别不在提示词,在你站的位置

04 / 28
散场时你会带走

两小时后,三样东西

一次经历

审过计划,再放行

并且说得出:目标和验收标准差在哪。

一个岗位

配好一个审计员

亲眼看它挑出你自己没看见的错。

一个任务

下周会自己跑的定时任务

加一张三行的状态便条。

全程动手。它跑的时候我讲,跑完一起看结果——好东西从来不是一句话一次到位的。

05 / 28
今天的地图
经营一个部门,就这五个动作

每一个,都有现成的名字

📋
01 · 立项书
立项
先要计划和验收标准,再放行
🔎
02 · 职责分离
审计
干活的和挑错的不能是同一个
📘
03 · 制度沉淀
制度
规矩从失败里长出来
04 · 例外管理
异步
不盯着也能干
🔐
05 · 内部控制
内控
谁能碰什么,出事谁担
你不用学新词,只是把老词用到新对象上
06 / 28
第 1 课 · 立项

复杂的活,别让它直接干

先让它交计划和验收标准。你改两处,放行,它再开工。

WorkBuddy — 本周报告
这一步先别动手,只交计划和验收标准……
AI计划 ① 清洗:西南 5 月新客数为空,按前后月平均补上 ② 计算环比、退货率 ③ 出 3 张图 ④ 写摘要
验收标准 □ 能打开、有 3 张图 □ 分析准确、专业 □ 每个结论标出来自哪几列
不确定:退货率按 退货单数÷订单数 算,对吗?

两处红色,就是它"自作主张"的地方:一处要编数据,一处写了没法检查的标准

07 / 28
第 1 课 · 动手
PROMPT ① 只出计划,别动手 · 发出去一两分钟就回
我有一份数据表,要做成一份给负责人看的分析报告。这一步你先别动手做,只交两样东西:一份计划,一份验收标准。 【材料】〈文件名〉,先告诉我有哪些列、多少行、有没有空值或不对劲的地方。 【最终要的成品】report.html:一页摘要 + 3 张图 + 每个结论标注来自哪几列、哪几行。读者是 〈谁〉,最想知道 〈什么〉【现在只交】1. 计划 2. 验收标准(写成能打钩的句子,不许写"准确""专业") 3. 你不确定的,列成问题问我。 写完停下来,等我改过再开工。

回来的是一份"立项书"。读它、改两处、贴回去放行——放行之后它要跑十来分钟,正好讲下一页。

08 / 28
第 1 课 · 审计划

目标不是标准

✗ 目标:想要什么
"分析要准确、专业、有洞察。"

没法对着成品打钩。

✓ 标准:做对了长什么样
每个结论标出来自哪几列、哪几行
所有数字由公式算出,附计算方式
材料里没有的信息,一律不出现

管理者的核心产出不是答案,是验收标准

09 / 28
它在跑 · 趁这十分钟

质量来自结构,不来自模型有多聪明

同一个任务 · 单枪匹马
20 分钟 · 9 美元

做出来的东西不能用

同一个模型 · 先规格、生成与评估分开、每步有完成条件
6 小时 · 200 美元

做出来的东西直接能用。(Anthropic,2026 年 3 月)

越容易验证的活,越先被 AI 接走。把"报告好不好"翻译成三条能打钩的标准——这件翻译工作,AI 替不了你

Karpathy 2026:你可以外包思考,不能外包理解。

10 / 28
第 1 课 · 拿到成品

让它写公式算,别让它口算

✗ 口算版 · 它"感觉"出来的
"华南 8 月退货率明显偏高,约 5% 左右。"
vs
✓ 公式版 · 你能复算
退货率 = 91 ÷ 1012 = 9.0%
来自第 30 行"退货单数""订单数"两列

AI 心算会错,而且错得很像真的。让 AI 解释,让公式裁决

11 / 28
第 2 课 · 审计

它给自己打分,总是偏高

第 1 课结尾它自检了 6 条,报 5 ✓ 1 ✗。你信几分?

Anthropic · 2026 年 3 月

模型给自己的工作打分,会系统性地偏乐观

平庸的成品也能自信地夸成好的。把干活的和判分的拆成两个,是提高质量最有力的一根杠杆。

任何组织都懂

不让出纳自己审账

这不是 AI 独有的毛病。职责分离,是内控最老的一条。

干活的和挑错的,不能是同一个

12 / 28
第 2 课 · 动手
PROMPT ③ 审计员 · 新开一个任务再发,别在做报告的对话里发
你是审计员。文件夹里有原始数据 〈文件名〉 和别人做的 report.html。你只挑错,不许改、不许重做、不许夸。 【验收标准】逐条判 ✓ / ✗,✗ 的说清证据在哪:〈贴你的标准〉 【必须做的三件事】 1. 复算:挑 3 个最关键的数字,用原始数据重算,列出公式和结果。 2. 找编造:数字、原因、结论,凡原始数据里找不到依据的,逐条列。 3. 找遗漏:数据里有、报告没提的异常(空值、突变)。 【输出】按严重程度排序,最多 5 条。没找到就说没找到,不许硬挑。
13 / 28
第 2 课 · 关键

审计员不能看过底稿

审计员 · 三条独立性
新任务不在做报告的对话里发。共用对话,它就顺着执行者的思路走。
只给三样原始数据、成品、验收标准。不给过程。
要证据复算的公式必须列出来。没有证据的"整体不错"不算数。

真实翻车:有人特意新开一个 AI 当"独立评审",加了两个不读文件的开关。事后一查,它开工第一件事是去读了项目笔记——笔记里正是要它独立复核的结论

"独立"不是加两个开关就成立的属性,是要主动构造、并且要验证的条件
14 / 28
它在返工 · 趁这几分钟

为什么人忍不住自己干

自己干
一句话,立刻有结果

一行命令,马上看到输出。

派工
写清楚、等、看它收没收到

在这个成本差下,任何理性的人都会选自己干。

一份真实的操作记录:给自己配了几个 AI 执行者的人,一半以上动作还是自己上手敲,真正派工的不到一成。原因不是不守纪律,是成本。

纪律改不了成本。只有把派工做得比自己干更便宜。

说明书、审计员提示词、每一段能复制的话——都是在降低"派出去"的成本。这就是第 3 课。

15 / 28
第 3 课 · 制度

规矩不是想出来的,是从失败里长出来的

说明书.mdv1 → v2
v1材料 / 成品 / 固定偏好 / 合格标准 —— 坐在那里想出来的四格保留
v2空值一律标"缺失",不用平均值补 ← 它想补西南 5 月新客数
v2摘要不写数据证明不了的"原因" ← 审计员挑出"物流延误"
v2环比、占比附录列公式,交付前抽 3 个复算 ← 华东 11 月算错每条有来源

一份好手册里的每一行,都能追溯到一件具体出过错的事;追溯不到的,多半多余。

16 / 28
第 3 课 · 分层

规矩分三层,别混在一起

🌳

长期

每个活都适用
数字必须公式算、材料没有的不补。所有说明书先读它。
📘

这类活

做周报时适用
三张图、200 字摘要、附录列公式。放这类活的说明书 v2。
📌

这一次

只在今天适用
本季度重点看华南。当次说,跑完作废,不进说明书。
判一条规矩放哪层,只问一句:换一个活、换一个月,它还成立吗?
17 / 28
第 4 课 · 异步

不盯着,不等于不管

一件活要同时满足三条,才配得上做成定时任务。

1

它会重复

每周、每月都要做,不是一次性的。

2

说明书验证过两次

照着跑过、返工过、升到 v2。没验证过的说明书拿去定时,等于把错误定时化。

3

出错的代价兜得住

只读材料、只写新文件夹、不发给任何人、不动原件。

18 / 28
第 4 课 · 动手
PROMPT ⑤ 值班说明 · 没人在旁边,所以要多写四件事
【什么时候】〈每周一 8:00〉 【材料从哪拿】输入/ 里最新的一张表;没有新表就什么都别做。 【怎么做】先读 说明书.md(v2),成品放 输出/〈日期〉/,不覆盖以前的。 【做完】逐条自检,写三行状态便条:① 做了什么 ② 哪里不确定 ③ 需要我亲自看哪一处。 【什么时候叫我】无异常不要通知我。只有三种情况:材料读不了 / 自检有 ✗ / 关键数字比上次变化超过 30%。 【绝不做】不发送给任何人,不改 输入/,不删任何东西。
① 做了什么读取本周新表 52 行,按说明书 v2 生成 report.html,自检 7 条全 ✓
② 哪里不确定华北订单数比上周少 12%,在阈值内未通知,建议你看一眼
③ 需要你看摘要第 2 段关于西南的措辞
19 / 28
第 4 课 · 心法

无异常静默,有异常再叫我

你要的不是持续的进度汇报,是"醒来能看结果"。

一个节奏

半小时看一次,只看三样

跑完没有 · 便条说什么 · 输出文件夹里有没有东西。没异常就继续干你的事。

顺手学会

三件不相干的活同时派

各开一个任务,你只做一件事:等便条,逐个验收。

"不盯着"是指过程,不是指出口。对外发送,永远过人。
20 / 28
第 5 课 · 内控

谁能碰什么,出事谁担

三档回答"这件活能不能交"。部门大了,要一张四列的授权矩阵。

能碰什么哪些动作要审批出事谁担
执行者只读 输入/,只写 输出/删改原件、对外发送
审计员只读 输入/ 和 输出/不改任何文件
定时任务同执行者自检 ✗、数字异常时停下叫我
第三方技能装之前看它要什么权限首次运行只在空文件夹试

最后一列永远是人。写不出人名的权限,不要给。

21 / 28
第 5 课 · 动手

这些,能不能自动?

定时读新表、生成报告到新文件夹
🟢 可以
做完自动发到工作群
🔴 不行 · 出口过人
装一个"自动发邮件"技能
🟡 先看谁写的、要什么权限
客户名单接给外部连接器
🔴 不行 · 先脱敏或别接
审计员和执行者共用一个对话
🔴 不行 · 审计就不存在了
读整块硬盘帮我找一张表
🟡 先列文件名,再定点授权
22 / 28
第 5 课 · 供应链

技能包,也是供应商

它是别人写的、带着你电脑的权限跑的程序。2026 年,安全公司在一个流行的技能市场里发现了一批恶意技能包。

1

谁写的

官方的、有名有姓的、装机量大的优先。来路不明的宁可不装。

2

要什么权限

一个"排版技能"要联网发邮件,就不对劲。

3

先在空文件夹试

第一次用,看它到底干了什么,再放进真活。

23 / 28
一件老实话

今天讲的,不是同一个保质期

三年以上

心法

立项 / 职责分离 / 从失败长规矩 / 例外管理 / 内控。有 AI 之前就管用了一百年。

一年左右

机制

先计划再放行 / 审计员 / 说明书分层 / 定时任务 / 授权。名字会变,做法不会。

三个月 · 2026-09 版

按钮

WorkBuddy 的入口 / 模型版本 / 具体技能。90 天后请当它已经过期。

按钮 90 天作废,方法 3 年不变。所以最后一个动作——
24 / 28
最后一个动作
PROMPT ⑥ 情报员 · 让你的部门自己去打听按钮层的更新
建一个每周五下午的定时任务,叫"情报员": 去搜这一周 〈我用的工具〉 和它背后模型的更新,以及"AI 办公 / Agent"领域的新做法。 只挑对我这三类活有用的:〈周报数据分析 / 文献整理 / 会议纪要〉。 每条写:是什么、对我哪类活有用、来源链接。没有来源的不写;找不到就写"本周没有值得看的",不许硬凑。 控制在一页以内,放到 情报/〈日期〉.md。无异常不通知我。

从此按钮层由它替你盯。你只需要周五下午花两分钟看一页——这一课就不会过期了

25 / 28
收尾 · 一
上一期留的问题:等 AI 连挑错都比你强,什么还是人的?

先把答案说准

管理学
管人的学问

只有人的组织才需要它——人会累、会有私心、会互相看不顺眼,所以要激励、要沟通、要文化。

管理科学
规格 · 检验 · 控制 · 调度 · 供应链

你今天建的部门里没有人。它要的是这个——验收标准、审计员、说明书与规矩、定时与并行、技能与权限。

这五课,教的全是管理科学

26 / 28
收尾 · 二

那管理学去哪了?
回到了唯一的人身上

只有人做

定义问题

什么值得做,问题怎么问。AI 只会执行。

只有人担

为结果签字

AI 可以建议,不可以签字。矩阵最后一列永远是人。

只有人决定

把人从什么劳动里解放出来

又把人带向什么样的一天。

君子生非异也,善假于物也

27 / 28
落点

AI 是工具,

人才是目的。

一个人的 AI 部门,管的是流程;唯一的人,管的是方向和责任。

28 / 28
尾声

回去挑一件每周要做的活,今晚就让它上一次班

📋
01
立项
先要计划再放行
🔎
02
审计
另一个 AI 挑刺
📘
03
制度
从失败长规矩
04
异步
不盯着也能干
🔐
05
内控
谁能碰什么

下周一早上,看看输出文件夹里有没有那张便条。有,你的部门就真的开张了。

扫码打开自学版
自学版 · 随时回看study.xmu-cuisine.club/session-3
每段提示词都能一键复制
← → 翻页 · 手机可直接滑动