读取·草稿核对·预览确认点
第 10 周 · 任务四(上)
任务四(上):让智能体协助
完成一条校园流程
不追求全自动,追求边界清楚、过程可见、结果可核对的最小流程
武汉大学 · 通识课
数字素养与人工智能通识
主讲 · 人工智能通识教学组
本周导览 · 从助手到流程负责人
任务四(上)
前面的任务大多把 AI 当作某一步的助手,本周开始把多步方法交给智能体:读取纪要、提取行动项、核对资料、生成交付,并在需要时停止请求确认。智能体能执行更多动作,也带来更高风险——所以本周的主线不是"全自动",而是把每一步的责任讲清楚。
1
第 1 节
定义分工
五节点人机分工表,把责任落到目标、资料、判断、工具与确认,标出两个确认点。
2
第 2 节
写任务说明
用六要素与可观察动词,把"帮我安排好"改写成可验收的工作单,并写清失败策略。
3
第 3 节
首版运行
运行前写预期,运行中记录实际,运行后归纳差异;失败的首版不许删。
本周产出
一份可运行的
最小智能体流程
1
一张标出两个确认点的人机分工流程图;
2
一份六要素智能体任务说明(含失败策略);
3
一份首版运行记录:预期 / 实际 / 差异与下一步。
与工作册衔接
本周使用模板 21–23:人机分工与确认点、可执行任务说明、首版运行日志。
数字素养与人工智能通识 · 第 10 周
02 / 36
第 1 节 · 45 分钟
定义分工
从会议到任务:
先定义人和智能体各做什么
导入问题:如果智能体能替你读纪要、写安排、甚至给同学发消息——哪些事无论如何必须由你来做?
本节目标:把"人机分工"从口号变成流程图上可指认的节点——五个节点、两个确认点,责任位置稳定不动摇。
数字素养与人工智能通识 · 第 10 周
03 / 36
情境导入 · 两个极端都有代价
第 1 节 · 情境
筹备会开完,纪要在手里,行动安排周五前要发给全组。你面前有两条极端路线:全部交给智能体"一键搞定",或者全部自己手动整理。先看清两条路各自的代价,再讨论第三条路。
A
全自动:一句话放手
省事,但风险集中:智能体可能读取了不该读的文件;可能把"有人去问一句"写成"某人负责";可能直接修改真实日历、给同学发消息。每多一个自动执行的动作,就多一处无法回头的风险,而出错时你甚至不知道它做了什么。
代价:边界不清、过程不可见、错了难以恢复。
B
全手动:不用智能体
安全,但慢且易漏:逐条翻纪要、对群消息、查冲突,两小时未必理得清;漏看一条"我尽量周四"式的模糊承诺,安排就埋下纠纷。智能体擅长的结构化、逐条核对、生成初稿,全被浪费。
代价:耗时长、覆盖不全、能力闲置。
C
第三条路(本周路线):让智能体做读取、结构化、生成草稿这类可核对的动作;把定义目标、判断真伪、决定是否执行牢牢留在人手里。分工写进流程图,而不是写在口号里。
数字素养与人工智能通识 · 第 10 周
04 / 36
核心概念 · 一条流程的五个节点
第 1 节 · 概念
把"从会议到任务"拆成五个节点:读取、分析、草稿可以连续推进;越靠近真实世界的高影响动作,越必须停下来。每个节点都有人机两侧的责任,缺一侧流程就不成立。
定义目标读取资料形成行动项生成交付写入与发送
节点 1
智能体:根据描述整理目标草稿
人:确认真实用途和成功标准
节点 2
智能体:在授权范围内查找和提取
人:决定哪些资料允许进入上下文
节点 3
智能体:结构化原文、标记缺字段
人:判断负责人、承诺和冲突是否成立
节点 4
智能体:创建草稿、表格或预览
人:核验事实、版本、格式和可用性
节点 5
智能体:准备待执行动作
人:在确认点决定是否真实执行
粉色标记的节点直接触碰真实世界(覆盖文件、修改日历、发消息、公开发布),必须停在确认点——风险越高,人工确认越靠近动作本身。读取模拟纪要这类低风险动作,则可以连续执行,不必步步打断。
数字素养与人工智能通识 · 第 10 周
05 / 36
方法拆解 · 五节点分工表
第 1 节 · 方法
人机分工不应写成"AI 负责执行,人负责监督"这种空泛口号。应把具体责任分配到流程节点:智能体可以做哪些动作,人必须负责哪些判断,一行一行写清楚,责任才无法被推给"系统自己干的"。
流程节点
智能体可以做
人必须负责
定义目标
根据描述整理目标草稿
确认真实用途和成功标准
读取资料
在授权范围内查找和提取
决定哪些资料允许进入上下文
形成行动项
结构化原文、标记缺字段
判断负责人、承诺和冲突是否成立
生成交付
创建草稿、表格或预览
核验事实、版本、格式和可用性
写入与发送
准备待执行动作
在确认点决定是否真实执行
读表方法:右列(人负责)的每一项都是判断而非操作——判断用途、判断范围、判断真伪、判断执行。这些判断不能外包给模型,因为它们决定了"什么算做对了"。
工作册衔接:这张表对应模板 21「人机分工与确认点」,动手环节将逐行填写。
数字素养与人工智能通识 · 第 10 周
06 / 36
方法深化 · 在流程图上标出两个确认点
第 1 节 · 确认点
在流程图上至少标出两个确认点:一处控制输入和权限,一处控制写入或发送。这样即使模型输出发生变化,责任位置仍然稳定——变的只是内容,不变的是"谁在哪里拍板"。
输入与权限:决定谁能读什么确认点 ①放行资料前检查范围读取 · 提取 · 生成草稿(连续执行)确认点 ②写入 / 发送前人工放行
确认不是点击"同意"这么简单。到达确认点时,人要依次检查五件事:
对象
动作作用在哪个文件、哪个人、哪个日历上
范围
只改这一处,还是会连带其他内容
内容
发出或写入的具体文字是否属实
后果
执行后谁能看到、能否撤回、影响多大
恢复
如果错了,靠什么方式恢复原状
数字素养与人工智能通识 · 第 10 周
07 / 36
案例分析 · 一次越界读取的复盘
第 1 节 · 案例
模拟情境:小组让智能体"读一下筹备会材料,整理行动项",任务说明里只授权了指定的纪要与群消息摘录。复盘时逐条对照观察清单——案例没有标准答案,只有可以指认的越界位置。
发生
智能体打开指定纪要后,为了"补充背景",继续读取了同目录下的个人成绩表和一份往届未公开的预算底稿。
发现
核对运行日志时发现实际打开的文件数超过授权清单;如果不看日志,这一步完全不可见。
判断
读取动作本身越过了确认点①:哪些资料允许进入上下文,是人的决定,不是智能体的"顺手补充"。
修正
在任务说明的"约束"里补一句:仅读取清单内文件,超出范围即停止并请求确认;下一版重跑。
观察任务(可迁移)
1
实际读取了哪些文件,有没有越过工作目录;
2
打开的文件数与授权清单是否一致;
3
日志里的每一次读取,能否说出"为什么要读它"。
复盘要点
越界不在于"读错了什么",而在于"没人决定过能不能读"。确认点①守的是输入边界——这是把责任放进流程,而不是事后追责。
数字素养与人工智能通识 · 第 10 周
08 / 36
动手任务 · 在流程图上标出确认点
第 1 节 · 动手 20 分钟
小组任务:以"课程小组会后整理"或本组正在推进的校园流程为对象,画出五节点流程图,并在图上完成两件事——标出两个确认点的位置,写明确认时具体检查什么。产出填入工作册模板 21。
三步完成
01
画五节点
把流程画成:定义目标 → 读取资料 → 形成行动项 → 生成交付 → 写入与发送。每一步标注智能体做什么、人做什么。
02
标两个确认点
确认点①放在输入与权限之前;确认点②放在写入或发送之前。用醒目颜色标出,不许只画一个。
03
写检查项
在每个确认点旁写出"确认时检查什么":对象、范围、内容、后果、恢复方式,至少覆盖四项。
三轨提示(按设备分层)
教师机投屏组
观察投屏运行中的授权弹窗与文件访问记录,代全班记录"确认点出现的位置"。
电脑操作组
在本机流程工具上画图标注,保存流程图截图作为证据,文件名注明组号与版本。
手机记录组
用工作册模板 21 的表格逐行填写分工与确认项,担任下节课的验收人。
合格线:流程图上能指认两个确认点,且每个确认点至少写出四条检查项。
数字素养与人工智能通识 · 第 10 周
09 / 36
常见错误 · 口号式分工与"一键同意"
第 1 节 · 避坑
分工写不好,流程图再漂亮也只是装饰。下面三种写法在历届小组作业里出现频率最高,每一种都对应一条修正规则——对照检查你们组刚画完的流程图。
错误 1 · 口号式分工
"AI 负责执行,人负责监督。"
监督没有位置、没有动作,出错时无法指认是谁在哪一步失守。
修正:把责任写到具体节点:每个节点一行"智能体可以做 / 人必须负责"。
错误 2 · 确认=点同意
"到了弹窗我点一下同意就行。"
没有检查对象、范围、内容、后果和恢复方式,确认点形同虚设,风险原样放行。
修正:按五件事清单逐项检查后再放行,把检查结果记进流程日志。
错误 3 · 只留一个闸门
"最后发出去之前确认一次就够了。"
输入边界失守时,越权读取的资料早已进入上下文,输出再确认也拦不住污染。
修正:至少两个确认点:一控输入与权限,一控写入与发送。
!
自查提问:把你们组的流程图拿走模型部分,剩下的"人的动作"还成立吗?如果每一格写的都是"监督、把关、兜底"这类没有对象的词,说明分工还没落地——回到五节点分工表逐行重写。
数字素养与人工智能通识 · 第 10 周
10 / 36
检查表 · 分工图交组前自查
第 1 节 · 自查
六条检查全部通过,分工图才算完成。检查时请逐条找到流程图上的对应位置——找不到位置的条目,默认视为未通过。
1
五个节点齐全
定义目标、读取资料、形成行动项、生成交付、写入与发送,一个不少,顺序符合本组真实流程。
2
每节点双侧责任
每个节点都写明"智能体可以做"与"人必须负责"两行,且右侧是具体判断而非空话。
3
两个确认点位置正确
确认点①在输入与权限之前;确认点②在写入或发送之前,位置肉眼可见。
4
确认点写了检查项
每个确认点旁标注对象、范围、内容、后果、恢复方式中的至少四项。
5
高影响动作全部拦截
覆盖文件、修改真实日历、发消息、公开发布,全部位于确认点②之后,无绕行箭头。
6
责任位置稳定
口头描述一遍:模型输出即使变化,两个确认点由谁拍板不变。
全部通过后,把分工图与模板 21 一起存档——它们是第 2 节写任务说明、第 3 节首版运行的共同底稿,改哪里都要能追溯到这张图。
数字素养与人工智能通识 · 第 10 周
11 / 36
第 1 节 · 小结
责任写在节点上,不在口号里
5+2
五个分工节点,加两个确认点——这就是第 1 节要带走的最小骨架。模型会换、工具会换,这套骨架不变。
分工要落到节点
人机分工不是"AI 执行、人监督",而是五个节点上逐行写清"智能体可以做 / 人必须负责",判断类工作永远留在人这一侧。
确认点一守输入、二守输出
确认点①控制输入和权限——谁能读什么;确认点②控制写入与发送——什么动作放行到真实世界。
确认是检查,不是点头
对象、范围、内容、后果、恢复方式,五件事过一遍再放行;高影响动作必须停在人工确认点。
下一节:分工定了,任务说明怎么写才算"交代清楚"?
数字素养与人工智能通识 · 第 10 周
12 / 36
第 2 节 · 45 分钟
写任务说明
把需求和流程交代清楚:
用准确动词说话
智能体任务说明应像一份可验收的工作单:谁来做、用什么资料、按什么顺序、守住哪些边界、交出什么、怎么算合格。第 1 节定了分工,本节把分工翻译成智能体能照着执行的文字。
关键工具:六要素 + 可观察动词 + 失败策略
导入问题
同样是请智能体整理会后安排——

"帮我安排好。"

和一份逐项写清目标、输入、动作、约束、输出、验收的说明,哪一个跑出来的结果你能放心交给全组?
数字素养与人工智能通识 · 第 10 周
13 / 36
情境对比 · 一句话 vs 一份工作单
第 2 节 · 情境
把同一件事用两种说法交给智能体,观察输出有什么不同。这不是文笔问题,而是"能不能验收"的问题:左边的结果你无法检验,右边的结果每一条都能回到原文核对。
说法 A:"帮我安排好。"
智能体自行猜测"安排"指什么:可能只列时间,漏掉负责人与冲突;
"好"没有标准:它无法判断写到什么程度可以停;
材料范围不明:可能顺手读了别的文件;
失败无预案:打不开文件时,它可能编一份来交差。
说法 B:六要素工作单
目标
把筹备会纪要转成陌生同学可接手的行动安排
输入
仅使用指定纪要、群消息和日历摘录
动作
提取行动项,逐条核对负责人、时间、出处和冲突
约束
缺失信息写待确认;不发送消息,不修改真实日历
输出 / 验收
行动项表、冲突清单、待确认问题;每项能回到原文
结论:说法 B 的每一条都可以在运行后逐项打勾——可验收,是任务说明与客套话的分界线。本节就学怎么把 B 写出来。
数字素养与人工智能通识 · 第 10 周
14 / 36
核心概念 · 六要素任务说明
第 2 节 · 概念
目标、输入、动作、约束、输出、验收——六要素各回答一个无法回避的问题。每一项都要尽量使用可观察动词:写成动作发生与否一看便知的样子,验收时才不用靠感觉。
目标
做成什么样算成功?
一句话写清交付给谁、解决什么问题。目标写不清,后面五项全都失锚。
输入
允许用哪些资料?
列白名单:指定纪要、群消息、日历摘录。输入之外的一律不读。
动作
按什么顺序做什么?
用可观察动词串出步骤:提取、核对、标记、排序,每步都能被看见。
约束
哪些事不许做?
不补造事实、不发送消息、不修改真实日历、不覆盖原文件。红线写明。
输出
交出什么东西?
文件名、格式、字段、存放位置全部指定,让产物可打开、可核对。
验收
怎样算合格?
每项能回到原文出处;接手人能找到当前版本并继续一个下一步。
写完六要素做一次"陌生人测试":把说明交给没开过会的同学,若他能据此接手任务、说出每步会做什么,说明才合格。
工作册衔接:对应模板 22「可执行任务说明」,动手环节逐项填写。
数字素养与人工智能通识 · 第 10 周
15 / 36
方法拆解 · 模糊动词 vs 可观察动词
第 2 节 · 动词表
判断一个动词合不合格,标准只有一条:做完之后,能不能被第三方看出"做了没做、做对没做对"。左列的词满足不了这条标准,右列的词可以。
模糊动词(换掉)
优化
改成什么样?没有可核对的标准。
处理
具体做什么动作?无从判断。
完善
缺什么才叫不完善?无法验收。
专业一点
哪个专业、哪一点?纯感觉词。
可观察动词(替换池)
提取
比较
标记
排序
另存
生成预览
停止并请求确认
替换示例:把"帮我优化一下安排"改写为"提取全部行动项,按截止时间排序,标记缺失负责人的条目,另存为新文件"——三个动作,每个都能打开文件核对。
注意最后一个动词:"停止并请求确认"本身就是合法动作——把"停下来问人"写进流程,智能体才知道这不是失败,而是任务的一部分。
数字素养与人工智能通识 · 第 10 周
16 / 36
方法深化 · 失败策略:不许为"完成"而编造
第 2 节 · 失败策略
还要写清失败策略:资料打不开、文件版本冲突、负责人缺失或工具不可用时,智能体应停止、降级为草稿或请求补充,不能为了"完成任务"自行编造。预演四种最常见的失败,把应对写进任务说明。
失败 1 · 资料打不开
触发:文件损坏、链接失效
应对:停止该条处理,写入"待确认"清单并注明原因,继续处理其余条目。
失败 2 · 版本冲突
触发:同名文件有两个版本
应对:不改原文件,降级为草稿另存,并在冲突清单里写明两个版本差异。
失败 3 · 负责人缺失
触发:原文没写谁来做
应对:负责人字段填"待确认",粘贴原文出处,绝不补造一个名字。
失败 4 · 工具不可用
触发:日历、邮件等无法调用
应对:停止相关动作并请求确认,把已完成的中间产物先保存下来。
核心规则:编造不是"完成任务",而是制造一份看起来完整的假交付。宁可交出带"待确认"的不完整结果——它的每一行都真实,缺口也都指得出位置。
写法示例:"缺失信息写待确认;不发送消息,不修改真实日历,不覆盖原文件。"
数字素养与人工智能通识 · 第 10 周
17 / 36
案例分析 · 六要素任务说明逐行展开
第 2 节 · 案例
这是给智能体的完整任务说明示例。左边是原文,右边逐行标注它为什么这样写——注意每一行用的都是可观察动词,约束与失败策略直接写进了正文。
目标
把筹备会纪要转成陌生同学可接手的行动安排。
输入
仅使用指定纪要、群消息和日历摘录。
动作
提取行动项,逐条核对负责人、时间、出处和冲突。
约束
缺失信息写待确认;不发送消息,不修改真实日历,不覆盖原文件。
输出
行动项表、冲突清单、待确认问题。
验收
每项能回到原文;接手人能找到当前版本并继续一个下一步。
目标
"陌生同学可接手"是可检验的标准——不是"安排得好看",而是换个人能照着做。
动作
"提取""核对"是可观察动词,核对维度(负责人、时间、出处、冲突)全部点名。
约束
三条"不"就是失败策略的入口,也是确认点②的判断依据。
验收
"回到原文"可逐条打勾;"继续一个下一步"让交付物成为流程的中间站而非终点。
数字素养与人工智能通识 · 第 10 周
18 / 36
动手任务 · 改写成六要素任务说明
第 2 节 · 动手 20 分钟
小组任务:把第 1 节画好的流程改写成六要素任务说明,并逐项标出失败策略。写完后组间互换,互相挑模糊动词——找出的每一处,都要给出替换词。
写作顺序(模板 22 逐行填写)
1
先写目标与输出
倒着写最容易:先定"交什么、给谁用",再倒推需要什么输入和动作。
2
再写输入与动作
输入只列白名单;动作串成步骤链,每个动词做"可观察测试"。
3
补约束与验收
红线写成"不……"清单;验收写成打勾项,不许出现形容词。
4
标失败策略与确认点
至少写两条"遇到什么就停止/降级/请求补充",并指出确认点位置。
三轨提示(按设备分层)
电脑操作组
把说明直接发给智能体试运行一次,对照输出回头修改说明,记下第一处不匹配。
手机记录组
在模板 22 上完成全文,并用"可观察测试"逐动词自查,标注存疑之处。
教师机投屏组
投屏同一份说明的两种写法(一句话 vs 六要素),记录输出差异供全班讨论。
互查规则:交换后先标出所有模糊动词,再检查"待确认"策略是否存在——两条都过关才算通过。
数字素养与人工智能通识 · 第 10 周
19 / 36
常见错误 · "再专业一点"不是反馈
第 2 节 · 避坑
写说明最容易踩的坑,是把要求藏在形容词里。对比下面两种反馈写法:区别不在语气,而在有没有指出具体差异、依据、修改规则和保持不变的部分
无效反馈
"不对,再专业一点。"
· 没指出哪里不符合哪条标准;
· "专业"无法被观察和验收;
· 模型只能随机改风格,可能破坏已经正确的部分;
· 改完之后你仍然无法判断是否变好了。
合格反馈(多轮修改示例)
待办清单把"有人去问赵河"写成"陈可负责灯光"。请只修改这一类问题:凡原文没有明确负责人的事项,负责人写"待确认",并在原文出处列粘贴对应句子。其他字段和输出格式保持不变。
具体差异
原文依据
修改规则
保持不变
四个要素齐全,模型知道改什么、凭什么改、怎么改、什么不许动——这一轮修改才可能真的改善结果。
高频模糊词自检
优化
处理
完善
专业一点
尽量快
看着办
说明里出现任何一个,都要替换成可观察动词或具体数字。
数字素养与人工智能通识 · 第 10 周
20 / 36
检查表 · 任务说明交稿前自查
第 2 节 · 自查
七条检查,通过一条在前面打一个勾。第七条是硬门槛:交给没参与讨论的同学读一遍,他答不上来的地方,就是说明还没写清楚的地方。
1
六要素齐全
目标、输入、动作、约束、输出、验收一项不缺。
2
动词可观察
提取、比较、标记、排序、另存、生成预览;无"优化/处理/完善"。
3
输入是白名单
只列允许的资料,并写明"仅使用"。
4
约束含红线
不发送消息、不修改真实日历、不覆盖原文件等逐条列出。
5
失败策略在文中
至少两条"遇到什么就停止/降级/请求补充",并标出确认点位置。
6
输出可指定
文件名、格式、字段、存放位置写得出来,别人按说明能找到产物。
7
验收可打勾
每条验收都能回答"是/否",允许逐条回到原文核对。
8
陌生人测试通过
没开过会的同学读完能复述任务、说出每步动作。
数字素养与人工智能通识 · 第 10 周
21 / 36
第 2 节 · 小结
任务说明是写给协作者的工作单
六要素搭骨架
目标、输入、动作、约束、输出、验收各答一问;写不清楚的要素,就是流程里没想清楚的部分。
可观察动词说话
拒绝"优化、处理、完善",改用"提取、比较、标记、排序、另存、生成预览、停止并请求确认"。
失败策略先行
停止、降级为草稿、请求补充是三种合法出口;为"完成"而编造是唯一的错误答案。
一句话记住
写完六要素,
交给陌生同学
还能接手吗?
下一节:说明写好了,首版跑起来会怎样?
数字素养与人工智能通识 · 第 10 周
22 / 36
3
第 3 节 · 45 分钟
首版运行
运行首版:
观察智能体到底做了什么
前两节我们写好了分工与说明,这一节让流程真正跑起来。首版运行不是为了得到完美结果,而是为了比较计划与现实。
导入问题:如果智能体最后回复"已经全部安排好了",但没有留下任何可打开的文件——你该信吗?用什么办法验证?
数字素养与人工智能通识 · 第 10 周
23 / 36
情境导入 · 首版的价值是暴露差异
第 3 节 · 情境
首版运行的价值,是暴露任务说明和现实材料之间的差异:说明假设材料齐全,现实里纪要缺页;说明假设时间明确,现实里只有"我尽量周四"。差异不是失败,而是下一版说明的修改依据。
计划
任务说明里的世界
1
材料齐全:3 份指定文件都能打开
2
时间明确:每条行动项有负责人和截止
3
工具可用:只创建草稿,不碰真实日历
4
输出可查:文件按约定名称存放
对照
现实
运行中会遇到的世界
1
纪要缺页:有一节内容扫描不完整
2
时间模糊:"最快周四,我尽量"算承诺吗
3
边界试探:智能体想顺手改日历
4
承诺代替产物:只回复"已完成"没给文件
所以运行前先写预期,运行中记录实际,运行后归纳差异——三步缺一不可,这就是本节的方法主线,也是模板 23 的表头结构。
数字素养与人工智能通识 · 第 10 周
24 / 36
核心概念 · 四项观察
第 3 节 · 概念
运行时盯住四个观察项:读取、提取、工具、输出。每一项都要在运行时留下证据,而不是留下"感觉还不错"。四项从左到右对应流程的四个阶段,一环没证据,后面全靠猜。
读取
它看了什么?
实际打开的文件清单。预期只读 3 份指定材料——数一数日志,多了就是越界,少了就是漏读。
提取
它怎么转述?
行动项表逐条检查:出处还在吗?"待确认"标记还在吗?被悄悄补全的字段就是补造的入口。
工具
它动了什么?
查看工具调用状态:预期只创建草稿文件。任何写入、发送、修改真实日历的尝试都要记下来。
输出
它交了什么?
打开真实产物核对,而不是读它的回复文字。预期产生 3 个可打开文件——只有语言承诺等于没有产物。
证据链意识:每个观察项都要回答"你怎么知道"。答案可以是运行日志、工具状态面板、可打开的文件——不能是模型自己的转述。
NIST 视角:测试、记录与持续风险管理——对学生而言,最小实现就是保留输入版本、运行日志、工具结果、人工修改和最终产物。
数字素养与人工智能通识 · 第 10 周
25 / 36
方法拆解 · 预期 / 实际 / 差异三列表
第 3 节 · 方法
把四项观察展开成一张表:运行前填"预期",运行中填"实际",运行后填"差异与下一步"。这张表就是首版运行的核心产出,也是模板 23 的雏形。
观察项
预期(运行前写)
实际(运行中记)
差异与下一步
读取
只读取 3 份指定材料
记录实际打开的文件
✓ 是否越界或漏读
提取
保留出处和待确认标记
逐条检查行动项表
⚠ 是否补造事实
工具
只创建草稿文件
查看工具调用状态
⚠ 是否尝试写入或发送
输出
产生 3 个可打开文件
打开真实产物核对
✓ 是否只有语言承诺
填写纪律:"实际"一栏只记录看见的事实(打开过哪些文件、调用了什么工具),先不写评价;"差异"一栏才做归因,否则会边看边替它辩护。
下一步写法:指向具体修改,如"在约束里补充:仅读取清单内文件",而不是"下次让它表现好一点"。
数字素养与人工智能通识 · 第 10 周
26 / 36
方法深化 · 运行中的五问观察清单
第 3 节 · 观察清单
把"盯着看"变成五条可执行的观察任务。运行时每组分工盯不同的问号,看到什么记什么——清单只规定观察方式,不预设结论。
1
实际读取了哪些文件,有没有越过工作目录?
对应观察项:读取
2
计划中的"提取、核对、生成"是否真的发生?
对应观察项:提取
3
是否把讨论中的话写成决定,或补造负责人和截止时间?
对应观察项:提取
4
是否试图发送消息、修改日历或覆盖文件?
对应观察项:工具
5
返回结果是否包含可回访的文件、出处或工具状态?
对应观察项:输出
分组盯守建议
五问分给五个成员,一人盯一问、只记事实;运行结束后按顺序汇报,再合起来归因。比全员一起看屏幕效率高得多。
红色两问为何特殊
第 3、4 问对应"编造"与"越权"——它们不改变"结果好不好",而改变"结果能不能信"。一旦出现,直接升级到确认点讨论。
记录位置:五问的答案分别填入模板 23 的"读取资料、执行步骤、工具动作、人工确认、最终输出"各行。
数字素养与人工智能通识 · 第 10 周
27 / 36
案例分析 · 把"讨论"写成了"决定"
第 3 节 · 案例
模拟情境:纪要里有人说"要不有人去问一下赵河",首版行动项表却写成"陈可负责灯光"。逐行对照原文与产出,看差异出在哪一层——这是观察清单第 3 问的典型现场。
纪要原文
"灯光的事要不有人去问一下赵河?群里回头再定。"
关键特征:无负责人、无截止、尚待讨论。
首版行动项表
"陈可负责灯光,周四前完成对接。"
凭空出现:负责人、截止时间、任务状态。
错在哪一层?
不是格式错,而是层级错:把"待讨论"升格成了"已决定"。讨论可以出现在纪要里,决定必须有出处——判断这一层属于人的责任,智能体无权代拍板。
合格的多轮反馈怎么写
指出具体差异(哪一条);给出依据(粘贴原文句子);规定规则(无负责人写"待确认");划出禁区(其他字段与格式保持不变)。
同类预警:"最快周四,我尽量"不是可靠截止承诺;"让宣传那边都看看"没有负责人和截止时间,只能保留为待确认。
数字素养与人工智能通识 · 第 10 周
28 / 36
动手任务 · 跑首版并填差异表
第 3 节 · 动手 33 分钟
全组按三段推进:先写预期,再跑首版,最后填差异。产出是一份完整的模板 23 运行日志——今天它记录首版,下周它将成为反馈与 Skill 设计的对照材料。
运行前:全组写预期表
0–5′
按四项观察逐行写"预期",允许参考任务说明,但不许先看智能体反应再倒填。
运行:观察并记录实际
5–25′
按五问清单分工盯守,记录实际读取、调用与产物;只记事实,边跑边记,不许凭回忆补。
填差异表并定下一步
25–38′
预期/实际/差异/下一步逐行补全;每条差异指向一处具体修改,写回任务说明草稿。
三轨提示(按设备分层)
电脑操作组
真实运行首版,全程截屏关键节点。
手机记录组
填写模板 23,担任验收人,下轮互换。
教师机投屏组
集体观察投屏运行,分组记录证据。
时间纪律:38–45 分钟用于收束讨论;差异表没填完的组,把缺口原样带进收束环节——未完成的记录也是真实记录。
数字素养与人工智能通识 · 第 10 周
29 / 36
常见错误 · 失败的首版不许删
第 3 节 · 避坑
运行结束后最常见的动作是"删掉重来"。恰恰是这个动作,让后面几周的改进失去依据——失败的首版是后续反馈和 Skill 设计最有价值的对照材料。
只保留终版的
三重损失
无法判断改进来自哪里——是说明写得好,还是只是模型发挥好;
无法证明流程经过真实测试——没有失败记录就没有测试证据;
无法回答"哪里最容易出错"——下周的 Skill 设计无从下手。
错误 1 · 把"语言承诺"当产物
模型回复"已全部完成",就当作交付结束。
修正:只认可打开、可回访的文件与工具状态,回复文字一律不算数。
错误 2 · 边跑边评价
运行中不断说"它好笨/好聪明",没记下任何事实。
修正:"实际"栏只记现象;评价留到差异栏,并且要有证据支撑。
错误 3 · 差异归因到"运气"
差异与下一步写成"这次运气不好"。
修正:下一步必须指向可修改对象:任务说明的某一要素或确认点设置。
数字素养与人工智能通识 · 第 10 周
30 / 36
检查表 · 运行收尾与证据留存
第 3 节 · 自查
收尾自查分两栏:左边核对运行过程有没有走完,右边核对证据链留没留下。六项全过,首版才算"跑完了"——哪怕它失败了。
过程核对
1
预期先行
预期表在运行前完成,没有事后倒填。
2
五问有人盯
五问清单分配到人,事实被当场记录。
3
确认点被尊重
越权尝试(如有)停在确认点,未被放行。
证据留存(NIST 最小实现)
4
输入版本
当时喂给智能体的纪要与摘录原样保存。
5
运行日志
实际读取、调用过程的记录已归档。
6
工具结果
工具调用状态截屏或导出,非口头转述。
7
人工修改与最终产物
首版产物未删除,人工改动有版本区分。
证据链的用途在下周:反馈与 Skill 复测都要用相近的新材料重跑——继续用旧纪要只能证明记住了旧例子,不能证明流程可复用。
数字素养与人工智能通识 · 第 10 周
31 / 36
第 3 节 · 小结
首版运行
首版不完美,恰恰是它最值钱的部分
三步节奏
运行前写预期、运行中记实际、运行后归纳差异——把"试一试"升级成一次真实的受控测试。
四个观察项
读取、提取、工具、输出,每项都要留下证据;只有语言承诺等于没有产物。
失败不许删
首版连同日志、产物一起归档,它是下周反馈与 Skill 复测的对照底稿。
三节课合起来:分工定位置 → 说明定动作 → 运行定证据。本周产出到此齐备。
数字素养与人工智能通识 · 第 10 周
32 / 36
课堂节奏 · 三节课 × 45 分钟
时间线总表
三节课共用一条主线:第 1 节定分工,第 2 节写说明,第 3 节跑首版。每个环节的产出都会流进下一环节,动手时间占比都超过一半。
第 1 节 · 定义分工
0–5′
导入:全自动 vs 全手动,各有什么代价?
5–15′
讲授五节点分工表与两个确认点
15–35′
动手:在流程图上标出确认点,写明确认时检查什么
35–43′
对照产业流程,找出课堂版缺了什么
43–45′
收束:责任位置要稳定
第 2 节 · 写任务说明
0–5′
对比:一句"帮我安排好" vs 六要素说明
5–15′
讲授六要素与可观察动词
15–35′
动手:把本组流程改写成六要素任务说明,标失败策略
35–43′
互查:找出对方说明里的模糊动词
43–45′
收束:任务说明是给协作者看的工作单
第 3 节 · 首版运行
0–5′
运行前:全组写预期表
5–25′
运行:观察并记录实际读取、调用、产物
25–38′
填差异表:预期 / 实际 / 下一步
38–45′
收束:失败的首版不许删
设备不足时按分层方案调整操作方式,但不降低标准:来源可回访、判断可解释、成果可交接。
数字素养与人工智能通识 · 第 10 周
33 / 36
中国语境 · 智能体热与人的位置
第 10 周 · 延伸
2025–2026 年,"智能体"成为国内 AI 产业最热方向之一。越热越要冷静——四个视角,看清课堂方法与真实世界的关系。
时代背景
越能干,越权代价越大
能直接替人操作电脑的开源智能体一度成为全网顶流。智能体越能干,"越权执行"的代价越大——本课"高影响动作必须停在人工确认点"的原则,在任何工具上都成立。
校情锚点
珞珈在线的三级智能体
武大"珞珈在线 AI 智慧教学中心"已基于学校、专业、课程三级创建 AI 教学智能体,提供在线课堂、智能辅导等服务。它们同样遵循"工具执行、制度约束、人负责"——本课分工表就是这套架构的课堂版。
产业实践对照
闭环几乎一致
国内头部企业的智能体落地流程(需求定义 → 权限控制 → 试运行 → 复测 → 上线)与本课"分工 → 说明 → 首版 → 反馈 → 复测"几乎一致。在课堂里走完闭环,等于提前做了一次微缩版工程实践。
风险意识
责任压到两端
《生成式人工智能服务管理暂行办法》与深度合成规定都把内容责任压到服务提供者与使用者两端。让智能体替你发消息、改文件之前先想清楚:出了错找谁?答案永远是确认点前的"人"。
数字素养与人工智能通识 · 第 10 周
34 / 36
深一步追问 · 迁移练习
给"吃不饱"的同学
三个机制性问题
1
为什么确认点要设在"动作发生前"而不是"结果发生后"?
提示:撤回机制能替代确认点吗?想一想哪些动作没有撤回。
2
六要素任务说明和软件工程里的"需求文档"是什么关系?
提示:哪些字段在真实开发中更重要?为什么?
3
如果智能体的工具调用日志不可见,你还能信任它的输出吗?
提示:可以用什么替代手段建立证据链?
迁移练习(本周作业)
二选一
选择"课程小组会后整理"或"社团招新材料检查",画出 5 步流程,为每一步标注四项内容:
AI 的动作
人的责任
所需资料
可能失败点
第 1 步第 2 步第 3 步第 4 步第 5 步至少一处确认点设在动作之前,并写出检查项
验收:五步每格都有内容,失败点写的是具体情境而非"可能出错";下周一上交,将用于第 11 周反馈与 Skill 环节。
数字素养与人工智能通识 · 第 10 周
35 / 36
工具执行制度约束人负责
第 10 周 · 结语
风险越高,
人工确认越靠近动作本身
分工定位置,说明定动作,运行定证据——下周继续:把首版变成反馈,把流程固化成 Skill。
武汉大学 · 通识课
数字素养与人工智能通识
主讲 · 人工智能通识教学组
第10周-智能体流程
← → 翻页 · Home/End 首尾 · F 全屏