当前输入给模型的材料、要求与对话历史。
Appearance
Appearance
本周建立后续实训必须共用的语言:大语言模型负责根据上下文生成内容,聊天机器人组织一次次对话,智能体围绕目标继续读取资料和调用工具,Skill 则保存已经跑通的方法。四者有关联,但不是同一个东西。
学习这些概念不是为了背定义,而是为了判断一句“已经完成”究竟意味着什么:它只是生成了一段文字,还是确实读取了文件、调用了工具、产生了可打开的结果?
大语言模型(Large Language Model, LLM)可以理解为一个根据当前上下文不断预测后续内容的生成系统。它在训练中学习了大量语言模式,因此擅长续写、改写、归纳、比较和生成结构化草稿;但它不会因为表达自信就自动获得真实世界的最新事实。
模型一次回答通常受四类信息影响:
当资料缺失时,模型仍会尝试生成“像答案的答案”,于是可能把常见模式、推测或错误信息写得很完整。课堂上不要求学生掌握模型训练公式,但必须能识别三种状态:原文明确、合理推断、缺少依据。
改善输出不能只靠“再认真一点”。更有效的做法是补资料、缩小问题、要求标注出处、规定缺失信息写“待确认”,并提前写清验收标准。提示词不是魔法咒语,而是一份给协作者看的任务说明。
为什么看起来很流畅的回答,仍可能不准确、过时或没有依据?
这节先把“会说”和“知道”拆开:模型能生成、归纳和改写,但需要材料和核验才能可靠地用于真实任务。
当前输入给模型的材料、要求与对话历史。
基于模式预测下一段表达,因此可能流畅但缺少依据。
回到来源、数据或现实系统确认内容能否成立。
教师示范:给同一问题两份回答:一份有资料链接、一份没有;带学生标出可以直接核验的句子。
易错提醒:不要把“回答很自信”当作“它一定准确”。
不要先给定义。先把问题“为什么看起来很流畅的回答,仍可能不准确、过时或没有依据?”投出来,给学生 30 秒独立判断,再请两位同学说出不同答案;教师只追问依据,暂不公布结论。
结合同题不同回答样例和来源缺失样例呈现一个小情境,让学生先说“我会怎么做”,把已有经验调动出来。
依次解释“上下文—生成—核验”。每解释一个概念,都回到情境中指出它对应的事实、动作或判断。
给同一问题两份回答:一份有资料链接、一份没有;带学生标出可以直接核验的句子。
明确边界:不要把“回答很自信”当作“它一定准确”。 请学生用一句话改写刚才的判断,让它更准确、可执行。
课堂案例:以“大模型在做什么:生成不是知道一切”为场景,先让学生仅凭直觉给出做法;再要求他们用“上下文、生成、核验”逐项说明依据,比较两种做法会得到什么不同结果。
收束:本节不要求学生背出术语,而要能用上下文、生成、核验解释自己的选择。
过渡到实践:进入任务前,先让学生把三个关键点勾到任务单上;后续操作要服务于本节目标:“理解大模型生成文本的基本特点,并能解释为什么需要资料、核验和版本信息。”。
同一问题,两种模式 · 问一问 · 工作目录「灯火计划」· 灯火计划资料包
迎新晚会要不要加抽奖?请给出建议。投屏对照两份回答,不要评价“哪个模型更聪明”。
可自己复现两次提问,但提交的是核验卡不是更好的回答。
看投屏,完成核验卡。
WorkBuddy 实战蓝皮书 https://workbuddy.homes/ 第 3 章三种工作模式
AI 会参与这节课,但它不是替学生完成任务;每次使用都要留下可核验的过程证据。
文本生成器与协作对象
让 AI 回答同一个问题,并与带资料、工具和后续步骤的智能体流程进行对照。
区分它生成的说法、实际读取的资料和真实发生的工具动作。
完成一张“回答—资料—工具—结果—下一步”的协作结构图。
理解大模型生成文本的基本特点,并能解释为什么需要资料、核验和版本信息。
两人比对回答中的“已知、推测、缺少依据”。
学生:带着问题“为什么看起来很流畅的回答,仍可能不准确、过时或没有依据?”记录三个关键词。
教师:先讲清概念、边界和真实例子,再请学生表达自己的初步判断。
学生:观察教师如何用概念分析一个具体案例,标出依据。
教师:边操作边说出判断过程,特别指出“这一步为什么不能只凭感觉”。
学生:三人小组比较答案,补上一个反例或限制条件。
教师:追问“依据来自哪里、有没有另一种解释”,帮助学生把概念用对。
学生:把今天的概念用到一张新的情境卡上,形成首版判断。
教师:巡回检查学生是否会把概念和事实、推测混在一起。
学生:提交“我现在能解释:理解大模型生成文本的基本特点,并能解释为什么需要资料、核验和版本信息。”。
教师:按证据完整度快速反馈,为下节调整分层支持。
一张回答核验卡,标出至少两处需要回查的信息。
提示:让学生先用证据解释,再补充术语;不要把概念讲成需要背诵的定义。
备用方案:使用资料包里预置的两份回答样例完成标注。
聊天机器人主要处理“输入一段话—返回一段话”的循环。智能体则可能围绕一个目标持续执行:读取文件、规划步骤、调用搜索或代码工具、检查结果,再决定下一步。区别不在界面像不像聊天,而在它是否真的与外部资料和工具发生了可观察的交互。
| 比较项 | 聊天回答 | 智能体流程 |
|---|---|---|
| 主要结果 | 文本或多媒体回答 | 回答、文件、工具状态和后续动作 |
| 工作跨度 | 通常是一轮或几轮对话 | 可跨多个步骤持续推进 |
| 外部能力 | 可能没有 | 可能读取文件、搜索、运行代码或操作应用 |
| 主要风险 | 内容错误、过时、无依据 | 内容风险加上越权、误写、误发和错误执行 |
| 验证方式 | 检查内容和来源 | 同时检查计划、工具调用、产物和外部状态 |
因此,智能体说“我已经发出通知”不能作为发送成功的证据。要看真实工具结果、消息状态或接收端。反过来,页面上出现一份草稿也不代表它已经发送;语言、界面和外部状态必须分开验证。
NIST 的 AI 风险管理资料把测试、评估、验证和确认视为持续过程。在本课中,它被压缩为一句操作原则:看实际输入、实际动作和实际产物,不用模型的自我描述代替证据。
同样是“整理会议”,为什么一种只给建议,另一种能把任务持续推进?
差异不在“谁更会说话”,而在能否把目标保留在过程里,读取资料、执行动作并依据结果继续推进。
模型根据你当前的输入生成一段内容,通常等下一次追问。
连接文件、日历、表格、消息等真实系统的能力。
根据结果判断下一步,再把新结果带回上下文。
教师示范:以“会后行动安排”为例,画出聊天回答停在建议处、智能体继续读纪要和查日历的不同路径。
易错提醒:不要把任何带对话框的产品都称为智能体。
不要先给定义。先把问题“同样是“整理会议”,为什么一种只给建议,另一种能把任务持续推进?”投出来,给学生 30 秒独立判断,再请两位同学说出不同答案;教师只追问依据,暂不公布结论。
结合DeepSeek 对话示例和WorkBuddy 流程示例呈现一个小情境,让学生先说“我会怎么做”,把已有经验调动出来。
依次解释“回答—工具—循环”。每解释一个概念,都回到情境中指出它对应的事实、动作或判断。
以“会后行动安排”为例,画出聊天回答停在建议处、智能体继续读纪要和查日历的不同路径。
明确边界:不要把任何带对话框的产品都称为智能体。 请学生用一句话改写刚才的判断,让它更准确、可执行。
课堂案例:以“聊天机器人与智能体:回答和行动的区别”为场景,先让学生仅凭直觉给出做法;再要求他们用“回答、工具、循环”逐项说明依据,比较两种做法会得到什么不同结果。
收束:本节不要求学生背出术语,而要能用回答、工具、循环解释自己的选择。
过渡到实践:进入任务前,先让学生把三个关键点勾到任务单上;后续操作要服务于本节目标:“区分一次文本回答与“目标—资料—工具—结果—下一步”的智能体协作过程。”。
主界面三区 + 三种模式 · 想一想 · 工作目录「灯火计划」· 灯火计划资料包
帮我把今天的迎新晚会筹备会后续安排好。停在计划页,不进入「做一做」。
跟看计划,截一张“计划/工具/确认点”记录。
在对照图上标注三区和三个模式。
WorkBuddy 实战蓝皮书 https://workbuddy.homes/ 第 3–4 章:界面、任务与第一个任务
AI 会参与这节课,但它不是替学生完成任务;每次使用都要留下可核验的过程证据。
文本生成器与协作对象
让 AI 回答同一个问题,并与带资料、工具和后续步骤的智能体流程进行对照。
区分它生成的说法、实际读取的资料和真实发生的工具动作。
完成一张“回答—资料—工具—结果—下一步”的协作结构图。
区分一次文本回答与“目标—资料—工具—结果—下一步”的智能体协作过程。
小组给示例贴上“生成、读取、调用、确认、返回结果”标签。
学生:带着问题“同样是“整理会议”,为什么一种只给建议,另一种能把任务持续推进?”记录三个关键词。
教师:先讲清概念、边界和真实例子,再请学生表达自己的初步判断。
学生:观察教师如何用概念分析一个具体案例,标出依据。
教师:边操作边说出判断过程,特别指出“这一步为什么不能只凭感觉”。
学生:三人小组比较答案,补上一个反例或限制条件。
教师:追问“依据来自哪里、有没有另一种解释”,帮助学生把概念用对。
学生:把今天的概念用到一张新的情境卡上,形成首版判断。
教师:巡回检查学生是否会把概念和事实、推测混在一起。
学生:提交“我现在能解释:区分一次文本回答与“目标—资料—工具—结果—下一步”的智能体协作过程。”。
教师:按证据完整度快速反馈,为下节调整分层支持。
一张聊天与智能体工作方式对照图。
提示:让学生先用证据解释,再补充术语;不要把概念讲成需要背诵的定义。
备用方案:使用资料包「聊天 vs 智能体」对照图完成标注。
一次对话成功,可能只是材料简单或运气好。只有当一套方法在相近新材料上仍然稳定,才值得保存为 Skill。Skill 不等于一条很长的提示词,它至少应回答:
以“会议转行动安排”为例,一个可靠 Skill 不应保证“自动安排好一切”,而应规定:只使用指定纪要;原文未明确的负责人和日期写待确认;输出待办表并带出处;真实发送和改日历前停止;用第二份相近纪要复测。
不是所有任务都值得做 Skill。一次性、目标尚未稳定、仍需大量临场判断或风险过高的流程,先保留为普通任务清单更合适。Skill 的价值来自稳定复用,而不是文件名本身。
一段反复跑通的协作流程,怎样从一次对话变成下次可复用的 Skill?
它把触发条件、输入材料、步骤、工具规则、检查与输出模板固定下来,让智能体在相似任务中稳定复用。
核心说明文件,交代用途、适用条件、步骤和验收方式。
业务规则、字段解释、范例等按需读取的材料。
需要稳定执行或固定输出时使用的辅助文件。
教师示范:展示一个最小 Skill 文件夹,让学生把“会议行动安排”分别放进说明、参考资料和模板。
易错提醒:不要把临时聊天记录原封不动保存成 Skill;先验证流程是否稳定。
不要先给定义。先把问题“一段反复跑通的协作流程,怎样从一次对话变成下次可复用的 Skill?”投出来,给学生 30 秒独立判断,再请两位同学说出不同答案;教师只追问依据,暂不公布结论。
结合SKILL.md 结构示例和流程卡呈现一个小情境,让学生先说“我会怎么做”,把已有经验调动出来。
依次解释“SKILL.md—参考资料—脚本与模板”。每解释一个概念,都回到情境中指出它对应的事实、动作或判断。
展示一个最小 Skill 文件夹,让学生把“会议行动安排”分别放进说明、参考资料和模板。
明确边界:不要把临时聊天记录原封不动保存成 Skill;先验证流程是否稳定。 请学生用一句话改写刚才的判断,让它更准确、可执行。
课堂案例:以“Skill 是什么:把做对的方法保存下来”为场景,先让学生仅凭直觉给出做法;再要求他们用“SKILL.md、参考资料、脚本与模板”逐项说明依据,比较两种做法会得到什么不同结果。
收束:本节不要求学生背出术语,而要能用SKILL.md、参考资料、脚本与模板解释自己的选择。
过渡到实践:进入任务前,先让学生把三个关键点勾到任务单上;后续操作要服务于本节目标:“理解 Skill 是任务说明、资料范围、流程、工具规则和验收标准的可复用组合。”。
专家 · 技能 · 连接器 · 问一问 · 工作目录「灯火计划」· 灯火计划资料包
只展示一个会议类 Skill 的结构。
可安装一个会议 Skill,但本节只读说明、不跑真实发送。
阅读资料包 08-skill-draft.md,标出五个构成块。
WorkBuddy 实战蓝皮书 https://workbuddy.homes/ 第 5 章:加载一个真正用得上的 Skill
AI 会参与这节课,但它不是替学生完成任务;每次使用都要留下可核验的过程证据。
文本生成器与协作对象
让 AI 回答同一个问题,并与带资料、工具和后续步骤的智能体流程进行对照。
区分它生成的说法、实际读取的资料和真实发生的工具动作。
完成一张“回答—资料—工具—结果—下一步”的协作结构图。
理解 Skill 是任务说明、资料范围、流程、工具规则和验收标准的可复用组合。
三人将一次会议整理流程拼成“触发—输入—步骤—输出—检查”五块。
学生:带着问题“一段反复跑通的协作流程,怎样从一次对话变成下次可复用的 Skill?”记录三个关键词。
教师:先讲清概念、边界和真实例子,再请学生表达自己的初步判断。
学生:观察教师如何用概念分析一个具体案例,标出依据。
教师:边操作边说出判断过程,特别指出“这一步为什么不能只凭感觉”。
学生:三人小组比较答案,补上一个反例或限制条件。
教师:追问“依据来自哪里、有没有另一种解释”,帮助学生把概念用对。
学生:把今天的概念用到一张新的情境卡上,形成首版判断。
教师:巡回检查学生是否会把概念和事实、推测混在一起。
学生:提交“我现在能解释:理解 Skill 是任务说明、资料范围、流程、工具规则和验收标准的可复用组合。”。
教师:按证据完整度快速反馈,为下节调整分层支持。
一张个人 Skill 构成卡。
提示:让学生先用证据解释,再补充术语;不要把概念讲成需要背诵的定义。
备用方案:用资料包 Skill 草稿完成五块拼图。
| 课节 | 时间线 | 环节 |
|---|---|---|
| 第 1 节 · 大模型在做什么 | 0–5' | 导入:同一个问题问两个模型,答案为何不同? |
| 5–15' | 讲授"生成≠知道"与四类影响因素 | |
| 15–35' | 动手:标记三种状态练习——给一段 AI 回答标注"原文明确 / 合理推断 / 缺少依据" | |
| 35–43' | 组间比对标注差异,讨论分歧点 | |
| 43–45' | 收束:流畅度不等于正确性 | |
| 第 2 节 · 回答与行动的区别 | 0–5' | 情景:智能体说"通知已发出",你信吗? |
| 5–15' | 讲授聊天机器人与智能体的对比表 | |
| 15–33' | 动手(手机即可):观察一次智能体运行的工具调用记录,找出"语言承诺"与"实际产物" | |
| 33–43' | "故意喂错"环节:给智能体一份日期混乱的纪要,看它怎么办 | |
| 43–45' | 收束:看实际输入、动作、产物,不看自我描述 | |
| 第 3 节 · Skill 与方法沉淀 | 0–5' | 提问:你上次成功的方法,下次还能复现吗? |
| 5–15' | 讲授 Skill 六问与"会议转行动"示例 | |
| 15–35' | 小组起草一份"课程笔记整理"Skill 说明草稿,互查触发条件与禁止事项 | |
| 35–43' | 讨论:哪些任务不该做成 Skill? | |
| 43–45' | 收束 + 预告下周进入灯火计划 |
选择“整理课程笔记”“规划社团例会”或“检查作业格式”中的一个任务,分别写出聊天机器人版本和智能体版本。圈出智能体需要调用的资料或工具,并标出至少一个人工确认点。