Appearance
课程评价与验收
这门课评价的是成果是否真实、可追溯、可解释、可交接,以及学生能否说明自己承担了什么责任。工具熟练度、安装了多少 Skill、提示词写得多长,都不直接加分。
下面是一套可直接使用的 100 分建议方案。学校已有考核规则时,可以保留各任务的验收门槛,只调整分值。
建议总评结构
| 部分 | 分值 | 主要证据 |
|---|---|---|
| 任务一:项目与行动安排 | 15 | 项目说明、资料清单、行动项、交接测试 |
| 任务二:调研与证据 | 15 | 调研问题、检索计划、证据表、简报答辩 |
| 任务三:数据与图表 | 15 | 数据字典、分析记录、图表、读者测试 |
| 任务四:智能体流程与 Skill | 15 | 人机分工、运行日志、反馈记录、复测结果 |
| 团队大作业与展示 | 25 | 成果索引、现场演示、证据回访、边界说明 |
| 个人学习档案与责任说明 | 15 | 个人版本记录、采用/拒绝理由、反思 |
| 合计 | 100 |
及格除了达到学校分数线,还必须同时满足三条底线:没有把 AI 输出冒充原始证据;没有编造负责人、时间、数据或来源;没有在课程演练中擅自执行真实发送、公开发布或敏感授权。
通用四级语言
| 等级 | 可追溯 | 可解释 | 可交接 | 人的责任 |
|---|---|---|---|---|
| 3 · 稳定 | 关键结论都能回到原始材料 | 能解释方法、取舍和限制 | 陌生同学可独立接手 | 明确记录核验、确认与拒绝理由 |
| 2 · 可用 | 大部分结论有来源,少量缺口已标注 | 能说明主要做法,部分理由不够完整 | 需要少量澄清后可以继续 | 能指出主要人工检查点 |
| 1 · 待改 | 来源、版本或操作记录明显不完整 | 只能复述结果,难以解释过程 | 依赖作者口头补充 | 把部分判断交给了 AI |
| 0 · 未形成 | 关键内容无法回访或存在编造 | 不知道结果怎样产生 | 无法继续使用 | 越权、隐瞒 AI 参与或没有核验 |
任务一 · 项目与行动安排(15 分)
每项 0–3 分。
| 评价项 | 3 分证据 | 常见失分 |
|---|---|---|
| 项目定义 | 对象、时间、约束、交付物和验收均明确 | 目标仍是“办好活动”等口号 |
| 资料边界 | 默认资料有来源、版本、用途和排除理由 | 所有文件不加区分地放进上下文 |
| 行动项质量 | 事项、出处、负责人、时间、状态完整 | 缺失信息被 AI 自动补全 |
| 冲突处理 | 时间、资源和依赖冲突已标出并给出处理路径 | 为了表格完整而忽略现实冲突 |
| 交接能力 | 接手组不靠口头解释能找到入口并完成下一步 | 当前版本不清,待确认项藏在正文里 |
验收门槛:任何行动项只要出现编造的负责人或截止时间,本任务先退回修改,不直接给完成等级。
任务二 · 调研与证据(15 分)
| 评价项 | 3 分证据 | 常见失分 |
|---|---|---|
| 问题可回答 | 对象、范围、时间和指标明确 | 问题过大或预设结论 |
| 检索计划 | 有关键词、来源优先级、排除规则和停止条件 | 只随手搜一个词 |
| 证据质量 | 原始来源优先,主张与证据逐条绑定 | 用搜索摘要或 AI 回答作证据 |
| 冲突与边界 | 能解释口径、样本、时间差异和不能确定之处 | 删除不支持自己的资料 |
| 答辩表现 | 能从追问回到 E 编号和原文,并形成修改动作 | 临场用更流畅的话掩盖证据缺口 |
验收门槛:简报中至少一个关键结论必须经过原始来源回访;无法回访时只能作为待核线索。
任务三 · 数据与图表(15 分)
| 评价项 | 3 分证据 | 常见失分 |
|---|---|---|
| 字段与口径 | 数据字典说明字段、单位、范围和指标定义 | 未读字段就直接画图 |
| 数据质量 | 原表保留,缺失、重复、异常及处理决定有记录 | 静默删除“不好看”的数据 |
| 分析可复核 | 输入范围、计算步骤和至少一次人工复算齐全 | 直接复制 AI 给出的数字 |
| 图表表达 | 问题、标题、标签、单位、来源和结论一致 | 先选漂亮图,再倒推问题 |
| 读者测试 | 有独立读图记录,并根据误读修改 | 只问“好不好看” |
验收门槛:图表必须标出来源和口径;如果轴、单位或样本范围会改变读者结论,先修正再评分。
任务四 · 智能体流程与 Skill(15 分)
| 评价项 | 3 分证据 | 常见失分 |
|---|---|---|
| 人机分工 | 人负责目标、授权、关键判断和最终确认 | 把责任写成“AI 负责全部处理” |
| 任务说明 | 输入、动作、约束、输出、验收和确认点完整 | 只有一句模糊要求或专业词堆砌 |
| 运行观察 | 记录预期与实际读取、调用、返回的差异 | 只保留最终文案 |
| 多轮改进 | 每轮反馈具体,补材料或标准但不随意换目标 | 只说“再专业一点” |
| 复测与复用 | 用相近新资料复测,并说明复用/改进/换 Skill 的理由 | 用同一份旧资料重复运行冒充稳定 |
验收门槛:任何真实写入、发送或公开动作都应停在人工确认点;越过边界后先做安全复盘。
团队大作业与展示(25 分)
每项 0–5 分:5 分达到稳定且能用证据回答追问;3–4 分达到可用但仍需少量补充;1–2 分形成首版但证据或交接明显不足;0 分未形成或存在底线问题。
| 评价项 | 5 分完成证据 |
|---|---|
| 问题与价值 | 真实校园问题范围清楚,成果有明确使用者和用途 |
| 多周整合 | 项目、调研、数据和智能体流程不是简单拼贴,而是围绕同一问题互相支撑 |
| 证据链 | 现场可以打开原始资料、数据、版本和运行记录 |
| 可用与可交接 | 能演示成果,陌生人知道入口、当前版本、限制和下一步 |
| 表达与反思 | 10 分钟内讲清问题—做法—证据—结果—限制,能回答追问 |
个人学习档案与责任说明(15 分)
每项 0–3 分。
| 评价项 | 3 分完成证据 |
|---|---|
| 个人贡献 | 能指出自己负责的文件、判断和版本,而不只报团队角色 |
| 过程记录 | 留有首版、修改、反馈与终版的可回访路径 |
| AI 使用透明 | 说明 AI 做了什么、自己检查了什么 |
| 独立解释 | 不依赖同伴或 AI,能解释一项关键方法和取舍 |
| 责任与反思 | 说出一条拒绝 AI 建议的理由和下一次优先修改项 |
快速反馈句式
- 证据反馈:
你写了________,但目前只能回到________。请补原始出处或把结论改成待确认。 - 交接反馈:
我在________处停住,因为缺少________。如果补上________,我可以继续。 - 数据反馈:
这张图让我读出________,但你的结论是________。请先检查标题、单位、轴或口径。 - 流程反馈:
计划要求________,实际运行却________。下一轮只改________,并保留其他目标。 - 边界反馈:
这条材料能说明________,还不能说明________。