教师专区

教授控制权交接

一套可打印的教师资料包,支持 45、90 或 180 分钟课程:包含无密钥路线、课堂探测测试、明确披露的调用预算、学习者工作表和以证据为基础的项目量规。

选择你拥有的课时

45 min

体会规则之墙,观看教师演示提示词预览,运行基线 Eval,加入上下文并比较分数。

90 min

再加入手册术语、循环与图的控制、安全边界和决策树。

180 min

让学习者用自己的密钥或无密钥路线完成实验室,玩“控制室”游戏,然后开始本地 TypeScript 课程。

上课之前

  1. 在课堂实际使用的浏览器和网络中打开手册与实验室。
  2. 实时演示时,请创建一把可撤销、低余额的独立密钥;绝不要分享教师密钥。
  3. 依次运行“保存并测试”、第 1 步、三笔点单预览和一次完整 Eval;再把用量与收费和服务商控制台进行比较。
  4. 准备脚本化的无密钥路线;如果实时探测失败,就切换过去。

无密钥路线本身就是完整的一课

第一部分按脚本运行、可以离线完成,也不需要密钥。实验室的第 2 步同样在本地运行。其余模型结果可以投影展示,或讨论事先准备好的运行结果;不要在全班面前排查私人凭证。

告诉学习者,一次点击最多会花多少

以下数字是逻辑调用次数和输出上限,而不是价格承诺。实时费用取决于模型、缓存、时段和服务商当前定价。

操作最多调用次数最大输出量
你的第一次调用1250 tokens
写提示词33 × 300 tokens
量一量20 + 8 = 287,600 tokens
包含两次 Eval 的学习流程6016,350 tokens

Eval 的并发数为 4。“停止”会阻止调度新请求,并尝试中止正在进行的请求,但已在进行中的请求仍可能计费。已发送却没有返回用量的请求,费用是未知,而不是零。

学习者工作表

  1. 写下一种当前规则处理不了的说法,以及为它需要补上的规则。
  2. 运行 Eval 1 前,预测分数并写下一条理由。
  3. 记录基线、一个失败用例,以及可能的失败来源。
  4. 说出一项改动,预测它的效果,然后运行 Eval 2。
  5. 分别记录一项改进和一项退步;不要藏起不方便的用例。
  6. 迁移到你熟悉的领域:一个由模型作出的决定、一项保留在手里的控制、一个失败输入,以及一道不可逆操作前的闸门。

项目量规

每项标准按 0 分(缺失)、1 分(部分做到)或 2 分(有证据)评分。只要证据和取舍站得住脚,不同的系统架构同样可以很优秀。

  • 问题边界:目标、非目标和模型权限。
  • 失败输入:具体、真实且可复现。
  • 最小评测:用例、预期证据和可检查的评分规则。
  • 不可逆操作闸门:在动作发生前,由代码或人进行干预。
  • 信任边界:服务商、工具、秘密和不可信输入。
  • 反思:失败、退步、成本、取舍和下一项测试。

接受证据,而不是唯一的标准答案

不含秘密的控制台输出、小型 JSON 或 Markdown 结果、代码链接、一个失败用例的追踪记录,或一份本地成绩单,都可以作为有效证据。量规不限定具体框架、服务商或提示词。

试教观察表应只保存在本地。绝不要把学习者密钥、提示词、服务商原始响应体、回复或可识别个人的作业放进本站、截图或 CI 日志。