如何创建具有可观察差异的评分量规。
量规等级应描述可观察的质量差异。避免只说“优秀作业”却不说明优秀之处的循环表述。
按任务需求调整流程。
分别列出评价标准,并描述各表现等级的可观察差异。使用学习者能够应用于自身作业的语言,检查相邻等级是否区分了质量,而非仅更换形容词。
- 你需要提供什么
- 用户提供的作业和学习标准。
- 你会得到什么
- 带有可观察表现等级的评价标准。
查看输入和结果。
演示用输入和输出 · 教学示例,并非 WebAct 实时运行结果
示例 个输入项
Create a three-level rubric for a short scientific claim supported by supplied evidence. Criteria: claim accuracy, evidence relevance and reasoning.
完整示例
Claim accuracy: 1 = claim is unclear or conflicts with the supplied facts; 2 = accurate but scope is unclear; 3 = accurate and appropriately scoped. Evidence relevance: 1 = absent or unrelated; 2 = relevant evidence is included; 3 = relevant evidence is selected and identified clearly. Reasoning: 1 = evidence is listed without a connection; 2 = connection is partly explained; 3 = explains how the evidence supports the claim and notes a relevant limit. Review the descriptors against an actual sample response before classroom use.
将这份输入载入提示词,再复制到 WebAct 中尝试任务。实际结果可能与示例不同。
决策与问题排查。
量规等级可以只写优秀、良好、较差而不解释吗?
描述每个等级具备或缺少的内容。单有标签无法告诉学习者或评阅者如何区分表现。
为什么两位教师给同一份作业的评分不同?
结合示例答案和标准比较各自的理解。修改允许相互冲突解读的模糊描述。
使用自己的资料试一试。
将任务提示词中的示例换成你的材料。保留所需条件,再把任务复制到 WebAct。
自定义并复制任务 ↑