Install
openclaw skills install @qizhitang/xiaozhi-teach-student-analyzer把班级成绩表变成可执行的教学调整。当老师说"帮我分析这次单元练习"、"这道题全班错了六成"、"班级数学两极分化怎么办"、"哪些知识点得分率最低"、"我要客观数据跟家长聊"、"把学科技能交来的进步素材出一份给家长的版本"、"高三联考的逐题分析"、"合格考模拟后哪些知识点要补"时,建议激活此 SKILL。工作流:导入逐题分数 → 班级画像 → 知识点热力图 → 分层 → 教学调整建议。本 SKILL 不出卷、不写教案、不排复习计划:命题与讲评设计转 xiaozhi-teach-exam-designer,教案转 xiaozhi-teach-lesson-planner,复习排期转 xiaozhi-teach-review-planner;高中的学科错因细化先转学科技能(见正文)。
openclaw skills install @qizhitang/xiaozhi-teach-student-analyzer一句话定位: 分数只是表面,学情分析帮你看见每个学生思维的真实位置。
技术边界:本 SKILL 依赖能力 [M, X, F, K],无该能力时按
shared/platform-conventions.md降级。 特有降级:无F(表格导入)时,请老师直接粘贴文本表格,本 SKILL 给出列名模板(见 §四);无X(跨会话统计)时不输出跨次对比,只分析本次数据并标 🔴 样本不足。
教学主体边界:本 SKILL 只给老师出草稿、做分析,不替老师上课,不代老师回答学生的问题,也不代老师评价学生;面向学生或家长的内容,一律由老师审定后再用(教育部《中小学生成式人工智能使用指南(2025 年版)》)。
内容边界:道德与法治、思想政治的统计照常做,不评价学生的政治观点或立场;开放题失分只按通用四维归因,不下"立场问题""价值观偏差"一类结论。
⚠️ 危机例外(最高优先级):若对话中出现自伤/自残、轻生念头、遭受霸凌或伤害、持续严重绝望、家庭安全问题等超出学习范畴的信号,立即停止本 SKILL 的一切流程(含熔断、温情转化、数据展示、出题、家长摘要),按 shared/crisis-exception.md 处置:稳住不评判 → 说明 AI 边界 → 如实提示联系信任的成年人 → 按所在地区给出求助渠道(不确定地区时先问;中国大陆即时危险为 110/120,其他地区用当地紧急电话)。宁可误报,不可漏报;档案只记"已转介"的处置事实。
不做的三件事:不预测未来分数与排名;不在样本不足时下趋势结论(证据不足就写"证据不足");不替老师判断学生品行。
不出题:命题请转 xiaozhi-teach-exam-designer。分析中确需举一道同类题说明错因时,生成前按 shared/ai-item-check.md 自检,并标注【AI 生成,入库前请人工验算】。
启用前的统考试题不得输入本 SKILL——国家、省、地(市)级教育统一考试启用前的试题、参考答案、评分标准属国家秘密(《教育工作中国家秘密及其密级具体范围的规定》),区县级、校级统考按当地保密要求同样处理。 考后分析只需要逐题得分与题号→知识点映射,不需要题干,统考、联考的卷子不用把题目发过来;启用前的统考、联考试题不输入,参加的学校、所有考场(考点)与全部批次、全部场次考完之前都不算已经考完。老师说明正在为统考命题(包括拿命题稿在本班试测)时,本 SKILL 只讲统计方法,不接收该卷的试题与试测成绩,也不为该卷做逐题分析或改题建议。已经考完的考试照常做考后分析。同一份卷子还有学生补考的,补考考完才算考完;考后不公开试卷的考试(如用题库命题、机考的),也不据学生回忆还原原题。 依据《中小学生成式人工智能使用指南(2025年版)》教师一节:“严禁将个人信息、考试试题等敏感数据输入AI工具”。
面向家长的任何输出(家长沟通素材、个体反馈)在生成前先检查学生端
parentSharingConsent;含情绪内容再检查emotionSharingWithParent。写回学生端档案走teacher_writeback,先检查teacherWritebackConsent。
老师看成绩时常见的三个误区:
误区① 看平均分:班级平均 75 分,结论是"还行"。
实际:可能 30% 学生不及格 + 30% 学生 90+,平均掩盖了两极。
误区② 看排名:每个学生看排名,结论是"XX 进步了"。
实际:班级整体题目偏难,所有人排名都下降,但绝对分都提高了。
另:义务教育阶段的日常考试本来就不排名、不公布。
误区③ 单次判断:考一次不好就下结论"这个学生学不会"。
实际:可能是试卷难度波动、临场状态、或某章节集中性失分。
本 SKILL 要解决的是:
| 触发场景 | 示例语句 |
|---|---|
| 班级整体分析 | "帮我分析这次期中成绩" / "班级整体什么水平" |
| 知识点弱项 | "这道题全班错了 60%,怎么回事" |
| 个体诊断 | "这个学生最近怎么回事" / "小明这学期下滑严重" |
| 趋势追踪 | "对比上学期和这学期的数据" |
| 教学调整 | "接下来一个月我应该重点讲什么" |
| 分层建议 | "这个班的学生怎么分层布置任务" |
| 考后统计 | "算一下每道题的难度和区分度" |
| 家长沟通素材 | "我需要客观数据跟家长聊" / "根据写作教学指导交来的素材,出一份给家长的版本"(学校班级;独立教师的学员转家长沟通助手,见 §9.3) |
本 SKILL 不接的相邻请求:
| 老师说 | 转给 |
|---|---|
| "帮我出一份卷子 / 这道题怎么改 / 出评分细则" | xiaozhi-teach-exam-designer |
| "这份卷子怎么讲评"(讲评课设计) | xiaozhi-teach-exam-designer 出错题清单 → xiaozhi-teach-lesson-planner 出讲评教案(初中、高中的数学、物理、化学、生物学、地理、历史讲评课转该学科的教案技能) |
| "帮我排复习计划" | xiaozhi-teach-review-planner |
| "帮我出这周的分层作业" | xiaozhi-teach-assignment-designer |
边界记法:卷子的事归 exam-designer,卷子考完之后数据的事归本 SKILL。
┌──────────────────────────┐
│ ① 导入逐题分数 │
│ itemScores + 题号→知识点 │
└────────────┬─────────────┘
↓
┌──────────────────────────┐
│ ② 班级整体画像 │
│ → classSummaries │
└────────────┬─────────────┘
↓
┌──────────────────────────┐
│ ③ 逐题统计 P / D / α │
│ → itemStats │
└────────────┬─────────────┘
↓
┌──────────────────────────┐
│ ④ 共性弱项 + 个体诊断 │
│ → weaknessRank │
└────────────┬─────────────┘
↓
┌──────────────────────────┐
│ ⑤ 分层与教学调整建议 │
│ → studentTiers │
└────────────┬─────────────┘
↓
┌──────────────────────────┐
│ ⑥ 生成待确认条目 │
│ 老师确认后落库 │
└──────────────────────────┘
本 SKILL 的一切逐知识点分析都以 classWorkspace.itemScores(逐题得分)为唯一来源。请老师提供两张表:
表 1 · 逐题分数(必需)——Excel 直接复制粘贴,第一行必须是列名:
学号/座号, 题1, 题2, 题3, 题4, 题5, 题6
座号03, 8, 8, 4, 6, 9, 0
座号07, 8, 4, 8, 3, 6, 0
...
满分, 8, 8, 8, 6, 15, 5。表 2 · 题号→知识点映射(必需)——即 classWorkspace.examBlueprints[].items:
题号, 知识点, 认知层级(了解/理解/掌握/运用), 难度档(基础/中等/较难), 满分
1, 一次函数概念, 了解, 基础, 8
2, 一次函数图象, 理解, 基础, 8
...
若老师已用 xiaozhi-teach-exam-designer 出过卷,表 2 直接读 classWorkspace.examBlueprints,无需重填。
只有总分怎么办:如果老师只能提供"学号 + 总分",本 SKILL 只做分数分布(平均、中位、标准差、分段人数、分层建议),
并明确告诉老师:不能出知识点热力图、不能算逐题难度与区分度、不能算信度——因为这三项在数学上都需要逐题分数。
此时 classSummaries[].dataCompleteness 记为 仅总分,报告首行写"本次为总分级分析"。
义务教育阶段:考试只有期末(初中可加一次期中;九年级在总复习阶段可有 1—2 次模拟考试),实行等级评价,结果不排名、不公布;单元练习是随堂练习,不是考试。两种的逐题得分都可以导入,做本 SKILL 的分析,报告只给老师本人(单元练习不计总分,指不给学生打总分、不按总分评价;题少、又是随堂做的,D 与 α 只作参考,结论标 🟡 初步趋势);给学生与家长的结果:考试写学校给的等级与知识点诊断,单元练习写知识点诊断(老师自定了简单等级的可以附上,不套期中、期末的等级线),都不写总分与名次(§10.2)。
先取 classWorkspace.classProfile.fullScore(或本卷 examBlueprints[].fullScore)把分数换算成得分率 = 得分 ÷ 满分,
所有警戒值都对得分率生效,这样 100/120/150 分卷可以横向比较。等级赋分、标准分与位次都不是得分率,不能拿来算 P、D、热力图,也不套警戒值,一律用原始的逐题得分(高中见 §8.4)。
| 指标 | 含义 | 警戒值(得分率口径) |
|---|---|---|
| 平均得分率 | 班级整体水平 | < 0.60 偏低 / > 0.85 偏高 |
| 中位数得分率 | 抗极值,代表"中间学生" | 比平均低 0.05 以上说明尾部拖拽 |
| 标准差(换算为得分率) | 班级内差距 | > 0.15 说明分化明显 |
| 极差(最高−最低得分率) | 两端跨度 | > 0.40 说明两极分化 |
| 优秀率(得分率 ≥ 0.85) | 拔尖学生占比 | < 10% 偏低 |
| 及格率(得分率 ≥ 0.60) | 基础达标率(不是合格线:高中合格考模拟的合格线由老师按本地考试说明给,见 §8.4) | < 60% 说明大面积未达标 |
| 低分率(得分率 < 0.40) | 严重落后学生占比 | > 15% 需重点关注 |
这些警戒值是经验值,随卷子难度浮动;难度偏离预期时(见 §4.3)先怀疑卷子,再怀疑学生。
正态分布 :多数学生集中在平均分附近,两端人数少
→ 班级整体教学节奏稳定,按既定计划推进
右偏分布 :多数学生得分高,少数学分低
→ 关注尾部学生,避免被平均分掩盖
左偏分布 :多数学生得分低,少数高分
→ 全班基础不牢,需放慢节奏补基础
双峰分布 :两端各有一群学生,中间少
→ 同班分层任务的必要性最强(义务教育阶段学校不得分设重点班和非重点班,见义务教育法第二十二条;高中走班由学校定)
xiaozhi-teach-exam-designer 沿用同一套)■ 难度 P(越大越易)
单题:P = 该题班级平均得分 ÷ 该题满分
全卷:P = 班级平均总分 ÷ 卷面满分
(0/1 计分的客观题,P 就等于通过率;主观题必须用"平均得分÷满分",不能用通过率)
P ≥ 0.85 偏易 → 适合作为基础题、开卷热身
P 0.70-0.85 较易 → 形成性测评的主体
P 0.50-0.70 适中 → 诊断性/终结性测评的主体
P 0.30-0.50 较难 → 区分中上段
P < 0.30 偏难 → 全班大面积失分,先查是否超纲或表述不清
■ 区分度 D(27% 分组法)
1) 把全部有效答卷按总分从高到低排序;
2) 取前 27% 为高分组,后 27% 为低分组(不足 20 人时改用"上下各半",
并在报告里注明 groupingMethod=上下各半,结论标 🟡 初步趋势);
3) D = 高分组该题得分率 − 低分组该题得分率。
得分率 = 该组该题平均得分 ÷ 该题满分,因此主观题同样适用。
D ≥ 0.40 优秀
D 0.30-0.39 良好
D 0.20-0.29 可接受
D < 0.20 需要解释,不等于坏题(见下)
■ D < 0.20 怎么读(常见误判)
❌ 错误说法:"D < 0.20 说明所有学生全对或全错"。
✅ 正确说法:D 低只说明"这道题没有把高低分组区分开",原因可能是:
· 这是基础题且大家都会(P 很高)→ **基础题允许 D < 0.20,不删不改**,
它的作用是保底与信心,不是筛选;
· 这是超纲题且大家都不会(P 很低)→ 考虑降级或删;
· 高分组反而错得多(D 为负)→ 高度怀疑答案错、题干歧义或评分标准有问题,
先人工复核原题,标记 flag=疑似错题。
判定规则:**只对难度档为"中等/较难"的题要求 D ≥ 0.20;基础题只看 P 是否 ≥ 0.85。**
■ 信度 Cronbach α(整卷内部一致性)
α = (k / (k−1)) × (1 − Σσᵢ² / σ总²)
k = 题目数,σᵢ² = 第 i 题得分方差,σ总² = 总分方差。
需要逐题分数;只有总分时算不了。
α ≥ 0.80 良好;0.70-0.80 可接受;< 0.70 说明本卷题目考的东西不够一致,
结论要保守(尤其不要拿单题得分率下"学生不会这个知识点"的硬结论)。
■ 样本量提示(必须随统计一起输出)
· 有效答卷 ≥ 30 人:P/D/α 可正常解读 🟢
· 20-29 人:D 与 α 波动较大,只作参考 🟡
· < 20 人:不输出 D 与 α,只给 P 与分布,并标 🔴 样本不足
· 缺考、中途离场、雷同卷先剔除再统计,并写明剔除了几份。
■ 写入
以上 P / D / groupingMethod / flag 由**本 SKILL 主写** `classWorkspace.itemStats`;
α 与整卷指标写入 `classWorkspace.classSummaries`。
同一 examId 已有条目的(如数学测评设计写入的),先读、比对,不另写一套;口径不一致时由老师定用哪一份(做法见 §8.4,各学段都照这样做——数学测评设计也写初中数学卷)。
`xiaozhi-teach-exam-designer` 只写考前的**预期难度** `examBlueprints[].items[].expectedP`,不写实际值。
前置条件:热力图只能在
dataCompleteness = 逐题时生成。只有总分时跳过本节,直接看 §4.2 分布形态。
判定顺序:先判 ⚪,⚪ 不成立再按得分率落入 🔴 / 🟡 / 🟢。
⚪ 待复核(不计入共性弱项)
条件:该知识点得分率 < 10% 且 满足下列任一:
· 该题 D ≤ 0(高分组反而更差)
· 老师复核后认定超纲、题干歧义或答案有误(itemStats.flag = 疑似错题)
处理:先复核题目本身,复核前不写进 weaknessRank,也不安排全班重讲。
🔴 共性弱项:得分率 < 40%(且不满足 ⚪ 条件)→ 建议全班重讲
🟡 强化项: 得分率 40%(含)- 70% → 不必重讲,作业中强化
🟢 起点项: 得分率 ≥ 70% → 可作复习课的基础起点
说明:旧版"⚪ < 5%、🔴 < 40%"两档互相包含,无法判定;本版以"是否已复核题目"作为 ⚪ 的唯一入口, ⚪ 与 🔴 因此互斥。
知识点热力图(章节 → 知识点 → 得分率)
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
[第 X 章] 函数
一次函数概念 🟢 82% [ 名错/ 名对]
一次函数图象 🟡 56% [ 名错/ 名对]
一次函数性质 🔴 32% [ 名错/ 名对] ← 共性弱项
用待定系数法求解析式 🟡 65% [ 名错/ 名对]
一次函数应用 🔴 38% [ 名错/ 名对] ← 共性弱项
━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━
红色共性弱项:得分率 < 40% 且失分人数 ≥ 班级人数的 30%
→ 写入 classWorkspace.weaknessRank(errorRate、dimension、evidenceExamIds)
→ 建议触发(需老师确认):lesson-planner 读 weaknessRank 排本周教案侧重点
→ 建议触发(需老师确认):classroom-coach 读 weaknessRank 定提问侧重点
黄色强化项:得分率 40%-70%
→ 同样写入 weaknessRank,但 stubbornCount 不累加
→ 建议触发(需老师确认):assignment-designer 读 weaknessRank 出分层作业
绿色起点项:得分率 ≥ 70%
→ 不写 weaknessRank
→ 建议触发(需老师确认):review-planner 把它排进复习地图的"快速过"层
顽固弱项(学校班级工作区的口径;shared/vocab.md §5 的具体条件以本节与 §6.2 为准):同一知识点在近 4 次测评中有 3 次错误率 > 30%,
记入 weaknessRank[].stubbornCount。粒度是"知识点 + 通用错因维度"(shared/vocab.md §1 的 概念模糊 / 计算失误 / 读题失误 / 方法用错),
学科子类型不同但通用维度相同的仍计入同一计数。不足 3 次证据时标 🟡 初步趋势,不写"顽固"。
每个学生输出一张诊断卡,至少需要 3 次历史数据才能给出稳定结论。
📎 完整模板见
references/student-diagnosis-card-template.md(学生诊断卡填写模板:成绩趋势/强弱项/学习行为信号/教师建议/家长话术方向)
数据要求:近 4 次测评,全部换算成得分率后再比较(不同满分的卷子不能直接比分数;
高中只考必修的卷与含选择性必修的卷分开比较,见 §8.4)
稳步上升:4 次得分率中至少 3 次逐次上升,且最近 1 次高于这 4 次的均值 🟢
稳定: 4 次得分率极差 < 0.05 🟢
波动: 4 次得分率极差 0.05-0.15,无明显方向 🟡
稳步下降:4 次得分率中至少 3 次逐次下降 🟢
证据不足:测评次数 < 3 次,或几次卷子的整卷 P 相差 > 0.15 🔴
置信度标签按
shared/vocab.md§7:🟢 数据充分(≥3 次独立观察且方向一致)/ 🟡 初步趋势 / 🔴 样本不足。 🔴 的结论只在本次会话使用,不写入classWorkspace。
个体顽固弱项按 shared/vocab.md §5 学校班级工作区的口径判定,具体条件就是下面几条(§5 指回本节):
粒度:同一知识点标签 + 同一通用错因维度(shared/vocab.md §1)
窗口:近 4 次测评
条件:其中 3 次该知识点得分率低于班级同题得分率,且该生该知识点得分率 < 0.60
排除:若该题在 §5.1 中被判为 ⚪ 待复核(题目本身有问题),本次不计数
满足 → weaknessRank[].stubbornCount 累加,并在个体诊断卡标注"顽固(近 4 次 3 次)"
近 4 次每次都低于班级同题得分率且 < 0.60 → 诊断卡改标"高危(近 4 次 4 次)",按 shared/vocab.md §5 的高危处理:先与学生本人沟通策略,告不告诉家长看授权位(shared/vocab.md §8:先查 parentSharingConsent,涉及情绪再查 emotionSharingWithParent)
不满足但已出现 2 次 → 标 🟡 初步趋势,只提示"下次同类题留意"
📎 完整模板见
references/class-report-template.md(7 段班级学情报告填写模板:整体表现/三层分布/共性弱项/区分度异常/警示名单/对比/教学调整建议)
基于班级画像,自动生成"讲/练/测 比例调整"。
讲 练 测
默认比例 40% 40% 20%
共性弱项多 → 50% 35% 15% (多讲)
两极分化 → 30% 45% 25% (多练多测)
整体偏弱 → 45% 40% 15% (重基础)
整体偏强 → 30% 40% 30% (多测拔高)
考前冲刺 → 20% 30% 50% (重测评)
测:指课堂上用练习检查掌握情况并讲评;义务教育阶段按随堂练习做(单次一般不超过 20 分钟;"考前冲刺"一行的"测"也拆成几次随堂练习,不整节课做卷),不另组织测验、不计总分、不排名。
A/B/C 分层由本 SKILL 计算并写入 classWorkspace.studentTiers,其他 SKILL 只读不写。
判定依据:该生近 3 次测评的平均得分率(不足 3 次时 tier 留空,basis 写"证据不足")
A 层(需补基础):平均得分率 < 0.60
B 层(达标): 平均得分率 0.60(含)- 0.85
C 层(可拓展): 平均得分率 ≥ 0.85
写入字段:
studentTiers[].studentAlias 学号/座号(不写真实姓名)
studentTiers[].tier A / B / C
studentTiers[].basis 如"近 3 次测评平均得分率 0.62"
studentTiers[].updatedAt 计算日期
三条硬规则:
① 分层是**动态的**——每次新测评后重算,不设固定人数比例。
某次卷子偏易时 C 层可能占一半,偏难时 A 层可能占一半,这是卷子的信息,不是学生变了。
② 分层依据是"近 3 次",因此**课前就可得**,不需要等本节课上完。
③ 分层只用于安排任务难度,不作为座位、评优、家长沟通中的身份标签;
对学生表述时用"这次的任务卡",不用"你是 A 层"。
A 层任务(基础学生):
· 弱项知识点的"再讲一遍"小课
· 课本例题 + 1 道变式
· 教师频繁巡视
B 层任务(中等学生):
· 弱项的变式训练 2-3 道
· 综合应用题 1 道
· 同伴互评
C 层任务(拔尖学生):
· 完成 B 层任务
· 弱项的跨章/跨学科迁移 1 道
· 1v1 拔高或独立研究
高中的成绩分析先问清四件事,再进第三节的流程:
① 哪场考试
· 校内的单元测、期中、期末,毕业年级的统考、联考与模拟考,还是合格考、等级考(各地也叫选考)、
高考的语文、数学、外语的模拟卷
· 统考、联考在参加的学校、所有考场(考点)与全部批次、全部场次都考完之后才分析,见开头"试题保密"段
② 本地当年的考试说明
· 合格考模拟的合格线由老师按本地考试说明给出(原始分或得分率,换算成得分率后用);
没给的标"待老师按本地考试说明确认",不拿 §4.1 的及格率 0.60 代替
③ 这个教学班考哪一种
· 合格考班还是等级考班——班级工作区没有选科这一项,由老师说明,
不从成绩或其他字段推断
④ 这张卷考到哪
· 只考必修,还是含选择性必修;细目表上有"范围"列或老师说明了每题属于哪一块时,
两部分分开统计
建档里有的字段先读:classProfile.subject、classProfile.gradeLevel,分清学科与年级;没有的问老师。classProfile.classId 对应教学班。
只用原始的逐题得分:等级考的赋分由考试机构按考生在全体考生中的位置换算,不是本卷的得分率——不能拿来算 P、D、热力图,也不套 §4.1 的警戒值。等级考的模拟卷(校内或联考)一律用原始逐题得分;老师只拿到赋分或等级的,说明这些数据不能用于本 SKILL 的分析,请老师提供原始逐题得分,只有原始总分时按 §4.0 做总分级分析。本 SKILL 不推算学生的赋分、等级或位次:班级与联考的数据算不出赋分,赋分本身也是排名。
学业质量水平:分析单位仍是知识点。细目表上标了"核心素养""学业质量水平"列的(这两列工作区没有,只在细目表上;历史命题与答题规范指导按约定格式把它们写进了 knowledgePoint,也可以照着拆开),本次报告可以按列汇总得分率,只写"本卷标为水平 X 的题,班级得分率是多少",不写"该生达到了学业质量水平 X"——合格与等级由省级考试认定。各学科的水平分级不同,见 shared/hs-subject-standards.md 第一节,不跨学科换算。
合格考的模拟:报告写低于老师所给合格线的人数;老师要名单时只列学号或座号,只给老师本人,不进家长版,也不当作学生的身份标签。只说本次模拟有几人低于合格线,不说谁"会过""不会过"。
必修与选择性必修分开:只考必修的卷与含选择性必修的卷,不放进同一条趋势线比较(§6.1 的"整卷 P 相差 > 0.15 不直接比"照用)。同一张卷里两部分都有时,分开给得分率;合格考与等级考的学生做同一张卷时,按老师说明的分组分别统计,只考合格考的那一组,不按选择性必修题给他们下弱项结论。
走班与样本:不跨教学班合并个人成绩;跨班只在两卷相同时比较班级层面的指标。走班的教学班人数可能不到 20 人,§4.3 的样本量提示照用(< 20 人不输出 D 与 α,标 🔴 样本不足);分组统计时按每组的人数判,人少的组只给得分率与人数。
选科不记录:
分层走班不是 studentTiers:学校的"分层走班"也常分 A、B、C 层,由学校按自己的办法定;本 SKILL 的 A/B/C 只用来安排任务难度(§8.2 规则③),两者不是一回事——不拿 studentTiers 去定走班的层,也不出走班或分班名单。
学分:模块考试、学分认定、合格与毕业由学校按课程方案与本地规定办,本 SKILL 不判定;本 SKILL 的分层、名单与报告也不作学分认定或综合素质评价的依据。
家长版:§10.2 照用;高中另外不写赋分与等级预测,年级或联考的位次、百分位,选科或换科建议,"合格考会不会过"的预测,也不写临界生名单。授权位照旧逐次查,高中由学生本人决定(shared/vocab.md §8),高三有已满 18 周岁的学生,同样以学生本人的同意为准;老师拿不准时先问学生本人。
itemStats 与 classSummaries:写入前先查同一 examId 在工作区里有没有条目(工作区不记写入方;数学卷常由数学测评设计先写,本 SKILL 上次写的也算)。有就先读,按本 SKILL 的口径重算比对,不另写一套:数字与口径都一致的不再写;数字有出入(如老师更正过逐题得分后重跑),或 groupingMethod 不同、sampleSize 对不上(剔除的答卷份数不同)时,把两套数字给老师看,由老师定用哪一份——选本 SKILL 的,经老师确认后替换该 examId 的条目;选已有的,本 SKILL 只读。
高中转给谁:
| 老师要的 | 转给 |
|---|---|
| 数学的班级错因归类与个体错因诊断 | 班级错因分析(xiaozhi-teach-math-error-analyzer) |
| 英语听说读写的四维能力画像 | 英语综合测评(xiaozhi-teach-english-assessment) |
| 语文作文的等级分布与讲评 | 写作教学指导(xiaozhi-teach-chinese-writing-guide) |
| 历史答题规范的专项讲评 | 历史命题与答题规范指导(xiaozhi-teach-history-assessment-guide) |
| 物理单题的讲法与变式 | 物理解题教学指导(xiaozhi-teach-physics-problem-guide) |
| 数学、物理、化学、生物学、地理、历史的讲评课与复习课(整节) | 数学教案设计(xiaozhi-teach-math-lesson-planner);物理教案设计(xiaozhi-teach-physics-lesson-planner);化学教案设计(xiaozhi-teach-chemistry-lesson-planner);生物教案设计(xiaozhi-teach-biology-lesson-planner);地理教案设计(xiaozhi-teach-geography-lesson-planner);历史教案设计(xiaozhi-teach-history-lesson-planner) |
| 生物学、地理合格考的复习排期;等级考的复习排期 | 生地学业水平考试复习规划(xiaozhi-teach-bio-geo-review-planner);复习规划师(xiaozhi-teach-review-planner) |
| 独立教师的家长沟通 | 家长沟通助手(xiaozhi-teach-parent-communication) |
| 物理、化学、生物学、地理的班级错因细化 | 老师端本库暂无专门技能,本 SKILL 按通用四维(shared/vocab.md §1)做 |
本库没有学科技能的五科(思想政治、信息技术、通用技术、艺术、体育与健康):统计照常做,各科的边界见 shared/hs-subject-standards.md 第十节。思想政治的开放题失分只按通用四维归因(答题不规范归"方法用错"),不评价学生的观点或立场,不下"立场问题""价值观偏差"一类结论。
老师通用 6 个 SKILL 共用同一份数据契约 shared/class-teaching-workspace.schema.json,
在正文中以 classWorkspace.<字段> 引用。只允许出现该 schema 中真实存在的字段。
| classWorkspace 字段 | 谁写 | 本 SKILL 的角色 |
|---|---|---|
classProfile | 老师首次建档 | 读(取 fullScore、classSize、gradeBand 做换算;高中另读 classProfile.subject、classProfile.gradeLevel 分清学科与年级,见 §8.4) |
examBlueprints | xiaozhi-teach-exam-designer 或学科老师端技能 | 读(题号→知识点、认知层级、难度档、expectedP) |
itemScores | 老师导入(本 SKILL 引导) | 读(唯一的逐题分数来源) |
homeworkAssignments | xiaozhi-teach-assignment-designer 或学科老师端技能 | 读 completionSummary 作为辅助证据 |
interactionLogs | xiaozhi-teach-classroom-coach 或学科老师端技能 | 读 misconceptionsObserved 作为辅助证据 |
itemStats | 本 SKILL 主写;学科老师端技能(目前是数学测评设计 xiaozhi-teach-math-exam-designer)也写本学科卷子的条目 | 写 pValue / dValue / groupingMethod / flag;同一 examId 已有条目的(不论哪个技能写的)先读、比对,不另写一套,口径不一致时由老师定用哪一份(§8.4) |
classSummaries | 本 SKILL 主写;数学测评设计也写数学卷的条目 | 写 mean / sd / meanRate / distribution / reliabilityAlpha / dataCompleteness;同一 examId 的规则同上 |
weaknessRank | 本 SKILL + 学科错因技能 | 写 knowledgePoint / errorRate / dimension / evidenceExamIds;stubbornCount 由本 SKILL 唯一累加,学科技能(math-error-analyzer、chinese-writing-guide、english-assessment、english-listening-designer、english-speaking-designer)只补本学科条目,不碰该计数 |
studentTiers | 本 SKILL 唯一写入 | 写 studentAlias / tier / basis / updatedAt |
lessonPlans | xiaozhi-teach-lesson-planner 或学科老师端技能 | 只读(看上节课覆盖了哪些 sourceWeaknessIds) |
reviewPlans | xiaozhi-teach-review-planner 主写 + 学科技能(english-assessment、english-listening-designer、bio-geo-review-planner)只补本学科条目 | 只读 |
xiaozhi-teach-exam-designer ← 读 itemStats(哪些题该改/该删)、classSummaries(下次难度基线)
xiaozhi-teach-lesson-planner ← 读 weaknessRank(教案侧重点)、studentTiers(A/B/C 分层)
xiaozhi-teach-classroom-coach← 读 weaknessRank(提问侧重点)、studentTiers(分组与提问分配)
xiaozhi-teach-assignment-designer ← 读 weaknessRank + studentTiers(分层作业)
xiaozhi-teach-review-planner ← 读 weaknessRank(复习重点)、classSummaries(起点水平)
xiaozhi-teach-math-lesson-planner、xiaozhi-teach-physics-lesson-planner、xiaozhi-teach-chemistry-lesson-planner、xiaozhi-teach-biology-lesson-planner、xiaozhi-teach-geography-lesson-planner、xiaozhi-teach-history-lesson-planner ← 读 itemStats(讲评课的得分率与异常标记)
xiaozhi-teach-math-exam-designer、xiaozhi-teach-math-error-analyzer、
xiaozhi-teach-english-assessment、xiaozhi-teach-history-assessment-guide 等学科端 SKILL 承担;本 SKILL 只做学科无关的统计与分层。references/analysis-framework.md 第七节的模板出——照样先核对授权,只写该生自己的纵向变化与可执行建议;素材里没有逐题得分的(如作文的等级与批语、口语或实验的进步反馈),纵向变化照素材里的等级与要点写,不为此要老师补逐题分数,也不据此改 studentTiers 或 weaknessRank;作文全文、口语录音等原始作答不转给家长,家长版不写进工作区。作业的家长反馈仍由作业设计师(xiaozhi-teach-assignment-designer)出。独立教师的学员转家长沟通助手(xiaozhi-teach-parent-communication);分不清是学校班级还是独立教师的学员时,先问老师。素材里出现危机信号的,先按危机例外处置,不出家长版;伤害可能来自家里的,不提示监护人(shared/crisis-exception.md"家庭安全类信号")。xiaozhi-teach-lesson-log、xiaozhi-teach-homework-tracker),
分析这位老师自己一对一、小班的学员时,可把它们的课后记录与课上练习记录作为补充证据,只作参考,不计入 §6.2 的顽固与高危判定;未安装时本 SKILL 完全可独立运行,不把它们列为必需输入。- 不默认调用学生端 DNA:教师自有数据优先;确需读写学生端档案时走 handover 的
teacher_writeback,并先检查 teacherWritebackConsent
- 不预测分数:不做"提分 X 分"承诺
- 不写焦虑话术:所有面向家长的素材用客观事实表达
- 不在样本不足时下结论:< 3 次数据明确写"证据不足"
- 不替老师判断学生品行:成绩差≠态度差
- 不自己造分层以外的标签:全库分层只有 studentTiers 的 A/B/C
✅ 使用:学号、化名、座位号
❌ 禁止:真实姓名(除非老师已确认班级内部使用)
✅ 班级报告:可写"近 4 次下降 ≥ 10 分的 3 人"
❌ 禁止:在公开报告中点名
生成前先检查学生端 parentSharingConsent;含情绪内容再检查 emotionSharingWithParent。任一为 false 时只输出给老师本人与学生本人。
义务教育阶段的日常考试(期中、期末与九年级的模拟考试)实行等级评价,考试结果不排名、不公布(教育部办公厅《关于加强义务教育学校考试管理的通知》,教基厅函〔2021〕34 号;教基厅〔2025〕3 号;按当地规定):给家长与学生本人的版本写学校给的等级与知识点诊断,不写总分(含整卷得分率)与名次;等级由老师照学校给的填(只在本次会话里用,工作区没有这一项),本 SKILL 不自定等级线;学校还没给等级的,请老师照学校的分法填上,没填之前家长版只写知识点诊断,不由本 SKILL 按分数换算。老师自留的班级报告与诊断卡照旧。高中照学校的做法,按下表与 §8.4。
✅ 使用:该生自己的纵向变化("这三次同一知识点的得分率 0.42 → 0.55 → 0.68")
✅ 使用:客观证据 + 1-2 句可执行建议
❌ 禁止:班级排名、名次段、排名百分位(如"班级前 30%""处于班级下层 20%")
——横向位次会把沟通推向比较,且随卷子难度剧烈波动,不是可行动的信息
❌ 禁止:单独分数 + 排名的组合
❌ 义务教育阶段另外不写:总分、整卷得分率(考试写学校给的等级与知识点诊断,单元练习写知识点诊断)
❌ 禁止:人格判断、焦虑话术
❌ 高中另外不写:赋分与等级预测、年级或联考的位次、选科或换科建议、"合格考会不会过"的预测;
授权由学生本人决定,已满 18 周岁的学生也一样(见 §8.4)
写入 weaknessRank:只写知识点与错因维度,不写"哪个学生差"
写入 studentTiers:只写学号/座号 + A/B/C + 依据,不写姓名与名次
写入 itemStats: 只写题目统计,不写答题人信息
| ✅ 应该做 | ❌ 不能做 |
|---|---|
| 至少要 3 次数据才下趋势结论 | 1 次成绩就给学生贴标签 |
| 报告必须分层呈现 | 只看平均分 |
| 弱项定位到具体知识点 | 只说"数学差" |
| 输出教学调整建议 | 只分析不给方案 |
| 不确定就标"证据不足" | 编造稳定趋势 |
| 报告用聚合数据呈现 | 在班级群公布个人分数或排名 |
| 区分题目质量与学生能力 | 把难题都怪学生不会 |
学情分析师
<── xiaozhi-teach-exam-designer(examBlueprints:题号→知识点)
<── xiaozhi-teach-assignment-designer(homeworkAssignments:作业完成情况)
<── xiaozhi-teach-classroom-coach(interactionLogs:课堂观察)
<── 学科教师 SKILL(学校班级的家长素材:进步反馈、考后成绩,经老师转来,按 §9.3 出家长版)
──→ xiaozhi-teach-lesson-planner(weaknessRank / studentTiers)
──→ xiaozhi-teach-classroom-coach(weaknessRank / studentTiers)
──→ xiaozhi-teach-review-planner(weaknessRank / classSummaries)
──→ xiaozhi-teach-exam-designer(itemStats:题目质量)
──→ 学科教师 SKILL(xiaozhi-teach-math-error-analyzer 等,做学科错因细化;高中的转交表见 §8.4)
··→ 若已安装独立教师包:xiaozhi-teach-lesson-log / homework-tracker 可作补充证据(可选,一对一/小班场景,不计入顽固与高危判定)
禁止行为:
references/analysis-framework.md — 学情分析框架与模板references/student-diagnosis-card-template.md — 学生个体诊断卡填写模板references/class-report-template.md — 班级学情报告(7 段完整模板)💡 小智说: "分数告诉你'发生了什么', 学情分析告诉你'为什么发生'和'接下来该怎么办'。 真正有效的教学调整, 不是哪个学生'不行',而是 哪一步设计没让他能行。"