🤖 多Agent协作追踪

每个学生由多个AI Agent协同批改 — 决策轨迹透明可追溯

Agent Collaboration Pipeline
Orchestrator OCR Math KG Diagnosis Strategy Lesson Exercise
决策轨迹:OCR(6题全识别) → Math Agent(客观题4题+解答题2题·全对·置信度均>0.9)
逐题置信度:
Q1
99%
Q2
98%
Q3
100%
Q4
96%
Q5
94%
Q6
93%
决策轨迹:OCR(6题全识别) → Math Agent(Q5步骤②置信度0.72·Q6步骤④置信度0.68) → KG Agent(匹配'配方法''单调性定义'知识点) → Diagnosis(标记2题需复核)
逐题置信度:
Q1
97%
Q2
98%
Q3
95%
Q4
88%
Q5
72%
Q6
68%
⚠ 2 项需教师复核
Q5 步骤2 · 置信度 72%
配方法错误判定需教师确认——学生是否真的漏写了+a²还是跳步
Q6 步骤4 · 置信度 68%
'不单调'理解偏差的判定——可能是概念混淆也可能是读题不仔细
决策轨迹:OCR(6题·Q3未作答识别为空·Q6未作答) → Math Agent(Q5置信度0.78·逻辑跳跃判定) → KG Agent(关联'导数符号判断'前置知识) → Diagnosis(标记Q6未作答需关注) → Strategy(建议了解学生是否存在学习动力问题)
逐题置信度:
Q1
97%
Q2
82%
Q3
100%
Q4
95%
Q5
78%
Q6
100%
⚠ 2 项需教师复核
Q5 步骤3 · 置信度 78%
逻辑跳跃判定——学生方向正确但省略了关键判断步骤
Q6 步骤1 · 置信度 100%
完全未作答——非AI能力问题,需要教师了解学生情况
决策轨迹:OCR(6题全识别) → Math Agent(客观题4题+解答题2题·全对·Q6识别出'陷阱题'额外加分)
逐题置信度:
Q1
99%
Q2
99%
Q3
100%
Q4
96%
Q5
95%
Q6
94%
决策轨迹:OCR(6题全识别) → Math Agent(Q5置信度0.75·Q6置信度0.80·表述不严谨判定) → KG Agent(关联'数学语言规范性'标签)
逐题置信度:
Q1
98%
Q2
96%
Q3
94%
Q4
95%
Q5
75%
Q6
80%
⚠ 2 项需教师复核
Q5 步骤3 · 置信度 75%
'≥0但未说明原因'判定为表述不严谨——可能与教师评分风格有关
Q6 步骤3 · 置信度 80%
'导数始终为负'表述有歧义——是否影响最终判分需教师判断
✗ 传统方案(单一大模型)
一张照片→一个Prompt→一个结果
OCR+推理+评语混在一次调用
出错时无法定位环节
无置信度分层,教师需全量复核
✓ 智教π(多Agent协作)
8个专业Agent各司其职
每个环节独立决策+置信度透明
完整决策轨迹可追溯
教师仅复核~15%低置信度结果