国家中小学智慧教育平台“用AI”列表里,“SEED学生综合素质智能评价”这个名字一听就透着“国家队”的气质——不是某个单点工具,而是冲着“学生综合素质评价改革”去的。封面上写着:重点研发计划项目“大规模学生跨学段成长跟踪研究”的研发成果,实现AI赋能的学生综合素质评价(图 1)。我点开一看,评分3.8分,80人评价。这个数字让我先停了一下:好东西为什么分数不高?测完一圈,我大概明白了。

图 1:SEED学生综合素质智能评价入口卡片
◆
一、它认得我,可我改不了
点开图标,没有再弹登录框,也没让我选学校。但我得先说清楚:这不等于“没认证”。它一进来就显示我的姓名,还能在学生和家长两种身份之间切换,说明后台是有用户体系和身份绑定的——它知道我是谁,只是这次的认证过程我没法回溯。
右上角有个头像,点进去能看到“基本信息”“账号设置”“切换账号”三个标签(图 2)。界面支持学生和家长两种身份切换,说明服务对象是孩子和家长。我当前是学生身份,显示“马涛,五年级/1班”,地区是北京海淀。可问题是:除了手机号是我的,学校、班级、地区全都不对(图 3)。我试着想改过来,找了半天也没找到能调整组织架构、改学校年级的地方。看来它记住了以前某次登录留下的信息,但认证是在哪次、怎么绑定的,现在回溯不了,信息错了用户也没法自助修正。
对综合素质评价这种需要长期追踪学生成长的产品来说,身份和数据归属是根基。根基没扎稳,后面的画像再漂亮也可能是张错位的地图。

图 2:学生/家长双身份切换界面

图 3:个人信息页面,学校地区信息与实际不符
◆
二、“小星运的诞生EF”:一场AI物流车的闯关马拉松
主界面是“天天向上”板块,摆着几个活动入口。我选了“小星运的诞生EF”(图 4),进去一看,活动说明写着:5个环节,预计用时40分钟。我心里嘀咕:五年级娃的注意力能撑40分钟吗?
页面中央是个环形地图,五个任务像五个关卡围着一个玻璃球(图 5):
1. 集思广益EF——跟小星运聊数据与伦理;
2. 活学活用EF——看视频,答AI知识题;
3. 火眼金睛EF——给交通路牌数据做标注纠错;
4. 环环相扣EF——为小星运选红绿灯流程图;
5. 蓄势待发EF——用图形化编程让小星运跑起来。
我卡在第一个问题上了:这个“EF”到底啥意思?界面没说。我估计是“Evaluation Form”或者“素养活动”的缩写。国家平台面向中小学生,缩写最好有个中文说明,否则家长和孩子都懵。

图 4:“小星运的诞生EF”入口

图 5:五个任务环形地图
◆
三、第一关:集思广益EF,五年级娃要答AI伦理题
进入第一关,任务说明说是“参与物流机器人小星运的话题讨论”,共6个题目,预计3分钟。第一题就问:“你家开通了快递自动配送服务,小星运配送时需获取家庭地址规划路线,你是否同意让它获取你的位置信息?”(图 6)
后面几题陆续问:快递公司因不共享定位取消服务你怎么办?小星运对偏远地区配送延迟公不公平?它损坏了贵重货物怎么追责?(图 7—图 11)
这些题其实是AI伦理、数据治理、算法公平性的简化版。作为教育素材,方向是对的。可对五年级学生来说,“位置信息共享”“算法偏见”“责任归属”这些概念还是偏抽象。题目没有给孩子足够的铺垫和情境,直接抛选择题,更像在考观点,而不是在培养判断能力。
我一路点下去,6道题做完,提交时弹出一个确认框(图 12),然后才弹出“恭喜你完成了本环节”,进度20%(图 13)。这关还算友好,至少能看懂。


图 6:第一关第1题,关于位置信息共享

图 7:第一关第2题,关于数据使用

图 8:第一关第3题,关于配送公平性

图 9:第一关第4题,关于算法偏见

图 10:第一关第5题,关于机器人故障责任

图 11:第一关第6题,关于事故赔偿标准

图 12:第一关提交确认

图 13:第一关完成,进度20%
◆
四、第二关:活学活用EF,看完视频考AI常识

图 14:第二关任务说明
第二关叫“活学活用EF”,先放一个2分26秒的视频《智慧物流机器人——人工智能在生活中的应用》(图 15)。看完视频做题(图 16、图 17):
- 日常生活中哪项活动应用了人工智能技术?(多选)
- 你认为人工智能的核心在于什么?
- 关于机器人的发展历史,正确顺序是?
这几道题中规中矩,属于AI通识教育的标准题。视频+答题的套路,和很多慕课没有本质区别。我做完提交(图 18),进度跳到40%(图 19)。

图 15:第二关视频学习

图 16:第二关AI知识题

图 17:第二关机器人历史排序题

图 18:第二关提交确认

图 19:第二关完成,进度40%
◆
五、第三关:火眼金睛EF,数据标注像考交规
第三关“火眼金睛EF”一进来,我就感觉不对劲。任务说明让学生“帮助小星运练就火眼金睛,精准识别各种路标”(图 20)。页面给出一组交通路牌识别数据,分甲、乙、丙、丁四组,还有样本数量、样本分布、标注准确性、识别准确率四张柱状图(图 21)。
题目要求学生根据图表分析乙、丙、丁三组在数据标注上的问题,并在表格里填入选项编号(数据标注量太少、各类型数据不均匀、存在错误数据干扰、图像识别算法不完善)。然后系统提示“请你点击丙组数据,并尝试更正错误标注,让小星运更聪明”(图 26),也就是要逐张检查、纠正错误标注。
我盯着那些路牌看了半天:禁止通行、左转弯、直行、右转弯、掉头、红绿灯……有些标志我这位五十岁的“老司机”都不敢秒认(图 22、图 23)。更别提选项里还有“左转弯+请选定行车方向”这种组合牌,系统却要求从六个固定标签里选一个(图 24、图 25)。五年级的孩子做这种题,估计还没开始思考AI,先被交通标志难哭了。
更离谱的是第4题:“虽然有小星运的各种智能技术帮助,但在不同情况下它可能不如人类驾驶员灵活安全。请你判断以下哪种环境更适合用小星运?”给了三张道路图:A是雾天高速,B是晴天普通道路,C是交警指挥的复杂路口(图 30)。这题本身没问题,可前置条件是“五年级学生”——他们中有多少真正理解“雾天能见度低”“交警手势优先”对自动驾驶意味着什么?
这一关我几乎是“硬着头皮”点完的。提交后进度60%(图 32)。我坐在屏幕前感慨:这哪是测AI素养,这是在考驾照科一。

图 20:第三关任务说明

图 21:第三关交通路牌识别数据与图表

图 22:甲组路牌数据
图 23:乙组路牌数据

图 24:路牌标签下拉选择

图 25:另一个路牌标签选择

图 26:第三关提示点击丙组数据并纠错

图 27:丙组路牌数据,需要逐张纠错

图 28:丙组路牌标签下拉选择示例

图 29:另一处标签选择示例

图 30:判断小星运适合哪种道路环境

图 31:第三关提交确认

图 32:第三关完成,进度60%
◆
六、第四关:环环相扣EF,给机器人挑流程图

图 33:第四关任务说明
第四关“环环相扣EF”相对简单一点:给小星运画一张设计图,让它根据红绿灯信号做出正确反应。页面给了A、B两个流程图选项,要求选出正确的一个,并指出另一个的问题(图 34、图 35)。
这题是典型的人工智能/编程思维训练:输入→判断→输出分支。对五年级学生来说难度适中,也能让孩子直观理解“机器人是怎么做决策的”。如果前面的关卡都按这个难度来,体验会好很多。
做完进度80%(图 36)。

图 34:第四关红绿灯流程图选择

图 35:指出未选流程图的问题

图 36:第四关完成,进度80%
◆
七、第五关:蓄势待发EF,Scratch式编程跑小车
第五关“蓄势待发EF”是个图形化编程任务(图 37)。页面提示“本活动应用了较新的前端技术,移动端体验不佳,建议使用电脑操作”,而且是“必做活动”。我点进去,左边是模拟地图,右边是积木块编程区,有小星运角色、红绿灯、路标、目的地(图 38、图 39)。
孩子需要用“移动”“右转”“左转”“面向方向”“重复执行直到”这类积木,让小星运从起点开到终点。这个设计其实不错,把前四关学到的交通规则和决策逻辑,转化为可执行的程序。但问题是:它是整个活动的“压轴戏”,前面已经把孩子耗得差不多了,到这里还要在电脑上用Scratch式界面编程,很多孩子可能已经没耐心了。
我随便拖了几下积木,点了提交,算是完成。页面显示5/5全部完成(图 40),主界面也显示“查看(5/5)”(图 41)。

图 37:第五关任务说明

图 38:第五关图形化编程游戏界面

图 39:编程积木工作区

图 40:五个任务全部完成

图 41:主界面显示已完成
◆
八、报告列表空空如也:激励线太长了
按常理,五个任务都完成了,总该出一份评价报告吧?我点进右上角的“报告”,“报告列表”里却写着“暂无报告”(图 42)。
这让我想起多智能体课堂那篇里“参与讨论5次”的统计——数字很好看,但经不起对账。SEED这里更直接:孩子花四五十分钟闯完五关,连个阶段性反馈都没有。勋章、等级、成长曲线这些游戏化激励,要么藏得太深,要么需要完成更多活动才触发。对小学生来说,反馈周期太长,放弃率就会很高。
怪不得首页评分3.8分。用户不是不认可理念,是体验没跟上。

图 42:报告列表为空
◆
九、AI在哪里?
聊了这么多关卡,回过头要问:SEED的“AI”到底在哪里?
从前台看,五个任务基本是选择题、视频题、数据标注题、流程图题、图形化编程题——交互形态并不新鲜。真正的AI大概率藏在后台:学生答题数据的多维度分析、综合素质画像的生成、区域/学校层面的成长常模对比、个性化发展报告的推送。也就是说,孩子感受不到AI,但平台在替老师、替区域做AI分析。
这本身没问题,甚至可以说方向很对:用AI解决大规模评价中“评什么、怎么评、怎么用”的难题。但问题是,前台的学习体验如果让孩子和家长都抓不到重点,后台的AI再强大,也很难获得真实的、高质量的数据。数据是AI的燃料,孩子的投入度就是数据的源头。
我查了一下背景:SEED平台是北师大团队依托国家重点研发计划项目做的,融合了“五育”和核心素养,提出3个维度、10个指标、36个要点的综合素质模型,研发了11项表现性评价工具,覆盖全国几十个省、几千所学校、几百万学生。这个学术站位和工程投入,值得尊重。但落到国家平台这个入口、落到一名五年级学生的真实使用时,界面流畅度、题目适龄性、反馈即时性,都还有很长的路要走。
◆
十、五点建议
1. 先让用户把身份信息改对。既然做综合素质评价,学生年级、学校、地区必须准确,而且要开放修改入口。不然画像再漂亮也是错的。
2. 题目难度要回归学段。第三关火眼金睛的交规式数据标注,明显超出五年级认知。可以把交通标志换成孩子熟悉的校园场景、生活场景,降低认知负荷,同时保留“数据标注影响AI识别”的核心目标。
3. 缩短反馈周期。每完成一个任务,至少给一句即时反馈、一个小勋章、一段能力解读;不要让孩子闯完五关还看不到报告。反馈是最好的激励。
4. 把“EF”翻译成中文。不管是“素养活动”还是“评价任务”,至少要让孩子和家长一眼看懂。教育产品不是科研论文,术语需要翻译。
5. 让用户看见AI。既然叫“AI赋能”,就要让孩子感受到AI的存在——比如数据标注后,立刻显示“小星运的识别准确率提升了”;编程完成后,立刻演示小星运的自主决策过程。只有看见,才能理解。
◆
写在最后
SEED综合素质评价是这次系列测评里“概念最高、界面最炫、题目最难”的一款。它代表了一种理想:用AI把德智体美劳五育发展量出来、画出来、追踪起来。这个方向我认同。
但一款评价产品,首先得让人愿意完成评价。如果五年级孩子做到第三关就开始怀疑人生,做到第五关已经精疲力竭,做完还发现没有报告,那后台的AI模型再精密,拿到的也是“应付式数据”。
教育评价改革的难点从来不只是“评什么”,更是“怎么让人真心参与”。SEED的底气很足,下一步要把这份底气,化成孩子指尖上愿意点下去的顺畅体验。
#国家中小学智慧教育平台 #AI工具实测 #SEED综合素质评价 #学生综合素质评价 #教育数字化
如果这篇测评对你有用,点个「关注,小红心,转发」让更多老师看到
#国家平台AI工具实测#SEED综合素质评价#AI教育
夜雨聆风