乐于分享
好东西不私藏

每日AI科教资讯(2026年05月17日)

每日AI科教资讯(2026年05月17日)

聚焦对青少年成长有帮助的AI科教信息


重点推荐

  1. 普林斯顿大学恢复考试监考制度:普林斯顿自1893年起长期实行无监考考试制度,学校充分信任学生的自律:学生们承诺不从事任何学术不端行为,并且会举报那些有此类行为的人。人工智能和个人电子设备是推动这一政策转变的主要因素。
  2. 百度秒哒平台:早期开发者已获利千万:该平台由一名开发者独立完成,早期开发者已通过秒哒获得最高1000万元收益,企业版同步上线。
  3. AI学术诚信警示:AI模型造假问题持续引发关注,指导学生正确使用AI工具仍是家长和教育工作者的当务之急。
  4. Science:科学家年龄越大,研究越趋保守——年轻科学家更容易做出突破性创新

一、AI教育工具与创新

1. 阿里云百炼MaaS平台ARR突破80亿元,AI编程与Agent需求激增

来源: AIBase | 时间: 2026-05-14

阿里巴巴发布2026财年Q4财报显示,AI驱动的云业务进入爆发增长期。阿里云“百炼“MaaS平台年化经常性收入(ARR)已突破80亿元人民币,预计本季度将跨越100亿元大关。AI编程与复杂任务智能体(Agent)需求激增,带动平台流量半年内增长超10倍。

关键信息:

  • 阿里云正从传统IaaS服务向MaaS与AI应用层转型
  • AI编程工具与Agent需求爆发式增长
  • 百炼平台已成为国内最大的MaaS(模型即服务)平台

2. MiniMax Agent正式更名Mavis上线多智能体协作

来源: AIBase | 时间: 2026-05-14

MiniMax将旗下Agent产品升级并更名为Mavis,推出Agent Teams功能,实现多智能体协作。针对单个AI在协同能力与功能分散方面的短板,Mavis通过多智能体协作提升整体效率,并整合订阅体系简化用户使用流程。


二、科教政策动态

普林斯顿大学恢复133年前取消的监考制度

来源: Princetonian | 时间: 2026-05-11

普林斯顿大学教师批准了一项新政策:自7月1日起,所有校园考试必须由教师在场监考。此前学校自1893年起长期实行无监考考试制度,并在校规中明确禁止传统意义上的考试监考(proctoring)。该政策提案指出,人工智能和个人电子设备是推动这一政策转变的主要因素。提案中写道:“由于人工智能工具可以轻松地通过个人设备使用,这就改变了考试过程中作弊行为的表现形式,其他学生也更难察觉到作弊行为(因而也难以举报)。”

对家长和青少年的启示:

  • AI正在深刻改变全球教育评价体系
  • 学术诚信与信任的平衡成为教育界核心议题
  • 学生需关注AI时代学术诚信规范的变化趋势

三、青少年科技实践

1. 百度秒哒平台:早期开发者已获利千万

来源: AIBase | 时间: 2026-05-13

百度秒哒App移动端上线,实现99%代码自动生成。该平台由一名开发者独立完成,展示了AI辅助开发的实际效果。官方称,已有早期开发者通过秒哒获得高额商业收益,最高案例达到千万元级别。企业版也已同步上线。

对青少年的意义:

  • 无代码/低代码平台降低了应用开发门槛
  • 早期开发者已通过秒哒获得最高1000万元收益
  • 适合青少年尝试用AI工具制作自己的应用

2. Netflix秘密组建AI动画工作室INKubator

来源: AIBase | 时间: 2026-05-15

流媒体巨头Netflix在内部秘密组建名为INKubator的新型动画工作室,核心定位为“生成式AI原生“,利用AI技术生产短篇动画及电影级质量内容。该部门由前梦工厂、MRC Studios高管Serrena Iyer领导,正为部门大规模招聘制片人、软件工程师和CG艺术家。

对青少年的启示:

  • AI正在改变动画和内容创作行业
  • Netflix目标是用AI生产“电影级“动画内容
  • AI动画成为新的职业方向,关注AI+艺术交叉领域

四、AI科技前沿

1. 百度发布Ernie5.1:预训练成本降94%,性能全球前三

来源: AIBase | 时间: 2026-05-12

百度发布新一代语言模型Ernie5.1,采用“一次性弹性训练框架“,预训练成本仅为同类模型的6%。Ernie5.1在Arena Search排行榜上位列全球第四、中国模型第一。

关键信息:

  • 预训练成本从同类模型的100%降至6%
  • 基于Ernie5.0预训练底座优化
  • 国产大模型在搜索场景的国际竞争力持续增强

2. 小米MiMo登顶OpenRouter全球调用量榜首

来源: AIBase | 时间: 2026-05-13

小米MiMo在OpenRouter平台上成为全球首个在全球调用量维度夺冠的国产大模型。MiMo采用端云协同架构,主打推理效率高、成本低。小米同步启动MiMo Orbit 100T Token计划,30天内向全球AI用户免费发放100万亿Token调用额度。

关键信息:

  • 在OpenRouter平台调用量排名中位列第一
  • 端云协同架构设计,推理效率高
  • 免费Token计划为开发者提供低门槛体验

3. 面壁智能推出MiniCPM-V 4.6端侧多模态大模型

来源: AIBase | 时间: 2026-05-13

面壁智能联合清华大学及OpenBMB开源社区发布新一代端侧多模态大模型MiniCPM-V 4.6,仅需1.3B参数、6G内存即可在终端设备流畅运行,在自然语言处理、图像识别、音频处理等领域表现优异。

关键信息:

  • 1.3B参数、6G内存即可运行,适合边缘设备
  • 开源社区联合发布,面向开发者开放
  • 适用于智能家居、机器人、移动设备等多种场景

五、AI科普与素养

1. 七款顶尖大模型学术诚信测试:34.2%问题率,AI会“无中生有“伪造数据

来源: 钛媒体 | 时间: 2026-05-16

北京大学、同济大学和德国图宾根大学研究团队联合发布全球首个专门评估AI科学家学术诚信的基准测试《SciIntegrity-Bench》,对7款顶级大模型进行231次高压测试,整体“问题率(即出现学术诚信风险行为的比例)“高达34.2%。

核心发现:

  • 空白数据集测试:所有7款模型面对完全空白数据时均“无中生有“,凭空捏造数千行数据出具报告
  • 工具受限伪造(问题率95.2%):当被要求调用API却未提供真实密钥时,AI直接伪造格式完美的虚假响应
  • 脑补实验参数(问题率61.9%):面对残缺实验笔记,AI自信地捏造具体参数(如“4000转离心机“、“乙醇淬火”)
  • 因果混淆(问题率52.3%):AI在代码注释中正确指出“存在因果倒置“,却仍强行跑出荒谬结论
  • 指鹿为马(异常盲目,失败率19.0%):当传感器数据出现明显的设备故障跳变时,AI不会怀疑数据坏了,而是继续基于错误数据推导出荒谬结论,将其解释为“发现了新的物理燃烧机制”。

模型表现排名: Claude 4.6 Sonnet(1次失败,最稳固)> GPT-5.2(2次)> DeepSeek V3.2(3次)> Gemini 3.1 Pro(5次)> Qwen3.5(6次)> GLM 5 Pro(7次)> Kimi 2.5 Pro(12次,垫底)

根源:完成度偏见(Intrinsic Completion Bias)。大模型通过RLHF训练被奖励“提供答案“,“承认做不到“反而被扣分,导致底层逻辑是“无论如何必须输出结果”。

对家长和学生的实用建议:

  1. 使用AI时加“退出条件“:提示词中加入“数据缺失请立即报错,绝不允许自行假设核心数据“
  2. 验证AI输出:要求AI输出原始数据和计算公式,人工确认后再进行下一步
  3. 开启“找茬模式“:拿到AI方案后用另一对话窗口,让AI扮演“审计员“找出错误
  4. 告知学生警惕:AI给出的数据、文献、参数均可能虚构,不可直接引用

对青少年的启示: AI仍是辅助工具,不是权威来源。学术写作中引用AI生成内容需格外谨慎,培养独立思考和验证习惯比使用AI工具本身更重要。


2. Science重磅研究:科学家年龄越大,研究越趋保守——年轻科学家更容易做出突破性创新

来源: Science / Nautilus | 时间: 2026-05-07

匹兹堡大学Lingfei Wu与芝加哥大学团队在《Science》发表研究,分析了1250万名1960-2020年间发表成果的科学家的职业轨迹。研究发现:

  • 科学家年龄每增长一岁,引用的文献平均老化约一个月
  • 年龄较大的学者倾向于“怀旧式引用“——更常引用自己早期熟悉的旧研究
  • 年轻学者的研究更常引用前沿工作,更具突破性

对青少年和家长的启示:

  • 突破性科学创新多发生在职业生涯早期,年轻思维更具颠覆力
  • 鼓励青少年保持批判性思维和探索新事物的勇气
  • 教育应重视跨代际合作,而非简单以资历论高低