乐于分享
好东西不私藏

AI每日资讯【2026年5月25日】

AI每日资讯【2026年5月25日】

今日核心信号

  • 模型竞争正在从“更强聊天”转向“更强执行”:视频生成、编程智能体、攻防能力都在提速。
  • 科研工作流被快速重写:数据库整合、假设生成与文献分析开始被单一模型平台串联。
  • ROI 更清楚了:银行审批、交通运维等高流程行业已经给出分钟级提效与明确商业指标。
  • 国家级部署升温:新加坡案例说明,大模型公司正把政府与公共服务场景当作下一增长曲线。
  • 监管分化加剧:美国纠结护栏与领先地位,欧洲转向应用策略,中国强调场景清单与制度配套。

前沿研究 / 论文

#01🔥重要 官方博客 / Google Blog / 英文

Gemini for Science:谷歌把科研工具链产品化

谷歌把 Gemini for Science 打包成面向科研场景的工具集,核心包括假设生成、计算发现、文献洞察与 Science Skills。官方称其已整合 30 多个生命科学数据库,正与 100 多家机构联合验证,复杂分析可从数小时压缩到数分钟,AlphaFold 相关能力累计已帮助超 300 万研究者。值得关注的是,大模型正从“回答问题”走向嵌入假设生成、代码搜索和文献梳理的完整科研工作流。
原始链接:https://blog.google/innovation-and-ai/technology/research/gemini-for-science-io-2026/
#02⚡值得关注 研究社区转载 / BAAI Hub / 中文

arXiv 收紧 CS 投稿:AI 时代预印本门槛上升

arXiv 近期明显收紧计算机科学类投稿规则。根据报道,综述和立场类论文若未先经过正式期刊或会议同行评审、未提供 DOI,将难以直接进入平台;而自 2026 年 1 月 21 日起,新投稿人若想自动获得资格,既要有机构邮箱,也要在对应背书域已有发表记录。平台背后约 300 名志愿审核员难以承接 AI 时代的海量稿件,规则收紧会抬高新人和独立研究者门槛,也意味着学术传播正从“先公开再筛选”转向更强调前置过滤。
原始链接:https://hub.baai.ac.cn/view/54943
#03🔥重要 科技媒体 / 科学网 / 中文

AI 推翻 Erdős 旧猜想:数学发现开始出现机器首创

科学网援引最新进展称,OpenAI 的实验性通用推理模型在单一提示下独立生成 125 页推理文本,给出优于 Erdős 1946 年单位距离猜想设想的平面点排布方案,相关结果已由外部数学家核验。若这一结论持续成立,它的重要性不只在“会做题”,而在于 AI 已能围绕开放式数学问题形成较长链路、可检查的原创推理。对基础研究界而言,这预示模型正从证明助手走向问题探索者,也会倒逼学界重估人机协作与学术署名边界。
原始链接:https://news.sciencenet.cn/htmlnews/2026/5/565249.shtm

产品与发布动态

#04🔥重要 官方博客 / Google Blog / 英文

Gemini Omni Flash 发布:多模态生成迈向“任意输入到视频”

Google 推出 Gemini Omni 家族首个模型 Gemini Omni Flash,把文本、图片、音频、视频等输入统一到一个生成框架里,并先从视频输出切入。官方展示已支持对话式修改环境、动作、角色和画风,还强调模型具备物理感知,可处理 24FPS、16:9 等细节。本周内功能会进入 Gemini App、Flow、YouTube Shorts 与 Create,开发者和企业 API 也将在未来几周开放。更值得看的是,多模态创作正走向统一编辑。
原始链接:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/
#05⚡值得关注 一手媒体 / 财联社 / 中文

DeepSeek 组建 Agent Harness 团队,直指编程智能体产品化

DeepSeek 被曝正在组建新的 Agent Harness 团队,并连续放出产品经理与研发工程师岗位,目标是把前沿模型能力转化成可落地的 Agent 产品。招聘要求中直接点名 Claude Code、Codex、Cursor、GitHub Copilot 等高频工具,显示其对标对象已非常明确。结合此前 V4 预览版对智能体工具适配、以及“识图模式”灰度上线,这一动作说明国产大模型竞争正从通用聊天转向开发者场景与桌面端执行能力,产品化节奏明显加快。
原始链接:https://www.cls.cn/detail/2376780
#06🔥重要 政经媒体 / Politico / 英文

Mythos 与 GPT-5.5 震动华盛顿:前沿模型进入攻防实战区

Politico 报道称,Anthropic 的 Mythos 与 OpenAI 的 GPT-5.5 因突出的网络攻防能力引发华盛顿高度紧张。测试人员称 Mythos 已找出数千个高严重性漏洞,在 10 次尝试中有 6 次可完整接管企业网络,GPT-5.5 为 3 次。争议焦点在于,这类模型对防御者有价值,但对攻击者的放大效应可能更强,足以把网络安全从“自动化提效”推向“能力跃迁”。这也让前沿模型的发布门槛、测试义务和政府访问权限突然变得更敏感。
原始链接:https://www.politico.com/news/2026/05/24/anthropic-openai-mythos-what-to-know-00934668

行业应用落地

#07🔥重要 官方博客 / OpenAI / 英文

OpenAI for Singapore 落地:海外首个 Applied AI Lab 指向国家级部署

OpenAI 宣布与新加坡数字发展与信息部等机构启动多年合作,整体投入超过 3 亿新元,并在当地设立美国以外首个 Applied AI Lab。官方称未来几年将新增 200 多个本地技术岗位,重点覆盖公共服务、金融、医疗、教育和数字基础设施。相比单纯设点,这次更像“前沿部署工程师+人才培养+生态扶持”的组合拳:既帮助政府和企业做高价值场景落地,也通过学院、培训和中小企业工作坊扩展使用面,释放出国家级 AI 渗透正成为模型公司新增长引擎的信号。
原始链接:https://openai.com/index/introducing-openai-for-singapore/
#08🔥重要 金融科技媒体 / Finextra / 英文

TD 银行把按揭审批交给 AI 代理:15 小时压到 3 分钟内

加拿大 TD 银行推出面向按揭和房屋净值信贷申请的 agentic AI 模型,由 Layer 6 团队开发,用于文档分类、关键信息提取、收入计算、合规检查、差异核对,并自动生成给承保人的摘要备忘录。官方给出的核心指标很醒目:原本平均约 15 小时的流程,被压缩到不到 3 分钟,且项目被视为实现每年 10 亿美元价值目标的重要基石。对行业来说,这不是聊天机器人式试水,而是把 AI 嵌入强流程、强风控、强责任链的金融作业面,ROI 已开始清晰可算。
原始链接:https://www.finextra.com/newsarticle/47801/td-builds-ai-model-to-speed-up-mortgage-applications
#09⚡值得关注 财经媒体 / 新浪财经转引 / 中文

上海加码类脑智能场景:34 家企业先落地,再谈规模复制

上海在类脑智能产业创新发展大会上集中发布建筑、金融、医疗等一批应用场景,并披露杨浦类脑智能未来产业集聚区已吸引 34 家企业落地。官方叙事的重点不只是“再造一个模型赛道”,而是试图用高能效、低时延、在线学习等类脑技术特性,缓解当前大模型在算力和能耗上的瓶颈,再把能力延展到智能机器人、低空经济和智能网联汽车。对于产业观察者而言,值得看的不是概念本身,而是上海是否能先把真实场景、芯片、算法和终端应用捏成闭环。
原始链接:https://finance.sina.com.cn/roll/2026-05-24/doc-inhyzeaf5727555.shtml
#10⚡值得关注 地方官方媒体 / 温州网 / 中文

温州智能交通研究院揭牌:交通 AI 从点状试验转向全流程闭环

温州智能交通研究院发布的场景显示,AI 已开始深入轨道交通运维与乘客服务:在控制中心,仅需 1 名工作人员就能完成设备异常复核、工单派发与闭环管理,结合无人机、机器人等智能终端后,整体运维效率提升 50%。同时,当地还在推进“AI 出行大脑”、非接触式办理、夜间检修智能体以及“低空+轨道”融合应用。它的示范意义在于,交通行业过去常卡在中试和数据环节,而这类研究院模式试图把研发、验证、迭代和推广直接接到真实运营系统上。
原始链接:https://news.66wz.com/system/2026/05/25/105774133.shtml

政策与监管

#11🔥重要 政策媒体 / The Hill / 英文

特朗普临时撤下 AI 行政令:美国前沿模型监管再现摇摆

The Hill 披露,特朗普原拟签署的 AI 行政令在最后时刻被撤下,草案本来计划建立企业在公开发布模型前自愿提交政府测试的流程,测试期最长可达 90 天,并强调不走强制许可路线。特朗普给出的理由是“不想让美国在 AI 上对华失速”,而硅谷重量级人物的游说也被认为发挥了作用。它反映出美国当前最核心的政策分歧:一边担忧前沿模型带来网络与国家安全风险,另一边又担心前置测试拖慢模型迭代,监管持续在“设护栏”和“保速度”之间摇摆。
原始链接:https://thehill.com/policy/technology/5891923-trump-ai-order-scrapped-divide/
#12⚡值得关注 智库政策解读 / CEPS / 英文

欧盟“Apply AI Strategy”启动讨论:监管之后开始转向应用竞赛

围绕欧盟“Apply AI Strategy”的最新任务组讨论显示,欧洲政策关注点正从 AI Act 的规则制定,转向如何在科学、工业与政府部门把 AI 真正用起来。任务组把医疗与制药、汽车与出行、政府与公共部门列为重点行业,并强调应用推广必须与基础设施、数据治理、技能供给和预算工具同步设计。对欧洲而言,这意味着政策重点正从“如何管”延伸到“如何规模化部署且不失主权”。若预算、数据共享和跨部门协同跟不上,合规先发优势未必能自动转化为产业竞争力。
原始链接:https://www.ceps.eu/ceps-task-forces/ceps-task-force-on-the-apply-ai-strategy/
#13⚡值得关注 党报观点 / 天津日报 / 中文

“人工智能+”进入场景深水区:政策开始要求全周期机会清单

天津日报对“人工智能+”行动的解读显示,国内政策重心正从泛泛倡议转向更可执行的场景机制设计。文章提出建立全周期场景机会清单发布机制,推动公共数据授权运营、可信数据空间建设,并以专项基金和适配信贷产品为抓手,覆盖制造、汽车、政务、医疗、物流、金融、农业等多个领域。值得注意的是,政策语气已不再停留于“鼓励试点”,而是强调从需求梳理、试点验证到示范推广的连续链条。对企业来说,真正的窗口期在于能否抢先进入被政策明确开放的高价值场景。
原始链接:https://epaper.tianjinwe.com/tjrb/html/2026-05/25/content_143088_3465952.htm