AI新闻速览(7月14日)
大家好,我是团团🐼
今日的主要内容有:
1. OpenAI 优化 GPT-5.6 Sol,并临时放宽部分订阅用户的使用限额
2. Meta 将路易斯安那州数据中心扩建至 5GW,总投入超 500 亿美元
3. OpenAI 暂时取消 Codex 和 ChatGPT Work 的 5 小时使用限制
4. 腾讯混元开源 HyOCR-1.5,OCR 推理最高提速 6.37 倍
5. 商汤开源统一视觉大模型 SenseNova-Vision
6. 蚂蚁开源两款面向大模型和智能体的安全护栏模型
7. 31 家企业签署智能体个人信息保护自律公约
8. 国产 AI 芯片以 14nm 工艺实现 520TFLOPS 算力
9. 阶跃终端首款智能体手机 STEPX Neo 亮相
10. 东方算芯发布软件定义近存计算 3D 芯片 DF1000
11. 德国研究联盟发布开源大模型 Soofi S
下面带你快速看完今天值得关注的 AI 新闻。
1. OpenAI 优化 GPT-5.6 Sol,临时放宽部分订阅用户限额
新闻来源: IT之家
GPT-5.6 系列开放后,OpenAI 称整体流量达到此前峰值约两倍。公司为缓解访问高峰,多次重置 ChatGPT Work 和 Codex 用户额度,并临时取消 Plus、Business 和 Pro 用户原有的每 5 小时一次限额。GPT-5.6 Sol 同步上线新的推理优化,官方称节省出的计算资源将回馈订阅用户,预计可使可用额度增加约 10%。Banked Reset 额度储备功能也已扩展到网页和移动端。
团团解读:GPT-5.6 一上线就把访问量推到新高,OpenAI 一边给模型提速,一边先把部分付费用户的使用上限松开,让大家能少一点“额度已用完”。
😏😏 模型再聪明,用户先看到的还是那句“请五小时后再来”。
2. Meta 追加超 500 亿美元,将数据中心扩建至 5GW
新闻来源: IT之家
Meta 宣布将美国路易斯安那州里奇兰教区的数据中心扩建至 5GW,并称项目投入将超过 500 亿美元。资金除用于数据中心建设外,也将投入劳动力培训和当地基础设施。Meta 承诺承担该项目消耗的能源、水资源及相关设施成本,不向消费者转嫁;同时计划投入逾 10 亿美元升级道路、供水和污水处理系统。为支撑用电需求,公司还将为新建天然气发电厂、电网级储能电池、核电增容和外购电力提供资金支持。
团团解读:Meta 把一座数据中心直接往 5GW 扩,钱不只砸服务器,还要把发电、储能、道路和供水一起补上,AI 算力竞争已经开始按城市基础设施来算账。
😏😏 大模型的尽头暂时不是 AGI,是电厂、变压器和水管。
3. OpenAI 暂时取消 Codex、ChatGPT Work 的 5 小时限制
新闻来源: IT之家
OpenAI Codex 工程负责人宣布,Codex 和 ChatGPT Work 暂时取消 Plus、Business 和 Pro 订阅用户的 5 小时使用限制。公司表示,GPT-5.6 Sol 将继续进行效率优化,降低同等任务的额度消耗。调整发生在新模型上线后的高并发阶段,OpenAI 此前也曾多次重置 Work 与 Codex 用户额度。GPT-5.6 Sol 还提供 Max 推理强度和 Ultra 模式,后者可用子智能体加速复杂任务。
团团解读:OpenAI 先把 Codex 和 ChatGPT Work 的计时限额取消,让付费用户可以连续干活;同时也说明,新模型带来的需求已经把原来的额度规则顶得有点紧。
😏😏 限额一放开,开发者最先做的事大概不是庆祝,而是继续烧 Token。
4. 腾讯混元开源 HyOCR-1.5,长文档 OCR 推理最高提速 6.37 倍
新闻来源: 腾讯混元 Hugging Face、arXiv
腾讯混元发布并开源端到端 OCR 视觉语言模型 HyOCR-1.5,将文档解析、文本检测、信息抽取和图文翻译整合到同一框架。新版本沿用轻量主干,引入 DFlash 推测解码,加快密集文档、表格和公式等长结构化输出的生成。技术报告称,在 Transformer 推理框架下速度提升 6.37 倍,在 vLLM 下提升 2.14 倍;项目同步开源模型权重、训练流程和推理工具。
团团解读:HyOCR-1.5 还是一套轻量 OCR 模型,但这次重点是让它读长文档、表格和公式时少等一会儿,并把训练和部署工具一起放出来。
😏😏 OCR 的痛点从来不是看不懂一个字,而是看懂一整份表格时别把人等下班。
5. 商汤开源统一视觉大模型 SenseNova-Vision
新闻来源: IT之家
商汤发布并全面开源日日新 SenseNova-Vision 理解生成统一视觉大模型,同时开源含 5000 万条样本的视觉指令语料库。该模型将目标检测、指代检测、OCR、关键点定位、深度估计、分割、多视角点云重建和相机位姿估计等任务纳入同一模型。商汤称,过去的统一视觉通常只是封装多个专家模型,而这次尝试把视觉能力原生融入通用基础模型;后续将把相关技术整合进日日新 U 系列模型,并公布 GitHub 开源地址。
团团解读:商汤想把检测、分割、识字、测深度和 3D 重建这些原本各做各的视觉任务,尽量收进一个模型里,再把模型和大规模训练数据一起开源。
😏😏 视觉模型终于不满足于“看见了”,开始试着把整套眼科门诊合并挂号。
6. 蚂蚁开源两款 AI 安全护栏模型
新闻来源: AIbase
蚂蚁 AI 安全实验室开源智能体安全护栏 SingGuard-NSFA,并披露多模态安全护栏 SingGuard。前者面向能够调用工具、执行代码和规划任务的智能体,在动作前进行风险检测,覆盖提示词注入、敏感信息窃取、恶意代码和权限滥用等场景。蚂蚁称模型将风险细分为 7 大类、28 个中类和 185 个具体场景,提供四种规模,实时判定模式单次约 50 毫秒。SingGuard 则覆盖文本、图像和跨模态内容。
团团解读:蚂蚁这次不是只审核模型说了什么,而是给会调用工具、会执行操作的智能体加一道实时检查,碰到高风险动作先踩刹车。
😏😏 Agent 能自己办事以后,安全护栏也得从“审台词”升级成“盯操作”。
7. 31 家企业签署智能体个人信息保护自律公约
新闻来源: IT之家
中国互联网协会移动互联网工作委员会与网民权益和个人信息保护工作委员会联合发布《智能体个人信息保护自律公约》,百度、腾讯、阿里、火山引擎等 31 家互联网企业在现场签署。公约围绕智能体处理个人信息建立自律规范,提出在推进技术创新的同时守住个人信息保护底线。同期还发布《小程序生态健康发展自律公约》,腾讯、蚂蚁、百度等 8 家主流小程序平台完成签署。该文件属于行业自律公约,并非监管部门发布的新规。
团团解读:智能体越来越会替人查资料、办业务,也会碰到更多个人信息。31 家企业先签了一份行业自律公约,约定处理这些数据时该守哪些边界。
😏😏 智能体能替你跑腿之前,先得学会别顺手把你的隐私也带走。
8. 国产 AI 芯片以 14nm 工艺实现 520TFLOPS 算力
新闻来源: IT之家、央视新闻
我国首颗采用软件定义与三维近存计算技术的 AI 芯片在上海亮相。报道显示,芯片采用 14nm 制程,实现每秒 520 万亿次浮点运算,访存带宽为每秒 6.4TB。其通过软件定义芯片让硬件资源按任务动态调配,再以三维垂直堆叠把计算与存储单元紧密集成,以缓解“存储墙”问题。配套全栈软件工具链兼容主流深度学习框架,并覆盖单卡、AI 服务器、液冷超节点和大规模智算集群等产品形态。
团团解读:这颗芯片没有把重点全押在更先进制程上,而是用软件重构和 3D 堆叠缩短计算与存储的距离,目标是把大模型训练和推理的供数速度提上去。
😏😏 芯片的难题有时不是算得不够快,而是数据送得太慢。
9. 阶跃终端首款智能体手机 STEPX Neo 亮相
新闻来源: IT之家
阶跃终端在品牌暨智能体战略发布会上展示首款智能体手机 STEPX Neo。该机背面配有交互副屏,搭载智能体原生系统 Step AOS。阶跃同时公布首批生态合作伙伴,包括美团、WPS、剪映、携程、高德、支付宝、百度、滴滴、京东、微博和百度地图等。STEPX Neo 是此次发布的新一代智能体终端之一,与此前的 Step Edge 端侧模型形成终端侧布局。官方尚未披露手机的具体硬件配置、价格与上市时间。
团团解读:阶跃把智能体系统装进了自家第一款手机,还拉来出行、办公、支付和内容平台做生态合作;不过手机到底卖多少钱、能干到什么程度,目前还没揭开。
😏😏 AI 手机最怕的不是副屏不够酷,而是生态名单比真机体验先毕业。
10. 东方算芯发布软件定义近存计算 3D 芯片 DF1000
新闻来源: IT之家
东方算芯在上海发布首颗旗舰芯片 DF1000。公司称,DF1000 是全球首颗软件定义近存计算 3D 芯片,采用“软件定义加 3D 堆叠近存计算”路线,在 14nm 工艺节点下实现 520TFLOPS@BF16 算力。其设计通过软件定义芯片实现软硬件解耦和动态重构,并以三维堆叠近存计算缩短数据传输距离。东方算芯称,产品依托国产供应链,后续将与基础软件、服务器和大规模集群系统共同构成产品体系。
团团解读:DF1000 走的是“用架构补制程”的路线:芯片本身可以按软件需求调整,又把算力和存储尽量挪近,想用 14nm 做出高端 AI 算力。
😏😏 不追最小线宽不等于少走一步,前提是架构这条路真能跑通。
11. 德国研究联盟发布开源模型 Soofi S
新闻来源: AI HOT、Soofi 技术报告
由德国人工智能协会协调的研究联盟发布开源大语言模型 Soofi S 30B-A3B。模型在德国电信慕尼黑工业 AI 云上训练,总参数为 316 亿,每个 Token 约激活 32 亿参数,采用 Mamba-2 与注意力层结合的混合架构。项目方称,在 4K 至 256K Token 上下文范围内,其生成吞吐量基本保持稳定。报告称,Soofi S 在所比对的完全开源模型中取得德语和英语综合最高分。
团团解读:德国团队做了一个特别偏重德语能力的开源模型,参数总量不小,但每次只激活一部分,重点是让长上下文场景下的速度别随着文本变长一路掉下去。
😏😏 欧洲主权模型要想不只停在口号里,先得把德语、长文本和算力账一起算明白。
好啦,2026年7月14日的 AI 新闻就到这里~
团团为您播报 🐼

夜雨聆风