夜雨聆风学习资料网

ARTICLE · 1117067

AI俱乐部 新闻速递 20261003

AI俱乐部 新闻速递 20261003

2026-10-03 · 每日精选 AI 资讯

生成式AI

一、微软发布首个流式转录模型,语音三条产品线一次性补齐

微软宣布推出旗下首个流式转录模型 MAI-Transcribe-2-Streaming,以及 MAI-Voice-2.1、MAI-Voice-2.1-Flash 两款文本转语音模型,均可通过 Microsoft Foundry 获取。

该转录模型支持 60 种语言,收到音频后 100 毫秒内生成初始假设并随上下文持续修正,最终词错误率 2.5%,最终转录耗时 0.13 秒,微软称其实时语音识别与字幕生成速度约为最接近竞品的两倍。

定价为每小时音频 0.54 美元优惠价、持续到年底,明显是冲着实时语音智能体这一波需求去的。

来源:环球网

二、Black Forest Labs 发布 FLUX 3 Image:能用边界框排布画面,改哪算哪

德国 AI 公司 Black Forest Labs 发布图像生成模型 FLUX 3 Image,支持最高 4K 分辨率输出,用户可在归一化的 0—1000 坐标网格上为每个元素指定 ID、描述文本与精确边界框,把主体放到画面指定位置。

模型单次生成最多可融合 10 张参考图,并可为每张参考图中的对象指定出现位置;编辑时可只修改指定区域,官方称其余像素保持不变,从而支持多轮精确编辑。

目前该模型以付费服务形式提供,API 价格至 10 月 8 日五折,企业可授权获取商业权重本地运行与微调,开放权重版本预计数周内公布。

来源:IT之家

三、Ai2 开源 Olmo-core 3:万亿参数 MoE 训练框架,8 卡吞吐提升 2.7 倍

非营利机构 Ai2(艾伦人工智能研究所)开源了下一代 MoE 训练系统 Olmo-core 3,把训练基座而非模型权重先公开,代码、技术报告与交互式讲解同步放出。

框架把并行方式从全分片数据并行(FSDP)改为分布式数据并行(DDP),让专家常驻各 GPU、只把数据路由过去,免去每批数据反复聚集与再分片权重的开销;在 8 张英伟达 B300 上,470 亿参数 MoE 的吞吐达到约 5.2 万 token/秒/卡,约为旧实现的 2.7 倍。

配合 MXFP8 低精度格式再提速约 21%,并把专家池从 8 扩到 128 时吞吐下降不到 5%,是目前 Megatron-Core 之外少有的开放替代方案。

来源:Ai2 官方博客 / 博客园

硬件与算力

一、三星把 HBM4 报价提到 HBM3E 的三倍,机构预计明年 HBM 均价涨 121%

据韩国《每日经济》报道,三星电子已将明年 HBM4 的供应报价定在每吉比特 4 美元的中高区间,是现款旗舰 HBM3E 约 1.50 美元/Gb 的三倍以上,并已启动与主要客户的年度合同谈判。

三星的底气来自性能:HBM4 已稳定实现 11.7 Gbps 的数据传输速率,峰值可达 13 Gbps,处于业内最高水平;其策略是把高规格稳定供货能力直接转化为价格溢价。

市场研究机构 TrendForce 预测,受 HBM4 占比提升与供应短缺双重驱动,明年 HBM 平均售价将较今年上涨 121%,此前由 SK 海力士主导的市场格局料进一步变化。

来源:华尔街见闻

二、伯恩斯坦:2026 年华为国内 AI 芯片份额有望超 50%,英伟达降至约 8%

伯恩斯坦对 2026 年中国 AI 半导体市场作出预测:华为份额可能超过 50%,英伟达则降至约 8%,华为有望坐上国内头把交椅。

份额预测背后是软件生态的推进——DeepSeek 已开源面向昇腾平台的一整套大模型基础设施组件,从高级语言编译工具到计算库、分布式通信库,与此前面向英伟达平台的组件一一对应,双方还在共同推进昇腾 950 的 128 卡超节点方案。

不过国产替代与海外找货仍在并行:腾讯与甲骨文达成五年租赁协议获取约 10 万枚 AI 芯片,字节在马来西亚部署数万枚 B200,模型公司也通过东南亚渠道获取 Blackwell 算力,芯片量产到万卡稳定协同仍需时间。

来源:虎嗅

三、郑州国家超算互联网核心节点:全国首个全国产十万卡 AI 超集群跑起来

国家超算互联网核心节点今年 7 月在郑州上线,定位是全国超算与智算的「总调度站」,哪闲哪缺统一调配,其算力底座是曙光 8000 超级系统——中国首个全国产十万卡 AI 超集群。

据现场介绍,该集群每秒峰值计算能力相当于全人类持续计算 200 年,目前正支持新材料、创新药等 26 个领域的 300 多种计算任务。

更关键的是从设计之初就支持「超智融合」:既能做科学工程计算,也能跑大模型训练;运行近两个月已完成千项超智融合适配,在蛋白质研究、气象预报、分子动力学等方向取得阶段性成果。

来源:大象新闻

智能体

一、IBM 给 Bob 加上自托管部署:让智能体回到数据所在的地方

IBM 发布智能软件开发平台 Bob 的自托管部署方案,支持在自有实体设施、私有云、主权云以及物理隔离(air-gapped)环境中运行,企业可自行掌控数据驻留、安全策略与 AI 治理。

与需要把数据迁到外部服务的 AI 编码工具不同,Bob 的自托管版本让企业在其代码、应用上下文与数据本就存在的地方部署智能体能力,运行经过许可的模型,或以混合配置连接外部模型服务。

IBM 援引自家商业价值研究院报告称,68% 的受访高管认为跨地域满足数据驻留与主权要求是一项挑战;IBM 同时披露内部已有超 8 万名员工使用 Bob,受访用户报告平均约 45% 的效率提升。

来源:InfoWorld / IBM

二、AWS 上线 Well-Architected Agent 预览:让智能体持续巡检云架构

AWS 推出 Well-Architected Agent 预览版,可持续分析云环境并按影响与投入排出优先级,给出覆盖成本、安全、性能与韧性的改进建议。

该智能体被定位为「架构师与云资源之间的顾问层」——它并不直接执行变更,而是把复杂环境翻译成可排序的待办清单,因此官方仍强调预览阶段不应授予其自动修复权限。

同日云安全厂商 GuidePoint Security 宣布加入 AWS Security Hub Extended 成为服务合作伙伴,说明平台层的整合并没有消掉实施、治理与人工判断的需求。

来源:HIPTHER

三、GitHub Copilot 开启「操作电脑」公开预览:能直接摆弄桌面应用

GitHub 宣布 Copilot CLI 与 Copilot 应用进入计算机操作(computer use)公开预览,可以在 macOS 与 Windows 上直接操作桌面应用程序。

这意味着智能体的可触达范围从有 API 的系统扩展到没有 API 的传统软件,也意味着它在开发者本机上的权限边界被实质性放大。

同期 GitHub 还为私下漏洞报告加了频率限制并推出结构化报告表单——平台方给出的理由是维护者正被大量低质量、自动生成的报告淹没,真实问题反而被埋掉。

来源:GitHub / DatapipeSoft

报告观点

一、MIT 科技评论:企业正转向「智能体」运营模式,2026 全球 AI 投资预计达 2.5 万亿美元

MIT Technology Review 刊发报告指出,企业正从「给员工配一个 AI 助手」转向以智能体为核心的运营模式,并预测 2026 年全球 AI 投资规模将达到 2.5 万亿美元。

报告给出的规模化建议包括:先重做流程而不是先买工具、把数据整理成「AI 可用」的状态、采用可组合的架构,以及补齐主权与合规控制。

其判断的落点其实很朴素——价值不来自模型本身,而来自业务流程被重新设计之后释放出来的那部分效率。

来源:MIT Technology Review

二、加州签署「禁止机器人老板法」等五部 AI 职场法案

加州州长纽森签署了五部与 AI 相关的法案,其中最受关注的是 SB 947,被称为「禁止机器人老板法」:禁止雇主仅凭自动化决策系统作出纪律处分或解雇决定,若主要依赖该系统,必须由人工复核并佐证。

员工有权在 AI 起主导作用时获得书面通知、了解系统使用了哪些个人数据,并拿到一位可进一步沟通该决定的真人联系方式;SB 951 另要求因 AI 导致的大规模裁员需提前 60 天书面通知。

同批法案还限制了工作场所监控(AB 1331)与 AI 驱动的情绪、神经数据监测(AB 1883),加州也因此成为全美首个专门就律师使用生成式 AI 立法的州。纽森去年曾否决过该法案的旧版本,理由是通知要求过于宽泛。

来源:加州参议院 / Bond Schoeneck & King

AI应用

一、巴克莱把 Claude 推向全球业务,Albertsons 用 ChatGPT Enterprise 改造内部流程

Anthropic 宣布巴克莱银行正在扩大双方的「战略合作」,把 Claude 部署到全球业务中,覆盖面向客户的工作流与内部流程;同一天 OpenAI 发布了 Albertsons 使用 ChatGPT Enterprise 与 API 的案例。

一家是全球系统重要性银行、一家是美国大型连锁超市,两个行业在同一周、几乎同一时间宣布全公司级铺开,说明企业侧 AI 已经从试点转向结构化落地。

值得注意的是,在数据要求严格的受监管行业里,银行选择的是 Anthropic 而不是市场份额领先的 OpenAI,这本身是个信号:合规约束正在影响供应商选择。

来源:Anthropic / OpenAI 案例

二、全国首个搭载国产电子架构的人形机器人发布,关节被破坏仍能稳定运行

在湖北宜昌举行的 2026 国产化电子架构具身智能机器人发布会上,深圳逐际动力与北京东土科技联合发布了全国首个搭载国产电子架构的人形机器人。

分工清晰:逐际动力提供本体硬件原创设计、大小脑融合技术与人形大脑系统 COSA,东土科技提供鸿道 Intewell 操作系统、AUTBUS 确定性总线、MaVIEW 智能体工具软件与全国产 AI 处理器芯片,实现控制与 AI 计算的隔离融合。

发布会现场由国家工业信息安全发展研究中心测试,在关节破坏、网络攻击、病毒植入等情况下该机器人均通过测试并保持稳定运行,指向的是对实时性与确定性要求苛刻的工业、特种场景。

来源:A5 站长网

产业资本

一、苏度科技再获超 10 亿元融资:用全栈自研仿真引擎做通用物理智能

具身智能公司苏度科技完成新一轮超 10 亿元人民币融资,由上海国投旗下国投先导、国投孚腾与国泰海通联合领投,道禾长期、东风资产、国开金融、朗玛峰等产业及长期资本参与,小米等老股东继续跟投。

公司由 3D 视觉与具身智能学者苏昊与连续创业者韩铮于 2025 年联合创立,围绕模型、数据、仿真技术、机器人本体及控制系统做全栈研发,是国内少数全栈自研具身智能原生仿真引擎的团队之一。

其 2026 年 4 月发布的 Sudo R1 在不使用任何真机数据的前提下,实现未知物体首次抓取成功率 98%、工业场景操作成功率 99.5%;本轮资金将主要用于技术研发与真实产业场景验证。

来源:IPO 早知道

二、A 股算力订单密集落地:18.21 亿元采购 GPU 算力卡、8 亿元签下云算力服务

奥尼电子公告称,全资子公司奥尼智能与 C 公司签署采购合同,向其采购 GPU 算力卡产品,合同总金额 18.21 亿元(含税);此前 9 月 24 日该子公司已与 B 公司签下约 15.56 亿元的同类采购合同。

同一日,ST 豆神公告全资孙公司豆神香港与 VB 客户签署《云计算服务协议》,以云服务方式提供 GPU 算力资源租赁、部署与运维,服务期 60 个月,合同总金额约 1.19 亿美元(折合人民币约 8 亿元),客户按约定预付总额 40%。

银河证券研报指出,主流科技巨头与云厂商的资本开支方向明确,多模态与推理端的 Scaling Law 效能尚未触及天花板,智能体长序列推理对算力的消耗确立了需求的长期向上通道。

来源:环球网 / 证券日报

👇 加入 AI 俱乐部,开启 AI 探索之旅

👇 下方为每日新闻合集,欢迎关注

本文内容整理自微信公众号及公开网络信息,仅供资讯分享如有侵权请联系删除 · AI俱乐部 新闻速递 · 20261003

相关学习资料