ARTICLE · 1123144
AI资讯速览(10.04)

浙江19.5万家外卖商家接入后厨监管,AI摄像头覆盖率达97.3%
据央视财经10月3日报道,浙江近日披露外卖后厨监管进展:已有19.5万家外卖商家接入相关系统,具备AI识别功能的摄像头覆盖率达97.3%。消费者可在订单页点击“明厨亮灶”,观看食品加工现场的实时画面。系统能识别后厨吸烟、洗菜池洗拖布、小动物进入厨房等违规行为,将线索推送监管人员督促整改;视频公开要求源于2022年施行的地方条例。
2026-10-03 · 央视财经
昆仑MES披露抚顺石化应用成效,物料平衡效率提升70%、增效超千万元
据经济日报10月3日报道,昆仑MES近日披露在抚顺石化的生产管控成效:物料平衡工作效率提升70%、数据准确性提升40%,累计整体增效超过千万元,生产业务数据采集率由80%提升至95%。设备预测模型已用于捕捉聚丙烯循环压缩机振动报警、定位故障,并将预警同步推送至多个终端。这套由昆仑数智自主研发的制造执行系统,已有生产统计模块在中国石油27家炼化企业落地,实现日平衡与经营数据同步。
2026-10-03 · 经济日报
华为明确小艺帮帮忙退出HarmonyOS 7新机,原支持设备升级后仍可使用
据IT之家10月3日对华为官网的报道,华为近日明确了“小艺帮帮忙”智能体的服务范围:这一HarmonyOS 6中的众测功能不再向HarmonyOS 7新机型提供,新机上相关个人技能也停止服务。原本在HarmonyOS 6期间受支持的设备升级至HarmonyOS 7后,仍可继续使用智能体、个人技能和定时计划任务。该功能此前允许用户教小艺操作应用;官方同时说明,应用平台政策限制可能使部分应用和任务无法代为执行。
2026-10-03 · 华为
美国财长贝森特提出中美AI事故通报设想,强调关键系统防护
据Axios10月3日报道,美国财长贝森特近日在该媒体的访谈中表示,拟提出与中国建立AI事故通报机制。他还主张,加强关键系统防护;当AI企业担忧可能失去对更强模型的控制时,应放慢推进速度。这是贝森特提出的沟通设想,报道未显示双方已经签署或启用这一机制。
2026-10-03 · Axios
OpenAI回应前安全负责人批评,称必要时暂停训练或推迟模型发布
据卫报10月4日报道,OpenAI近日回应前安全报告负责人David Robinson对部署文化的批评,称公司正加强安全与安保措施,必要时会暂停训练或推迟模型发布。Robinson在文章中主张,前沿AI实验室应借鉴核电与航空行业,以多层冗余和谨慎规划控制自主系统风险。上述观点是其离职后公开提出的建议;OpenAI回应称,要确保模型能力不会超出公司能够安全管理和保护的范围。
2026-10-04 · The Guardian
STL Partners统计欧美数据中心投资受阻规模,社区反对影响项目落地
据财联社10月4日报道,STL Partners近日披露研究数据,公众反对已影响欧洲约420亿美元、美国约770亿美元的数据中心投资,涉及延期和取消的项目。随着AI基础设施扩张,电力、用水、土地和审批条件正在成为项目落地的重要约束。报道还引述Alvarez & Marsal的投资风险分析:开发商即使在施工前取消项目,也可能已承担土地、设计、电网接入和审批等前期成本;这些投资数字并非已发生的总损失。
2026-10-04 · 财联社
ChatGPT向美国Free和Go用户开放Finances,可连接账户分析支出
ChatGPT官方于北京时间10月3日宣布,Finances财务管理功能开始向美国Free和Go用户开放。用户可通过Plaid和Experian连接账户,以自身财务与信用信息为依据获取回答。官方列出的用途包括查找遗忘订阅、发现陌生或可能重复的扣款、追踪经常性账单涨价,以及获取每周财务更新。
2026-10-03 · OpenAI
Aleph Alpha开放Kolibri模型权重,支持英德双语与百万token上下文
Aleph Alpha于10月3日发布Kolibri英德双语混合专家模型,完整权重按Apache 2.0许可开放。模型总参数781亿,每个token激活约34.6亿参数,官方称可支持最高100万token上下文。其最长训练上下文为256K,较长上下文能力应与训练长度区分;模型训练基础设施位于德国和芬兰。
2026-10-03 · Aleph Alpha
摩根士丹利统计9月AI相关债券发行约230亿美元,年内累计4660亿美元
据华尔街见闻10月3日报道,摩根士丹利近日在报告中统计,9月全球AI相关债券发行约230亿美元,为今年次低月份;截至9月底,年内累计约4660亿美元。该机构口径下,9月美国投资级市场的AI相关发行量为零,非美元及杠杆融资市场仍有交易。报告预计第四季度发行量可能回升,但这一判断属于预测;上述金额是AI相关债务口径,不是创业公司股权融资总额。
2026-10-03 · 华尔街见闻
Inc42周榜含4笔AI相关融资,已披露金额合计1061.6万美元
Inc42于10月3日发布9月28日至10月2日印度创业融资周榜,其中可核实的AI相关子集包含Arivihan、Aignosis、Unveilr AI和Keploy共4笔。Arivihan的AI教学平台融资1020万美元,Aignosis的AI自闭症筛查业务融资41.6万美元,两项已披露金额合计1061.6万美元。Unveilr AI与Keploy未披露本轮金额,因此未计入金额加总;该结果仅为周榜子集,不代表印度AI融资全市场规模。
2026-10-03 · Inc42
Inc42访谈银行与AI企业,揭示战略入股后的共建与数据协作
Inc42于10月3日发布银行投资AI企业的原创访谈,发现银行正从单纯采购工具转向持股、联合研发和共同开发。CoRover创始人表示,银行合作已延伸至技术和业务领域协作,受控定制依托客户批准的知识与流程,而非将专有数据放入通用产品。Axis Bank业务负责人介绍,银行正与初创企业合作开展语音AI、文档读取和界面原型开发,印度语言等能力难以全部自建。文章指出,战略投资的价值还包括影响产品路线和架构;所引既有融资案例并非10月3日新增轮次。
2026-10-03 · Inc42
每日经济新闻访谈毕马威,分析高利率如何约束AI企业IPO估值
每日经济新闻于10月3日发布原创采访,分析高利率环境下AI企业上市融资的估值约束。毕马威美国资本市场准备负责人莎莉·马格尔告诉记者,买卖双方估值预期差距扩大,投资者更重视经常性收入、稳定需求和长期增长。报道以AI数据中心设备企业Accelevation与运营商Csquare为例,说明高增长和订单储备并不保证发行定价获得支持;同时指出,仍能从私募市场获得资金的企业可等待更合适的估值,公开市场则提供更广泛的投资者基础。
2026-10-03 · 每日经济新闻
微软将ThinkingBox接入OpenEnv,以数据库终态和20次重复测试智能体
微软与Hugging Face于北京时间10月4日介绍ThinkingBox的OpenEnv评测入口,让智能体完成业务任务后,按数据库最终状态和副作用判断是否成功。基准包含507个合成业务工作流,每项任务从相同干净环境重复20次,分别报告单次成功率、20次中至少成功一次及实测20次全部成功的比例。在12款模型、121680次有效试验的消融分析中,79853次尝试未通过检查,其中67.24%仍正常结束并调用了改变状态的工具,说明工具调用顺畅不等于业务结果正确。
2026-10-04 · Microsoft与Hugging Face
Arena更新智能体成本测评,GPT-6.1 Sol与Sonnet 5.5呈现不同价格表现
Arena于北京时间10月3日公布新的Agent Arena智能体测评结果:GPT-6.1 Sol的Max配置位列第5,单任务费用中位数为0.56美元,得分与GPT-6 Sol及GPT-6 Astra相差不到2个百分点。同期Claude Sonnet 5.5位列第3,单任务费用中位数为2.74美元,而第2名Claude Opus 5.5为1.58美元。这组结果把任务表现与执行成本放在同一框架下比较;费用受任务、工具调用和评测配置影响,不能直接等同于日常API调用账单。
2026-10-03 · Arena
Kevin Liao主张用项目文档管理智能体记忆,公开Markdown工作区实践
Kevin Liao于10月3日发表技术文章,主张用持续维护的项目文档替代每轮检索零散记忆片段。其方法让智能体在工作前查阅指令、设计说明、决策与研究索引,完成工作后更新过时文档;作者称已在自己的项目中实践一年,并公开Operator Memory。文中的主要争议是相似度检索能否保持上下文、时效与可审计性,文章未提供统一基准或证明所有向量记忆系统失效。
2026-10-03 · Kevin Liao
Rapid-MLX发布后台窗口操控实验,让电脑智能体减少抢占前台
Rapid-MLX于北京时间10月4日发布v0.15.5,引入实验性的后台窗口操控模式。符合条件的点击、文本输入和非Command按键,可发送至用户授权的指定窗口,并在输入前重新核对窗口身份;如果用户已切换应用,程序会跳过焦点恢复。Finder、Command快捷键和部分回退操作仍需前台执行,强制后台模式会拒绝退回前台。版本同时减少连续推测解码周期中的主机同步次数;这项机制只覆盖经适配的模型,性能改善取决于具体工作负载。
2026-10-04 · Rapid-MLX
Kitsuno公布Laya影子运行实测,生产旁路暴露离线评估遗漏
Kitsuno于10月3日公布开源决策模型Laya的微调与生产实测:模型与现有Jev同时处理相同招聘请求,但仍由Jev作出实际业务决策。首次18小时收集的1158条真实请求暴露了离线测试缺少葡萄牙语职位的覆盖问题,团队据此补充训练样本。更新模型在574项决策测试中准确率为95.8%,Jev为93.7%,总体差异尚无统计显著性。团队还为同一职位的多道问题共享读取过程,将CPU推理时间由12.7秒降至约4.1秒,但仍慢于Jev接口。
2026-10-03 · Kitsuno
MCP Python SDK升级至v2.3.0,无效工具头注解改为注册时报错
MCP Python SDK于北京时间10月3日发布v2.3.0,将无效工具头注解从运行后可能被客户端静默过滤,改为在注册工具时直接报错。新版本按工具名称取得参数校验所需的结构,避免每次调用工具都额外请求完整工具列表;交互式OAuth登录的等待也不再计入请求超时。开发者还可调整单次SSE事件大小上限,但默认仍为1MiB,使用新选项需满足更新后的依赖要求。
2026-10-03 · Model Context Protocol
Cactus发布16.9MB语音模型Whistle,七种语言可在本地CPU转写
Cactus于北京时间10月3日宣布发布Whistle,将语音转写模型压缩至16.9MB,支持英、德、法、西、意、荷、波兰语,可在本地CPU运行并提供逐词时间戳和语音特征。官方在Apple M4 Pro上测试10秒音频、采用默认五束解码时,首个词元延迟为11.1毫秒;该延迟随音频长度变化。模型与文本决策模型Needle共用推理引擎,可把语音输入衔接到工具调用。官方对比显示,它在部分数据集上优于Whisper base,但在TED-LIUM、AMI与MLS平均结果上仍落后。
2026-10-03 · Cactus
Pi pod作者展示自托管智能体沙箱,支持从终端或手机接入会话
Pi pod作者于北京时间10月3日在Hacker News展示自托管版本,将Pi编程智能体会话运行在用户自己的服务器沙箱中。项目包含命令行客户端、服务端控制层与隔离环境,手机端代码也已公开;作者在讨论中说明,移动应用尚未正式发布,但可从源码构建。自托管版按AGPL-3.0许可开放,商业托管服务仍标为即将推出,当前不是已上线的云服务。
2026-10-03 · Pi pod
Simon Willison提出智能体默认费用硬上限,超额时停止服务而非只发提醒
Simon Willison于北京时间10月4日发表新文章,提出智能体调用付费接口和云服务时,应默认配置费用硬上限:达到额度后停止项目或返回错误,而非仅发送提醒邮件。他建议由用户主动选择解除上限,并明确承担后续费用;智能体也可优先推荐支持此机制的服务商。文章以AWS项目月度费用限额和Google Cloud部分服务的Spend Caps作为已有实现,指出前者仍向有限客户开放。AWS的这项费用限额此前于9月推出,Google Cloud的Spend Caps于7月推出。
2026-10-04 · Simon Willison
DeepSeek Harness新版本试验Claude Code Mods兼容,新增插件创建入口
DeepSeek Harness于10月3日发布v0.2.1-alpha.1开发者预览版,新增实验性Claude Code Mods兼容层。该层主要用于验证相关API与Harness插件能力之间的关系,当前不提供完整兼容保证。插件管理页还增加“让Agent创建插件”入口,允许先保留草稿、进入创造模式,发送需求后再执行;开发者也可为反向代理指定对外访问地址。
2026-10-03 · DeepSeek
本文基于Aleph Alpha、Arena、Axios、Cactus、DeepSeek、Inc42、Kevin Liao、Kitsuno、Microsoft与Hugging Face、Model Context Protocol、OpenAI、Pi pod、Rapid-MLX、Simon Willison、The Guardian、华为、华尔街见闻、央视财经、每日经济新闻、经济日报、财联社等多方公开信息整理而成,仅作信息分享与观点交流,不代表任何机构立场;文中引用数据及案例均来自公开来源,相关版权归原作者和原发布机构所有。
