ARTICLE · 1136801
今日AI 速报 · 2026年10月7日【月之暗面完成IPO前最后一轮融资】
1.【OpenAI 一次性发布 722 篇数学手稿:内部前沿模型攻下数百个未解问题】
北京时间 10 月 7 日凌晨,OpenAI 在 GitHub 一次性发布 722 篇由内部前沿模型生成的数学手稿,按结果相关性归为 372 个「结果族」,覆盖理论计算机科学、数论、几何、数学物理等 17 个领域,包含在准黎曼假设、希尔伯特第十问题、Mahler 猜想、Kaplansky 相关猜想等长期未解问题上的进展,部分成果已给出 Lean 形式化证明。OpenAI 称绝大多数结果由一个智能体在单一提示下完成,平均每个结果消耗约相当于 ChatGPT Pro 三小时的计算量,评测中共投喂 4000 道数学题。普林斯顿高等研究院的数学与人工智能咨询小组(AGMAI)为发布提供了修订与引用规范,并称这对数学界是「意义重大的事件」。 |
🔗 来源:https://www.stdaily.com/web/gdxw/2026-10/07/content_592207.html
2.【Mistral 发布 1 万亿参数 Mistral Large 4 预览版:欧洲自建算力训练,月底开放权重】
当地时间 10 月 6 日,法国 Mistral AI 发布旗舰模型 Mistral Large 4(ML4,代号「le Chonk」)公开预览版,即日起在 Mistral Studio 提供 API 体验,模型权重定于 10 月 27 日开放下载。ML4 为原生多模态 MoE 模型,总参数约 1 万亿、激活约 490 亿,完全在 Mistral 欧洲自有数据中心基于约 3800 块英伟达 Grace Blackwell GPU 从零训练,语料覆盖 160 多种语言。官方称其在网络安全(CyberBench 通过率 93%)、金融与法律等企业级负载上达到开源模型 SOTA,DeepSWE 1.1 得分 61.7%,但编码等能力与最前沿闭源模型仍有差距;API 定价为每百万 token 输入 1.36 美元、输出 4.18 美元。 |
🔗 来源:https://www.ithome.com/1/010/108.htm
10 月 6 日,Google 推出图像生成与编辑模型 Nano Banana 2.1,已在 Gemini App、Search 的 AI Mode、AI Studio、Flow、Stitch、Google Ads 与 Gemini 企业版陆续上线。新模型支持 1K/2K/4K 输出、最多 14 张参考图融合(可稳定最多 4 个角色与 10 个物体)、掩码与手绘式局部编辑,并能调用 Google 网页与图片搜索为结果「接地」,文本渲染和多轮角色一致性明显提升。价格是最大看点:标准图像输出降至每百万 token 30 美元,单张 1K 图约 0.0336 美元,较 Nano Banana 2 便宜约一半,批量任务再打五折。 |
🔗 来源:https://www.analyticsinsight.net/news/google-nano-banana-21-50-cheaper-ai-image-generation
10 月 6 日,Google DeepMind 发布 EmbeddingGemma 2,这是其首个开源的原生多模态嵌入模型,基于 Gemma 4 架构、Apache 2.0 许可,权重已上线 Hugging Face。模型总参数 7.4 亿,可把文本、代码、图像、视频与音频映射到同一 768 维向量空间;模块化设计让纯文本/代码仅需 2.7 亿参数,加视觉 4.4 亿、再加音频 5.7 亿。在 Pixel 11 Pro 上量化后纯文本版活跃内存仅约 191MB、完整多模态版约 567MB,上下文窗口从上一代的 2K 提升到 8K。Google 称其在代码检索(MTEB Code 78.68)等任务上超越部分参数量两倍于己的专用模型,适合端侧离线 RAG 与隐私优先场景。 |
🔗 来源:https://blog.google/innovation-and-ai/technology/developers-tools/embeddinggemma-2/
10 月 6 日,Anthropic 宣布把运行半年的 Project Glasswing 与原 Cyber Verification Program 合并为三层结构的 Cyber Verification Program,通过审核的安全团队可解锁更低的网络攻击类拦截阈值。三层分别为面向防御工作的 Defense Access、增加授权渗透测试的 Red Team Access(仅限机构),以及需与美国政府联合审核、针对电网/飞行系统/银行间清算等安全关键系统的 Specialized Access,三层均可用 Claude Opus 5.5、Sonnet 5.5 与 Mythos 5.1。Anthropic 用 CyScenarioBench 测试称,无权限时所有任务在第一次提示即被拦截,Defense 档 50 次试验中 46 次被拦,Red Team 档则完成 50 项中的 34 项;Glasswing 合作方在 4–7 月共发现至少 12.9 万个已验证漏洞,其中 3.3 万个为严重或高危。 |
🔗 来源:https://www.anthropic.com/news/cyber-verification-program
10 月 6 日,Sierra 与 Meta 联合发布开放标准 Personal Agent Protocol(PAP),用于规范个人 AI 智能体如何与企业网站、API 及企业自有智能体交互、认证并完成交易,首批合作方包括 Genesys、Instinct、Rocket、Shopify、Stripe、Walmart(Meta 一侧还包括 NiCE、Decagon)。协议基于 OAuth 会话,用户可先以访客身份查询库存或退货政策,需要账户时再登录并自行决定只读或写入权限,企业则可自行决定把哪些能力开放给智能体。v0.1 规范与参考实现计划于 10 月底发布,未来可能加入细粒度权限、延误/发货推送与「不共享卡号即可支付」的支付扩展;Meta 同时披露其个人智能体 Muse 在美国已有数百万用户,亚马逊已以爬虫风险为由封禁 Muse。 |
🔗 来源:https://sierra.ai/blog/introducing-personal-agent-protocol
10 月 6 日,Google 公布 Google Earth AI 旗下人口动态基础模型(Population Dynamics Foundation Model, PDFM):它把卫星影像、天气与空气质量、聚合搜索趋势、人类移动与场所活跃度等隐私保护信号,用自监督学习压缩成按月更新的「地点指纹」向量,可直接插入现有流行病学模型,无需另建数据管道。论文与五家独立伙伴(西奈山、波士顿儿童医院、NYU、牛津/蒙特雷理工、华盛顿大学及 WHO 非洲区域办)在四个国家做了五组验证:美加边境 146 县 MMR 疫苗接种率解释方差从 0.159 提升到 0.216;墨西哥约 2450 个市镇的一个月登革热预报在最多 72% 的活跃传播市镇得到改善;刚果(金)霍乱提前 4–8 周预警的 Precision@5 提升 18.1%。WHO 非洲区域办已用配套的地理空间推理智能体在刚果(金)埃博拉疫情中筛出 48 个暴露定居点、逾 4.55 万人风险名单。 |
🔗 来源:https://geoawesome.com/google-earth-ai-public-health-geospatial-foundation-models
10 月 6 日,视频理解公司 TwelveLabs 发布 Pegasus 1.6,原生支持第一视角(egocentric)视频,目标是解决机器人团队「给视频打标」这一瓶颈。新模型可自动完成动作分段与标注、手/工具/物体交互的密集描述、素材质量筛查、检索与隐私合规检测,上下文窗口 26.1 万 token,可一次处理最长约 2 小时视频;公司称人工标注 1 小时第一视角视频通常需要 70–155 小时。定价为每视频小时 1.75 美元、每百万图像输入 token 3 美元、每百万输出 token 15 美元,已有美国机器人训练数据公司用它每天清洗数十万小时视频。 |
🔗 来源:https://venturebeat.com/technology/twelvelabs-debuts-pegasus-1-6-to-improve-robotics-training-data-from-first-person-video
10 月 6 日,OpenAI 与 Atlassian 宣布扩大自 2023 年起的合作,把 GPT-6 系列(含 GPT-6 Astra 与 GPT-5.6 系列)前沿模型接入 Atlassian 平台与 AI 助手 Rovo,并与 Atlassian 的 Teamwork Graph 企业上下文层结合。改造后的 Rovo 可把 Jira 工单、Confluence 文档与讨论串起来,回答「上线是否按计划推进」这类问题,并给出风险与下一步建议;Atlassian 内部已有超过 3000 名开发者使用 Codex,并把 ChatGPT/Codex 的 CLI 插件接入现有工作流。双方还在探索更深的 Jira 集成——把任务直接派给 AI 智能体、跟踪进度并回收结果,同时用 DX 平台度量 AI 对交付速度的影响。 |
🔗 来源:https://openai.com/index/atlassian-partnership/
10.【月之暗面完成 IPO 前最后一轮融资:估值约 500 亿美元,拟 2027 年一季度赴港上市】
10 月 6 日,彭博社援引知情人士称,月之暗面(Moonshot AI)已完成 IPO 前最后一轮私募融资,估值约 500 亿美元,公司正推进 2027 年第一季度在香港上市,最快本月起与潜在投资者进行初步会谈,募资规模最高或达 50 亿美元。这是继 7 月 Kimi K3 开源模型发布后公司估值的又一次大幅跃升——今年夏季上一轮融资时估值约 315 亿美元,衡量未来营收的 ARR 预计从当前 10 亿美元升至 12 月的 20 亿美元。据报道,公司已委任美国银行担任整体协调人,与中金、德意志银行、高盛共同推进交易,并已保密提交上市申请。 |
🔗 来源:https://m.techweb.com.cn/article/2026-10-06/2979546.shtml