296起融资密集落地,AI 资本六月加速狂奔。
文|云舒&小鱼
编辑 |猫猫侠
6月重点关注:
01
六月人工智能市场发生投融资事件296起,披露融资金额926.07亿元

图一:2025年6月-2026年6月我国人工智能领域投融资事件数量及披露金额(数据来源:烯牛数据)

图二:2026年6月我国人工智能领域投融资事件各细分行业统计(数据来源:烯牛数据)

图三:2026年6月我国人工智能-具身智能&机器人领域投融资事件统计(数据来源:烯牛数据)

图四:2026年6月我国人工智能领域投融资事件轮次分布(数据来源:烯牛数据)

图五:2026年6月我国人工智能领域B/C/D/E/F轮投融资事件统计(数据来源:烯牛数据)

图六:2026年5月我国人工智能领域IPO事件(数据来源:烯牛数据)

图七:2026年1月我国人工智能领域Pre-IPO事件(数据来源:烯牛数据)

图八:2026年5月我国人工智能领域融资金额占比统计(数据来源:烯牛数据)

图九:2026年6月我国人工智能领域投融资金额亿级人民币以上事件统计(数据来源:烯牛数据)

向上滑动阅览事件详情
1、脑机接口新进展!西湖灵犀完成天使+轮融资
03
收并购月报

图十:2026年6月我国人工智能领域收购事件统计(数据来源:烯牛数据)
向上滑动阅览事件详情
1、千百度3亿控股本原智数:跨界玩转AI的新探索
2026年6月5日,港股上市公司千百度(01028.HK)发布公告,其全资附属公司上海千度将以总计3亿元人民币的代价,收购并认购国内领先的人工智能数据服务供应商——上海本原智数企业管理有限公司(简称“本原智数”)约90.91%的股权。具体交易分为两步:首先以1.5亿元现金收购李逆勇、王兆玺等创始股东持有的本原智数约83.33%的现有股权;随后再出资1.5亿元认购公司新发行股份,对应增资扩股后45.45%的股权。交易完成后,千百度将绝对控股本原智数,后者财务业绩将并入上市公司报表。根据公告,目标集团(本原智数及其附属公司)2025年度收益为1.56亿元,除税后净溢利为1110万元。以此计算,本次交易对应的投前估值约为1.8亿元,静态市盈率(PE)约16倍。在普遍“烧钱”的AI行业,一家已实现稳定盈利的数据服务商显得尤为稀缺。(并购风云)
2、控股AI视觉检测企业 华翔股份加速构建AI产业生态
6月9日,华翔股份(16.730, 0.38, 2.32%)宣布,已完成对上海申智创视觉科技有限公司(以下简称“申智创”)的控股。此举是公司深化“人工智能+制造”融合、构建未来工厂核心竞争力的关键布局。未来华翔股份将依托申智创构建AI产业生态:短期以华翔为基石,确保技术领先;中期将通过服务行业头部客户,建立新的零部件检测标准,带动全行业品质升级;长期则聚焦深度挖掘质检数据价值,从智能感知迈向智能决策,构建覆盖“感知-决策-执行”的工业大脑。(上海证券报)
3、千里科技拟全资收购融感科技
千里科技6月11日发布公告,公司控股子公司重庆千里智驾科技有限公司拟收购宁波市融感科技有限公司100%股权,交易价格为2,590.8万元。本次交易构成关联交易,但不构成重大资产重组。公告显示,千里智驾是公司智能驾驶业务板块的核心企业,本次收购旨在进一步构建覆盖L2至L4级别的全栈式智能驾驶解决方案,巩固其在智能驾驶产业的核心竞争力。融感科技成立于2023年6月,总部位于浙江省宁波市,是一家专注于毫米波雷达及融合感知技术的车规级技术企业,其开发技术团队平均具备10年以上自动驾驶行业汽车电子正向开发或生产工艺制造经历。(天天智驾)
04
本月 AI,“黑科技” 出没

向上滑动阅览事件详情
1、物理AI爆发临近?英伟达发布“全能”世界模型 机器人、自动驾驶有望获强力助推
6月1日消息,在今日举行的2026台北GTC大会期间,英伟达发布了Cosmos 3——一款基于突破性Transformer混合架构的物理AI世界模型。据悉,Cosmos 3是全球首个完全开源的全能模型(Omni-Model,也叫全模态模型)。其能够以领先的物理精度原生理解和生成文本、图像、视频、环境声音和动作,将物理AI的训练和评估周期从数月缩短到数天。(科创板日报)
2、字节跳动 AI 智能体平台扣子 Coze 3.0 版本上线,支持接入 Claude Code、Codex CLI 等平台
6月1日消息,字节跳动前天发布 AI 智能体平台扣子 Coze 3.0 版本,支持多人多 Agent 协作、开箱即用,拥有多种专家技能。扣子 3.0 拥有全新 Agent 写作方式,可灵活组合一人 + 多 Agent / 多人 + 多 Agent。多项目独立管理,资产自动沉淀,让团队协作更有序。支持自由切换主流平台,可完成从开发到上线的全流程工作流。(IT之家)
3、MiniMax推出MiniMax M3模型
6月1日消息,MiniMax推出MiniMax M3模型。据介绍,该模型基于自研MiniMax Sparse Attention(MSA)架构,API最高支持1M tokens上下文窗口,保障至少512K tokens可用。(广角观察)
4、JetBrains 开源 Mellum2 模型:12B 参数,升级为 AI 智能体编程助手
6月2日消息,JetBrains 发布博文,宣布开源 Mellum2 模型,这是面向软件工程系统的新机器学习模型。官方表示相比原版 Mellum,它从代码补全模型升级为完整编码助手,并把上下文窗口从 8192 Token 扩到 131072 Token。开发者可在 Apache 2.0 许可测下部署基础版、指令版和思考版。(IT之家)
5、百度文心发布PaddleOCR-VL-1.6:准确率突破96.33%
6月2日消息,百度发布PaddleOCR-VL-1.6。作为文心衍生模型,PaddleOCR-VL-1.6在OmniDocBenchv1.6权威评测中准确率突破96.3%。据了解,PaddleOCR基于文心大模型训练而来,支持超100种语言识别,用户覆盖170多个国家和地区。此次发布的PaddleOCR-VL-1.6在PaddleOCR-VL-1.5基础上进一步升级,通过模型驱动的数据构建机制和渐进式训练优化,在保持0.9B轻量化架构的情况下,模型准确率和复杂场景适应能力进一步提升。(科创板日报)
6、中国第一:阿里发布 Qwen3.7-Plus 模型,升级多模态交互混合 AI 智能体
6月2日消息,阿里千问大模型发布博文,宣布推出 Qwen3.7-Plus 模型,定位为多模态交互混合智能体。Qwen3.7-Plus 是 Qwen3.7 的多模态升级版,核心定位是视觉与语言统一的智能体基座。它保留文本、编码、工具使用和生产力工作流能力,同时强化视觉理解、视觉推理和跨模态任务处理。(IT之家)
7、微软全面押注智能体时代:发布新模型、展示新终端、重塑应用生态
6月3日消息,作为人工智能(AI)浪潮中的重要参与者,微软不仅提供关键的云基础设施和相关服务,还分别向OpenAI和Anthropic投入数十亿美元的资金。如今,这家科技巨头正进一步发力,试图在自研AI模型领域与行业领先者展开竞争。当地时间周二,在于旧金山举行的Build开发者大会上,微软发布了其首款代码生成模型——MAI-Code-1-Flash。该模型能够根据用户输入的自然语言描述,自动生成应用程序和网站的源代码。目前,该模型已集成至GitHub Copilot AI编程助手以及Visual Studio Code编辑器中。(广角观察)
8、酷哇科技发布CooWAIM 2.0交互式世界模型
6月3日消息,酷哇科技近日发布CooWAIM 2.0交互式世界模型,基于DAWN架构,将世界预测器与动作降噪器置于隐空间联合训练,世界假设指导动作生成,动作假设反过来重塑世界推演,形成双向闭环,通过高效特征压缩将计算量降低约75%。该模型已在酷哇50多个城市部署的万台级机器人上完成真机数据打磨,累计运营里程超4500万公里,可适配轮式底盘、四足机器狗、人形机器人等多种形态。(广角观察)
9、阿里千问向第三方 Agent、Skill 全面开放,肯德基、瑞幸、蜜雪冰城、东航将首批接入
6月3日消息,阿里旗下千问 App 今日宣布,千问将向第三方 Agent、Skill 全面开放,所有企业均可在千问运营自己的品牌 Agent。目前,瑞幸咖啡、肯德基、蜜雪冰城、东方航空等首批企业正在千问进行 Agent 服务测试,并将陆续上线。官方表示,未来企业可以在千问 App 中运营自己的 Agent,自定义 Agent 人设与服务边界,以对话的形式为用户提供各种形式的产品服务。(IT之家)
10、英伟达官宣推出全球首款完全开放的全模态物理AI模型NVIDIA Cosmos 3()
6月4日消息,在2026中国台北GTC大会上,英伟达正式官宣重磅产品——NVIDIA Cosmos 3,这款面向物理AI的开放世界基础模型,凭借全新混合Transformer架构,打通视觉推理、世界生成、动作预测三大核心能力,成为全球首款完全开放的全模态物理AI模型。与此同时,英伟达牵头成立全球开发者协作联盟,正式拉起物理AI生态阵营,宣告物理AI规模化落地时代加速到来。英伟达同步祭出生态大招,正式成立NVIDIA Cosmos Coalition全球协作联盟,集结全球顶尖世界模型研发团队与AI开发者,共同推动下一代开放世界模型的技术迭代与落地普及。(广角观察)
11、全球最强开源生图 AI 模型:Ideogram 4.0 登场
6月4日消息,Ideogram 昨日发布博文,宣布推出 Ideogram 4.0 开放权重文文生图模型,基于跑分数据是全球最佳开源生图 AI 模型。该模型核心规模为 9.3B 参数,延续近期开源模型的单流架构路线,让文本 tokens 与图像 tokens 共享同 1 个自注意力序列,并把设计控制放在训练和推理格式的中心。(IT之家)
12、智动未来联合蔡盼盼团队发布MINT-4B VLA模型
6月4日消息,广东智动未来联合上海创智学院蔡盼盼教授团队发布MINT-4B多模态VLA(视觉-语言-动作)大模型。该模型凭借突破性泛化能力与实机表现,在英伟达等行业巨头及国际权威专家发布的全球主流通用机器人大模型评测中跻身前三甲,技术指标优于OpenVLA、GR00T、π、UniVLA等标杆模型。 (广角观察)
13、美企苦高价AI久矣?DeepSeek登上趋势榜第一
6月5日消息,AI成本居高不下,“烧不动钱”的美国企业客户,开始将目光投向中国大模型。根据美国企业指出管理平台Ramp日前最新报告,DeepSeek登上“软件趋势榜单”第一。该榜单主要追踪的是企业向某软件供应商的首次采购情况,这也意味着DeepSeek成为该平台上增速最快的软件之一。(科创板日报)
14、华为云发布新一代ModelArts Next模型训推平台
6月5日消息,华为云正式发布新一代模型训推平台ModelArts Next,提供RL服务、机密推理、模型路由、模型矩阵四大核心能力。MaaS模型路由支持成本优先、效果优先、均衡模式三种策略;企业级RLaaS服务实现一分钟创建任务、全程可视化观测、训推一致性保障;机密推理能力依托硬件级可信执行环境,在AI编码、金融风控等高敏感场景中,确保模型处理的数据“只进不出”;模型矩阵能力实现了主流SOTA模型(如DeepSeek、Kimi、智谱GLM等)Day0上线,结合自研模型Pangu,能力覆盖编程、多模态等丰富场景。(广角观察)
15、大晓机器人发布首个全屋三维可交互世界模型
6月5日消息,大晓机器人发布Kairos-HomeWorld全屋家庭世界模型,这是全球首个实现全屋生成、个体物体全交互的世界模型统一框架,能够一键生成结构连贯、物理合理、功能完整的全屋三维场景,并同步开源全球规模最大、首个专为中国家庭打造的全屋3D数据集。(钛媒体)
16、高德发布3D原生城市世界模型ABot-Earth0.5,已建成覆盖190多个国家和地区的3D地图
6月8日消息,阿里巴巴集团旗下高德正式发布全球首个3D原生城市世界模型ABot-Earth0.5,该模型已建成全球覆盖面积最广的3D地图,遍及190多个国家和地区。其中模型输出的是可编辑的3DGS格式的素材,能够直接导入Unity、Unreal Engine等主流引擎进行交互开发。根据测算,ABot-Earth0.5的3D制图成本仅为传统方式的百分之一,效率却提升了约一千倍。(科创板日报)
17、腾讯云升级发布AI原生营销云与云Mall 2.0产品
6月8日消息,腾讯升级发布AI原生营销云、云Mall 2.0两个核心产品,并同步推出营销与交易一体化解决方案。两大产品以“Agent协同”为底层架构,分别切入营销与交易两大核心场景,推动企业经营从“人配置系统”迈向“Agent组织系统”;一体化方案则以统一数据底座打通公域获客与私域运营、营销转化与交易复购,助力企业构建全域智能增长闭环。(36氪)
18、苹果WWDC26召开,推出史诗级升级的Siri 2.0与Apple Intelligence。
6月9号消息,苹果全球开发者大会 (WWDC 2026) 于北京时间6月9日至13日在线上举办,核心主轴为“全面向 AI 进化”。此次大会重点发布了 iOS 27 等全平台新系统,并推出史诗级升级的 Siri 2.0 与 Apple Intelligence。(广角观察)
19、美团发布AI浏览器Tabbit 1.0,核心功能永久免费
6月9日消息,美团AI浏览器Tabbit 1.0 将新增记忆功能,会持续记录用户偏好、背景以及其他重要信息,并形成“可调用记忆”,自动适配用户回复风格,减少无效对话及动作,让每一次交互都更贴近用户需求。Tabbit负责人刘炯表示,Tabbit面向大众用户的基础对话、网页阅读、常用妙招等核心功能将永久免费。针对高频的Agent自动化调用及高级定制化场景,Tabbit将探索差异化的订阅制模式,以平衡算力成本。目前,Windows、macOS版本的Tabbit已同步上架,移动端也已开启测试。(广角视察)
20、MiMo 昨晚发布 V2.5-Pro-UltraSpeed,这是业内首次在 1 万亿参数模型上突破 1000 tokens/s 输出速度
6月9日消息,小米 MiMo 官方昨日宣布,与 TileRT 联合发布 Xiaomi MiMo-V2.5-Pro 的 UltraSpeed 模式。MiMo-V2.5-Pro-UltraSpeed API 同步上线,采用限时体验价,定价为 MiMo-V2.5-Pro 的 3 倍,同时提供输出速度约 10 倍的提升。(IT之家)
21、Anthropic发布Mythos系列新模型:代码、科研、视觉能力全面突破
6月10号消息,Anthropic最新推出了一款新模型“Claude Fable 5”,作为“神话级”(Mythos-class)的一员,公司将其设计为可安全用于一般用途的模型。Anthropic指出,任务越长、越复杂,Fable 5相对于公司其他模型的优势就越明显。新闻稿援引Stripe的报告称,在早期测试中,Fable 5将数月的工程量压缩到了几天之内。在一个拥有5000万行代码的Ruby代码库中,Fable 5仅用一天时间就完成了整个代码库的迁移,而如果这项工作由一个团队手动完成,则需要两个多月。(科创板日报)
22、微盟宣布接入微信AI生态
5月14日消息,今天,阿里云上线企业级AI建站平台万小智2.0,可为用户提供从网站生成、域名备案、网站上线到后台管理运营等环节的完整服务,最快几分钟,就能生成并上线符合用户需求的生产级网站。(IT之家)
23、Anthropic最新估值超越OpenAI 年化收入半年内涨4倍
6月10日消息,微盟作为首批内测团队,已与微信团队联合开发并测试接入微信AI生态。未来,商家可通过微盟小程序便捷接入微信AI,为消费者提供各类服务体验。重点覆盖电商、零售、本地生活等多类商家,帮助商家在微信生态内实现智能化经营。与此同时,微盟还将借助在服装、快消、商超、购百、本地生活等众多垂直细分行业的领先经验,为商家接入微信AI提供行业化解决方案,与微信生态AI能力在底层技术层面展开合作。(广角观察)
24、钉钉换帅!90后技术极客陈宇森接任,Agent成阿里AI B端押注点
6月11号消息,阿里巴巴今日宣布钉钉管理层调整:陈航卸任钉钉CEO,92年技术极客陈宇森接棒。阿里巴巴合伙人委员会在公司内网发布帖文《有情有义有成长,才是阿里文化》,对近日钉钉离职员工长文《置身钉内》引发的讨论表达了鲜明的态度。合伙人委员会以严厉的措辞批评了钉钉团队的管理方式,直接指出这“不是阿里文化该有的样子”。紧接着,阿里集团宣布了对钉钉管理层的调整。(科创板日报)
25、苹果 CoreAI 端侧 AI 架构测试:M4 Mac 上 Qwen3 0.6B 解码速度是 MLX 的 2.47 倍
6月11日消息,科技媒体 Wccftech 发布博文,报道称在 2026 年全球开发者大会(WWDC)上,苹果推出 CoreAI 引擎,接替 2017 年推出的 CoreML 框架,主打端侧大模型推理。CoreML 框架已服役 9 年,主要面向图像分类等小型静态任务;而最新接棒的 CoreAI 主要面向端侧本地推理和边缘 AI 场景,重点优化设备端大语言模型推理,重点支持更灵活的模型格式和更大的模型内存占用。(IT之家)
26、AI赋能2026世界杯:高清第一视角+3D数字人判越位+生成式战术平台
6月13号消息,随着东道主墨西哥在揭幕战中以2比0战胜南非,2026年美加墨世界杯正式拉开帷幕。在这届首次由三国联办、首次扩军至48支球队的盛会上,多项AI技术首次被系统性引入赛事核心环节,一批“AI裁判”正式上岗。裁判视角AI视频增强系统无疑是本届赛事的亮点,本届世界杯应用了AI驱动影像稳定增强技术,首次将裁判第一视角画面经AI处理后直接投入全球直播。(36氪)
27、科大讯飞发布星火多模态大模型 X2-VL,当前唯一基于全国产算力训练的主流大模型
6月13日消息,据无锡发布消息,科大讯飞在 2026 长三角机器人及自动化展览会暨无锡具身智能机器人产业链伙伴大会上发布星火多模态大模型 X2-VL。据科大讯飞副总裁、江苏大区总经理孙东平介绍,科大讯飞星火多模态大模型 X2-VL 是当前唯一基于全国产算力训练的主流大模型,采用专属 MoE 架构。这款大模型基于无锡本地算力平台 —— 太湖星跃平台加速训练。科大讯飞已在无锡高新区成立子公司,未来将专门负责该多模态大模型的日常运营。(IT之家)
28、最强文本转 SQL 任务 AI 模型:谷歌发布 Gemini-SQL2,准确率 80.04% 登顶
6月13日消息,Google Research发布公告,宣布推出 Gemini-SQL2 模型,基于 Gemini 3.1 Pro 打磨,具备最顶尖的 Text-to-SQL 能力。Text-to-SQL 是指把自然语言问题自动转换成 SQL 查询的技术。用户不必手写数据库语句,只需用口语描述需求,系统就尝试生成可运行的 SQL。它常用于数据分析、自助报表、企业搜索和 SaaS 数据问答场景,但难点在于表结构理解、字段歧义和复杂业务规则。(科创板日报)
29、马赫 Mind-Pro 模型已全面落地赋能 L9 Livis 车载智能
6月15日消息,理想今天举行 Livis Day 汽车软件与人工智能发布会,官方现场宣布,马赫 Mind-Pro 模型已全面落地赋能 L9 Livis 车载智能。马赫 Mind-Pro 模型在 IFEval 指令跟随、LongBench-v2 超长文本理解、AIME26 高阶数学推理、BFCL-v4 工具调用等领域,已经稳居行业第一梯队。并在 Token 生成速度、任务完成质量、Token 使用成本、端到端响应时延等商业维度,实现真正可量产。(IT之家)
30、商汤发布SenseNova U1图文交错增强版模型,支持多页连续创作
6月15日消息,商汤发布日日新SenseNova U1系列U1-8B-MoT-Interleaved图文交错增强版模型。该模型面向图文交错创作与生成(Interleaved Generation)场景进行了专项强化,支持绘本、故事书、多页 PPT、图文教程等连续内容创作,解决传统多模态模型“多轮生成后角色形象飘移、画风断裂、图文脱节”等痛点。(广角观察)
31、微信支付发布 AI 接入工具箱 2.0,Token 消耗少一半
6月15日消息,今年 4 月,微信支付官宣发布一整套面向 AI 的支付接入 Skill,涵盖 Skill 技能包、AI 友好文档、AI 友好 API 三大工具。据微信公开课消息,微信支付 AI 接入工具箱迎来 2.0 版本,围绕“安全、高效、原生流畅”的方向,重点更新了五大内容。据介绍,微信支付 AI 接入工具箱 2.0 现在全面支持中文、英语、日语、韩语、法语、俄语、葡萄牙语、西班牙语、阿拉伯语这 9 种语言。全球开发者基本可以用自己的母语对接微信支付。(IT之家)
32、全球最大 AI 聚合平台上线“拼好模”:Deepseek+Kimi+Gemini 以一半成本实现 Claude Fable 5 级智能
6月16日消息,全球最大 AI 大模型 API 聚合平台 OpenRouter 于 6 月 14 日发布公告,宣布推出 Fusion API 复合 AI 模型,只需约一半成本就能实现 Claude Fable 5 级别性能。Fusion 是个多模型协同系统服务,会把用户输入同时发给多个模型,再汇总分析各模型结果,最后生成统一回答。官方测试组合包括 Claude Opus 4.8 与 GPT-5.5、双 Claude Opus 4.8 等“双强”组合,以及 Claude Opus 4.8、GPT-5.5、Gemini 3.1 Pro“三强”组合。(IT之家)
33、阿里巴巴发布首个具身智能大模型 Qwen-Robot 系列,为机器人打造手、脚、大脑通用底座
6月16日消息,阿里巴巴发布千问具身智能大模型 Qwen-Robot 系列,包含 VLA 操作模型 Qwen-RobotManip、VLN 移动模型 Qwen-RobotNav 和世界模型 Qwen-RobotWorld 三大模型。这是千问大模型家族首个完整的具身智能模型系列 —— 三个模型分别为机器人装上灵巧的手、认路的脚和会思考的大脑,既可单独部署,也能协同运转,让不同形态的机器人迈向真实落地有了可靠的“通用底座”。(IT之家)
34、成本砍半,字节跳动推出 Seedance 2.0 Mini 视频生成模型
6月16日消息,字节跳动火山引擎旗下火山方舟体验中心于 6 月 15 日正式上线 Seedance 2.0 Mini 视频生成模型,并计划近期开放 API 服务。该模型主打高性价比定位,瞄准更广泛的视频创作与规模化生产市场。官方称,Seedance 2.0 Mini 比 Seedance 2.0 Fast 快 2 倍,输出质量与 Seedance 2.0 Fast 相当。(IT之家)
35、京东即将开源视觉语言实时交互模型 从“一问一答”走向“边看边说”
6月17日消息,从一份在开源社区和海外AI技术圈受到关注的技术报告获悉,该模型想解决的问题,不只是让模型更会"看视频",而是让模型能够通过摄像头等实时视频流持续观察现实世界,并自己判断什么时候该回应、什么时候该保持沉默、以及什么时候把任务委托给后台agent。换句话说,它试图把多模态大模型从传统的"一问一答",推进到"实时流式交互"。(科创板日报)
36、全球首个人形机器人通用小脑 GPT 模型:银河通用发布 AstraBrain-WBC 0.5
6月19日消息,“银河通用机器人”官方公众号发布博文,宣布推出全球首个人形机器人通用小脑 GPT 基础模型 AstraBrain-WBC 0.5,采用全球最大规模 2 万小时人类动作数据训练,8040 万参数规模。AstraBrain-WBC 0.5 首次构建起面向人形机器人全身实时运动控制的通用基础模型,使用 2 万小时人类动作数据进行训练,参数规模达 8040 万,是行业首个达到 GPT-1 量级的人形机器人全身实时运控大模型。(IT之家)
37、LM Studio 与苹果合作,成功用四台 Mac Studio() 运行万亿参数 Kimi K2.6 大模型
6月20日消息,在苹果 WWDC 2026 期间,LM Studio 与苹果合作在四台 Mac Studio 集群上成功运行起了月之暗面万亿参数大模型 Kimi K2.6,并通过 LM Link 实现从 MacBook Neo 和 iPhone 的安全远程访问。Kimi K2.6 大模型总参数规模达到 1 万亿,采用 MoE 架构,激活参数为 320 亿,支持长上下文、多模态输入以及智能体任务处理。(IT之家)
38、京东开源实时视频视觉语言交互模型JoyAI-VL-Interaction
6月22日消息,据京东黑板报消息,京东近日开源实时视频视觉语言交互模型JoyAI-VL-Interaction,据介绍,这是全球首个全栈开源的interaction模型和系统,并获得vLLM-Omni的day-0原生支持。(广角观察)
39、百川发布新一代医疗增强大模型 M4:登顶 OpenAI 医疗评测,超越 GPT-5.5
6月22日消息,百川智能与清华大学研究团队今日联合发布新一代医疗增强大模型 Baichuan-M4。该模型在 HealthBench 及其 Hard、Professional 三个榜单上同时位列世界第一,全面超越 GPT-5.5、Claude Opus 4.7、DeepSeek-V4-Pro,幻觉率低至 3.3%。在 OpenAI 提出的医疗评测 HealthBench 上,M4 综合得分 68.6,位列世界第一,领先第二名 GPT-5.5 超过 10 分;在最考验复杂临床决策的 Hard 子集上,M4 领先达 15.9 分。(IT之家)
40、豆包大模型2.1发布,Coding能力进入国际第一梯队
6月23日消息,火山引擎在北京举办2026夏季FORCE原动力大会,集中发布豆包大模型2.1,以及视频、图像、音频等多款新模型,并升级面向Agent的云服务体系。 据火山引擎披露,截至今年6月,豆包大模型日均Token调用量已突破180万亿,过去一年增长超10倍。全球范围内,第一个跨越质变点的视频生成模型是Seedance 2.0,Coding与Agent领域则是Claude Opus 4.6。 作为本次大会发布的主力模型,豆包2.1 Pro 在 Coding(编程)、Agent(智能体)、VLM(视觉语言模型)三大核心方向实现能力跃升,多项评测表现优于Claude Opus 4.6,正式跨越生产级质变点。(广角观察)
41、宇树科技与 GMO AIR 达成合作,G1 人形机器人等产品将登陆日本市场
6月23日消息,GMO 互联网集团旗下公司“GMO AI & 机器人商事”(GMO AIR)宣布,公司已于 6 月 19 日与“全球市场份额第一”的人形机器人厂商宇树科技签署合作协议,成为宇树科技在日本的官方经销商。GMO AIR 将在日本市场销售 G1、H1 等人形机器人产品及 Go 2、B2 等四足机器人产品。公司将为客户提供通信服务、云计算资源、网络安全能力、金融服务等完整解决方案,还能够按需求提供研发、验证实验和商业应用方案。(IT之家)
42、即梦AI上线Seedance 2.0 VIP原生4K版本
6月24号消息,即梦AI网页版Seedance 2.0 VIP正式上线原生4K功能,支持超清输出。与后期超分不同,原4K能够从源头保留更多局部细节。人物发丝、服装纹理、建筑线条、材质肌理等高密度信息,都能更完整、清晰呈现,进一步提升画面细节、色彩层次与光影表现,适配影视后期、品牌视觉、广告营销等高品质创作场景。(科创板日报)
43、北森官宣全面转型AI应用公司,并发布AI HR专家平台Mavens
6月24日消息,北森今日正式宣布一项战略转型:公司将从传统“HR软件”厂商,全面升级为HR领域的“AI应用”公司,并重磅推出首个一站式AI HR专家平台Mavens。该平台基于北森自研的垂直领域模型SenGPT和SenClaw Agent体系,聚焦成为HR专家的AI分身。据CEO纪伟国透露,北森未来将All in AI,除了成立AI人才科学研究院、组建投资FDE外,未来预计两年投入10亿元在产研及内容研究。前一天,北森公布了业绩财报:2026财年实现营收11.05亿人民币元,同比增长16.90%;净亏损2338.5万元,同比改善84.14%;经调整净利润5549万元,首次实现扭亏为盈。(广角观察)
44、阿里千问发布首个原生语言世界模型 Qwen-AgentWorld,可在七大领域中模拟智能体交互环境
6月24日消息,阿里巴巴千问大模型今天正式发布 Qwen-AgentWorld,官方称这是首个原生语言世界模型,能够在七大领域中模拟智能体交互环境,提供两种规模(35B-A3B 与 397B-A17B)。原生世界建模:环境建模从继续预训练(CPT)阶段起即为训练目标,贯穿 CPT → SFT → RL 全流程,而非对通用大语言模型的事后适配;七大领域,一个模型:单一模型同时覆盖文本类环境(MCP、Search、Terminal、SWE)与 GUI 类环境(Web、OS、Android),实现跨领域知识迁移。(IT之家)
45、腾讯操作系统层级AI助手Marvis iOS 版上线
6月25号消息,腾讯旗下的操作系统层级AI助手Marvis马维斯移动端APP iOS版本正式登陆苹果App Store。至此,Marvis完成了移动端和PC端的全量覆盖。据了解,自2026年5月20日发布以来,Marvis1个月内已累计交付21个版本,平均每1~2天迭代1个版本,其中包括会话管理、语音输入、手机端连接Mac远控、人设管理、低资源占用模式等功能。(科创板日报)
46、百度开源 Unlimited OCR 模型:基于 DeepSeek OCR,解析文档告别 AI 越生成越慢
6月25日消息,百度于6月22日开源推出 Unlimited OCR 模型,总参数量 30 亿,推理时仅激活 5 亿参数,目标解决在解析长文档时,端到端 OCR 模型越生成越慢的问题。端到端 OCR 模型是统一神经网络架构系统,融合检测图像中的文本和字符识别,摒弃了传统“先检测文字框、再单独识别”的繁琐流程,直接从输入图像映射到文本序列输出,从而减少信息丢失和计算冗余。(IT之家)
47、OpenAI 再次升级 GPT-5.5 Instant AI:更具洞察力,购物推荐更实用
6月25日消息,OpenAI 在 X 平台发布公告,宣布升级 GPT-5.5 Instant 模型,更能洞察用户表达意图,并在处理复杂任务时更可靠。OpenAI 公司于 5 月 5 日推出 GPT-5.5 Instant 模型,在医学、法律和金融等高风险主题上,该模型产生的幻觉减少了 52.5%,并显著提升数学、科学和视觉推理等方面。(IT之家)
48、北大与DeepSeek联合开源DSpark框架,高并发下生成速度提升超60%
6月27日消息,DeepSeek联合北京大学正式发布DSpark推理加速框架,旨在解决大语言模型在高并发生产环境中的推理效率瓶颈。该框架已部署于DeepSeek-V4-Flash与DeepSeek-V4-Pro的预览版服务引擎中,相比此前生产环境采用的单token推测解码基线MTP-1,在同等吞吐量水平下可将单用户生成速度提升60%至85%。相关论文、训练代码及模型检查点已在GitHub平台DeepSpec项目中开源。(广角观察)
49、Anthropic 测试手机端 Claude Cowork,支持远程管理 AI 长任务
6月27日消息,科技媒体 bleepingcomputer发布博文,报道称 Anthropic 正测试移动端 Claude Cowork,用户可直接在手机上发起并调整任务。Claude Cowork 是 Anthropic 为 Claude 设计的桌面导向智能体工作模式,适合处理耗时较长的常规知识工作任务。它可调用用户授权的文件,帮助创建文档、生成表格、撰写报告等。典型场景包括资料整理、文档处理和多步骤任务跟进。(IT之家)
50、两年深耕:全国首个开源鸿蒙机器人操作系统 M-Robots OS 完整捐献至开放原子开源基金会
6月28日消息,深圳开鸿数字产业发展有限公司 CEO 王成录宣布,经过两年深耕,M-Robots OS 正式完整捐献至开放原子开源基金会,专属一级根社区同步启动运营。M-Robots OS 是全国首个开源鸿蒙机器人操作系统,1.0 版本已于 2025 年 4 月发布,今年 5 月发布了 2.0 版本。系统具备多机实时协同、多硬件形态兼容、AI 原生以及丰富 API 与开发工具链四大核心能力,是可以提供“底层统一、场景多元”的全栈式系统平台。(IT之家)
51、做视频不花钱、一句话搞定大纲分镜,Agnes AI 推全新免费视频创作平台 Pavo
6月29日消息,新加坡本土模型公司 Sapiens AI 于 6 月 1 日宣布,旗下 Agnes AI 核心全模态模型(包含文本、图片、视频)API,向全球开发者与创作者无限期免费开放。今日,Agnes AI 又宣布推出一个全新的免费视频创作平台 Pavo,宣称一句话即可成片,且使用 Agnes 自研模型生成完全免费。目前,Agnes AI 提供的免费模型包括文本模型 Agnes-2.0-Flash、图片模型 Agnes-Image-2.1-Flash、视频模型 Agnes-Video-2.0。(IT之家)
52、无界动力发布首个“长时序双向物理因果链”隐空间世界模型MWA™
6月29日消息,无界动力正式发布全球首个“长时序双向物理因果链”隐空间世界模型——MWA™具身通用大脑。据了解,MWA™通过时序Chunk(组块)级逆向动力学建模机制,输出连续多步Latent Action Chunk(潜动作组块)动作组,为机器人在多元复杂场景下的长时间、连贯、精准的任务执行提供了新的潜空间时序建模方案。该模型在由斯坦福大学等顶尖机构联合发起的具身智能权威榜单RoboCasa GR1 TableTop中登顶,超越英伟达GR00T-N1.6、大晓机器人ACE-EGO-0、小鹏DIAL、高德ABot-M0等行业主流模型。(广角观察)
53、马斯克:Grok 4.5内测已比肩Opus,今年每月都发布一个全新大模型!
6月29号消息,马斯克在其社交媒体平台X上发文称,旗下最新一代大语言模型Grok 4.5已正式在SpaceX和特斯拉内部开启Beta测试,之后才会进行更广泛的推广。值得注意的是,根据马斯克的说法,早期的评测结果显示,该模型的性能已经接近、甚至可能超越了Anthropic的旗舰模型Claude Opus。目前,强化学习(RL)仍在持续显著地优化该模型,其配套的“Grok Build”测试基准也在日趋完善。(科创板日报)
05
六月人工智能、大数据、云资源领域招投标回顾




夜雨聆风