引言
本文将国内各厂发布的大模型(非垂类模型)按时间线顺序进行了罗列。
在这里你可以看到各家发布大模型的节奏,谁家掉队了,谁家憋了个大的;也可以看出AI大模型发展的方向与“热点”,以及目前存在的一些问题,引发一些思考🤔。如有遗漏,欢迎评论区补充。
2026年8月3日
阿里千问正式发布Qwen3.8-Max(开源)
Qwen 3.8-Max 基于 Qwen 3.5 的架构基础构建,参数规模扩展至 2.4 万亿,激活参数95B,支持100万上下文Tokens,在编程、办公、科研以及长周期任务等方面实现了全面提升。它不仅能应对更具挑战性的问题,还能更可靠地端到端完成复杂任务,输出值得信赖的成果。 ——千问
2026年7月31日
深度求索DeepSeek-V4-Flash正式版API上线公测(开源)
注:总参数284B,单 token 激活参数13B,上下文长度1M,最大输出384K tokens
2026年7月17日
月之暗面Kimi正式推出Kimi K3(开源)
Kimi K3 是一个 2.8 万亿参数模型,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。它是全球首个开源的 3 万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。
虽然 Kimi K3 的整体表现仍落后于最强的闭源模型 Claude Fable 5 和 GPT-5.6 Sol,但它在我们的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。——月之暗面Kimi
2026年7月6日
腾讯混元正式发布Hy3(开源,采用Apache 2.0协议)
注:MoE混合专家结构,总参数295B,单次推理激活参数21B,上下文窗口256K。
它展现出显著强于同尺寸模型的智能水平,并比肩更大尺寸旗舰模型的效果,大幅提升了在各类产品和生产力任务中的实用价值。 ——腾讯混元
2026年6月30日
美团正式发布新一代万亿参数大模型 LongCat-2.0(开源,采用MIT协议)
作为业界首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数模型(总参数 1.6 T,平均激活约 48 B,动态范围 33B~56B),LongCat-2.0 从零开始预训练,原生支持 1M 超长上下文,其架构设计自始至终围绕一个核心目标:让模型在真实的 Agentic Coding 任务中,更高效、更稳定地完成代码理解、生成与执行。 ——美团
2026年6月23日
字节火山引擎正式发布豆包大模型2.1系列:Doubao-Seed-2.1-pro 和Doubao-Seed-2.1-turbo(闭源)
注:闭源商用MoE稀疏架构大模型,官方未对外公开完整总参、单专家参数
豆包大模型2.1是生产级 Coding 和 Agent 任务的首选。在企业和开发者邀测的大量真实生产环境中,豆包大模型2.1在 Coding 工程交付、Agent 长链路任务执行上全面提升,在多模态理解能力上保持领先优势,可胜任企业研发和高经济价值的生产任务。 ——火山引擎
2026年6月17日
智谱上线并开源GLM-5.2 (开源,采用MIT License)
注:2026年6月13日,GLM-5.2向 GLM Coding Plan 全量用户开放,覆盖 Lite / Pro / Max / 团队版。
MoE混合专家稀疏架构,总参数量744B,共256个独立专家模块,单次推理动态激活8个专家,有效激活参数约40B
今天GLM-5.2专为长程任务能力而生,全新特色包括:
Solid 1M上下文,稳定支撑长程任务
更强体感,更实用的Coding能力
极致Infra优化,Day 0运行在国产算力平台
MIT开源协议,无地域限制,技术平权无国界——智谱
2026年6月2日
阿里千问正式发布Qwen3.7-Plus——将视觉与语言统一为一体化智能体基座的多模态模型。(闭源)
在 Qwen3.7 强大文本能力的基础上,Qwen3.7-Plus 全面升级了视觉-语言能力,同时保持了在编码、工具使用和生产力工作流方面的完整智能体能力。
Qwen3.7-Plus 的核心特色在于其作为多模态交互混合智能体的能力。它能够感知真实世界场景、读取屏幕并操作 GUI、基于视觉参考生成代码、端到端导航移动应用,以及基于网络知识回答视觉问题——在单一智能体循环中无缝融合 GUI 与 CLI 交互。作为全能型编码智能体与生产力助手,它以全模态输入处理从前端原型到复杂软件工程、再到多步工作流自动化的全方位任务。它具备跨框架泛化能力,无论通过 Claude Code、OpenClaw、Qwen Code 还是其他框架部署,均能保持稳定表现。
——千问
2026年6月1日
MiniMax 稀宇科技发布MiniMax M3(开源)
注:整体采用MoE混合专家+自研MSA稀疏注意力双重稀疏架构,总参数量428B。单次推理实际激活参数约22-23B。
前沿 Coding 能力、1M 上下文、原生多模态,一个模型全给你
MiniMax M3 在编程和智能体等专业任务上达到了前沿的能力。它使用了我们提出的全新注意力架构 MSA (MiniMax Sparse Attention),最高支持 1M 超长上下文。如外界所期待的那样,它也是一个原生多模态模型,支持图片和视频的输入,并能操作电脑桌面。——MiniMax 稀宇科技
2026年5月29日
阶跃星辰正式发布并开源 Step 3.7 Flash(
开源,采用Apache 2.0许可证)
这是我们面向 Agent 生产化阶段推出的新一代 Flash 模型,它不是单纯追求“更快”或“更便宜”的轻量模型,而是围绕 Agent、Coding、Search 与多模态工作流进行系统优化,在速度、成本、可靠执行和复杂任务完成能力之间力求取得更优平衡。多模、快速、好用、省心! ——阶跃StepFun
2026年5月20日
阿里千问正式发布Qwen3.7-Max ——面向智能体时代的新一代旗舰模型(闭源)
Qwen3.7-Max 致力于成为全能的智能体基座——无论是编写和调试代码、自动化办公流程,还是在跨越数百乃至数千步的长周期任务中持续自主执行,都能胜任。
Qwen3.7-Max 的核心优势在于智能体能力的广度与深度:编程方面,从前端原型开发到复杂的多文件工程均能驾驭;办公与生产力方面,通过 MCP 集成和多智能体协作实现工作流自动化;长周期自主执行方面,在一项长达 35 小时、超过 1000 次工具调用的全自主内核优化实验中保持了连贯推理,充分验证了其持久稳定的执行能力;此外,无论部署在 Claude Code、OpenClaw、Qwen Code 还是其他框架下,都能稳定发挥出色的跨框架泛化能力。
——千问
2026年5月9日
百度文心5.1 正式上线(闭源)
充分继承文心5.0 知识,显著降低预训练成本,将总参数压缩至约1/3、激活参数压缩至约1/2,仅使用业界同规模模型约6% 的预训练成本,实现同级别模型基础效果领先。 ——百度文心
2026年4月24日
深度求索DeepSeek-V4 的预览版本正式上线并同步开源。(开源)
DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本: ——DeepSeek

2026年4月23日
小米Xiaomi MiMo-V2.5 系列模型正式开启公测。(开源,采用MIT协议)
注:MiMo-V2.5为MoE稀疏混合专家架构,总参数量310B,单次推理动态激活15B参数
Xiaomi MiMo-V2.5 系列包含 MiMo-V2.5、V2.5-Pro 、V2.5-TTS Series 、V2.5-ASR。更强的推理,更稳的 Agent ,更长的上下文,更强的指令遵循与模糊指令理解,更好的全模态感知和理解 ——这是一次从“能用”到“好用”的全面跨越。 ——Xiaomi MiMo
腾讯混元Hy3 preview 语言模型发布并开源。(开源)
这是一个快慢思考融合的混合专家模型,总参数 295B,激活参数 21B,最大支持 256K 上下文长度。
Hy3 preview 是我们重建后训练的第一个模型,也是混元迄今最智能的模型,在复杂推理、指令遵循、上下文学习、代码、智能体等能力及推理性能上实现了大幅的提升。——腾讯混元
2026年4月20日
阿里千问发布Qwen3.6-Max-Preview(闭源)
相比 Qwen3.6-Plus,本次预览版带来了更强的世界知识和指令遵循能力,以及在多项基准上显著提升的智能体编程表现。作为预览版,模型仍在积极迭代中,后续版本将持续优化。
Qwen3.6-Max-Preview主要特性包括:
相比 Qwen3.6-Plus 显著提升的智能体编程能力
更强的世界知识和指令遵循
更优的真实场景智能体与知识可靠性表现
——千问
月之暗面Kimi发布并开源 Kimi K2.6 模型,带来行业领先(state-of-the-art)的代码、长程任务执行和 Agent 集群能力。(开源)
Kimi K2.6 的通用 Agent、代码、视觉理解等综合能力得到全面提升,其中在博士级难度的完整版人类最后的考试(Humanity's Last Exam)、在考察模型真实软件工程能力的 SWE-Bench Pro、评估 Agent 深度检索能力的 DeepSearchQA 等基准测试中均取得行业领先的成绩,持平或优于 GPT-5.4、Claude Opus 4.6 和 Gemini 3.1 Pro等闭源模型。 ——月之暗面Kimi
2026年4月8日
智谱开源GLM-5.1,GLM-5.1是我们迄今最智能的旗舰模型,也是目前全球最强的开源模型。(
开源,采用MIT协议开源)
注:2026年3月27日,GLM-5.1已向GLM Coding Plan全部用户(Lite/Pro/Max)开放。
整体采用GLM-MoE-DSA混合专家稀疏架构,总参数量744B,共256个路由专家加1个全局共享专家,推理时每个token动态激活8个专家,单次推理有效激活参数约40B
GLM-5.1大大提高了代码能力,在完成长程任务方面提升尤为显著。和此前分钟级交互的模型不同,它能够在一次任务中独立、持续工作超过8小时,期间自主规划、执行、自我进化,最终交付完整的工程级成果。 ——智谱
2026年4月2日
阿里千问Qwen3.6-Plus 正式上线(闭源)
该版本现已通过 API 即刻开放调用,相较于前代模型实现了全方位的能力大幅跃升。其中最引人注目的是,我们显著增强了模型的智能体(Agent)编程能力。无论是前端网页开发,还是复杂的代码仓库级问题求解,Qwen3.6-Plus 均树立了全新的业界标杆(SOTA)。此外,Qwen3.6-Plus 对世界的感知更加精准,多模态推理能力也更为敏锐。本次发布直接回应了社区在 Qwen3.5-Plus 部署期间反馈的意见,为开发者生态提供了高度稳定可靠的基础,带来真正具有变革意义的“氛围编程”(Vibe Coding)体验。
——千问
2026年3月30日
阿里全模态大模型Qwen3.5-Omni上线,支持文本,图片,音频,音视频理解。(闭源)
结构上,Qwen3.5-Omni的 Thinker与Talker 均采用 Hybrid-Attention MoE 架构。Qwen3.5-Omni 系列包含Plus, Flash, Light三种尺寸的Instruct版本,支持 256k 长上下文,模型支持超过 10 小时的音频输入及超过 400 秒的 720P (1 FPS)音视频输入。模型在海量文本、视觉以及超过 1 亿小时的音视频数据上进行原生多模态预训练,该模型展现出卓越的全模态感知与生成能力。相比Qwen3-Omni, Qwen3.5-Omni 多语言能力大大增强,能够支持113种语种和方言的语音识别和36种语种和方言的语音生成。
——千问
2026年3月19日
小米发布面向 Agent 时代的全模态基座模型 Xiaomi MiMo-V2-Omni。(开源)
MiMo-V2-Omni 专为现实世界中复杂的多模态交互与执行场景而生。我们从底层构建了融合文本、视觉、语音的全模态基座,并以统一架构将“感知”与“行动”深度绑定。这不仅打破了传统模型“重理解、轻执行”的局限,更让模型原生具备了多模态感知、工具调用、函数执行及 GUI 操作能力。MiMo-V2-Omni 可无缝接入各种 Agent 框架,实现了从理解到操控的跨越,大幅降低了全模态 Agent 的落地门槛。 ——Xiaomi MiMo
小米发布面向 Agent 时代的旗舰基座模型 Xiaomi MiMo-V2-Pro。(开源)

Xiaomi MiMo-V2-Pro 专为现实世界中高强度的 Agent 工作场景而打造。它拥有超过 1T 的总参数量(42B 激活参数),采用创新的混合注意力架构,并支持 1M 超长上下文长度。在强大的模型基座上,我们在更为广泛的 Agent 场景中持续 Scaling 算力,进一步拓展了智能的动作空间,实现了从 Coding 到 Claw 的重要泛化。 ——Xiaomi MiMo
2026年3月18日
MiniMax 稀宇科技发布MiniMax M2.7(开源,但采用限制商用的Modified-MIT协议)
MiniMax M2.7 是我们第一个模型深度参与迭代自己的模型。
M2.7 能够自行构建复杂 Agent Harness,并基于 Agent Teams、复杂 Skills、Tool Search tool 等能力,完成高度复杂的生产力任务。例如,在研发M2.7的过程中,我们基于模型构建强化学习 Harness 中的数十个复杂的 skills,更新自己的 memory,驱动模型自身的强化学习,并基于结果优化强化学习过程和 Harness,开启模型的自我进化。——MiniMax 稀宇科技
2026年2月26日
阿里千问发布Qwen3.5,并推出Qwen3.5系列的第一款模型 Qwen3.5-397B-A17B的开放权重版本。(开源,采用Apache 2.0许可)
作为原生视觉-语言模型,Qwen3.5-397B-A17B 在推理、编程、智能体能力与多模态理解等全方位基准评估中表现优异,助力开发者与企业显著提升生产力。该模型采用创新的混合架构,将线性注意力(Gated Delta Networks)与稀疏混合专家(MoE)相结合,实现出色的推理效率:总参数量达 3970 亿,每次前向传播仅激活 170 亿参数,在保持能力的同时优化速度与成本。我们还将语言与方言支持从 119 种扩展至 201 种,为全球用户提供更广泛的可用性与更完善的支持。
——千问
2026年2月14日
字节火山引擎正式发布豆包大模型2.0系列。(闭源)
围绕这些大规模生产环境下的使用需求,豆包大模型2.0(Doubao-Seed-2.0)做了系统性优化,依托高效推理、多模态理解、复杂指令执行等能力,能够更好地完成真实世界的复杂任务。
同时,豆包大模型2.0提供了灵活的模型选择:包含 Pro、Lite、Mini 三款多模态通用模型,以及面向开发者的 Code 模型(Doubao-Seed-2.0-Code),以满足不同场景下企业和用户对延迟和成本的不同需求。——火山引擎
2026年2月13日
MiniMax 稀宇科技发布MiniMax M2.5(开源)
今天,我们介绍 MiniMax M2.5:M2.5 在编程、工具调用和搜索、办公等生产力场景都达到或者刷新了行业的 SOTA,比如 SWE-Bench Verified (80.2%),Multi-SWE-Bench (51.3%),BrowseComp (76.3%);M2.5 优化了模型对复杂任务的拆解能力和思考过程中 token 的消耗,使其能更快地完成复杂的 Agentic 任务。在 SWE-Bench Verified 的测试中,M2.5 比上一个版本 M2.1 完成任务的速度快了 37%;M2.5 让无限运行复杂 Agent 在经济上可行。在每秒输出 100 token 的情况下,M2.5 连续工作一小时只需花费 1 美金;而在每秒输出 50 个 token 的情况下,只需要 0.3 美金。 ——MiniMax 稀宇科技
2026年2月12日
智谱上线并开源 GLM-5。从代码到工程,Agentic Engineering时代最好的开源模型。(开源,采用MIT协议)
在 Coding 与 Agent 能力上,取得开源 SOTA 表现,在真实编程场景的使用体感逼近 Claude Opus 4.5,擅长复杂系统工程与长程 Agent 任务。 ——智谱
2026年2月11日
科大讯飞发布发布基于全国产算力训练的星火X2大模型。(闭源)
从X1.5到X2,升级有两大亮点⭐️:
1️⃣通用能力全面升级,星火X2整体能力对标国际顶尖模型水平,在数学、推理、语言理解、智能体等能力上媲美国际最优;130+多语言综合能力继续提升,拉美、东盟等地区重点语种效果保持业界领先水平。
2️⃣依托星火X2的算法突破、行业高质量数据集以及专业思维链的强化学习,星火行业大模型持续升级,产品应用方案取得显著进步。
这次面向关键行业落地的实用化升级,标志着我国基于全国产算力训练的大模型底座在算法和工程创新方面迈入新阶段。星火X2在实现通用能力全面升级的同时,更加专注于教育、医疗、汽车、智能体等高专业性、高体验性场景,致力于为这些领域提供领先、可靠的技术方案与支撑。——科大讯飞
2026年2月6日
美团推出 LongCat-Flash-Lite(开源)
一款拥有 685 亿参数,每次推理仅激活29亿~45亿参数的轻量化 MoE 模型。通过将超过 300 亿参数高效用于嵌入层,LongCat-Flash-Lite 不仅超越了参数量等效的 MoE 基线模型,还在与同规模现有模型的对比中展现出卓越的竞争力,尤其在智能体与代码领域表现突出,并依托 YARN 技术可支持最长 256 K上下文,能高效处理长文档、大规模代码分析等场景。同时,该模型基于嵌入扩展的应用与系统级优化,让模型推理效率大幅提升,在输入 4K,输出 1k 的典型负载下,LongCat API 可提供 500-700 token/s 的生成速度。 ——美团
2026年2月2日
阶跃星辰发布开源基座模型:Step 3.5 Flash(开源)
它具备强大的推理能力与 Agent 智能,为 Agent 而生。
核心亮点如下:更快:推理速度最高 350 TPS(单请求代码类任务)更强:在 Agent 场景和数学任务上媲美闭源模型更稳:胜任复杂、长链条任务——阶跃StepFun
2026年1月27日
月之暗面Kimi发布并开源 Kimi K2.5 模型(开源。采用改良版MIT许可证)
注:MoE混合专家稀疏Transformer架构,总参数量1万亿(1T),单次推理动态激活32B参数,参数激活率仅3.2%。标准稳定无损上下文窗口256K tokens,单次默认最大输出32768 tokens,支持手动调大至65536 tokens。
它是 Kimi 迄今最智能的模型,在 Agent、代码、图像、视频及一系列通用智能任务上取得开源 state-of-the-art 表现。
也是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务。——月之暗面Kimi
2026年1月26日
阿里千问正式推出Qwen3-Max-Thinking(闭源)
通过大幅增加模型参数规模,并投入大量强化学习训练算力,Qwen3-Max-Thinking 在多个关键维度上实现了显著提升,包括事实知识、复杂推理、指令遵循、人类偏好对齐以及智能体能力。在19项权威基准测试中,其性能可媲美 GPT-5.2-Thinking、Claude-Opus-4.5 和 Gemini 3 Pro 等顶尖模型。
——千问
2026年1月22日
百度文心原生全模态大模型文心5.0正式版上线。(闭源)
参数达2.4万亿采用原生全模态统一建模技术支持文本、图像、音频、视频等多种信息的输入与输出 ——百度文心
2026年1月20日
智谱正式发布并开源GLM-4.7-Flash(开源)
GLM-4.7-Flash是一个混合思考模型,总参数量为30B,激活参数量为3B,作为同级别SOTA模型,为轻量化部署提供了一个兼顾性能与效率的新选择。 ——智谱
2026年1月16日
美团LongCat 团队正式对外发布LongCat-Flash-Thinking-2601。(开源)
▲目前只列出了2026年的大模型发布情况,如有遗漏的国内厂商发布的大模型和内容错误,欢迎大家在评论区指出。作为已发布的 LongCat-Flash-Thinking 模型的升级版,LongCat-Flash-Thinking-2601在Agentic Search(智能体搜索)、Agentic Tool Use(智能体工具调用)、TIR(工具交互推理)等核心评测基准上,均达到开源模型 SOTA 水平。该模型尤其在工具调用上表现出卓越的泛化能力,在依赖工具调用的随机复杂任务中性能超越了 Claude,可大幅度降低真实场景下新工具的适配训练成本;同时它是首个完整开源并支持在线免费体验「重思考模式」的模型,同时启动 8 个大脑飞速运转,确保思考周全、决策可靠。 ——美团LongCat
夜雨聆风