ARTICLE · 1084726
AI大模型产业最新动态:十大热点新闻与解读 -2026年9月27日
“ 模达卓越,智启未来”

www.modatech.com.cn / www.modatech.cn

“ 模达卓越,智启未来”
模达科技
www.modatech.com.cn / www.modatech.cn

国内外大模型发展如火如荼,近期有哪些值得关注的新闻?一起看看吧!
国际篇
INTERNATIONAL NEWS
Anthropic上线Claude Opus 5.5 ,任务成本大降40%
9月23日,积极筹备上市的美国AI初创公司Anthropic发布新AI模型Claude Opus5.5,据称在大多数工作中的性能与Fable 5.1类似,但可以更低的成本处理各种企业任务。
定价方面,Opus 5.5每百万输入token收费为4美元,每百万输出token收费则为20美元。
Opus 5.5的生成结果速度快于Opus 5,文字表达更加清晰。
Anthropic表示,Opus 5.5在发布前已由包括METR和Frontier Design在内的外部公司进行测试。该公司还实施了类似于Fable模型的安全措施,旨在限制风险较高的网络安全和生物学用途。
据彭博报道,Anthropic计划在未来几周内继续扩充5.5系列,推出新版Claude Sonnet和Haiku。
Anthropic行政总裁Dario Amodei早前表示,公司将实施新的安全措施,包括引入第三方评估机构。

SpaceXAI最强模型Grok 4.7上线:价格只有旗舰一半
9月22日,SpaceXAI推出最强模型Grok4.7。发布页开头只有一句极具“攻击性”的定位:面向编程与知识工作的最强模型,速度达可比模型两倍,价格仅一半。这次升级没有停留在跑分表上——Grok4.7换用更大的基础模型,强化长时间任务、自我检查和长上下文管理,并把文档、演示、法律、医疗和工程等专业工作纳入重点测试,目标是让模型在持续数小时的任务里少走弯路、交出可直接使用的结果。
马斯克发推称,Grok4.7在智能水平、运行速度和成本之间取得了“很有竞争力的平衡”。

图源:网络
编程平台Bitrig支持iPhone Duo:交互式3D模拟器可折叠、旋转测应用
AI编程平台Bitrig宣布支持iPhone Duo应用开发,提供交互式3D模拟器以测试不同使用场景下的应用表现,同时支持管理多个Xcode版本,提升开发效率。

图源:网络
谷歌发布Gemini 3.8 Flash TTS:支持自然语言定制声音
语音合成技术正在迎来前所未有的精细化时代。当地时间9月23日,谷歌正式宣布推出Gemini3.8Flash TTS和 Gemini3.8Flash-Lite TTS两款全新的文本转语音模型,全面满足开发者和创作者在个性化角色配音以及大规模音频生成上的多元需求。
在产品定位与核心功能上,两款模型各有侧重。其中,Gemini3.8Flash TTS主要面向声音和角色设计,支持用户通过直观的自然语言描述来创建定制化声音,并能够逐句精准控制语气、语速以及口音等核心要素。此外,该模型还支持基于短短30秒的音频样本进行高效的声音复刻。而另一款 Gemini3.8Flash-Lite TTS则专注于大规模音频生成和高效配音场景。
在生态与多语言支持方面,谷歌官方表示,这两款全新模型全面支持超过100种语言和方言,并且开箱即用地产出了2000多种现成声音,为全球范围内的语音应用开发与内容创作提供了强有力的底层算力支撑。

OpenAI推出GPT-6 Sol和Luna:API价格大降50%
OpenAI9月23日发布GPT-6系列的最新成员——GPT-6 Sol和GPT-6 Luna。两款模型采用与GPT-6 Astra类似的训练方法,把Astra在专业工作、事实性、编码、计算机使用和对齐等方面的最先进性能,带入更快、更经济的模型。OpenAI也强调,GPT-6 Astra仍是其整体最优秀的模型,追求无妥协体验仍应首选它。
价格砍半,成本最低不到竞品一成
GPT-6 Sol和Luna的 API价格相比 GPT-5.6促销价降低50%。更值得注意的是单任务成本:在AutomationBench跨应用业务流程测试中,GPT-6 Sol在xhigh强度下表现优于Claude Opus 5,成本却仅为Opus 5每任务成本的9%;同一测试high强度下,GPT-6 Luna较前代提升5.4%,每项任务成本降低58%。
评估智能体的Last Exam测试中,GPT-6 Sol在max effort状态下得分 56.4%,高于Claude Opus 5在该评估中的最高分,每任务成本还降低 60%。事实可靠性同样进步:GPT-6 Sol的错误率约为前代的一半,接近 Astra 级可靠性且成本更低;Luna的事实可靠性也大幅提升。
性能逼近旗舰,长任务更省
编程方面,两款模型均针对AI Coding Agent工作负载优化。FrontierCode 1.1 Main测试中,GPT-6 Sol较GPT-5.6 Sol明显提升,并以更低成本达到Claude Fable 5.1 xhigh相当水平。DeepSWE v1.1软件工程测试里,GPT-6 Sol在max effort下取得68.8%,距 Claude Fable 5的最高成绩69.9%仅差1.1个百分点,单任务成本却低约 80%;GPT-6 Luna在max effort下为66.6%,表现接近Opus 5与 Fable 5的medium effort,单任务成本分别低约93%和96%。
计算机操作上,Astra仍是 OpenAI最强,但Sol和Luna能以更低成本完成相关任务。OSWorld 2.0 offline测试中,GPT-6 Sol在xhigh effort下取得60.5%,与Claude Opus 5 medium effort的60.3% 接近,单任务成本低约80%;Luna的max effort超GPT-5.6 Sol medium effort,成本约为后者十分之一。
OpenAI还将Astra改进后的沟通风格带到Sol和Luna,称新模型在技术与编程对话中更清晰、用更少术语与奇怪措辞、压缩低价值细节且不失实质。同时,官方改进了GPT-6提示缓存,默认提供更高缓存命中率,帮助智能体重用更多上下文、加快响应;价值对齐上,两款模型较GPT-5.6有所改进,编码工作的误导性声明发生率降低。
自今日起,GPT-6 Sol和Luna已在ChatGPT Work与Codex中向所有 Plus、Pro、Business、Enterprise和Edu用户开放,免费及Go用户可在桌面应用使用 Luna;API中分别以gpt-6-sol与gpt-6-luna提供,目前尚未在Chat中上线。

图源:网络

国内篇
DOMESTIC NEWS
通义千问开源Qwen-Image-2.1:7B参数实现文生图与图像编辑一体化
9月21日,通义千问团队正式开源新一代图像模型 Qwen-Image-2.1。该模型以仅7B参数的轻量视觉生成模块,将文生图、透明图像生成与多种图像编辑能力整合于同一框架,在生成效果、推理效率与使用成本之间取得了新的平衡。
据官方介绍,Qwen-Image-2.1的视觉生成部分采用32层 Single-Stream DiT 结构,参数量仅为7B。通过混合粒度注意力结构与KV Cache复用机制,模型在多图输入场景下的推理效率显著提升,显存开销也得到有效控制。
透明图像生成是本次更新的核心亮点之一。模型能够根据提示词自动判断输出普通图像或带透明通道的RGBA图像,并支持在保留透明背景的前提下进行主体表情修改、文字编辑等操作。用户还可输入真实照片,由模型自动提取主体并输出透明图层,方便后续设计与合成。
在图像编辑方面,Qwen-Image-2.1支持最多10张参考图输入,可综合多个主体与素材生成协调画面。局部编辑支持圈选、涂抹和独立掩码三种方式,编辑区域指定更加灵活。模型还重点提升了人像与商品的一致性——修图后人物面部特征、商品文字与形态均能保持高度还原。
此外,模型在文字渲染、人物光影与细节刻画上也有明显提升,覆盖全景图、信息图、分镜图等多种任务场景。目前,Qwen-Image-2.1已同步在GitHub、ModelScope和Hugging Face等平台开源,供开发者与创作者免费使用。

月之暗面推出Kimi Code桌面版:Plan、目标、Swarm三种模式齐发
月之暗面把Kimi Code从命令行里拽了出来。日前其宣布,人工智能编码工具Kimi Code正式推出桌面版,作为CLI版的官方桌面客户端,将原本以命令行形式提供的AI编程能力搬进图形界面。开发者只需通过对话,就能让智能体阅读代码、修改文件、运行命令,并持续啃下复杂的开发任务。
桌面版按工作区来管理项目和会话,新建会话后选定本地项目文件夹就能开工。智能体会主动分析代码结构、编辑文件、执行构建与测试命令,再根据跑出来的结果回头调整方案。针对不同任务,它准备了多档工作模式:Plan模式先吃透需求、生成执行计划,等用户点头再动手改代码;目标模式适合需要多轮推进、持续检查的长期目标;Swarm模式则把独立任务拆开,调度多个子智能体并行处理;还有一个实验性的多智能体协作模式,专门对付规模更大的工程项目。界面上会实时展示智能体的工具调用、执行进度和文件变更,开发者可以直接点开对话里提到的文件、查看代码差异,还能用标签页、搜索、置顶和批量管理来归置多个项目会话。
把终端、浏览器和Git收进同一个窗口,是桌面版最实在的体贴。内置终端能直接跑项目、做测试、跑格式检查和调试;右侧面板可按文件或修改轮次审计差异,顺手预览MD、JSON、HTML等文件。面向前端开发,内置浏览器能预览网页、验证交互、查找资料,还能对网页元素或屏幕区域做标注,把截图加文字评论直接甩给智能体,帮它精准定位页面错位、样式问题和报错。在Git项目里,桌面版能看清当前分支、领先与落后状态、文件变化和关联PR信息,让修改、测试、审阅到合并形成一条不断线的流程。
值得一提的是,Kimi Code的CLI版是以开源形式发布的,但这次的桌面版并未开源,月之暗面在发布内容里也没有提及未来是否会开放桌面版的源代码。对于想本地把玩底层实现的开发者来说,这扇门暂时还关着。

阿里云发布Qwen Book:AI智能体电脑正式亮相
2026云栖大会上,阿里云正式发布AI智能体电脑Qwen Book,主打自主理解用户意图、持续学习与长期任务执行。产品搭载Skill键盘阵列、全局AI按键、语音手写笔等交互入口,并提供支持7×24小时运行重度任务的操作空间,针对传统AI办公中跨应用、跨Agent协同效率不足的问题进行优化。
Qwen Book基于“OS as Harness”理念,以千问端云模型为核心,深度融合操作系统、应用、云服务与硬件能力,统一管理交互入口、运行时环境、个人持续上下文以及软硬件操控能力,构建可理解、可记忆、可持续运行和可治理的Agent计算环境。阿里云研发副总裁、终端智能计算事业部总裁张献涛表示,希望Qwen Book从硬件工具进一步演变为Token驱动、持续成长的智能体载体,推动个人智能向RSI演进。
生态方面,Qwen Book已与高通、英特尔、罗技、绿联等伙伴完成适配,并打通支付宝、千问输入法等阿里系应用,同时开放系统接口和能力接入。大会期间,Qwen Book还宣布与开源项目Omarchy合作,共同探索面向Agent的新一代桌面操作系统。

腾讯推出“Hy翻译”App,支持33种语言及离线翻译,主攻出境游场景
9月24日,腾讯正式推出全新翻译产品“Hy翻译”App,定位为“一站式翻译助手”,主攻出境旅游、商务交流等场景。目前该应用已在美国、日本、韩国、东南亚等多个国家和地区上线。
据介绍,“Hy翻译”支持33种主流语言的互译,并覆盖藏语、维吾尔语、蒙古语、哈萨克语、朝鲜语5种少数民族语言及方言。功能层面,App提供语音翻译、拍照翻译、对话翻译和离线翻译等多种模式,满足用户在无网络环境下的使用需求。
值得一提的是,“Hy翻译”支持翻译风格切换,用户可根据场景选择“学术论文”“日常口语”“商业正式”等不同翻译风格,提升翻译的准确性和自然度。此外,该应用还同步推出了微信小程序、PC客户端及浏览器插件版本。

小米发布并开源MiMo-V2.6:AA智能指数46分登顶最强开源模型
小米发布了MiMo-V2.6系列模型,包括Pro与Flash版本,技术报告和权重已通过HuggingFace全面开源。该系列模型在递归自我改进路径上取得了关键进展,训练成本较高但性能显著提升。在AA智能指数中,MiMo-V2.6-Pro取得46分,成为当前最强开源模型,同时开放了7k+高质量RL任务环境和端到端训练框架。

图源:网络
>>>>>>END<<<<<<
模达科技AI前沿,与您一起见证智能科技的蓬勃发展!
文章仅代表我司观点,请您甄别借鉴。


模达科技公众号
微信号 : modatechsub
扫码关注我们。