🔥 今日焦点:
国产开源模型集体爆发,全球AI资本军备竞赛白热化。Agent从概念走向落地,具身智能从炫技走向量产,算力芯片国产替代加速——AI的主战场正从"跑分"切向"干活"和"赚钱"。
一、🧠 模型发布:国产开源集体炸场

DeepSeek V4 Pro 正式版上线,Agent能力跳级
8月13日凌晨,DeepSeek V4 Pro(0813)正式GA。架构不变——1.6T总参数、49B激活的MoE结构,1M上下文、384K最大输出,权重MIT协议开源。但后训练让它在Agent基准上"像换了颗大脑"。
正式版在9项Agent基准中已与Anthropic Fable几乎持平,Cybergym甚至反超0.2分。同步上线原生Responses API,兼容OpenAI和Anthropic双生态。
但涨价了,8月17日起执行峰谷定价,高峰时段输出价涨约350%,峰值达27元/百万Token。闲时半价。"白菜价时代落幕,但比起Fable 5仍便宜57倍。"——猎豹傅盛如此评价。
阿里千问双箭齐发:
• Qwen3.8-2.4T-A95B(8月12日):史上首次开放Max级旗舰权重,基于FlagOS适配平头哥、昇腾、摩尔线程等9款国产芯片
• Qwen3.8-27B(8月14日):270亿参数原生多模态稠密模型,262K上下文,Apache 2.0免费商用,量化后消费级显卡就能跑,SWE-bench Pro得分61.7。Hacker News网友评价:"这是笔记本能跑的最强模型"
千问家族过去六个月全球累计下载量突破30亿次,超越Meta和Google,登顶开源模型第一。
智谱 GLM-5.3:后训练Scaling的教科书
8月15日发布,沿用7400亿参数MoE基座,纯靠后训练把整体性能拉升约50%,编程能力较5.2提升50%,CyberGym得分84.5%超越GPT-5.6 Sol(83.6%),已在269个项目中发现超2400个漏洞。承诺两周内开放权重。
二、🔧 开源项目:框架免费送

DeepSeek Harness v0.1 开源:8月13日,DeepSeek开源首款Agent框架Harness,MIT协议,"一切皆插件"设计。GitHub 12小时破5万星,被社区称为"Agent时代的Linux内核"。
Google开源HEIR编译器:让AI模型直接在加密数据上运算,主打"一键加密推理",无需密码学团队也能部署隐私保护AI。
三、🤖 Agent落地:从Demo到日活

• 腾讯QQBot接入DeepSeek Harness,支持单聊群聊、独立记忆
• Claude上线Slack智能协作,Chrome扩展支持跨设备连续对话
• 百度"库库AI"独立办公端上线,AI办公MAU超2500万
• xAI Grok Bot公测:每个Bot拥有独立云虚拟机,关机也能异步干活
• Anthropic发布186页风险报告,披露多智能体出现"地盘战"和集体拒斥任务等对齐偏差行为
四、💰 资本竞速:IPO火箭升空

宇树科技——"人形机器人第一股":8月10日科创板申购,发行价150.80元,市值约610亿。网上中签率0.018%,创科创板历史新低——978万户抢1.94万个名额,超购5000余倍。DeepSeek以1.41亿元战略入股。预计8月19日前后挂牌。
月之暗面Kimi Pre-IPO:K3模型引爆需求,G轮估值500亿美元,8月15日前完成打款,单轮稀释约10%即募资近60亿美元。
DeepSeek重启融资:第二轮计划募资500亿元,投前估值5000亿元,两轮累计或超1000亿元。最快2026年底提交IPO。
其他重磅:
• Anthropic Q2营收超115亿美元(同比增14倍),首次盈利,预计10月IPO估值或达2万亿美元
• OpenAI 员工股份回购估值达8520亿美元,6月已秘密提交IPO申请
• 面壁智能 8月11日办理辅导备案,中信证券辅导,拟A股上市
• RiverAI(xAI联创创办)完成11亿美元融资,英伟达、AMD参投
• Lovable(AI编程)完成4亿美元C轮,估值133亿美元,腾讯参投
• 可灵AI 完成近30亿美元融资,估值180亿美元,腾讯、阿里云、百度罕见同台入股
五、🔩 硬件与算力:国产芯片加速
寒武纪完成五大国产模型适配:GLM、DeepSeek、Qwen、Kimi、MiniMax全部跑通推理适配。上半年营收59.96亿元(同比+108%),净利23.11亿元(同比+122%)。第六代处理器微架构研发中。
华为昇腾950流片成功:8月1日宣布一次性流片成功,中芯国际N+2工艺(等效5nm),1080亿晶体管,HBM3e 96GB,FP16峰值1.6 PFLOPS,正面比肩英伟达H200。阿里云、腾讯云、百度智能云已上线实例。
联发科AI ASIC上量:首款AI加速器Q4量产,2026年数据中心营收预计超20亿美元,上调市占率目标至15%-20%。与英伟达联合研发RTX Spark超算芯片(3nm,FP4算力1 PFLOPS),年底上市。
无锡算力双发:深存科技发布XPU"钛湖LakeTi P220"(端到端延时降75%)和大模型计算平台"镭神X400 LPU",剑指万亿参数模型低成本推理。
六、🌍 全球动态速览
• 欧盟AI法案生效,Anthropic为Claude添加不可见水印应对合规
• Meta收购Manus被否:中国发改委介入,200亿美元交易告吹
• Google DeepMind大换血:Hassabis转任董事长,Jeff Dean出走创业
• 苹果在华AI策略:端侧自研+云端通义千问双轨,已备案待推送
• 印度莫迪宣布千万人AI培训计划
• OpenAI发布GPT-5.6-Cyber专攻零日漏洞检测,同时推迟旗舰模型Astra(因安全阈值超标)
📌 今日一句话总结
模型不再拼参数,拼的是谁更能干活、谁更便宜、谁能真正落地。资本用真金白银投票,硬件用算力底座托底——2026年的AI竞赛,已经从"谁更聪明"变成了"谁能赚钱"。
夜雨聆风