8月16日 AI 速报:Qwen 下载量破 30 亿,本地化从发布走向普及
今天的主题词是"被用起来":Qwen 开放模型下载量突破 30 亿、3.8-27B 登顶 Hugging Face 趋势榜;DeepSeek 侧,社区长程实测给 V4-Pro 挑出停止控制的硬伤,Harness 生态则在另一条线上继续补位。商业侧,Anthropic 季度营收传闻冲上 115 亿美元。
DeepSeek 动态
V4-Pro 长程实测:停止控制是硬伤
18 轮、1 亿 token 的社区测试里,V4-Pro 仅 3 次主动结束生成。作者直言这种停止控制问题"无法靠脚手架修复",只能等模型自身迭代——再强的 Harness 也救不了不肯停嘴的模型 [1][2]。
Harness 生态继续补位
DSH 消息面板新增编辑、删除、插话、排序与清空,误删可 10 秒撤销 [3];插件站汇总识图、文件引用等常用插件并给出一键安装命令 [4][5];colleague-skill 可生成定制 Skill,OpenBiliClaw 把 B 站场景接进 DSH [6][7];另有开发者正做界面美化插件,并打算封装成客户端 [8]。
模型战场
Qwen:生态位彻底坐实
开放模型累计下载突破 30 亿次,3.8-27B 登顶 Hugging Face 趋势榜 [9][10]。官方随后放出 8bit 到 1bit 的动态量化 GGUF,进一步拉低笔记本部署门槛 [11],有用户称它配 DeepSeek Harness 跑编码代理是"试过最好的组合" [12]。实测面:35 项一次生成任务较前代有提升;FP8 去拒答版把拒答率从 64%-99% 压到 0%-6%,跑分波动小于 1.3 分 [13]。代价是 extra high 推理下明显过度思考、容易扩大任务范围,连 Simon Willison 都提醒这会影响实际使用 [14]。
其他厂商与前沿
• Anthropic 季度营收被曝达 115 亿美元、同比增长约 1400%,系媒体口径,待官方确认 [15] • MiniMax H3 与 Magnific 现场演示商业片与音乐视频工作流,2K 生成限时五折 [16] • Gemma 4 E4B:张量级量化分配让同显存推理指标从 28.9 提到 69.5 [17];Kimi-K3 文本模型进入 llama.cpp 支持队列 [18] • 研究侧:论文称推理 RL 只改变约 1%-3% 的 token、可用约千分之一算力复现收益,结论待独立核验 [19];类 Genie 世界模型在单张 RTX 5090 上跑到 720p/16FPS [20]
工具生态
• LlamaParse 推出 agentic plus 提取器,可处理百至五百页文档、提取十万级字段,FTX 文档实测 114 页挖出 7.5 万个字段 [21][22] • xAI CodePilot 接入 Grok 4.6、DeepSeek V4 Pro 与 GLM 5.3,并支持 Grok 图像视频与 Twitter 检索 [23] • Browser Use 放出可操作任意网站的真实场景演示 [24];Simon Willison 的 CORS Chat 可测 OpenAI 兼容端点,顺手验证了本地 Qwen [25] • GitMCP 把仓库转成 MCP 服务,让编码 Agent 直接检索 CAD 文档 [26];AGENTCODI 尝试把 Codex 工作流搬上 Android [27] • 行业侧:a16z 数据显示 AI 支出前 1% 的企业投入是中位数的 600 倍以上,采用分化加剧 [28];大模型把字幕翻译初稿从数天压到数分钟,译者群体首当其冲
一句话总结
开源模型的分水岭正从"谁能发"移到"谁能被用起来":Qwen 用 30 亿下载量宣告本地生态进入普及期,DeepSeek 一边被实测挑出停止控制硬伤、一边靠 Harness 生态在工程侧补课——模型本身与工程配套,已是同一场竞赛的两条赛道。
引用链接
[1] : https://x.com/karminski3/status/2088856655534624783[2] : https://x.com/karminski3/status/2088856968626880647[3] : https://x.com/geekbb/status/2088787826246877352[4] : https://x.com/vista8/status/2088815051826491754[5] : https://x.com/vista8/status/2088815337815056885[6] : https://x.com/vista8/status/2088857787757429133[7] : https://x.com/vista8/status/2088882885394649325[8] : https://x.com/op7418/status/2088919845236859288[9] : https://x.com/Alibaba_Qwen/status/2088876951041941792[10] : https://x.com/Alibaba_Qwen/status/2088881015855182122[11] : https://x.com/Alibaba_Qwen/status/2088891548507492646[12] : https://www.reddit.com/r/LocalLLaMA/comments/1vpv12b/qwen_38_27b_with_dshdeepseek_harness_is_amazing/[13] : https://www.reddit.com/r/LocalLLaMA/comments/1vppox6/qwen3827b_abliterated_fp8_refusal_6499_06_and/[14] : https://x.com/simonw/status/2088646238933840153[15] : https://www.qbitai.com/2026/08/473947.html[16] : https://x.com/MiniMax_AI/status/2088558801909866526[17] : https://www.reddit.com/r/LocalLLaMA/comments/1vp2x49/gemma_4_e4b_iq2_xxs_14054_reasoning_performance/[18] : https://www.reddit.com/r/LocalLLaMA/comments/1vp6haw/model_add_kimik3_text_model_by_pwilkin_pull/[19] : https://www.reddit.com/r/LocalLLaMA/comments/1vpuhh1/paper_claims_rl_for_reasoning_only_changes_13_of/[20] : https://www.reddit.com/r/LocalLLaMA/comments/1vpujkc/geniestyle_playable_world_model_running_720p_at/[21] : https://x.com/jerryjliu0/status/2088759243365044618[22] : https://x.com/jerryjliu0/status/2088733158766501952[23] : https://x.com/op7418/status/2088917575342461115[24] : https://x.com/browser_use/status/2088680611561263539[25] : https://simonwillison.net/2026/Aug/15/cors-chat/[26] : https://juejin.cn/post/7673875524200808494[27] : https://www.reddit.com/r/OpenAI/comments/1vp4har/agentcodi_bringing_the_codex_workflow_directly_to/[28] : https://x.com/a16z/status/2088658228959953052
夜雨聆风