乐于分享
好东西不私藏

8月16日 AI 速报:Qwen 下载量破 30 亿,本地化从发布走向普及

8月16日 AI 速报:Qwen 下载量破 30 亿,本地化从发布走向普及

8月16日 AI 速报:Qwen 下载量破 30 亿,本地化从发布走向普及

今天的主题词是"被用起来":Qwen 开放模型下载量突破 30 亿、3.8-27B 登顶 Hugging Face 趋势榜;DeepSeek 侧,社区长程实测给 V4-Pro 挑出停止控制的硬伤,Harness 生态则在另一条线上继续补位。商业侧,Anthropic 季度营收传闻冲上 115 亿美元。

DeepSeek 动态

V4-Pro 长程实测:停止控制是硬伤
18 轮、1 亿 token 的社区测试里,V4-Pro 仅 3 次主动结束生成。作者直言这种停止控制问题"无法靠脚手架修复",只能等模型自身迭代——再强的 Harness 也救不了不肯停嘴的模型 [1][2]

Harness 生态继续补位
DSH 消息面板新增编辑、删除、插话、排序与清空,误删可 10 秒撤销 [3];插件站汇总识图、文件引用等常用插件并给出一键安装命令 [4][5];colleague-skill 可生成定制 Skill,OpenBiliClaw 把 B 站场景接进 DSH [6][7];另有开发者正做界面美化插件,并打算封装成客户端 [8]

模型战场

Qwen:生态位彻底坐实
开放模型累计下载突破 30 亿次,3.8-27B 登顶 Hugging Face 趋势榜 [9][10]。官方随后放出 8bit 到 1bit 的动态量化 GGUF,进一步拉低笔记本部署门槛 [11],有用户称它配 DeepSeek Harness 跑编码代理是"试过最好的组合" [12]。实测面:35 项一次生成任务较前代有提升;FP8 去拒答版把拒答率从 64%-99% 压到 0%-6%,跑分波动小于 1.3 分 [13]。代价是 extra high 推理下明显过度思考、容易扩大任务范围,连 Simon Willison 都提醒这会影响实际使用 [14]

其他厂商与前沿

  • • Anthropic 季度营收被曝达 115 亿美元、同比增长约 1400%,系媒体口径,待官方确认 [15]
  • • MiniMax H3 与 Magnific 现场演示商业片与音乐视频工作流,2K 生成限时五折 [16]
  • • Gemma 4 E4B:张量级量化分配让同显存推理指标从 28.9 提到 69.5 [17];Kimi-K3 文本模型进入 llama.cpp 支持队列 [18]
  • • 研究侧:论文称推理 RL 只改变约 1%-3% 的 token、可用约千分之一算力复现收益,结论待独立核验 [19];类 Genie 世界模型在单张 RTX 5090 上跑到 720p/16FPS [20]

工具生态

  • • LlamaParse 推出 agentic plus 提取器,可处理百至五百页文档、提取十万级字段,FTX 文档实测 114 页挖出 7.5 万个字段 [21][22]
  • • xAI CodePilot 接入 Grok 4.6、DeepSeek V4 Pro 与 GLM 5.3,并支持 Grok 图像视频与 Twitter 检索 [23]
  • • Browser Use 放出可操作任意网站的真实场景演示 [24];Simon Willison 的 CORS Chat 可测 OpenAI 兼容端点,顺手验证了本地 Qwen [25]
  • • GitMCP 把仓库转成 MCP 服务,让编码 Agent 直接检索 CAD 文档 [26];AGENTCODI 尝试把 Codex 工作流搬上 Android [27]
  • • 行业侧:a16z 数据显示 AI 支出前 1% 的企业投入是中位数的 600 倍以上,采用分化加剧 [28];大模型把字幕翻译初稿从数天压到数分钟,译者群体首当其冲

一句话总结

开源模型的分水岭正从"谁能发"移到"谁能被用起来":Qwen 用 30 亿下载量宣告本地生态进入普及期,DeepSeek 一边被实测挑出停止控制硬伤、一边靠 Harness 生态在工程侧补课——模型本身与工程配套,已是同一场竞赛的两条赛道。

引用链接

[1] : https://x.com/karminski3/status/2088856655534624783
[2] : https://x.com/karminski3/status/2088856968626880647
[3] : https://x.com/geekbb/status/2088787826246877352
[4] : https://x.com/vista8/status/2088815051826491754
[5] : https://x.com/vista8/status/2088815337815056885
[6] : https://x.com/vista8/status/2088857787757429133
[7] : https://x.com/vista8/status/2088882885394649325
[8] : https://x.com/op7418/status/2088919845236859288
[9] : https://x.com/Alibaba_Qwen/status/2088876951041941792
[10] : https://x.com/Alibaba_Qwen/status/2088881015855182122
[11] : https://x.com/Alibaba_Qwen/status/2088891548507492646
[12] : https://www.reddit.com/r/LocalLLaMA/comments/1vpv12b/qwen_38_27b_with_dshdeepseek_harness_is_amazing/
[13] : https://www.reddit.com/r/LocalLLaMA/comments/1vppox6/qwen3827b_abliterated_fp8_refusal_6499_06_and/
[14] : https://x.com/simonw/status/2088646238933840153
[15] : https://www.qbitai.com/2026/08/473947.html
[16] : https://x.com/MiniMax_AI/status/2088558801909866526
[17] : https://www.reddit.com/r/LocalLLaMA/comments/1vp2x49/gemma_4_e4b_iq2_xxs_14054_reasoning_performance/
[18] : https://www.reddit.com/r/LocalLLaMA/comments/1vp6haw/model_add_kimik3_text_model_by_pwilkin_pull/
[19] : https://www.reddit.com/r/LocalLLaMA/comments/1vpuhh1/paper_claims_rl_for_reasoning_only_changes_13_of/
[20] : https://www.reddit.com/r/LocalLLaMA/comments/1vpujkc/geniestyle_playable_world_model_running_720p_at/
[21] : https://x.com/jerryjliu0/status/2088759243365044618
[22] : https://x.com/jerryjliu0/status/2088733158766501952
[23] : https://x.com/op7418/status/2088917575342461115
[24] : https://x.com/browser_use/status/2088680611561263539
[25] : https://simonwillison.net/2026/Aug/15/cors-chat/
[26] : https://juejin.cn/post/7673875524200808494
[27] : https://www.reddit.com/r/OpenAI/comments/1vp4har/agentcodi_bringing_the_codex_workflow_directly_to/
[28] : https://x.com/a16z/status/2088658228959953052