乐于分享
好东西不私藏

2026年7月4日 AI前沿资讯日报

2026年7月4日 AI前沿资讯日报
2026年7月4日 AI前沿资讯日报
今日亮点
• 阿里巴巴全面禁用 Claude 引爆社区,一篇阿里员工长文获大量关注成为全站热门内容;Anthropic 同步升级封堵中国访问通道,FT 独家报道佐证。
Fable 5 将于 7 月 7 日从订阅中移出改为按量计费,产品经理承诺容量允许后恢复。
Meta 内部确认下一代模型“西瓜”基准测试追平 GPT-5.5
 豆包和千问同日宣布 7 月 15 日下架智能体服务;
 腾讯云页面意外泄露 DeepSeek V4 正式版早在 5-6 月已训练完成。
新内容
一、重大行业事件
1. 阿里禁用 Claude 与 Anthropic 封堵中国访问
阿里巴巴内部于 7 月 3 日宣布全面禁用 Claude。全员被要求卸载 Anthropic 相关产品,包括 SonnetOpusFable 等多个系列模型以及 Claude Code 在内的 Agent 产品,禁令于 7 月 10 日正式生效。据凤凰网科技报道,阿里内部回应称原因是近期 Claude Code 被曝存在植入后门的安全风险,经综合评估后将其列入高风险软件名单,并推荐使用自研 Qoder 作为替代方案。
一篇阿里员工的长文《写在阿里全面禁用 Claude Code 之际,A/ 终将反噬其身》获得大量关注,成为社区现象级热门内容。作者以利益相关人身份表示,公司内部观点以反对卸载居多,很多人不理解为何如此粗暴强硬。但作者旗帜鲜明地支持公司决定,引用了 GitHub 上关于 Opus 4.8 fabricates user messages 的 BUG 报告,认为 Anthropic 存在窃取用户工作流和代码数据的行为。社区高赞回复指出“Anthropic 一直都在偷东西,偷 OpenAI、偷 Figma、偷一堆工作流”,也有用户表示“不用但希望它活着,给点压力,不要让 OpenAI 一家独大”,还有人调侃“阿里员工都在用 Claude Code,那 Qwen 谁来用?”。
二、重大模型与平台更新
2. Fable 5 订阅变更:7 月 7 日移出订阅改为用量计费
Anthropic 计划于 7 月 7 日后将 Claude Fable 5 从现有订阅中移除。据 IT 之家转述 bleepingcomputer 报道,由于需求极高且难以预测,Anthropic 将 Fable 5 转为基于使用量的计费模式。在 7 月 7 日前,ProMaxTeam 和部分 Enterprise 订阅用户使用 Fable 5 最高占每周使用限额的 50%。
Claude Code 产品经理 Thariq 在 X 上回应社区关切:虽然 Fable 5 将暂时从订阅中移除,但团队计划在容量允许时尽快将其恢复为订阅的标准组成部分。社区解读这一表态为“取决于竞争对手——如果 GPT-5.6 跟 Opus 4.8 一样拉,就不会给订阅用户;如果 5.6 赶上 Fable 5,第二天就回归”。
4. DeepSeek V4 正式版训练完成泄露
有用户发现腾讯云 tokenhub 公告页面(cloud.tencent.com/announce/detail/2353)透露了 DeepSeek V4 正式版和 DeepSeek-V4-Flash 的定价/配额信息,从模型命名 ID 可以判断正式版早在 5-6 月就已训练完成。社区预计 7 月中旬可能正式推出,猜测目前延迟发布是在优化基础设施以应对高并发压力。
5. 字节 Seedance 2.5 视频生成模型即将上线
据消息,字节豆包视频生成模型 Seedance 2.5 预计 7 月 6 日上线体验中心,一周后开放 API。该模型发布于 6 月 23 日,目前处于全球企业内测阶段。据介绍,Seedance 2.5 在三个维度实现突破:支持 30 秒单段原生直出与高质量延长;支持 50 个全模态素材联合输入;支持更灵活的视频二次编辑,保持画面一致性的同时完成局部调整。
6. OpenAI Codex 配套键盘即将发布
OpenAI 将于 7 月 15 日发布 Codex 配套键盘——由 Work Louder 联名的 Creator Micro 2,宣传语为“Wireless, playfully tactile and just capable as you”。产品宣传图展示了两台无线紧凑型键盘。社区对此反应热烈,有用户回复了之前 OpenAI 键盘的预告截图感叹“要成真了吗”。
7. NVIDIA 免费上线 GLM-5.2 API
NVIDIANIM 平台悄然上架了智谱 GLM-5.2 模型的免费 API。GLM-5.2 是 Z-ai 的旗舰 LLM,面向 agentic workflows、coding 和 long-horizon reasoning 任务。社区用户第一时间测试发现速度极快,将 Claude Desktop 里的 GLM-5.1 改为 5.2 即可直接使用。有用户测试发现日本服务器调用成功率比美东高,上下文窗口约 170K tokens。社区建议在 Claude Code/OpenCode 中配置 context: 170000 以避免超限后返回空内容。
8. Claude Pro 5hr 额度升至 $40
有用户通过计算 Total cost / Current session 发现 Claude Pro 的 5 小时限额已从之前的 $30 提升到 $40。上个月底观察到变为 $30,而最新数据确认已达 $40。但社区同时注意到 Fable 5 即将从订阅中移除,周限额可能面临缩减。
三、开源项目与工具
9. Fable 5 + Codex 多模型协作 Skill
一个新发布的 Skill 解决了社区高频需求:让 Fable 5 规划、Codex 执行的协作流程自动化。用户只需先和 Codex 说清楚要解决的问题,然后调用该 Skill 即可生成一串任务 brief,告诉 Fable 5 应该把什么类型的任务委派给 Codex。核心理念是把 Fable 5 从脏活累活中解脱出来,专注于需要高级推理的任务。社区反馈已有用户将其改造为委托给 Pi Agent 的版本。
10. Claude Science 开源平替与代理方案
两个独立项目围绕 Claude Science 构建开源生态。Open Science(ai4s-research/open-science)是 MIT 开源平替,作者因多个 Anthropic 账号被封且不退款,怒而用仅剩的 Fable 5 账号全力复刻了 Claude Science 的功能。AIUsage 则在 0.13.0 版本中新增了 Claude Science 代理功能,支持免登录使用并接入任意第三方 API,包含仪表盘、订阅账号管理、多种代理模式等功能。
11. AI 接码短信转发固件
一位开发者为解决 Codex 二次验证和海外平台注册需求,二开了一个适配 giffgaff 卡的短信转发固件。项目基于 ESP32 硬件,支持 SMTP、POST_JSON 等多种转发方式,内置 AI 转发功能。亮点在于流量保号策略:设备自动管理 SIM 卡流量消耗以维持号码活跃,无需人工干预。后台界面包含系统概览、网络设置、转发设置、设备日志等完整功能。
12. 远程 Vibe 工具 MindFS 第二季
MindFS(a9gent/mindfs)发布第二季更新,定位为"Access your personal AI agents and workstation data anywhere, anytime through browser"。相比第一季,新版在远程 AI 工作站访问体验上做了全面进化,支持在浏览器中操作远程 AI Agent 和工作站数据。
13. Agent 辅助 RSS 阅读器 Livo
Livo(kaieye/Livo)是一款 Agent 辅助的 RSS 信息阅读器,首个公开发布版本。界面左侧为订阅源分类侧边栏,中间是文章列表,右侧为详情页。支持自制订阅源和公众号订阅。目前需要登录才能使用,开发者表示后续会优化这一限制。
14. devin-byok-plus V2.2.0 发布
devin-byok-plus(原 windsurf,jornlin/devin-byok-plus)发布 V2.2.0,这是一个 Devin IDE 的 VS Code 扩展,支持在 Devin 中使用原生 AI 界面但请求使用自己的 API Key。新版本增加多渠道配置切换功能,控制面板可一键切换 Hybrid 和 Inference 模式。
15. VanishMe 浏览器指纹伪装工具
VanishMe(XiNian-dada/VanishMe)是一个浏览器隐私保护扩展,可伪装浏览器指纹以降低网站追踪风险。功能包括地理位置伪装、时区伪装、语言伪装、WebRTC 防泄漏等。作者表示该项目起因是前段时间 Claude Code 后门事件导致隐私泄露担忧,可用于绕过 fuck-claude、iprisk 等检测。
四、深度评测与实战
16. Fable 5 性能评测与安全研究
Remote Labor Index(RLI)评估 AI 智能体完成 240 个付费自由职业项目(总值 14.4 万美元)的专业质量比例,Fable 5 达到 16.1%,远超 Opus 4.8(8.3%)和 GPT-5.5 (6.3%),8 个月内提升 6 倍。虽然多数项目仍不达标,但增速说明 AI 在真实付费任务上的可用边界正在快速外推。安全方面,安全研究员 Vitto Rivabella 披露了对 Fable 5 越狱测试的详细过程与结果。他坦言绝大多数尝试均以失败告终,模型防御体系多层叠加,成功拦截约 90% 的攻击请求,同时部署输入端与输出端双重安全检测机制。测试发现至少 3 个独立分类器:输入端分类器、实时输出分类器。模型对祈使句极为敏感,一旦检测到潜在恶意意图立即触发中断。但最终仍被攻破——研究员使用了轻度思维链劫持、拒绝回应反驳以及桑塔利语、阿姆哈拉语等冷僻语言的组合拳。相关漏洞已向 Anthropic 反馈。
17. AI 智能体发现全新超导材料
阿里达摩院联合中国人民大学、中国科学院大学等发布首个超导材料发现 AI 智能体 Elements Claw,预测出 6.8 万个可能的超导材料,其中 4 种全新材料已合成并证实存在超导性。相关数据已全部开放。作为对比,国际主流超导数据库 SuperCon 历经数十年积累仅收录约 2000 种材料。
18. 桥水基金 AI 金融判断准确率研究
桥水基金与 Thinking Machines Lab 的最新研究显示,前沿 AI 模型在金融判断任务上的准确率未达到 80% 的可信门槛。GPT、Claude、Gemini 在基础提示下平均准确率约 50%,经过优化提示后可提升到约 70%,但仍不可靠。值得注意的是,以开源模型 Qwen3-235B为基础,在 Tinker 平台上进行专项训练后,模型测试准确率达到 84.7%,优于所有测试中的前沿模型,说明垂域微调仍然是提升专业判断力的有效路径。
19. Claude Code 系统提示词精简 80%
Anthropic 为迎合 Claude 5 系列模型的能力,进一步精简了 Claude Code 的系统提示词,降幅约 80%。产品经理 Gautam Kedia 在 X 上确认了这一变更。Anthropic 发现过多的示例约束反而遏制了模型表现——模型已经足够聪明,不需要那么多手把手的指导。社区调侃"是不是以后只需要打'我想'两个字,就能直接帮我开干了"。
20. 中国首个地层学 AI 大模型发布
在第五届国际地层学大会上,中国科学家面向全球发布了首个地层学 AI 大模型及智能全球地层剖面对比系统。据中国科学院院士沈树忠介绍,目标是通过时间轴和全球大数据方式,把地球 46 亿年历史的所有地质记录按照统一时间标准进行排序。中国目前已发现 11 颗"金钉子"(全球界线层型剖面和点位),数量稳居世界前列。
五、行业与政策动态
21. 豆包、千问同日下架智能体服务
7 月 3 日,豆包和千问同一天宣布智能体功能将于 2026 年 7 月 15 日正式下线。豆包发布《豆包智能体功能下线通知》称由于产品功能调整,下线后用户可在一段时间内查看并保存智能体信息及历史对话,之后数据将无法恢复。千问也发布了类似通知。此前,豆包海外版 CiCi 已在去年 5 月 20 日下架过智能体功能。社区对此事件有两种解读:一是认为"国家不让智能体替代人类员工,要控制宣传、保就业岗位";二是认为这些平台的智能体本质上只是自定义 System Prompt(类似 Gemini 的 Gems),并非真正的 Agent,下架更多是产品策略调整。有用户指出豆包智能体生态其实非常热闹——纯角色扮演比酒馆还热闹,核心用户群体是年轻人。
22. 华为韬定律 V2 版论文发布
华为半导体负责人何庭波于 7 月 3 日在 ChinaXiv 发布《面向多层级电子系统的时间缩微理论》(韬定律)V2 版论文。相比 5 月 25 日的 V1 版,新版补充了大量工程落地细节与实测量化数据,形成 8 章完整论述体系。新增覆盖 LogicFolding 架构、键合界面截面、 Unified Bus 互连架构、Hi-ONE 光引擎等核心技术的原理与实物示意图。V2 版深度阐释了 LogicFolding 的"齿比"概念:当混合键合间距接近顶层金属布线尺寸时,3D 设计空间从传统的宏块级离散优化转变为新范式。首次公开 Kirin 2026 相关数据。华为韬定律V2版论文发布:Kirin 2026数据首次公开,补充工程细节与实测数据 | 浏览 122 ·点赞 6 ·回复 2
23. 微软 AI 操作系统 Aion 曝光
科技媒体 Windows Latest 分享了微软内部代号 Project Aion 的系统视频。该系统基于 Microsoft Edge 和 Web3 轻量化 Windows 代码库构建,完全针对 AI 场景设计——没有传统开始菜单和桌面图标,一切均基于 AI 交互实现。任务栏加入 Spaces(空间)功能,可自动把已打开应用和网站归入不同区块。该系统不支持传统 Win32 应用,定位类似 ChromeOS 但更激进地以 AI 为核心。社区评论认为"经典套个 AI 皮造些没什么鸟用的东西"。
24. 腾讯声纹 AI 防沉迷系统上线
腾讯游戏正式发布 2026 暑期未成年人保护专项方案,全面升级"AI 双引擎防沉迷"体系。游戏端新增 AI 巡航系统,搭载声纹检测、年龄识别、代过行为识别多重 AI 能力,精准整治未成年人冒用成人账号、找人代过人脸等违规操作。配套上线 AI 版成长守护工具,家长直接对话 AI 就能管控子女游戏账号。社区讨论焦点在于防沉迷的实际效果——高赞回复指出"不玩游戏就刷抖音,抖音成瘾性不比游戏差",也有人认为"打游戏的孩子脑子都不笨,刷视频的才是无药可救"。
25. AI 政策动向:特朗普护栏论与扎克伯格 Agent 慢论
特朗普在白宫接受 CNBC 专访时表示"你需要一些护栏,但要尽量少做限制",强调不希望繁琐限制妨碍美国企业与中国竞争。特朗普此前曾多次表达对政府持股 AI 企业的兴趣。此番言论正值美国商务部对 Anthropic 的 Mythos 5 与 Fable 5 模型实施出口管控之后。
Meta CEO 扎克伯格则在内部全员会上坦承"AI Agent 技术的发展并没有达到此前的预期",公司仍在努力实现超级智能但需要更多时间。Meta 近期面临两难:一方面投入数百亿美元建设 AI 基础设施,另一方面快速推进的代价日益明显。社区调侃"那你还出租算力,搞得股市全崩盘"。
26. DeepSeek 涨价与替代方案讨论
DeepSeek API 白天使用价格翻倍,引发用户寻找替代方案。社区讨论指出可用火山引擎、阿里、腾讯等大厂中转,价格比官方便宜。也有用户关注 OpenCode Go 是否会跟进涨价,以及 7 月中旬 V4 正式版发布后的定价策略。
六、实用教程
27. Fable 5 + Ultracode 节省 Token 技巧
一位 5x 订阅用户分享了在 Ultracode + Workflow 模式下大幅节省 Token 的提示词配置。核心原理:主线程使用 Fable 5 时,Workflow 使用 Opus 4.8 + Sonnet 5;主线程用 Opus 4.8 时,Workflow 默认继承,疑难杂症提权 Fable 5;并给出明确的预算限制。效果:同样的 review 任务,从之前一个 5h 窗口都跑不完,降到 40% 左右跑完,速度更快且质量无明显差距。
28. Claude Code 多智能体编排实战
一篇实战教程详细介绍了如何在 Claude Code 中设置多 Agent 编排:将 Fable 5 用作编排器(orchestrator,最大推理强度),Opus 作为深度推理子智能体,Sonnet 负责机械性工作,Codex 作为同级资深工程师提供不同视角。设置步骤包括通过 /model 选择 Fable 5、将 reasoning/effort 调至最大、使用 /agents 配置子智能体分工。 Claude Code 多智能体编排实战:Fable 5 做主脑,Opus/Codex 并行推理,Sonnet 打辅助。
29. VibeCoding 前端美化方案合集
一篇长期更新的合集帖汇总了解决 Vibe Coding 前端界面丑陋的各种方案。作者指出放弃项目往往不是技术难度,而是界面太丑让人没有继续的欲望。收录方案包括: Gemini 根据图片生成前端样式代码;CodeX 搭配 frontend-design/ui-ux-pro-max Skills;使用 Open Design 生成 HTML 后转写;原型转示例 HTML 再让 Agent 读取开发等。高赞回复建议"拉一个 agent 去做审美的审查和可视化界面的审查"。
七、社区讨论与观点
30. Claude Code Skills 管理讨论
社区讨论如何管理层出不穷的 Skills。痛点包括:Skills 太多不知如何吸收管理;时间久了就忘了被新 Skills 替代;不是所有 Skills 都适合自己。高赞回复建议"相信我,绝大部分都没啥用,把它们全去了效率不会有任何降低,还能省不少 token"。也有用户建议搞个人知识库索引 Skill 用途,新项目时查询匹配。还有用户表示"裸的 Codex 就很聪明了,全默认设置,等需要某个 Skill 的时候再告诉它参考"。
31. AI 开发实践:全栈、架构与 Agent 开发体验
社区围绕 AI 辅助开发展开多维讨论。关于全栈开发,一个前后端分离的大型项目应该一个会话负责一端还是同时处理?实践经验包括把前后端放同一目录让 AI 同时处理但用不同 git 管理、通过 /add-dir 或 @README 引用另一端。关于 AI 中台架构,一位刚入职的开发者分享了公司 AI 中台构想:前端 Dify + 原有 IT 系统,后端 MCP/Agent 集 + RAG + vLLM 部署,社区为其画了详细的分层架构图。关于 Agent 开发困境,开发者反映用 LangGraph 写完发现本质上就是预设好的工作流,完全体会不到"智能"——高赞回复区分了 LangGraph 面向固定工业场景 vs Claude Code 式自主探索的不同定位。关于上下文管理,用户困惑为何新开会话要重新分析项目代码,回复指出"压根不需要重开会话,本地会话和请求给 LLM 的会话是裁剪过的",以及 Codex App 有 fork/派生功能
32. AI 安全警示:检测站盗余额与防数据丢失
一位用户分享了惨痛经历:半个月前使用站内某位佬友的模型纯净度检测网站检测 API Key 纯净度,检测完就没管了。结果被人跑了一宿 claude-fable-5,账户上 100 多块钱全部跑光。社区强烈建议"检测完立马删掉 key",最好再加一个限额 1 块以防万一。另一位用户分享了防止 AI 删数据的方法:在全局指令里写死"不准删除",配合 claude --dangerously-skip-permissions 和 codex --yolo 使用,从第一天 Vibe 到现在没被删过任何数据。但高赞回复犀利指出"提示词不是百分百管用的",幻觉、上下文污染、降智不听指令等情况都可能导致 AI 无视禁令,建议更可靠的方案是把 rm 别名为移动到回收站。
33. Vibe Coding 创作展示:游戏开发
两个高热度的 Vibe Coding 游戏项目展示了 AI 编程的创造力。一位用户用 Fable 5 做了"牛马大逃杀"肉鸽游戏,主要核心都是 Fable 5 独立完成,Token 用完后换 Sonnet 5 补充。另一位用户纯 Vibe Coding 实现了完整的德州扑克游戏,支持人机对战、多人在线对局和排行榜,早期用 Opus、后期用 GPT 主力、Gemini 优化前端。作者感叹"兴趣是最好的老师,一直 vibe 一直爽,有点上头"。社区评价界面和 UI 效果不错。
34. AI 对就业影响讨论
一位自述"前端行业已经淘汰的差不多了"的开发者发帖请社区预测 AI 时代岗位淘汰顺序。社区观点包括:目前被淘汰的更多是坐办公室和电脑打交道的人,因为不需要引进新设备、阻力小;人工成本太低的岗位反而不好淘汰,引进设备不一定比人工划算;法律岗等简单文字类工作已开始受影响;"有淘汰就会有新岗位"。
总结今日趋势
1. Anthropic vs 中国市场
阿里禁用 + FT 报道 + 社区强烈反响,Anthropic 与中国用户的关系进入新阶段,封堵力度空前
2. Fable 5 定价博弈
从订阅移除改为按量计费,社区将其解读为与 GPT-5.6 的竞争策略绑定
3. 国产模型密集动态
DeepSeek V4 训练完成、豆包/千问下架智能体、Seedance 2.5 即将上线、GLM-5.2 免费 API——国产 AI 生态快速演变
4. AI 编程工具生态爆发
多模型协作 Skill、多 Agent 编排、Token 节省技巧等最佳实践快速沉淀
5. 安全意识升级
模型检测站盗 Key、AI 删数据、浏览器指纹伪装——社区正在形成系统性安全防护意识