当前时间: 2026-07-23 02:35:07
分类:办公文件
评论(0)
2026年7月2日 AI前沿资讯日报• Claude Code 隐私安全风暴进入第二天:CC 负责人公开回应“没想到你们会读日志”,引爆 大量用户热评;Anthropic 宣布将回滚相关检测代码,但社区怀疑已有更隐蔽替代方案• Claude Sonnet 5 社区评测全面展开:“已被 GLM 斩杀”引发国产模型信心潮,多维对比显示 Sonnet 5 定位尴尬——价格不够便宜、速度不够快、能力不如Opus• Fable 5 正式回归:美国商务部解除出口管制,但附带 50% 周限额度、7/7 后转按量付费、编码回退 Opus 4.8 等多重限制Claude Science 在 7 月 1 日正式发布,集成 60+ 科学工具包,聚焦生命科学领域Vibe Coding 中遭遇 rm -rf 恶意注入,安全警报引发社区对中转站安全性的广泛讨论Codex PowerShell 兼容性问题获大量关注,成为全场最高互动帖之一1. CC 隐私安全风暴·第二日:官方回应、证据汇总与社区技术反制6/30 已报道「Claude Code 安全风暴:时区追踪、中转站黑名单与隐写术全面曝光」。7/1 新增 12 篇延伸讨论,事态持续升级:Claude Code 负责人在社交媒体上公开表示“老实说,我没想到你们会读日志”,这一回应在社区引爆大量用户关注,成为当日最高互动帖。社区用户对此反应两极——有人认为“老外还挺诚实的,这点很技术范”,也有人认为这是“纯纯把用户当狗看”。CC 开发者之一随后正式回应:这是今年三月启动的一项实验,目的是“防止未经授权的转售商滥用账户并防范蒸馏攻击”,团队已有更强的替代方案,这些代码将被回滚。Anthropic 官方也发帖确认将回滚 CN 指纹检测代码。CC 另一位负责人表示“这种监控方式将被移除,我们采取了更有效的方式来实现用户检测”——社区对此解读为“检测手段更高明了,这个你们看到的已经落后了”。CC 开发者还承认早在三月份就开始收集时区、时间等信息用于区分用户。2. Claude Sonnet 5 社区多维评测与定位争议6/30 已报道「Claude Sonnet 5 正式发布:新 tokenizer 与性能评价」。7/1 社区评测全面铺开,149 赞重磅评测帖直言"已被 GLM 斩杀": 最高热度的评测帖对 Sonnet 5 和 GLM-5.2 进行了逐项对比,结论是 GLM-5.2 在编码任务上全面领先。帖主指出 Sonnet 5 存在与 4.7/4.8/Fable 相同的分词器问题——"依旧错字大模型",甚至出现 64k 思考 token 仍不够用的极端情况。考虑到 Sonnet 5 降价后仍比 GLM 更贵,社区评价"已经被开源斩杀"。3. Fable 5 正式回归:出口管制解除与使用限制6/30 已报道「Fable 5 或要求 KYC 人脸识别并额外收费」。7/1 确认回归但附带多重限制:Anthropic 官方发布公告,美国商务部已正式解除对 Claude Fable 5 和 Mythos 5 的出口管制,Fable 5 将于 7 月 1 日恢复全球上线。社区热帖"Fable 他真的回来了"表达了期待, 但热评"非常好,给我狠狠的蒸,我想用国产 fable"也折射出社区对国产模型追赶的信心。 具体限制引发广泛不满:Fable 5 在每周使用限额中只能占用最多 50%;7 月 7 日之后不再包含在订阅套餐中,转为积分付费模式;编码和调试任务将自动回退到 Opus 4.8;新增安全分类器对内容审查更严格。社区用户吐槽"简单点,编程全走 opus 4.8,网络安全不给用","搞笑来了,真觉得自己是什么逆天无敌模型?"。实际使用中,有用户发现"一个模型回测优化方案也触发安全风险",认为审查力度过于离谱。总体评价是"限时限量供应,实质上还是半开放"。4. Codex 降智、额度缩减与 PowerShell 兼容性困局6/30 已报道「Codex/GPT 降智深度调查:Sub2API、DSpark 与模型路由问题」。7/1 新增 3 篇帖子,其中 PowerShell 兼容性问题获 242 赞成为全场最高互动帖之一: PowerShell 问题在 Windows 开发者中引起强烈共鸣——帖主形容"每天看着 codex 对着 powershell 疯狂流口水,大部分时间花在和 powershell 搏斗上"。相比之下,cursor 和 claude code 执行 PowerShell 的成功率"如丝般顺滑"。高赞回复分享了 AGENTS.md 中添加 PowerShell 执行规范的解决方案:统一使用 PowerShell 7、禁止使用 cmd.exe,效果显著改善。 额度方面,Plus 用户反馈使用 GPT-5.5+xhigh 写代码约 40 分钟就触达 5 小时额度上限, 前端代码"给我糊了一坨屎"。桌面版 APP 的磁盘占用问题也被曝光——Codex 起了十几个进程导致磁盘 100%,关闭后立刻恢复,排查发现可能与 logs_2.sqlite 的 TRACE 日志高频写盘有关。6/30 已报道「AI 模型鉴别器 hlwy-ai-checker 2.0 更新」。7/1 工具迅速迭代到 2.1 和 2.2 版本,同时出现了一种基于 tokenizer 特征的全新检测方法: 84 赞帖分享了一组混合中日英文、代码变量名和广告文案的检测 prompt——将这段内容发给 AI 让其逐词复述并解释,不同模型的 tokenizer 会产生明显差异,可用于判断模型真假。社区认为"全是 tokenizer 的问题,能拿来分类模型"。hlwy-ai-checker 从 2.0 快速迭代到 2.1(新增并发检测和 codex/cc 伪装)再到 2.2(新增大横评功能用于筛选最优中转站),开发速度令人印象深刻。51 赞帖倡议"搞个中转站模型质量大横评",按与官方 API 的匹配度排序,但也有人指出风险:"评测完中转站全换成假的,到时候就是你恰烂钱了"。1. Claude Science 发布:AI 科研工作台首日体验Anthropic 于 7 月 1 日正式推出 Claude Science——一个集成了 60+ 科学工具包的 AI 科研工作台,涵盖基因组学、单细胞分析、蛋白质组学等领域,当前 beta 版支持 macOS/Linux 本地运行和远程 SSH 连接。生物信息学方向的用户证实工具链"很眼熟,不是用过就听业内人士推荐过",确认这是一个聚焦生命科学的平台。有用户接入 DeepSeek V4 Pro 体验,发现速度"很快",也支持接入 GPT-5.5 但"要慢很多"。Claude Science 读取 ANTHROPIC_BASE_URL 环境变量,因此可以写本地 proxy 来使用。社区评价认为 Anthropic "当大家还在卷模型能力的时候,已经依托大模型能力延展出不同业务",思路与传统公司先有业务再接 AI 的路径相反。troubleshooting 帖提醒:7/1 当天出现了大规模封号,可能与此前收集的地理信息集中清算有关,使用时务必做好网络保护。2. GPT 5.6 产品线重组:每个模型都有 Pro 版本通过调用 OpenAI Responses API 发现了一个新参数 reasoning.mode ,揭示 GPT- 5.6 系列的产品线策略——Luna Pro 在 GeneBench Pro 排行榜上大于 5.5 Pro,意味着 5.6 下的每个子模型(Sol、Luna、Terra)都将拥有 Pro 版本,"怪不得改名"。社区用户计算发现 20x 套餐价格可观,期待 Terra 和 Luna 的 Pro 版本能开放给 Plus 用户。3. Anthropic 推出 AI 药物研发计划Anthropic 宣布进军医疗健康领域,推出 AI 药物研发计划。这引发社区讨论——结合同日发布的 Claude Science,有用户调侃"又是科研又是生物医学又是药物研发又是军事合作的,这不妥妥荒坂公司预备役了"。有用户指出这与 CEO 达里奥的学术背景有关:"达里奥在本科、博士、博士后阶段都是学的生物",从个人兴趣驱动公司战略。4. 上海 AI 实验室发布 Agents-A1 智能体模型上海 AI 实验室"书生"发布 Agents-A1,一款 35B 参数的混合专家架构(MoE)智能体模型,覆盖长链搜索、工程任务、科学研究、指令跟随及工具调用等场景。训练采用三阶段范式:全领域监督微调、垂直领域专家模型构建、异构感知优化。社区用户对"35B 比肩万亿参数性能"的宣传持谨慎态度。5. 英伟达刷新 DeepSeek V4 推理纪录:成本降至 1/5英伟达宣布将 DeepSeek V4 的单 Token 推理成本降至原来的 1/5,AI 吞吐量最高提升 20 倍。社区讨论焦点在于成本下降是否会惠及终端用户——高赞回复直言"凭什么给免费用户吃甜头,省下来的当然是我的利润和投资人的分红",也有用户期待英伟达免费 DeepSeek 服务的体验改善。 英伟达刷新 DeepSeek V4 推理纪录:单 Token 成本降至 1/5,AI 吞吐量最高提升 206. 开源项目集中发布:DEEIX Chat、AI 全自动开发、科研 Skills 等本日开源项目产出密集: DEEIX Chat v0.3.0 以 91 赞领跑,定位为轻量级企业 AI 工作空间,支持模型路由、多模态对话、文件处理、工具调用和计费管理,静态运行时内存仅 34 MB。经过 8 个版本迭代,在对话体验和内容渲染上显著提升。SoloDawn 1.0 正式版主打"AI 全自动开发",通过三层质量门 + 内置规则引擎解决 AI 幻觉,支持多 AI CLI 协作,宣称可全自动产出生产级软件。 科研 Skills是一套面向学术场景的 Claude Code Skill,能自动做实验、写 Paper,特点是引用可追溯、数字可验证,区别于"一抓一大把"的玩具级科研 Agent。 Pi Code Agent 生态整理系统梳理了 Pi 平台的插件、第三方扩展、使用习惯和常见问题,为新用户提供了完整的入门指南。 此外还有:AI 视频生成工具 CyberCode、高质量 PPT 生成 Skill ppt-craft-editable、Claude Desktop Windows 中文补丁工具 GUI、本地 Agent 框架 Spice。7. Vibe Coding 安全警报:中转站恶意注入 rm -rf安全事件帖报告了一起严重的 Vibe Coding 安全事故——用户在编码过程中对话突然被中断,让 AI 继续后,AI 提示检测到恶意注入的 rm -rf 命令。社区讨论分为两个方向:一是认为中转站被攻击,在响应中注入了恶意指令;二是认为这可能是 Opus 4.8 自身的幻觉——"幻觉自己被 injected,被害妄想"。有类似案例引用指出,Claude 在对话中声称"会话中出现了恶意 Prompt、伪造的工具结果以及类似 system-reminder 的注入内容", 但实际上可能只是模型的安全防御机制过度触发。无论原因如何,这一事件再次提醒开发者在使用中转站时注意代码执行安全。8. Grok Build 偷传用户代码仓库至 Google Cloud用户发现 Grok Build 存在异常流量行为——grok.exe 向 storage.googleapis.com 上传了数 GB 数据,而 Grok 本身的模型 URL 是 cli-chat-proxy.grok.com。经分析,Grok Build 会将用户整个代码仓库打包上传,由于仓库中包含大文件,流量特别大。DeepSeek 对 grok.exe 的分析确认了这一行为。社区调侃"喜欢打包用户代码?那给它上一些蓝光电影",但安全隐忧不容忽视。9. 公益站提示词审查 + AI 自动封禁系统正式上线记录了公益站"小鸡毛"正式上线提示词审查系统的始末。该站从 5 月初建站以来一直"相信佬友们的善意",未加入任何关键词拦截或客户端限制,但不断收到因用户破限行为导致的 Cyber Abuse 警告信。最终不得已实装拦截审查 + AI 后置审核自动封禁机制。站长透露运营成本惊人:"1 天就跑了 1 万刀的 token","正常一个 Plus 号 5 小时只有 10 多刀"。当前处于高强度手动补号阶段,计划实现自动化补号后"会狠狠送额度"。10. GLM-5.2 使用体验:思考模式、缓存率与质量问题GLM-5.2 的使用生态围绕三个核心痛点展开:首先是讯飞渠道的思考模式开启——用户"奋战了一晚上"才成功让讯飞的 GLM-5.2 输出思考块,网上几乎完全查不到相关信息,最终在社区帮助和 DeepSeek 的辅助下解决。其次是缓存率问题——opencode go 套餐用户反馈 CLIproxyAPI+CC 和 opencode-cc+Codex 方案均存在频繁缓存击穿,综合缓存率不到 60%,尤其在 60k+ token 的场景下更不稳定。第三是渠道质量——有用户验证某 GLM Coding Plan 拼车在高峰期实际打到了 Kimi K2.7-Code 做 fallback,而非宣传的 GLM- 5.2。11. Kimi K2.6 英伟达渠道输出异常:文字恐怖谷英伟达渠道的 Kimi K2.6 被发现输出完全"精神错乱"——让它做题时完全胡言乱语,吐出的内容"已经完全不像个人样了"。Bug 触发率极高(5 次测试中 3 次触发),帖主推测可能是英伟达自行对模型进行了量化导致。DeepSeek 在英伟达渠道也出现了类似问题,进一步佐证了这是英伟达渠道层面的问题而非模型本身的缺陷。12. Claude Code / Codex 配置经验:Rules 与 AGENTS.md教程帖从团队协作角度系统梳理了 Claude Code Rules 的用法——作为项目组小组长,帖主发现团队成员各自使用 AI 开发后代码风格差异巨大,通过 Rules 统一团队规范成为必需。回复中有用户从认知心理学角度分析 Claude.md 与 Rules 的关系,建议控制在 200 行以内,把它理解为"与大模型之间的对话基本共识"。另一帖分享了一份详细的 AGENTS.md 全局规则模板,定义了角色定位、基本约束、原则优先级等完整框架。回复建议补充"请把我当成一个什么都不懂的傻子"这一约束来提升交互效果。13. Vibe Coding 设计技巧与术语科普系统整理了 Vibe Coding 中常用的设计术语速查表——帖主指出 AI "听不懂人话"往往不是模型能力不够,而是用户用了"高级感""眼前一亮"这类模糊中文描述。由于 LLM 对英文专业术语的语义锚点远强于中文,使用准确的英文术语(如 Typography、Grid System、Color Theory)能显著提升 AI 生成效果。另一帖推荐了 code-inspector-plugin 插件,用于在 Vibe Coding 写前端后快速通过 Alt+Shift 快捷键定位到对应 DOM 元素的源代码位置,支持 React 和 Vue 项目。14. Anthropic 封号策略升级:杭州出差被封与 7 月强制实名报告一起极端封号案例——用户只是去杭州出差一天,全程没打开 Claude,笔记本都没带,仅手机安装了 Claude 也没打开,当晚就被封号。一年老号,"之前怎么造都是没问题的"。社区对此分为两派:有人认为是 A 社最近在乱封,有人则认为可能是"之前已经识别成问题号了,最近算力紧张直接秋后问斩"。7 月 Anthropic 要求强制实名验证, 社区讨论应对策略。有用户分享了自己的模型切换经历:4 月 claude 主力 → 5 月 codex 主力+glm 副手 → 6 月 codex 主力+glm 副手+deepseek 打杂,结论是"CC 真要彻底封死,对我基本没啥影响了"。15. AI 就业与技能变革:Agent 招聘行情与蒸馏对岗位的影响关注 Agent 岗位的招聘行情——从企业视角看,投简历的人不少但"基本还是一些玩具项目的人比较多",真正能落地一套 Agent 的人稀缺。有从业者分享:"去年我靠 AI 蹭了大国企一个项目,今年跟我对接的人自己玩 AI 搞了很多,已经不带我玩了"。另一位前端开发工程师描述了蒸馏对岗位的现实冲击:已将业务逻辑封装成 Skill,效率大幅提升,但公司不报销 AI 费用还在裁员,担心"效率提升之后,是否会让领导觉得自己更容易被替代"。社区建议"积累经验、沉淀能力到自己身上,找机会跑路"。16. 国家超算互联网 9.9 元 GLM-5.2 Token Plan 上线国家超算互联网推出限时秒杀 Token Plan(TP-Basic-002),仅需 9.9 元即可获得包含 OpenClaw 2 核 4G 实例和 60000 Credits/月额度的套餐,支持 GLM-5.2 模型访问。作为非主流渠道,价格具有吸引力,但社区关注实际可用额度有多少。17. AI 编程困境大讨论:维护难题、Bug 循环与代码审查悖论多篇高热度讨论帖聚焦 AI 编程的现实困境。58 赞帖提问"完全用 AI 开发的软件,后续维护要怎么做"——全程 Vibe Coding 导致的屎山代码难以审查,同事联调也不知如何入手。 高赞回复建议"AI 写的代码,AI 审查,AI 修,谁造的孽,谁填坑",也有人建议沉淀文档和知识库来辅助维护。59 赞帖则总结了一条"血泪之言"——Bug 是永远改不完的,产品差不多就行了。28 赞帖描述了"代码审查悖论":让另一个 AI 审查 AI 写的代码确实能发现问题,但审查 AI"好像永远能再挑点毛病",越改越乱。社区建议编写 Skill 来规范化这个流程。古法编程消亡讨论中有真实案例:某公司因"事后补救"策略导致支付系统 Bug 被钻空子,损失价值约 15 万的游戏道具,"痛定思痛,发现还得事前规划"。通过 Apple 转印度区购买 Grok 订阅的教程——每月仅需 38 人民币,一年 6500 卢比,相比国内 AI 订阅价格极具性价比。Grok 有类似 Codex 的编程工具,且“道德底线低,挖掘资料够深”。不过有用户坦言“买了之后就几乎没怎么用过,之前想的是当搜索引擎用,结果后来只用来找片了”。也有人认为月付 38 元很划算,“毕竟一个月有 150 刀可以用 composer”。19. 多 Agent 协作与 Skill 日常使用经验分享了使用 Hermes 实现多 Agent 团队协作的完整方案——支持不同 API 提供商及模型、支持单独注册 MCP 工具,经 3 小时研究后稳定运行,并开源了相关 Skill。日常 Skill 使用讨论中,社区分享了 opencode + oh-my-opencode-slim + codestable 等工具链组合,以及基于 Andrej Karpathy 理念的 CLAUDE.md 配置方案。CC 安全风暴进入第二天,官方回应非但未能平息社区情绪,“更有效的检测方式”反而加剧了不信任感。用 DeepSeek 审查 Claude 输出正在成为部分用户的标准操作,国产模型在此背景下获得了更大的心理认同。Sonnet 5 “已被 GLM 斩杀”的评测、“又贵又慢不如 glm5.2”的普遍评价、以及 Codex 额度缩减后“用国产模型替代”的呼声,共同构成了一幅国产模型追赶甚至局部超越的图景。GLM-5.2 在编码任务上的表现尤其受到认可。Bug 改不完、代码审查悖论、维护难题、古法编程消亡——社区开始直面大规模 AI 编程带来的代码质量和工程化挑战。“事前规划”比“事后补救”更有效,正在成为共识。从 CC 的 prompt 投毒到 Grok Build 偷传代码、从中转站恶意注入 rm -rf 到公益站被迫加强审查——AI 工具的安全边界问题正在从理论风险变为现实事故。Anthropic 同日推出 Claude Science 和 AI 药物研发计划,与其说是跟风,不如说是利用模型能力延展出垂直业务——这种“从 AI 出发找场景”的思路与传统企业“从场景出发接 AI”形成了鲜明对比。
基本
文件
流程
错误
SQL
调试
- 请求信息 : 2026-07-23 09:15:06 HTTP/1.1 GET : https://www.yeyulingfeng.com/a/828290.html
- 运行时间 : 0.248929s [ 吞吐率:4.02req/s ] 内存消耗:4,863.07kb 文件加载:145
- 缓存信息 : 0 reads,0 writes
- 会话信息 : SESSION_ID=2505f5a6fd4b5874b5fe2ccd22dafcf5
- CONNECT:[ UseTime:0.001070s ] mysql:host=127.0.0.1;port=3306;dbname=wenku;charset=utf8mb4
- SHOW FULL COLUMNS FROM `fenlei` [ RunTime:0.001730s ]
- SELECT * FROM `fenlei` WHERE `fid` = 0 [ RunTime:0.000637s ]
- SELECT * FROM `fenlei` WHERE `fid` = 63 [ RunTime:0.000594s ]
- SHOW FULL COLUMNS FROM `set` [ RunTime:0.001275s ]
- SELECT * FROM `set` [ RunTime:0.000487s ]
- SHOW FULL COLUMNS FROM `article` [ RunTime:0.001371s ]
- SELECT * FROM `article` WHERE `id` = 828290 LIMIT 1 [ RunTime:0.004922s ]
- UPDATE `article` SET `lasttime` = 1784769307 WHERE `id` = 828290 [ RunTime:0.025333s ]
- SELECT * FROM `fenlei` WHERE `id` = 64 LIMIT 1 [ RunTime:0.000615s ]
- SELECT * FROM `article` WHERE `id` < 828290 ORDER BY `id` DESC LIMIT 1 [ RunTime:0.001101s ]
- SELECT * FROM `article` WHERE `id` > 828290 ORDER BY `id` ASC LIMIT 1 [ RunTime:0.000998s ]
- SELECT * FROM `article` WHERE `id` < 828290 ORDER BY `id` DESC LIMIT 10 [ RunTime:0.001604s ]
- SELECT * FROM `article` WHERE `id` < 828290 ORDER BY `id` DESC LIMIT 10,10 [ RunTime:0.023485s ]
- SELECT * FROM `article` WHERE `id` < 828290 ORDER BY `id` DESC LIMIT 20,10 [ RunTime:0.007133s ]
0.252838s