乐于分享
好东西不私藏

AI早报7月5日:GPT-5.6细节确认,Anthropic进军药物发现,阿里封禁Claude Code

AI早报7月5日:GPT-5.6细节确认,Anthropic进军药物发现,阿里封禁Claude Code

一、Anthropic正式进军药物发现,Claude Science科研平台上线

Anthropic在6月30日AI for Science活动上宣布推出Claude Science科研工作台,这是一个内置60多个预配置工具的研究环境,涵盖基因组学、蛋白质组学和药物发现流程,整合了科学数据库连接器、序列分析工具和高性能计算资源。平台面向Pro、Max、Team和Enterprise用户开放Beta测试,支持macOS和Linux。
与此同时,Anthropic启动了一项针对"被忽视疾病"的内部药物研发项目,聚焦传统药企不愿投入的罕见遗传病和热带病。诺华CEO万桑哈指出,新AI模型有望将药物研发周期从12年缩短至7-8年,成功率从8%提升至16%。AlphaFold共同开发者John Jumper近期加盟Anthropic,表明公司正在系统性地布局生命科学赛道,将自身定位为未来五年生命科学领域的核心AI合作伙伴。

二、GPT-5.6 Sol/Terra/Luna三款模型预览细节全面确认

OpenAI确认了GPT-5.6系列三款模型的核心规格。旗舰模型Sol在Terminal-Bench 2.1测试中达到96.7%,创下新纪录,新增"最大推理强度"和"超模式"两个能力层级,专攻复杂智能体任务和科学推理。Terra定位日常均衡模型,性能与GPT-5.5持平但成本降低一半,预计定价约2.50/15美元每百万token,将直接挑战Claude Sonnet 5的2/10美元定价。Luna则是系列中最快最便宜的选项。
GPT-5.6目前仍处于政府限制预览阶段,仅向获批的政府和企业伙伴开放。Altman在6月26日表示"还需几周",意味着正式发布窗口在本周关闭。Terra的定价策略是本次预览中最重要的竞争信号——如果性能达标,将引发与Anthropic的真正价格战。

三、OpenAI发布GeneBench-Pro,生物学基准竞赛正式开启

OpenAI推出GeneBench-Pro,这是一个研究级基准测试,评估AI智能体在计算生物学中的表现,重点测试其在科学数据模糊性下的判断能力。测试已开源代表性题目。
这一发布时机耐人寻味:Anthropic在6月发布了VirBench,展示确定性工具可将AI生物准确率从16.9%提升至92.8%。OpenAI数日内跟进GeneBench-Pro,清晰表明生物学已成为继编程之后AI基准竞赛的下一个主战场。这复刻了2024-2025年SWE-bench的竞争弧线:一方建立基准,另一方推出更难版本,最终第三方标准化测试定分止争。

四、阿里巴巴禁止员工使用Claude Code

据TechCrunch报道,阿里巴巴已禁止员工使用Anthropic的Claude Code编程工具。此举背景是Anthropic此前向参议院银行委员会提交信函,指控阿里旗下Qwen通过2880万次欺诈性Claude交换进行模型蒸馏。两家公司的技术脱钩正在持续加深,中国企业与西方AI平台之间的访问壁垒进一步升高。

五、Grok 5仍在训练,Q3发布概率仅3%

xAI的Grok 5仍在Colossus 2超算集群上训练,该集群已扩展至1.5GW功耗规模。预测市场Polymarket将Q3发布合约的概率收于约3%,反映社区对xAI时间线的冷静判断。xAI未提供任何发布日期。
对开发者而言,当前可用的xAI生产模型仍为Grok 4.3,通过Amazon Bedrock提供服务,定价1.25/2.50美元每百万token。Colossus 2的大规模投入表明Grok 5将是一次重大能力跃升——xAI不会在这种规模上为渐进式升级投入算力。最早 realistic 窗口为2026年Q4。

六、Anthropic封堵中国公司Claude访问漏洞

英国《金融时报》报道,Anthropic正在关闭允许中国公司(包括蚂蚁集团)通过"中转站"中继服务和云服务商绕道访问Claude的漏洞。据报道,中国公司的工程师仍在寻找新的绕行路径。
这项执法行动是Anthropic在Fable 5解禁谈判中对美国政府做出的正式承诺的一部分,直接关联模型蒸馏风险:Anthropic此前指控Qwen通过数千万次欺诈性API调用蒸馏Claude能力。这也说明AI模型的出口管制正在从政策层面落实到技术执行层面。

七、Meta承认AI智能体进展停滞,Watermelon模型宣称遭质疑

在7月2日的内部会议上,扎克伯格坦承AI智能体开发在过去4个月"没有按预期加速",8000人重组"尚未见效",预计还需3-6个月才能看到成果。 Minutes后,AI主管Alexandr Wang声称Meta未发布的Watermelon模型已在内部基准上追平GPT-5.5,但未公开任何基准名称或验证数据。市场对此并不买账——Meta股价下跌4.9%至582美元,投资者显然更信任CEO的坦诚而非AI主管的未经验证宣称。
此外,特斯拉将从7月6日起将员工AI工具支出限制在每周200美元,但Grok豁免。一个年投入1250-1450亿美元的巨头CEO承认智能体尚未交付,是迄今为止关于AI智能体规模化进展最可信的公开数据点。

结语

本周AI行业呈现出清晰的竞争格局:OpenAI与Anthropic在模型定价、生物学基准和科研工具三条战线全面交锋;Meta CEO的坦诚揭示了智能体赛道"投入巨大、回报滞后"的现实;Grok 5的延期则说明前沿模型训练周期正在拉长。值得关注的是,白宫自愿AI标准框架可能在本周公布,GPT-5.6正式发布窗口也即将关闭——这两件事将共同定义2026下半年AI竞争的基本规则。