国内·今日
华为小艺Claw今天全量开放——你的鸿蒙手机,今天起可以用上最新的AI助手了

今天(7月1日),华为正式宣布鸿蒙"小艺Claw"向所有HarmonyOS 5.0及以上机型全量开放。操作很简单:把小艺App升级到11.6.4.300版本及以上,就能直接用上,不需要另外申请,不需要排队等待。
小艺Claw是什么?简单说,这是华为对标ChatGPT的系统级AI助手,深度整合进鸿蒙操作系统,可以跨App理解你的屏幕内容、执行复杂任务,而不只是一个聊天窗口。这次全量开放同步推出了两个付费套餐:49元体验包上线Auto-Model模式,能自动根据任务类型选择最合适的模型;199元标准包则支持openPangu-2.0-Pro(华为自研盘古大模型)、DeepSeek V4-Flash、DeepSeek V4-Pro、MiniMax M3四种模型自由切换。
这次全量开放的意义在于:之前小艺Claw只对部分机型或邀测用户开放,今天是真正意义上向所有鸿蒙用户推开了这扇门。华为鸿蒙目前的活跃设备数量已经超过10亿台,哪怕只有一小部分用户更新并开启,规模也相当可观。对国产AI生态来说,这是一次真实的大规模落地。
值得注意的是套餐里的模型选择——华为自研盘古、DeepSeek、MiniMax三家国产模型并列,用户可以自己选。这个设计很聪明:华为不强推单一模型,而是给用户选择权,同时把几个最强的国产大模型全部拉进了自己的生态。谁表现好谁留下,商业逻辑清晰。

来源:AI工具集(原始来源:IT之家 / 华为官方)· 2026年7月1日
国内·今日
腾讯今天开源了一个翻译大模型——33种语言、5种方言,离线也能用

今天,腾讯混元正式开源新一代翻译大模型Hy-MT2,同步推出三个尺寸:1.8B(轻量端侧)、7B(均衡)、30B-A3B(旗舰)。支持33种语言互译,以及维吾尔语、藏语、哈萨克语等5种民族语言和方言——这个覆盖范围,目前国内没有同类开源模型能做到。
最值得关注的技术表现:7B和30B-A3B两个版本在多项评测中达到了开源模型的最佳水平。开源意味着开发者可以直接下载权重,部署在自己的服务器或本地设备上,不需要调用任何第三方API——对企业来说,翻译数据不出内网,合规成本大幅降低。
配套产品同步上线:腾讯Hy翻译小程序今天可用,支持语音输入、自定义翻译风格(正式/口语/直译),iOS和安卓APP也即将上架。最实用的一个功能是离线翻译——把1.8B小模型下载到手机本地,没有网络也能跑,出差和海外场景不再依赖网络。

来源:AI工具集(原始来源:腾讯混元官方发布)· 2026年7月1日
今日研究
追踪了三年,AI生产力研究终于有了真实答案:有人翻倍,有人反而更慢
AI Weekly今天发布了一篇他们称之为"终于可以直接回答这个问题"的研究综述。问题是:用AI工作,真的能让你更高效吗?
三年的数据给出的答案是:是,也不是。对某些人、某些任务来说,效率提升是真实的,而且幅度惊人——有案例显示某些任务速度翻倍甚至更多。但对另一些人来说,引入AI之后反而更慢——因为他们要花大量时间验证AI的输出是否正确,或者不断尝试找到合适的提示方式。
最关键的发现是:收益没有流向营销承诺的那些地方。受益最大的不是"坐在办公室做重复性工作"的人,而是那些本身对自己的工作领域有深度认知、能快速判断AI输出质量好坏的人。简单说:越懂行,AI越有用;不懂行,AI可能反而是负担。
另一个反直觉的数据:在软件开发这个被认为"最适合AI"的场景里,METR研究发现引入AI后开发者完成任务的时间平均延长了20%——因为检查AI代码的时间超过了AI节省的时间。当然,这个数字在持续下降,模型越来越准,验证成本越来越低。

来源:AI Weekly #509(今日发布) · 2026年7月1日
今日曝光
Meta雇人扮未成年人,专门测试竞争对手的AI会说什么——Wired今天把这件事捅出来了
Wired今天发表了一篇调查报道,揭露了一个让很多人看了皱眉的做法:Meta雇用了数百名承包商,让他们扮演未成年人的身份,系统性地测试竞争对手AI聊天机器人——包括ChatGPT、Claude、Gemini——如何回应自杀、性行为、毒品和其他高风险话题。
Meta的说法是:这是为了了解行业安全标准,帮助自己改进产品。但Wired的报道指出,这些测试报告的最终去向,是Meta的竞争情报团队,而不只是安全团队。换句话说,这不只是"做好事",也是在系统性地摸竞争对手的底线。
这件事让人不舒服的地方有几个层次:首先,让成年人扮演未成年人去测试AI的"边界",这个行为本身在伦理上就有争议;其次,测试结果用于竞争情报而非纯粹的安全研究,目的不够纯粹;第三,这意味着AI安全测试这件事,已经成为大公司之间的竞争手段,而不只是行业自律。Meta目前没有公开回应这篇报道。

来源:AI Weekly(引用Wired今日报道) · 2026年7月1日
国内·今日
腾讯买了百度的AI芯片——这在两年前是不可想象的事
AI Weekly今天报道了一条让国内科技圈不少人惊讶的消息:腾讯已成为百度旗下昆仑核心AI芯片的主要客户。这是中国互联网巨头之间有记录以来第一次大规模跨采购——百度的芯片卖给了腾讯。
为什么这件事以前不会发生?过去二十年,BAT(百度、阿里、腾讯)之间维持着一种默契的封闭生态——各家用各家的云、各家的AI、各家的基础设施,老死不相往来。这种封闭有商业逻辑:不让竞争对手摸清自己的技术底牌,不给对方贡献收入。
现在为什么变了?英伟达GPU出口管制让国内高端算力供给持续紧张,腾讯自研芯片进展相对缓慢,而百度昆仑核心已经在AI推理场景跑出了相对成熟的产品。与其让算力缺口拖累业务,不如务实地采购国产替代品——即便卖家是老对手。Hang Seng Tech指数当天随着这条消息反弹了3.68%,结束了长达九个月的下跌。
这个信号说明:国产AI芯片的实用性已经强到让竞争对手愿意放下架子来买。这不只是商业决策,也是国产替代路线走通的一个现实注脚。

来源:AI Weekly(今日报道) · 2026年7月1日
海外·今日
OpenAI今天发布了一个专门测AI"科研判断力"的基准——不只是看它会不会做题
今天,OpenAI官方发布了GeneBench-Pro,一个专门针对AI在计算生物学研究中判断力的评测基准。它测的不是"AI能不能正确回答这道题",而是"AI在数据不完整、结论不确定的情况下,能不能做出合理的科研判断"。
为什么这个区别很重要?真实科研里,数据永远是有噪声的。研究员每天面对的核心问题是:这个模式是真实的生物信号,还是实验噪声?这个数据能不能支撑我想问的问题?这个结果该怎么改变我下一步的计划?这些都是"更高阶的判断",不是背公式能解决的。
GeneBench-Pro用的是更难、更接近真实研究的合成任务,同时开源了部分代表性问题供外部验证。OpenAI在发布时报告了主要模型在这个基准上的成绩,但没有公布具体排名——只说"在科学推理不确定性上显示出强劲结果"。
这条新闻和这个月我们报过的几条放在一起看很有意思:上周GPT-5帮免疫学家解开3年谜题,上上周DeepMind一周解开9道数学难题,今天OpenAI发布专门测科研判断力的基准——AI进入科研的速度,比大多数人意识到的要快得多。

来源:Releasebot(原始来源:OpenAI官方,今日发布)· 2026年7月1日
夜雨聆风