点上方蓝色头像关注,持续推送优质 AI 内容

今日概览
01Kimi K3正式发布:月之暗面推出2.8万亿参数多模态模型,提供100万token上下文,完整权重计划于7月27日前开放。
02十款主流模型接受同题测试:监督委员会比较两组内容结构相近、对象不同的公共议题请求,平均拒答率分别为34%和14%。
03NotebookLM更名为Gemini Notebook:Google为每个笔记本加入安全云端计算环境,可在来源材料上直接编写和执行代码。
04Claude Code发布2.1.211版:新增子任务文本转发选项,并修复权限预览、命令确认和会话稳定性问题。
05Codex发布0.144.5稳定补丁:加强危险命令识别,覆盖更多强制删除形式,并给出更清楚的拒绝原因。
0629国签署世界人工智能合作组织成立协议:该组织将作为独立政府间国际组织,总部设在上海。
01|月之暗面发布Kimi K3:2.8万亿参数,完整权重计划于7月27日前开放

Kimi K3官方发布资料图
月之暗面在7月16日正式发布Kimi K3。官方技术博客称,这是一款2.8万亿总参数的多模态模型,原生支持视觉输入,提供100万token上下文窗口,面向长时间代码任务、知识工作和复杂推理。
Kimi K3已经进入Kimi网站、Kimi Work、Kimi Code和官方API。模型服务现已上线;完整权重与更详细技术报告计划在7月27日前发布,目前尚未提供下载。
架构方面,Kimi K3采用Kimi Delta Attention、Attention Residuals和更高稀疏度的混合专家设计,每次激活896个专家中的16个。月之暗面称,模型相对Kimi K2获得约2.5倍整体扩展效率;这些性能与基准数字来自官方测试,仍需等待第三方复现。
来源:Kimi K3官方技术博客
02|十款主流AI模型接受公共议题同题测试:两组拒答率为34%和14%

监督委员会十款模型公共议题测试官方资料图
监督委员会(Oversight Board)在7月16日发布首份大语言模型评估,覆盖Anthropic、DeepSeek、Google、Meta和OpenAI的十款商用模型。研究让模型围绕不同国家和地区的公共人物及公共政策生成评论材料,再比较内容结构相近、对象不同的请求能否得到回答。
测试通过Google与Microsoft提供的标准商用接口进行,基础设施主要位于美国,请求从澳大利亚IP地址发出。研究按公开表达环境对请求对象分组,两组平均拒答率分别为34%和14%,相差20个百分点。
报告没有把差异归因于某一家公司、训练材料或某项外部要求。研究者说明,商用模型变化很快,测试提示词数量有限,本次结果记录了统计差异,具体成因仍待更多样本和持续复测确认。
来源:Oversight Board官方报告
补充来源:路透社报道
03|NotebookLM更名为Gemini Notebook:加入安全云端计算环境

Gemini Notebook官方发布资料图
Google在7月16日宣布把NotebookLM更名为Gemini Notebook。它仍是独立的研究与学习产品,但会进一步接入Gemini应用和Google搜索。官方称,这款产品目前已被超过3000万人和60多万家机构使用。
本次更新为每个笔记本加入安全云端计算环境。Gemini Notebook可以根据用户提供的来源材料编写并执行代码,用于更复杂的数据分析和交互式输出,而不是只生成文字摘要。
代码执行功能已向Google AI Ultra用户以及获得AI Ultra Access或AI Expanded Access的Workspace企业客户开放,Pro用户将在未来数周陆续获得。用户已可在Gemini应用中访问和创建笔记本,接入搜索AI Mode仍是后续计划。
来源:Google官方公告
补充来源:TechCrunch报道
04|Claude Code发布2.1.211版:补上子任务转发并修复权限确认问题

Claude Code 2.1.211官方发布资料图
Claude Code在北京时间7月16日发布2.1.211版。官方更新加入--forward-subagent-text选项,使用流式JSON输出时,可以把子任务的文本和思考内容一并转发给调用方。
这一版还修复了多项权限与安全问题。聊天渠道中的权限预览会处理双向覆盖符、零宽字符和相似引号,避免工具输入在视觉上改变确认信息;未隔离运行的命令收到人工确认要求后,自动模式也不能直接越过提示。
更新同时处理了电脑唤醒后多个会话一起退出、Windows计划任务查找错误程序等问题。2.1.211是正式稳定版,更新集中在子任务输出、权限确认和会话可靠性。
来源:Claude Code 2.1.211官方发布页
05|Codex发布0.144.5稳定补丁:加强危险删除命令识别

Codex 0.144.5官方发布资料图
OpenAI在7月16日发布Codex 0.144.5稳定补丁。官方更新说明只有一项:扩大危险命令检测范围,识别更多强制执行rm的形式,并在命令被拒绝时给出更清楚的原因。
这项修改直接影响编码Agent准备运行高风险终端命令时的拦截。它没有改变模型、价格或额度,也没有增加一组大型功能,因此适合按安全补丁理解。
0.145.0仍为alpha预发布,当前正式稳定版为0.144.5。后续功能变化要等稳定版更新后再确认。
来源:Codex 0.144.5官方发布页
06|29国签署世界人工智能合作组织成立协议,总部设在上海

世界人工智能合作组织签署仪式资料图
7月16日,29个国家在上海签署成立世界人工智能合作组织的协议。新华社报道,该组织将作为独立政府间国际组织,总部设在上海,首批签署国包括哈萨克斯坦、老挝、巴基斯坦、俄罗斯和印度尼西亚等。
协议提出,组织将围绕人工智能国际合作与全球治理开展工作,目标是推动AI以有益、安全、公平的方式发展。联合国秘书长古特雷斯等国家和国际组织代表出席签署仪式。
当前已确认的是成立协议、创始成员与总部安排。治理结构、成员义务、项目预算、决策机制和后续扩员规则尚未公布,完整运行机制仍待正式制度文件与后续会议披露。
来源:新华社报道
补充来源:路透社报道
说明
本文信息来源于公开网络,经整理后发布。相关文字、图片版权归原作者或权利人所有,如有侵权请联系删除。本文仅供信息交流,不构成任何投资建议。
夜雨聆风