乐于分享
好东西不私藏

DeepSeek Harness 插件一夜燃爆 GitHub:长期记忆、电子宠物、小游戏全来了【AI 日报 2026年8月17日】

DeepSeek Harness 插件一夜燃爆 GitHub:长期记忆、电子宠物、小游戏全来了【AI 日报 2026年8月17日】

要闻

#1 DeepSeek Harness 插件一夜燃爆 GitHub:长期记忆、电子宠物、小游戏全来了

#2 两年磨一剑!Ilya 首个模型曝光,SSI 走"边推理边学习"的 TTT 路线

#3 Claude 联合人类破解 30 年难题:扫清 2000 阶以下全部哈达玛矩阵

开发生态

#4 388 个 PR 全自动提交:Claude Code 之父让 AI 全权维护一款 App

产品应用

#5 阿里千问开放 AI 眼镜生态:导游、教练、巡检都能自己建 Skill


DeepSeek Harness 插件一夜燃爆 GitHub:长期记忆、电子宠物、小游戏全来了

#1

大家已经给 DeepSeek 装上了啥?长期记忆、电子宠物、4399 小游戏全来了。

8 月 16 日晚间起,DeepSeek Harness 的插件生态在 GitHub 上爆发式增长。Harness 是 DeepSeek 于 8 月 13 日以 MIT 协议开源的智能体框架,采用“一切皆插件”架构——模型、工具、技能、会话均可自由替换重组。短短两三天,社区开发者就为它装上了长期记忆、电子宠物、4399 小游戏等五花八门的插件,量子位以“一夜燃爆 GitHub”形容这一社区现象。

此前,腾讯 QQ Bot 已宣布接入 Harness,国家超算互联网也上线了其全套源码。作为 DeepSeek 在智能体赛道的开源底座,Harness 的插件生态能否复制 VS Code、浏览器扩展式的“平台效应”,成为开发者社区近期最关注的话题之一。就在同一周,DeepSeek 完成了 V4 系列正式版发布与新定价调整,开源 + 商业化两条线都在加速。


两年磨一剑!Ilya 首个模型曝光,SSI 走"边推理边学习"的 TTT 路线

#2

SSI 正在探索基于 TTT(Test-Time Training,测试时训练)的小型推理引擎——模型会学习"如何学习",并在解决问题的过程中动态更新部分权重。

8 月 15 日,X 上网友爆料称,Ilya Sutskever 创办的 SSI(Safe Superintelligence)正在开发其首个模型:一个基于 TTT(测试时训练) 技术的小型推理引擎。与传统大模型推理时权重固定不同,这个引擎会在解决实际问题的过程中动态更新部分权重——相当于"边干活边长脑子"。爆料者称,即使模型规模不大,也足以与经过更大规模训练的模型掰手腕;当前版本已经准备就绪,最快 8 月向少数用户开放,下一代版本的规模将直接扩展 10 倍

SSI 成立两年多来不发模型、不做产品、不公开论文,外界对其研究方向几乎一无所知。这一爆料与此前几条公开线索高度吻合:一是 SSI 投资人 Gavin Baker 本月初透露其将在 8 月发布首个模型;二是 7 月英伟达在看过 SSI 高度保密的研究后果断加码,将它的算力提升了一个数量级;三是技术路线与 Ilya 多次公开强调的观点一致——他在去年 11 月的播客中直言"预训练这个词把行业带偏了",真正的超级智能应当能够在部署之后持续学习。如果爆料属实,这将是 Ilya 离开 OpenAI 后交出的第一份答卷,被社区形容为"一把会在出手时自己变招的剑"。


Claude 联合人类破解 30 年难题:扫清 2000 阶以下全部哈达玛矩阵

#3

Anthropic 研究员、数学家 Levent Alpöge 报告称,他们找到了解决 668 阶哈达玛矩阵的方案——12 张矩阵,直接扫清了 2000 阶以下所有悬而未决的哈达玛矩阵阶数。

8 月 15 日,Anthropic 研究员、数学家 Levent Alpöge 与两名人类合作者带着 Claude,构造出了 668 阶哈达玛矩阵。668 阶自 2005 年被 428 阶取代后,一直是哈达玛猜想中最小的未知阶数,难倒人类数学家整整 30 年。Alpöge 在 X 上发布了一条只有 23828 个"+"和"-"符号的推文,配套的解密脚本最终吐出 12 组矩阵,对应 668、716、892、1132、1244、1388、1436、1676、1772、1916、1948 和 1964 阶——正是此前 2000 阶以下全部 12 个空缺

这道题被收录在菲尔兹奖得主陶哲轩等 60 余人联合出题的 FrontierMath 高阶数学基准中,这是其 50 个开放问题里第 4 个被 AI 解决的(此前 2 个由 GPT 解决、1 个由 Claude 解决),EpochAI 已暂时将题目标注为"由 AI 解决"。不到一个月前,Claude 刚协助人类推翻雅可比猜想;如今再度传来捷报。外界的评点是:AI 正在成为人类数学家的"超级推演助理",人类对数学底层规律的探索速度正在被显著加快。


388 个 PR 全自动提交:Claude Code 之父让 AI 全权维护一款 App

#4

在 Slack 频道 proj-claude-maintains-apps 中,AI 自主完成 388 个 PR 提交,其中 180 个被成功合并,全部代码由 AI 编写。

8 月 16 日,Claude Code 创始人 Boris Cherny 公布了一项实验:让 Claude 在 Slack 频道"proj-claude-maintains-apps"中全权负责一款 App 的日常维护。AI 自主完成了 388 个 PR 提交,其中 180 个被成功合并,全部代码由 AI 编写,涵盖 bug 修复、依赖更新与小功能迭代。Cherny 观察到,Claude 能理解上下文、自主规划任务、调试并生成测试用例,初步验证了 AI 自主软件维护的可行性。

尽管实验仍存在边界模糊、复杂重构受限等问题,但这一实践为"AI 驱动 DevOps"提供了重要实证。当 AI 不仅能写代码、还能自己改 bug 和发版本,开发者的角色正在从"写代码的人"转向"定义问题的人"——这与 Anthropic 此前披露的"生产代码库中绝大多数代码由 Claude 编写"相互印证,AI 在软件工程链路中的自主程度正在快速上升。


阿里千问开放 AI 眼镜生态:导游、教练、巡检都能自己建 Skill

#5

千问开放平台已上线,并支持 AI 眼镜端。开发者可利用拍照、语音交互等能力创建特定场景的 Skill,如视障辅助、景点导览等。

8 月 16 日,阿里千问开放平台正式上线并支持 AI 眼镜端。开发者可利用拍照、语音交互等能力,为眼镜场景创建导游、教练、巡检等专属 Skill,面向行业还可提供工业巡检助手等深度定制服务。这意味着千问把开源模型生态延伸到了 AI 眼镜这一新兴硬件入口上。

此前,千问刚凭借全球下载量突破 30 亿次登顶开源模型下载量第一。此次开放眼镜生态,是其"旗舰开源 + 全尺寸覆盖 + 多端落地"策略的又一落子。在苹果、Meta 等巨头争夺 AI 眼镜市场的当下,国产模型厂商正试图通过生态开放与场景定制抢占开发者心智,AI 眼镜或许会成为大模型下一个贴身入口。


关注 Daniel AI Notes,每天 3 分钟,跟上 AI 时代。