乐于分享
好东西不私藏

五台AI超算突然堆上桌!英伟达加码"龙虾"开源项目,本地Agent宣战云端大模型,产品公告已经倒计时!

五台AI超算突然堆上桌!英伟达加码"龙虾"开源项目,本地Agent宣战云端大模型,产品公告已经倒计时!

你以为AI超算是大厂机房里才有的东西?错了。

就在上周,一张照片悄悄在AI社区炸开了锅,五台深灰色的英伟达DGX Spark,整整齐齐叠在一张普通的工作桌上,旁边还坐着一只穿水手条纹衫的红色龙虾毛绒玩具现场没有发布会和新闻稿,只有一句轻描淡写的致谢

然而,懂行的人看到这张图,马上意识到事情并不简单

一只"龙虾",让英伟达亲自送货上门

▲ Vincent Koc发布的主帖配图:五台DGX Spark与OpenClaw龙虾毛绒同框,画面安静,信息量巨大

发这条帖子的人叫Vincent Koc,是开源AI Agent框架OpenClaw的首席架构师他写道:

"衷心感谢@nvidia为OpenClaw工程团队送来DGX Spark。这些机器已经在高强度工作了……我们与NVIDIA的联合努力很快将带来产品公告,本地模型体验改进,以及超越当前可能的本地用例。"

话不多,每个字都是重量。

英伟达官方账号@NVIDIAAI随即回复了一记拳头 👊,这个简单到近乎敷衍的表情,却是最公开、最轻量的盖章确认

▲ 英伟达官方账号以一个拳头表情完成了公开背书,简单,但有分量

这次送货来自一家市值排名全球前列的芯片公司,它主动把自家最新桌面AI超算送进一个开源项目的工程师机房一共五台。

"龙虾"是谁?为什么英伟达要重视它?

如果你没听说过OpenClaw,先记住这句口号:"The AI that really does things."

这句口号描述的是能执行任务的AIOpenClaw是一个local-first(本地优先) 的个人AI Agent框架,它能持续运行、读取你的文件、管理你的日历、代你发邮件、值机买票、控制浏览器,还能通过WhatsApp、Telegram、Discord等你天天在用的聊天软件接受指令

▲ openclaw.ai首页,一键安装命令赫然在目,用户证言墙密密麻麻

简单说:它是一个"会自己动手"的AI管家,功能超出了回答问题的聊天窗口

它的吉祥物是一只红色龙虾🦞,曾用名Clawdbot、Moltbot,现在以OpenClaw品牌在AI社区迅速走红这只"龙虾"走红的速度,已经快到让英伟达不得不重视,从2026年3月起,英伟达接连为OpenClaw发布官方Playbook、举办GTC现场装机活动、推出配套安全栈NemoClaw,一套组合拳打下来,每一步都在把DGX Spark和OpenClaw的名字绑在一起

送五台机器,是这条合作线最新的明确节点

DGX Spark是什么?AI超算如何塞进桌面

很多人听到"AI超算",脑海里浮现的是机房里那种比冰箱还大的服务器柜DGX Spark采用了紧凑的桌面形态

它大约只有一本精装书叠两本那么大,150×150×50.5毫米,重约1.2公斤,放在桌上就像一个特别厚实的Mac mini但别被外形骗了:

▲ NVIDIA官方硬件文档:128GB统一内存、20核Arm CPU、ConnectX-7网络接口,规格不打折

里面装着的是:

  • NVIDIA GB10 Grace Blackwell超级芯片
    (CPU与GPU集成)
  • 128GB统一内存
    ,带宽约273 GB/s
  • 最高约1 PFLOPS的AI算力(FP4标称)
  • 1TB或4TB自加密NVMe存储
  • ConnectX-7高速网络接口

英伟达自己的产品页把它叫做**"Desktop Agent Computer"(桌面Agent计算机),将其定位为专门服务于"始终在线的AI Agent"**的桌面节点

128GB的统一内存意味着什么?意味着原本只能在数据中心里跑的千亿级参数模型,理论上可以完整装进这台放在你桌上的小盒子里单机可以跑约2000亿参数量级的模型原型,双机互联则可以突破更大的参数量级

▲ nvidia.com产品页:"Desktop Agent Computer"的定位已经写进官方大标题

五台叠放透露了什么

回到那张照片。五台机器意味着什么?

技术社区的反应几乎是本能的。用户Zodiac(@Zoddiacc)立刻追问:

"五台已经超出了NVIDIA文档里常见的四节点支持范围,第五台是独立运行,还是通过Exo拼进集群的?另外,agent循环会不会在273 GB/s内存带宽打满之前,算力就先触顶了?"

▲ 社区技术用户@Zoddiacc的追问:五节点拓扑与带宽瓶颈,问题直指工程核心

这是懂行者才会问的问题。五台叠放呈现出一个工程集群的雏形

Vincent在原帖里点名了Exo,这是一个开源项目,专门把多台Mac或工作站"拼"成一个本地推理集群,自动发现设备、按拓扑分配模型层、提供兼容常见API的统一接口

▲ exolabs.net首页:把你手边的设备连成本地推理集群,是Exo的核心价值主张

社区里有用户晒出"龙虾骑在EXO种马上"的梗图,浪漫化了这个组合浪漫背后是真实需求:单机128GB仍有参数上限,多机联网才是社区突破"参数墙"的土法

他们在跑什么模型?答案令人振奋

Vincent的帖子里,除了致谢和预告,还点名了两款正在测试中的本地模型:Poolside Laguna 和 PrismML Bonsai

这两个名字,代表着本地AI模型的两种截然不同的哲学

Laguna S 2.1是Poolside在7月21日前后刚刚发布的旗舰模型:118B总参数、MoE架构、每次推理激活约8B参数、上下文长度可达约100万token官方博客明确写道:它"小到足以在单台NVIDIA DGX Spark上完成复杂工作",并与英伟达在TRT-LLM、NVFP4、Blackwell推理优化上深度合作

回复帖里,另一位用户Evan直接写道:"Poolside very impressed"

▲ Poolside《Introducing Laguna S 2.1》:118B参数MoE,单台Spark可跑,并与英伟达深度合作推理优化

Bonsai,走的是完全相反的路,PrismML的1-bit量化系列,8B参数版本体积约1.15GB,可以跑在几乎任何设备上一个追求极致性能,一个追求极致轻量两者并列出现在Vincent的帖子里,隐约勾勒出OpenClaw未来可能覆盖的硬件光谱:从手机到Spark,统一调度,统一体验

推理引擎没有银弹,工程选择因模型而变

Hugging Face的开发者merve(@mervenoyann)跑来问:"你们用什么推理引擎?"

▲ Hugging Face的merve来问推理引擎选型,这一问戳中了社区痛点

OpenClaw维护者Onur Solmaz(@onusoz)给出了这场讨论里最务实的回答:

"因模型而异。我见过llama.cpp表现更好的情况,也见过vLLM表现更好的情况。性能会随版本迭代而提升。"

▲ OpenClaw维护者的务实回答:没有"唯一最优后端",看模型说话

这话听起来平淡,但信息量极大。它打破了"官方最优推理栈"的幻觉,英伟达Playbook里推荐的vLLM+NVFP4配方和社区喜欢的llama.cpp量化路线,都是当下的最优近似,仍有继续演进的空间

英伟达自己的文档也在随着工程实践迭代:从最初的Ollama路径,到现在把vLLM+nvidia/Qwen3.6-35B-A3B-NVFP4写进默认配方,Playbook的演化本身就是一部工程探索史

这次送礼连接着一条完整生态链

看清楚时间线,你会发现这项合作已经铺垫数月

2026年3月,英伟达发布OpenClaw on DGX Spark官方Playbook,把"agentic workflows on Grace Blackwell"写进官方话术;GTC现场设置Build-A-Claw活动,参与者可当场购买Spark,由英伟达工程师协助安装OpenClaw

2026年4月,技术博客推出NemoClaw:在OpenClaw之外叠加OpenShell沙箱与策略隔离,目标是"更安全的常开本地助手",因为一个能读文件、开终端的AI Agent,一旦配置错误,数据泄露与恶意代码风险是真实存在的

2026年7月,五台Spark送进工程师机房,联合产品公告预告出炉

▲ 英伟达技术博客:NemoClaw+OpenClaw+DGX Spark,安全常开本地Agent的完整栈

这是一条"硬件,运行时,安全,活动,联合产品"的完整漏斗英伟达用最热门的开源Agent运行时,为DGX Spark这款"桌面Agent计算机"提供了最有说服力的社会证明

本质上,这是一场关于"谁来做大脑"的战争

当AI助手从每天偶发的问答,变成24小时不间断运转的工具循环,按token计费的云端大模型,账单会以你没预料到的速度暴涨更不用说,你给一个"会自己动手"的AI Agent接入云端API,意味着你的日历、邮件、文件,都在以某种形式经过云服务器

这是隐私焦虑与成本焦虑的双重叠加

128GB统一内存的DGX Spark,加上Laguna这类"能在单机上跑的强力MoE",加上Bonsai这类"轻到可以随身带"的1-bit模型,本地路线第一次在性能上接近了"可以认真干活"的门槛

英伟达GeForce的指南给出的理由是:"云端助手方便,但本地Agent回应的是隐私与成本焦虑"

▲ NVIDIA GeForce指南:面向RTX用户,明确点出云API的费用与数据上传问题

等待"产品公告"

目前唯一确定的是:"Product announcements soon."

功能列表、发售价格和绑定模型仍未公布但五台Spark叠在那里,社区的追问沸腾起来,英伟达的拳头表情落下去,所有信号都指向同一个方向:本地AI Agent的重要节点,正在逼近

那只穿水手条纹衫的红色龙虾毛绒,静静坐在五台超算旁边,面无表情

但它下一步要去哪里,整个AI社区都在等着看

资料来源:Vincent Koc @vincent_koc 原帖、NVIDIA官方文档与博客、Poolside Laguna S 2.1发布博文、OpenClaw官网、Exo Labs、PrismML Bonsai公告等公开材料