乐于分享
好东西不私藏

Kimi K3部署文档引爆算力圈,容芯致远AGC64直接交卷

Kimi K3部署文档引爆算力圈,容芯致远AGC64直接交卷

2026

Kimi K3部署文档引爆算力圈,容芯致远AGC64直接交卷

Kimi K3 技术报告里那句话确实分量很重——“推荐在64卡及以上超节点配置中部署”。

2.8万亿参数、896个专家,MoE架构下通信量大到惊人,跨节点通信一旦卡壳,推理效率直接崩盘。超节点第一次被写进大模型的“安装说明书”——这不是“最好有”,是“没有不行”

大模型已经把“单机”这条路堵死了。谁能在超节点上跑出规模、跑出效率,谁就拿下了下一阶段的入场券。

容芯致远AGC64,64卡超节点,就是为这一刻准备的

SUMMARY ●

64卡?AGC64刚好就是64卡。

Kimi K3要64卡及以上超节点,AGC64F单机正好支持64张GPU。

不是“堆64张卡”,是让64张卡像一张卡一样跑。AGC架构支持单一操作系统统一管理64个GPU,实现全局内存共享,数据不需要跨节点反复拷贝。MoE模型里最怕的跨节点通信延迟,在AGC64这里被从架构层面有效解决。

有些超节点方案还在“规划中”或“预计明年部署”,AGC64已经进入量产阶段。不是PPT,是能交付的。

ANNUAL SUMMARY‌ 

别人绕英伟达,容芯致远走的是另一条路。

《超节点绕行英伟达》说得很清楚:国产算力正在换赛道——不比单卡了,比集群调度、互联效率、系统稳定性

容芯致远在这条赛道上走得更远——重新定义了CPU与GPU的分工协作方式,让CPU回归它最擅长的管理调度角色,把数据通路的主线交给GPU直连,各司其职、各尽其能。

传统架构GPU:CPU比例只有2:1,GPU经常在等CPU调度。AGC架构把这个比例拉到20:1甚至32:1,算力有效利用率从不足40%拉到60%以上。单台AGC64就能跑DeepSeek 671B,硬件还能省50%。

超节点元年,容芯致远已经站上去了。

华泰证券把2026年称为“国产超节点元年”。元年拼的不是谁先喊口号,是谁先能量产、谁先能交付、谁先能让大模型在上面跑出效率。

Kimi K3把超节点写进了大模型的“安装说明书”。容芯致远AGC64,已经把答案装进了机柜。

64卡,已量产可交付。交付周期:两个月

ANNUAL SUMMARY‌ 

关于容芯致远

北京容芯致远科技有限公司聚焦计算机体系结构创新,致力于AI算力基础设施的底层技术突破,属于人工智能未来产业核心赛道。公司研发的全球首创AGC智算体系架构,以GPU为计算核心,突破传统CPU主导的架构逻辑,核心技术涵盖GPU热插拔、GPU-RAID、智能BMC及Bluelink光互连。其中Bluelink技术基于Micro-LED光互连,致力于解决AI超算集群数据传输瓶颈,被列为国家重点研发计划颠覆性技术创新重点专项,具备前沿技术引领能力。