Entity

  • CASSINI - CASSINI 网络感知 ML 集群调度器:几何抽象交错通信相位,Affinity 图,1.6× 吞吐改善
  • Cerebras WSE - Cerebras 晶圆级加速器;HC2026 CS-4 = 3× WSE-3T;CS-6 预告 3D DRAM
  • DeepSeek-V4 - V4 模型系列:1.6T/284B MoE,百万 token 上下文,CSA+HCA 混合注意力
  • Graphcore IPU - Graphcore Colossus Mk2 IPU:1472 全互联 core、896 MB 分布式 SRAM,Voxel 论文用于 3D AI chip 仿真验证
  • Kyber Rack - NVIDIA 第二种 rack 架构,144 GPU/rack,NVLink 7 switch,支持 NVL144/288/1152
  • Moonshot AI Kimi K3 - 月之暗面 2026-07 发布的 2.8T 参数开源 LLM;KDA + 周期 MLA + AttnRes 混合架构;原生视觉 + 1M context;激活 16 of 896 routed + 2 shared experts
  • MRC (Multipath Reliable Connection) - Multipath Reliable Connection:OpenAI/Microsoft/AMD/NVIDIA/Broadcom 联合设计的多路径 RDMA 传输协议,包 spraying + 选择性重传,100K+ GPU 训练集群生产部署
  • NVIDIA Groq 3 LPX - NVIDIA rack-scale LPU;HC2026 第一手 10,996 TPS/user、350 ns C2C、40 PB/s
  • NVIDIA Vera Rubin NVL72 - NVIDIA Vera Rubin;HC2026 NVLink 6 3.6 TB/s、七芯片五机柜、Vera C2C 1.8 TB/s
  • 深入理解 AI Infra(李博杰) - 开源教材:从约束推导设计;五个数据搬移问题;十二章预算/机制摘要
  • UnifiedBus (UB) - Huawei UnifiedBus 高性能互连协议,SuperPoD-scale AI/HPC,统一协议栈,全资源池化
  • Vera ETL256 - 256 CPU 独立 rack,Spectrum-6 ETL switch,液冷,全 copper 互联