Cursor 开源 MoK:MoE 通信延迟从 103μs 压至 18μs,单卡吞吐提升 41%
Cursor 开源 MoK 项目,将 Token 调度、跨 GPU 通信与专家计算打包进单一 GPU kernel,在 NVIDIA GB300 上单卡吞吐提升 41%、信令延迟从 103 微秒降至 18 微秒,成为应用层改写底层算力调度的标志性案例,显示 AI 编程工具开始向上游计算效率要性能。
Cursor 开源 MoK 项目,将 Token 调度、跨 GPU 通信与专家计算打包进单一 GPU kernel,在 NVIDIA GB300 上单卡吞吐提升 41%、信令延迟从 103 微秒降至 18 微秒,成为应用层改写底层算力调度的标志性案例,显示 AI 编程工具开始向上游计算效率要性能。