Cursor 重排 GPU 流水線,MoE 模型訓練提速41%
2026-08-05 12:29:52
幣界網消息,Cursor開源的mixture-of-kittens(mok)用於加速MoE大模型訓練。該技術將原本分開的GPU數據傳輸和計算合併為一個kernel,允許GPU在傳輸數據的同時進行計算,從而減少等待時間。在512塊GB300 GPU的实际訓練中,整體吞吐量提高了41%。單獨測試MoE層時,mok的速度最高比公開方案快2.37倍。mok已用於Cursor數萬塊GPU的composer訓練,并以Apache 2.0開源。目前僅支持輝達Blackwell GPU,主要面向擁有GB200、GB300 NVL72集羣的機構。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HQYC官方帳號,及時關注最新動態






