2 月 26 日,DeepSeek 宣布开源 DeepGEMM。
DeepGEMM 是一个专为简洁高效的 FP8 通用矩阵乘法,GEMM 设计的库,具有细粒度缩放功能,如 DeepSeek-V3 中所提出。它支持普通和混合专家(MoE)分组的 GEMM。该库采用 CUDA 编写,在安装过程中无需编译,通过使用轻量级的即时编译(JIT)模块在运行时编译所有内核。
(羊城晚报•羊城派综合自澎湃新闻、潇湘晨报)