跳到正文
原文
Hugging Face·· 2020-09-10AI 评分42

用于更小更快语言模型的块稀疏矩阵

Block Sparse Matrices for Smaller and Faster Language Models

AI 导读

Hugging Face 发布扩展库 pytorch_block_sparse,通过块稀疏矩阵乘法使神经网络更小、更快速。库中提供的 BlockSparseLinear 可直接替换 torch.nn.Linear,并支持动态修改现有模型直接进行常规训练。该扩展基于 NVIDIA CUTLASS 构建,在 75% 稀疏度下比对应稠密矩阵速度快约 2 倍,内存消耗减少 4 倍。

来源:Hugging Face · huggingface.co