Attention-Head-Pruning

(★ 22)

Layer-wise Pruning of Transformer Heads for Efficient Language Modeling

Attention-Head-Pruning 최신버젼 다운로드

최종 버전 다운로드 (.zip)
// repository documentation