Computation and Language · Computer Science
TopicBERT for Energy Efficient Document Classification
Yatin Chaudhary, Pankaj Gupta, Khushbu Saxena, Vivek Kulkarni +2
2020-11-02
Computation and Language · Computer Science
EarlyBERT: Efficient BERT Training via Early-bird Lottery Tickets
Xiaohan Chen, Yu Cheng, Shuohang Wang, Zhe Gan +2
2021-06-09
Computation and Language · Computer Science
ALBERT: A Lite BERT for Self-supervised Learning of Language Representations
Zhenzhong Lan, Mingda Chen, Sebastian Goodman, Kevin Gimpel +2
2020-02-11
Computation and Language · Computer Science
FastBERT: a Self-distilling BERT with Adaptive Inference Time
Weijie Liu, Peng Zhou, Zhe Zhao, Zhiruo Wang +2
2020-04-30
Computation and Language · Computer Science
Efficient Fine-Tuning of Compressed Language Models with Learners
Danilo Vucetic, Mohammadreza Tayaranian, Maryam Ziaeefard, James J. Clark +2
2022-08-04
Computation and Language · Computer Science
RoBERTa: A Robustly Optimized BERT Pretraining Approach
Yinhan Liu, Myle Ott, Naman Goyal, Jingfei Du +6
2019-07-29
Computation and Language · Computer Science
An Automatic and Efficient BERT Pruning for Edge AI Systems
Shaoyi Huang, Ning Liu, Yueying Liang, Hongwu Peng +4
2022-06-22
Computation and Language · Computer Science
BEBERT: Efficient and Robust Binary Ensemble BERT
Jiayi Tian, Chao Fang, Haonan Wang, Zhongfeng Wang
2023-05-10
Computation and Language · Computer Science
RomeBERT: Robust Training of Multi-Exit BERT
Shijie Geng, Peng Gao, Zuohui Fu, Yongfeng Zhang
2021-01-26
Computation and Language · Computer Science
CoRe: An Efficient Coarse-refined Training Framework for BERT
Cheng Yang, Shengnan Wang, Yuechuan Li, Chao Yang +3
2021-02-19
Computation and Language · Computer Science
RefBERT: Compressing BERT by Referencing to Pre-computed Representations
Xinyi Wang, Haiqin Yang, Liang Zhao, Yang Mo +1
2021-06-17
Computation and Language · Computer Science
MC-BERT: Efficient Language Pre-Training via a Meta Controller
Zhenhui Xu, Linyuan Gong, Guolin Ke, Di He +4
2020-06-17
Computation and Language · Computer Science
Downstream Datasets Make Surprisingly Good Pretraining Corpora
Kundan Krishna, Saurabh Garg, Jeffrey P. Bigham, Zachary C. Lipton
2023-05-29
Computation and Language · Computer Science
bert2BERT: Towards Reusable Pretrained Language Models
Cheng Chen, Yichun Yin, Lifeng Shang, Xin Jiang +6
2021-10-15
Computation and Language · Computer Science
Elbert: Fast Albert with Confidence-Window Based Early Exit
Keli Xie, Siyuan Lu, Meiqi Wang, Zhongfeng Wang
2021-07-02
Computation and Language · Computer Science
DeeBERT: Dynamic Early Exiting for Accelerating BERT Inference
Ji Xin, Raphael Tang, Jaejun Lee, Yaoliang Yu +1
2020-04-28
Computation and Language · Computer Science
MosaicBERT: A Bidirectional Encoder Optimized for Fast Pretraining
Jacob Portes, Alex Trott, Sam Havens, Daniel King +5
2024-01-17
Computation and Language · Computer Science
StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding
Wei Wang, Bin Bi, Ming Yan, Chen Wu +4
2019-09-30
Computation and Language · Computer Science
Q8BERT: Quantized 8Bit BERT
Ofir Zafrir, Guy Boudoukh, Peter Izsak, Moshe Wasserblat
2021-12-20
Computation and Language · Computer Science
DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter
Victor Sanh, Lysandre Debut, Julien Chaumond, Thomas Wolf
2020-03-03
Computation and Language · Computer Science
NarrowBERT: Accelerating Masked Language Model Pretraining and Inference
Haoxin Li, Phillip Keung, Daniel Cheng, Jungo Kasai +1
2023-06-07
Computation and Language · Computer Science
RoChBert: Towards Robust BERT Fine-tuning for Chinese
Zihan Zhang, Jinfeng Li, Ning Shi, Bo Yuan +5
2022-10-31