Computation and Language · Computer Science
Sparser is Faster and Less is More: Efficient Sparse Attention for Long-Range Transformers
Chao Lou, Zixia Jia, Zilong Zheng, Kewei Tu
2024-06-25
Computation and Language · Computer Science
Predicting Attention Sparsity in Transformers
Marcos Treviso, António Góis, Patrick Fernandes, Erick Fonseca +1
2022-04-22
Machine Learning · Computer Science
Informer: Beyond Efficient Transformer for Long Sequence Time-Series Forecasting
Haoyi Zhou, Shanghang Zhang, Jieqi Peng, Shuai Zhang +3
2021-03-30
Machine Learning · Computer Science
Towards Long-Term Time-Series Forecasting: Feature, Pattern, and Distribution
Yan Li, Xinjiang Lu, Haoyi Xiong, Jian Tang +3
2023-01-06
Machine Learning · Computer Science
Generating Long Sequences with Sparse Transformers
Rewon Child, Scott Gray, Alec Radford, Ilya Sutskever
2019-04-25
Computation and Language · Computer Science
Explicit Sparse Transformer: Concentrated Attention Through Explicit Selection
Guangxiang Zhao, Junyang Lin, Zhiyuan Zhang, Xuancheng Ren +2
2019-12-30
Machine Learning · Computer Science
Inter-Series Transformer: Attending to Products in Time Series Forecasting
Rares Cristian, Pavithra Harsha, Clemente Ocejo, Georgia Perakis +3
2024-08-08
Machine Learning · Computer Science
Dateformer: Time-modeling Transformer for Longer-term Series Forecasting
Julong Young, Junhui Chen, Feihu Huang, Jian Peng
2023-02-22
Machine Learning · Computer Science
Masked Language Modeling for Proteins via Linearly Scalable Long-Context Transformers
Krzysztof Choromanski, Valerii Likhosherstov, David Dohan, Xingyou Song +7
2020-10-02
Artificial Intelligence · Computer Science
Long Document Ranking with Query-Directed Sparse Transformer
Jyun-Yu Jiang, Chenyan Xiong, Chia-Jung Lee, Wei Wang
2020-10-27
Machine Learning · Computer Science
Sequence Complementor: Complementing Transformers For Time Series Forecasting with Learnable Sequences
Xiwen Chen, Peijie Qiu, Wenhui Zhu, Huayu Li +4
2025-01-07
Machine Learning · Computer Science
Towards Efficient Large Scale Spatial-Temporal Time Series Forecasting via Improved Inverted Transformers
Jiarui Sun, Chin-Chia Michael Yeh, Yujie Fan, Xin Dai +9
2025-03-17
Machine Learning · Computer Science
Triformer: Triangular, Variable-Specific Attentions for Long Sequence Multivariate Time Series Forecasting--Full Version
Razvan-Gabriel Cirstea, Chenjuan Guo, Bin Yang, Tung Kieu +2
2022-05-02
Computation and Language · Computer Science
SEA: Sparse Linear Attention with Estimated Attention Mask
Heejun Lee, Jina Kim, Jeffrey Willette, Sung Ju Hwang
2024-03-26
Machine Learning · Computer Science
Introducing Spectral Attention for Long-Range Dependency in Time Series Forecasting
Bong Gyun Kang, Dongjun Lee, HyunGi Kim, DoHyun Chung +1
2024-11-25
Machine Learning · Computer Science
Sparse Transformer with Local and Seasonal Adaptation for Multivariate Time Series Forecasting
Yifan Zhang, Rui Wu, Sergiu M. Dascalu, Frederick C. Harris
2024-07-17
Machine Learning · Computer Science
Combiner: Full Attention Transformer with Sparse Computation Cost
Hongyu Ren, Hanjun Dai, Zihang Dai, Mengjiao Yang +3
2021-10-29
Machine Learning · Computer Science
Are Self-Attentions Effective for Time Series Forecasting?
Dongbin Kim, Jinseong Park, Jaewook Lee, Hoki Kim
2024-12-24