Computation and Language · Computer Science
An Algorithm for Aligning Sentences in Bilingual Corpora Using Lexical Information
Akshar Bharati, V. Sriram, A. Vamshi Krishna, Rajeev Sangal +1
2007-05-23
Computation and Language · Computer Science
Learning Contextualised Cross-lingual Word Embeddings and Alignments for Extremely Low-Resource Languages Using Parallel Corpora
Takashi Wada, Tomoharu Iwata, Yuji Matsumoto, Timothy Baldwin +1
2021-10-22
Computation and Language · Computer Science
Agreement-based Learning of Parallel Lexicons and Phrases from Non-Parallel Corpora
Chunyang Liu, Yang Liu, Huanbo Luan, Maosong Sun +1
2016-06-16
Artificial Intelligence · Computer Science
Fine-Grained Word Sense Disambiguation Based on Parallel Corpora, Word Alignment, Word Clustering and Aligned Wordnets
Dan Tufis, Radu Ion, Nancy Ide
2007-05-23
Computation and Language · Computer Science
Improving Pretrained Cross-Lingual Language Models via Self-Labeled Word Alignment
Zewen Chi, Li Dong, Bo Zheng, Shaohan Huang +3
2021-09-14
Computation and Language · Computer Science
Joint Word Representation Learning using a Corpus and a Semantic Lexicon
Danushka Bollegala, Alsuhaibani Mohammed, Takanori Maehara, Ken-ichi Kawarabayashi
2015-11-23
Computation and Language · Computer Science
Fine-Grained Analysis of Cross-Linguistic Syntactic Divergences
Dmitry Nikolaev, Ofir Arviv, Taelin Karidi, Neta Kenneth +3
2020-07-14
Computation and Language · Computer Science
Graph Algorithms for Multiparallel Word Alignment
Ayyoob Imani, Masoud Jalili Sabet, Lütfi Kerem Şenel, Philipp Dufter +2
2021-09-15
Computation and Language · Computer Science
ALAS: Measuring Latent Speech-Text Alignment For Spoken Language Understanding In Multimodal LLMs
Pooneh Mousavi, Yingzhi Wang, Mirco Ravanelli, Cem Subakan
2025-07-08
Computation and Language · Computer Science
PART: Progressive Alignment Representation Training for Multilingual Speech-To-Text with LLMs
Pei Zhang, Andong Chen, Xi Chen, Baosong Yang +2
2025-09-25
Computation and Language · Computer Science
Harvesting comparable corpora and mining them for equivalent bilingual sentences using statistical classification and analogy- based heuristics
Krzysztof Wołk, Emilia Rejmund, Krzysztof Marasek
2015-11-20