语码转换中的“谁”:基于性格画像预测埃及阿拉伯语-英语语码转换水平的案例研究
计算与语言
2022-08-02 v1
摘要
语码转换(CS)是多语者表现出的一种常见语言现象,他们倾向于在单次对话中交替使用不同语言。CS 是一种复杂现象,不仅包含语言层面的挑战,其在不同说话者之间动态行为方面也极具复杂性。鉴于引发 CS 的因素因国家而异,也因人而异,CS 被发现是一种依赖于说话者的行为,其中外语嵌入的频率在不同说话者间存在差异。尽管若干研究者已从语言学角度探讨预测 CS 行为,但从社会学和心理学视角预测用户 CS 行为的研究仍然匮乏。我们提供了一项实证用户研究,考察用户 CS 水平与性格特质之间的相关性。我们对双语者进行访谈,收集其画像信息,包括人口统计学特征、人格特质和旅行经历。随后我们使用机器学习(ML)基于其画像预测用户的 CS 水平,并识别出建模过程中的主要影响因素。我们同时实验了分类与回归任务。我们的结果表明,CS 行为受到说话者关系、旅行经历以及神经质和外向性人格特质的影响。
引用
@article{arxiv.2208.00433,
title = {The Who in Code-Switching: A Case Study for Predicting Egyptian Arabic-English Code-Switching Levels based on Character Profiles},
author = {Injy Hamed and Alia El Bolock and Cornelia Herbert and Slim Abdennadher and Ngoc Thang Vu},
journal= {arXiv preprint arXiv:2208.00433},
year = {2022}
}
备注
To be published in the International Journal of Asian Language Processing. arXiv admin note: substantial text overlap with arXiv:2112.06462