ISO 639:2023 中递归语义锚定:面向 ISO/TC 37 框架的结构性扩展
计算机科学中的逻辑
2025-06-10 v1 人工智能
摘要
ISO 639:2023 统一了 ISO 语言编码系列并引入情境元数据,但缺乏处理方言漂移和克劳语混合的机器原生机制。我们提出递归语义锚定的形式化方法,为每个语言实体 附加一族固定点算子 ,通过关系 模型受限语义漂移,其中 为潜在语义流形中的漂移向量。基准锚 恢复 ISO 639:2023 标准身份,而 标记最大漂移状态,触发确定性后备。我们采用范畴论将算子 视为态射,将漂移向量视为范畴 中的箭头。函子 将每个漂移对象映射到其唯一锚点并证明收敛。我们提供 RDF/Turtle 模式(`BaseLanguage`、`DriftedLanguage`、`ResolvedAnchor`)及实例——例如 (标准普通话)与 (口语变体),以及 用于尼日利亚皮钞语锚定。变压器模型实验表明,在使用 -指数指导后备路由时,针对噪声或代码混合输入的语言识别和翻译准确率显著提升。该框架与 ISO/TC 37 兼容,为未来标准提供面向 AI 的、具漂移感知的语义层。
引用
@article{arxiv.2506.06870,
title = {Recursive Semantic Anchoring in ISO 639:2023: A Structural Extension to ISO/TC 37 Frameworks},
author = {Bugra Kilictas and Faruk Alpay},
journal= {arXiv preprint arXiv:2506.06870},
year = {2025}
}
备注
21 pages, no figures. Includes formal proofs, RDF/Turtle ontology schema, {\phi}-index disambiguation cases, and evaluation of transformer-based AI models under semantic drift