中文

A11YN:面向可访问 Web 界面代码生成的 LLM 对齐

软件工程 2025-10-17 v1

摘要

大型语言模型(LLM)最近在直接从指令生成功能和审美协调的网页界面方面显示出强大的能力。然而,这些模型常常复制其训练数据中的可访问性缺陷,导致排除对多样化需求和情境用户的界面。为此,我们提出了 A11yn,即首个能够可靠地对生成可访问性合规网页 UI 的代码生成 LLM 进行对齐的方法。A11yn 对一项新颖的奖励函数进行优化,该奖励函数对违反 Web 内容可访问性指南(WCAG)的行为进行惩罚,并根据违规严重程度由可访问性测试引擎识别进行比例惩罚。为支持训练,我们构建了 UIReq-6.8K,一个包含 6,800 个多样化网页 UI 生成指令的数据集。对于评估,我们引入了 RealUIReq-300,一个包含 300 个来自公共网页并经精心挑选的真实世界网页 UI 请求基准,涵盖广泛的用例。实证结果表明,A11yn 显著优于强大基线方法,在保持生成 UI 语义忠实性和视觉质量的同时,将不可访问率降低了 60%。这些发现表明,可访问性可以在 LLM 中系统性地优化,展示了在代码生成中实现可访问性对齐的可行性。

关键词

引用

@article{arxiv.2510.13914,
  title  = {A11YN: aligning LLMs for accessible web UI code generation},
  author = {Janghan Yoon and Jaegwan Cho and Junhyeok Kim and Jiwan Chung and Jaehyun Jeon and Youngjae Yu},
  journal= {arXiv preprint arXiv:2510.13914},
  year   = {2025}
}