思维模式的调解:LLM 用于设计脚本
计算与语言
2024-12-05 v2 人工智能
人机交互
摘要
建筑师采用可视化脚本和参数化设计工具来探索更广泛的设计空间(Coates, 2010)、细化其对设计几何逻辑的思考(Woodbury, 2010),以及克服传统软件的局限性(Burry, 2011)。尽管两十年来致力于使设计脚本更易于使用,但设计者的自由思维方式与算法刚性之间的鸿沟仍然存在(Burry, 2011)。最近的大型语言模型(LLM)发展表明,这种局限性可能会很快改变,因为 LLM 编码了对人类情境的通用理解,并且具有产生几何逻辑的能力。本项目推测,如果 LLM 能有效地在用户意图与算法之间进行调解,它们将成为使设计脚本更普及且有趣的强大工具。我们探讨了此类系统是否能够解释自然语言提示,以组装与计算设计脚本相关的几何操作。在该系统中,配置多个具有特定上下文的 LLM 代理以推断用户意图并构建顺序逻辑。给定用户的高层文本提示后,将创建几何描述,提炼为逻辑操作序列,并映射到软件特定命令。该系统在一定复杂度范围内能够生成完整的视觉脚本,但在超过此阈值后会失败。这表明 LLM 如何使设计脚本更贴合人类创造力和思维方式。未来的研究应探索对话式交互,扩展到多模态输入和输出,并评估这些工具的性能。
引用
@article{arxiv.2411.14485,
title = {Mediating Modes of Thought: LLM's for design scripting},
author = {Moritz Rietschel and Fang Guo and Kyle Steinfeld},
journal= {arXiv preprint arXiv:2411.14485},
year = {2024}
}
备注
Published at ACADIA 2024