中文

MemoVis:一款由生成式人工智能驱动的用于为三维设计反馈创建配套参考图像的工具

人机交互 2024-09-17 v2

摘要

提供异步反馈是三维设计工作流程中的关键步骤。一种常见的反馈方式是将文本评论与配套参考图像配对,这有助于说明文本的要点。理想情况下,反馈提供者应具备三维和图像编辑技能,以创建能够有效描述他们想法的参考图像。然而,他们通常缺乏此类技能,因此不得不求助于草图或在线图像,而这些图像可能与当前的三维设计不匹配。为了解决这个问题,我们推出了 MemoVis,这是一个文本编辑器界面,它利用由反馈评论驱动的生成式人工智能,协助反馈提供者创建参考图像。首先,基于视觉-语言基础模型的新颖实时视点建议功能,帮助反馈提供者将评论与相机视点锚定。其次,给定一个相机视点,我们引入了三种基于预训练二维生成模型的图像修改器,将文本评论转化为该视点下三维场景的更新版本。我们与反馈提供者进行了一项受试者内研究,证明了 MemoVis 的有效性。配套图像的质量和明确性由另外八名具有三维设计经验的参与者进行了评估。

关键词

引用

@article{arxiv.2409.06082,
  title  = {MemoVis: A GenAI-Powered Tool for Creating Companion Reference Images for 3D Design Feedback},
  author = {Chen Chen and Cuong Nguyen and Thibault Groueix and Vladimir G. Kim and Nadir Weibel},
  journal= {arXiv preprint arXiv:2409.06082},
  year   = {2024}
}

备注

In the Journal of ACM Transactions on Computer-Human Interaction