生成式 AI 在多媒体通信中的应用:最新进展、信息论框架与未来机遇
多媒体
2025-08-26 v1 图像与视频处理
摘要
生成式人工智能(AI)的最新突破正在深刻变革多媒体通信领域。本文系统性地综述了生成式 AI 在多媒体通信中的关键最新进展,重点强调扩散模型和 Transformer 等变革性模型。然而,传统的信息论框架无法解决语义保真度问题,这在人类感知中至关重要。我们提出了创新的语义信息论框架,引入针对多媒体应用专门调整的语义熵、互信息、信道容量和率失真概念。该框架将多媒体通信从纯粹的数据传输重新定义为语义信息的传递。我们进一步指出了未来机遇和关键研究方向。通过联结生成式 AI 的创新与信息论,本文描绘了通向稳健、高效且富有语义意义的多媒体通信系统的道路。本探索性论文旨在激发语义优先范式的转变,提供一种具有重要意义的未来多媒体研究视角的新颖见解。
引用
@article{arxiv.2508.17163,
title = {Generative AI for Multimedia Communication: Recent Advances, An Information-Theoretic Framework, and Future Opportunities},
author = {Yili Jin and Xue Liu and Jiangchuan Liu},
journal= {arXiv preprint arXiv:2508.17163},
year = {2025}
}
备注
ACM Multimedia 2025