PixInWav:用于隐藏像素于音频中的残差隐写术
多媒体
2021-06-21 v1 声音
音频与语音处理
摘要
隐写术包含将数据中隐藏于可公开获取的主媒体中的机制。先前工作聚焦于单模态设置(例如,将图像隐藏于图像中,或将音频隐藏于音频中),而 PixInWav 面向将图像隐藏于音频中的多模态情形。为此,我们提出一种在短时离散余弦变换(STDCT)音频谱图上运行的新型残差架构。在我们的结果中,我们发现所提出的残差音频隐写设置允许隐藏图像与主机音频的独立编码而不损害质量。因此,虽然先前工作需同时具备主机与隐藏信号以隐藏信号,PixInWav 可离线编码图像——其后可以残差方式隐藏于任意音频信号中。最后,我们在实验室环境中测试我们的方案,通过空气从扬声器向麦克风传输图像,验证了我们的理论见解并获得了有前景的结果。
引用
@article{arxiv.2106.09814,
title = {PixInWav: Residual Steganography for Hiding Pixels in Audio},
author = {Margarita Geleta and Cristina Punti and Kevin McGuinness and Jordi Pons and Cristian Canton and Xavier Giro-i-Nieto},
journal= {arXiv preprint arXiv:2106.09814},
year = {2021}
}
备注
Extended abstract presented in CVPR 2021 Women in Computer Vision Workshop