多媒体中基于音频内容的地理标注
声音
2016-11-14 v2 多媒体
摘要
在本文中,我们提出利用多媒体录音的音频来提取地理相关信息的方法。我们的方法主要基于城市声学环境由多种声音组成这一事实。因此,位置信息可以从音频中存在的声音事件/类别的组合中推断出来。更具体地说,我们采用矩阵分解技术以不同声音类别的形式获取录音的语义内容。然后将这些语义信息组合起来以识别录音的位置。
引用
@article{arxiv.1606.02816,
title = {Audio Content based Geotagging in Multimedia},
author = {Anurag Kumar and Benjamin Elizalde and Bhiksha Raj},
journal= {arXiv preprint arXiv:1606.02816},
year = {2016}
}
备注
5 pages