中文

内容识别基本极限的信息论分析

信号处理 2018-10-09 v1

摘要

我们从信息论视角研究内容识别问题并推导其基本极限。此处,版权方公司希望借助安全公司的资源追踪其商业内容的非法使用,同时保障其内容隐私。出于隐私问题,版权方公司仅向安全公司公开原始内容的某些哈希值。我们将版权方公司的商业内容视为编码器的码本,将内容(提供给安全公司)的哈希值视为解码器的码本,即编码器与解码器对应的码本并不相同。因此,内容识别被建模为编码器与解码器使用非对称码本的通信问题。我们进一步通过向通信设置添加“安全”约束以防止在给定解码器码字时估计编码器码字,从而解决内容识别中的“隐私问题”。通过此建模,所提带安全约束的非对称码本可靠通信问题给出了内容识别问题的基本极限。为此,我们引入信息容量并证明该容量等于编码器码字独立同分布下系统的操作容量,从而给出内容识别的基本极限。作为一个广为人知且被广泛研究的框架,我们针对二元对称信道评估了该容量并给出闭式表达式。

关键词

引用

@article{arxiv.1810.03255,
  title  = {Information Theoretic Analysis of the Fundamental Limits of Content Identification},
  author = {Sait Tunc and Yucel Altug and Serdar Kozat and Kivanc Mihcak},
  journal= {arXiv preprint arXiv:1810.03255},
  year   = {2018}
}