We study the sample complexity of estimating the covariance matrix $\mathbf{\Sigma} \in \mathbb{R}^{d\times d}$ of a distribution $\mathcal D$ over $\mathbb{R}^d$ given independent samples, under the assumption that $\mathbf{\Sigma}$ is graph-structured. In particular, we focus on shortest path covariance matrices, where the covariance between any two measurements is determined by the shortest path distance in an underlying graph with $d$ nodes. Such matrices generalize Toeplitz and circulant covariance matrices and are widely applied in signal processing applications, where the covariance between two measurements depends on the (shortest path) distance between them in time or space. We focus on minimizing both the vector sample complexity: the number of samples drawn from $\mathcal{D}$ and the entry sample complexity: the number of entries read in each sample. The entry sample complexity corresponds to measurement equipment costs in signal processing applications. We give a very simple algorithm for estimating $\mathbf{\Sigma}$ up to spectral norm error $\epsilon \left\|\mathbf{\Sigma}\right\|_2$ using just $O(\sqrt{D})$ entry sample complexity and $\tilde O(r^2/\epsilon^2)$ vector sample complexity, where $D$ is the diameter of the underlying graph and $r \le d$ is the rank of $\mathbf{\Sigma}$. Our method is based on extending the widely applied idea of sparse rulers for Toeplitz covariance estimation to the graph setting. In the special case when $\mathbf{\Sigma}$ is a low-rank Toeplitz matrix, our result matches the state-of-the-art, with a far simpler proof. We also give an information theoretic lower bound matching our upper bound up to a factor $D$ and discuss some directions towards closing this gap.


翻译:我们研究估算 $\ mathbbbf=Sigma} 的变量复杂性。 特别是, 我们关注最短路径变量的复杂性。 任何两种测量的共差由以美元为节点的底图中最短路径距离确定。 这种矩阵将 美元和 美元 的基数的基数基数和基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基, 基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基数基。

0
下载
关闭预览

相关内容

机器学习入门的经验与建议
专知会员服务
94+阅读 · 2019年10月10日
A Technical Overview of AI & ML in 2018 & Trends for 2019
待字闺中
18+阅读 · 2018年12月24日
Disentangled的假设的探讨
CreateAMind
9+阅读 · 2018年12月10日
disentangled-representation-papers
CreateAMind
26+阅读 · 2018年9月12日
已删除
将门创投
3+阅读 · 2018年8月21日
Hierarchical Disentangled Representations
CreateAMind
4+阅读 · 2018年4月15日
Arxiv
0+阅读 · 2021年1月7日
Arxiv
3+阅读 · 2018年10月18日
VIP会员
相关资讯
A Technical Overview of AI & ML in 2018 & Trends for 2019
待字闺中
18+阅读 · 2018年12月24日
Disentangled的假设的探讨
CreateAMind
9+阅读 · 2018年12月10日
disentangled-representation-papers
CreateAMind
26+阅读 · 2018年9月12日
已删除
将门创投
3+阅读 · 2018年8月21日
Hierarchical Disentangled Representations
CreateAMind
4+阅读 · 2018年4月15日
Top
微信扫码咨询专知VIP会员