Sparse PCA 稀疏主成分分析

2016-12-06 16:58:38 qilin2016 阅读数 15677 文章标签：统计学习算法更多

本文链接：https://blog.csdn.net/zhoudi2010/article/details/53489319

SPCA原始文献：H. Zou (2006) Sparse principal component analysis
PCA 可以参考： The Elements of Statistical Learning 第十四章
主成分分析的基本思想以及R的应用可以参考：稀疏主成分分析与R应用
关于统计学习中的稀疏算法可以参考：Statistical learning with sparsity: the lasso and generalizations
一份很好的文档：http://www.cs.utexas.edu/~rashish/sparse_pca.pdf

首先直接来看算法：

SPCA algo

令A初始化为V[,1:k]，即为前k个principal components的loading vectors.
对于给定的 $A = [α_{1}, \dots, α_{k}]$
对于给定的 $B = [β_{1}, \dots, β_{k}]$
重复2-3步，直到收敛.
Normalization之后得到 $V_{i}$

接下来对该算法进行必要的解释：
想要得到稀疏的结果，核心思想是在优化参数时加入 $L_{1}$

H. Zou (2006)的Theorem 1就提出了PCA和Regression的联系。即：如果我们已经知道由SVD得到的principal components, 那么ridge estimates就是 $V_{i}$

所以新的优化问题是这样的形式：

这里写图片描述

第二项和第三项是elastic net，或者理解为ridge+lasso. 第一项则和之前的形式有些不同。如果我们令 $A = B$

这一步我们遇到的问题是：
1. $A$

解决思路是：
1. 将问题转化为：如果 $A$

先说问题2的解决方法（注释2）：
这里写图片描述

令 $Y^{*} = X α_{j}$

就得到了最终需要的形式：

这里写图片描述

再说问题1的算法，也就是文章最开始提到的算法中的2,3步（注释3）：

这里写图片描述

如此这般，SPCA就ok了！

不过，还有几个小问题：

注释1处为什么 $A = B$

具体可以参考The Elements of Statistical Learning 14.5

我们为了最小化reconstruction error:
$‖ x_{i} - μ - V_{q} λ_{i} ‖^{2}$

$V_{q} V_{q}^{⊤}$

所以 $A = B$

注释2处这个转化怎么得到的？

$‖ X - X B A^{⊤} ‖^{2}$

注意到 $A$

所以将 $‖ X - X B A^{⊤} ‖^{2}$

$‖ X - X B A^{⊤} ‖^{2}$

注释3处 A given B 怎么证明？

需要用到Procrustes Rotation的结论：

这里写图片描述

(A.7)是squared Frobenius matrix norm, 所以 $‖ X ‖^{2} = t r a c e (X^{⊤} X)$

Procrustes （普洛克路斯忒斯）是希腊神话中的一名强盗。他是海神波塞冬的儿子，在从雅典到埃莱夫西纳的路上开设黑店，拦截行人。店内设有一张铁床，旅客投宿时，将身高者截断，身矮者则强行拉长，使与床的长短相等。而由于普洛克路斯忒斯秘密地拥有两张长度不同的床，所以无人能因身高恰好与床相等而幸免。后来英雄忒修斯前往雅典时，路过此地，将其杀死。（From Wiki）