如何计算最近的半正定矩阵？

Question

我要从 R 转到 Python，并尝试使用 Python 重现我在 R 中习惯做的一些事情。R 的矩阵库有一个非常漂亮的 8834004065898，它称为nearPD() (PSD) 矩阵到给定矩阵。 虽然我可以编写一些代码，但作为 Python/Numpy 的新手，如果已经有了一些东西，我不会对重新发明轮子感到太兴奋。 关于 Python 中现有实施的任何提示？

Answer 1

我不认为有一个库可以返回您想要的矩阵，但这里是来自 Higham (2000) 的近东正半定矩阵算法的“只是为了好玩”编码

import numpy as np,numpy.linalg

def _getAplus(A):
    eigval, eigvec = np.linalg.eig(A)
    Q = np.matrix(eigvec)
    xdiag = np.matrix(np.diag(np.maximum(eigval, 0)))
    return Q*xdiag*Q.T

def _getPs(A, W=None):
    W05 = np.matrix(W**.5)
    return  W05.I * _getAplus(W05 * A * W05) * W05.I

def _getPu(A, W=None):
    Aret = np.array(A.copy())
    Aret[W > 0] = np.array(W)[W > 0]
    return np.matrix(Aret)

def nearPD(A, nit=10):
    n = A.shape[0]
    W = np.identity(n) 
# W is the matrix used for the norm (assumed to be Identity matrix here)
# the algorithm should work for any diagonal W
    deltaS = 0
    Yk = A.copy()
    for k in range(nit):
        Rk = Yk - deltaS
        Xk = _getPs(Rk, W=W)
        deltaS = Xk - Rk
        Yk = _getPu(Xk, W=W)
    return Yk

在论文中的例子上进行测试时，它返回正确的答案

print nearPD(np.matrix([[2,-1,0,0],[-1,2,-1,0],[0,-1,2,-1],[0,0,-1,2]]),nit=10)
[[ 1.         -0.80842467  0.19157533  0.10677227]
 [-0.80842467  1.         -0.65626745  0.19157533]
 [ 0.19157533 -0.65626745  1.         -0.80842467]
 [ 0.10677227  0.19157533 -0.80842467  1.        ]]

Answer 2

我会提交一个非迭代的方法。 这是对Rebonato 和 Jackel (1999) （第 7-9 页）的轻微修改。 迭代方法可能需要很长时间来处理超过几百个变量的矩阵。

import numpy as np

def nearPSD(A,epsilon=0):
   n = A.shape[0]
   eigval, eigvec = np.linalg.eig(A)
   val = np.matrix(np.maximum(eigval,epsilon))
   vec = np.matrix(eigvec)
   T = 1/(np.multiply(vec,vec) * val.T)
   T = np.matrix(np.sqrt(np.diag(np.array(T).reshape((n)) )))
   B = T * vec * np.diag(np.array(np.sqrt(val)).reshape((n)))
   out = B*B.T
   return(out)

代码是根据此处围绕 R 中的非 PD/PSD 矩阵对本主题的讨论而修改的。

Answer 3

这可能是对 DomPazz 答案的愚蠢扩展，以考虑相关性和协方差矩阵。 如果您正在处理大量矩阵，它也会提前终止。

def near_psd(x, epsilon=0):
    '''
    Calculates the nearest postive semi-definite matrix for a correlation/covariance matrix

    Parameters
    ----------
    x : array_like
      Covariance/correlation matrix
    epsilon : float
      Eigenvalue limit (usually set to zero to ensure positive definiteness)

    Returns
    -------
    near_cov : array_like
      closest positive definite covariance/correlation matrix

    Notes
    -----
    Document source
    http://www.quarchome.org/correlationmatrix.pdf

    '''

    if min(np.linalg.eigvals(x)) > epsilon:
        return x

    # Removing scaling factor of covariance matrix
    n = x.shape[0]
    var_list = np.array([np.sqrt(x[i,i]) for i in xrange(n)])
    y = np.array([[x[i, j]/(var_list[i]*var_list[j]) for i in xrange(n)] for j in xrange(n)])

    # getting the nearest correlation matrix
    eigval, eigvec = np.linalg.eig(y)
    val = np.matrix(np.maximum(eigval, epsilon))
    vec = np.matrix(eigvec)
    T = 1/(np.multiply(vec, vec) * val.T)
    T = np.matrix(np.sqrt(np.diag(np.array(T).reshape((n)) )))
    B = T * vec * np.diag(np.array(np.sqrt(val)).reshape((n)))
    near_corr = B*B.T    

    # returning the scaling factors
    near_cov = np.array([[near_corr[i, j]*(var_list[i]*var_list[j]) for i in xrange(n)] for j in xrange(n)])
    return near_cov

Answer 4

对于那些仍然在这里结束的人，您现在可以使用statsmodels.stats.correlation_tools.cov_nearest

Answer 5

我知道这个线程很旧，但是这里提供的解决方案对于我的协方差矩阵并不令人满意：转换后的矩阵看起来总是与原始矩阵大不相同（至少对于我测试的情况）。 因此，基于此答案中提供的解决方案，我将在这里留下一个非常简单的答案：

import numpy as np

def get_near_psd(A):
    C = (A + A.T)/2
    eigval, eigvec = np.linalg.eig(C)
    eigval[eigval < 0] = 0

    return eigvec.dot(np.diag(eigval)).dot(eigvec.T)

这个想法很简单：我计算对称矩阵，然后进行特征分解以获得特征值和特征向量。 我将所有负特征值归零并构造回矩阵，该矩阵现在将是半正定的。

为了完整起见，我留下了一个简单的代码来使用 numpy 检查矩阵是否为半正定（基本上检查所有特征值是否为非负）：

def is_pos_semidef(x):
    return np.all(np.linalg.eigvals(x) >= 0)

如何计算最近的半正定矩阵？

问题描述

5 个解决方案

解决方案1
32 已采纳 2012-06-07 21:40:03

解决方案2
15 2013-08-30 22:03:00

解决方案3
3 2016-07-25 12:50:54

解决方案4
1 已采纳 2022-04-13 18:23:52

解决方案5
0 2020-07-28 09:39:53

如何计算最近的半正定矩阵？

问题描述

5 个解决方案

解决方案1 32 已采纳 2012-06-07 21:40:03

解决方案2 15 2013-08-30 22:03:00

解决方案3 3 2016-07-25 12:50:54

解决方案4 1 已采纳 2022-04-13 18:23:52

解决方案5 0 2020-07-28 09:39:53

解决方案1
32 已采纳 2012-06-07 21:40:03

解决方案2
15 2013-08-30 22:03:00

解决方案3
3 2016-07-25 12:50:54

解决方案4
1 已采纳 2022-04-13 18:23:52

解决方案5
0 2020-07-28 09:39:53