分享

机器学习之如何完成矩阵的参数求导?

 taotao_2016 2020-04-05

专栏限时打折中

函数f(x)关于向量x的梯度

机器学习之如何完成矩阵的参数求导?

函数f(x)关于向量X^T的梯度

机器学习之如何完成矩阵的参数求导?

m维行向量函数f(x)=(f1(x),...,fm(x))关于向量x的梯度

机器学习之如何完成矩阵的参数求导?

f(A)关于m*n矩阵A的的梯度

机器学习之如何完成矩阵的参数求导?

对向量的偏导数

机器学习之如何完成矩阵的参数求导?

XTAy可以看成内积<x,Ay>,那么对x求偏导就是Ay

机器学习之如何完成矩阵的参数求导?

y^TAx可以看成内积<y,Ax>,进而可以变为<A^Ty,x>,所以对x求偏导就是A^Ty

机器学习之如何完成矩阵的参数求导?

X^TAX可以堪称内积<x,Ax>,由于两个边都有,当对左边求偏导结果是Ax,此时变为<A^Tx,x>继续对右边求偏导结果就是A^Tx,那么两个接起来就是Ax+A^Tx

迹函数的梯度矩阵

对于一个n阶方阵A的迹被定义为方阵A的主对角线的元素之和,通常对方阵的求迹操作写成trA,于是我们有

机器学习之如何完成矩阵的参数求导?

常用的矩阵迹的微分

机器学习之如何完成矩阵的参数求导?

常用的迹函数的梯度矩阵举例:

机器学习之如何完成矩阵的参数求导?

如上所示迹是对角线上的元素和,所以对A求偏导,此时矩阵A的非对角线上的元素为0,对角线上的元素为1

机器学习之如何完成矩阵的参数求导?

如上所示迹AB对A求偏导数,对Apl的结果为Blp,那么也就是B矩阵的转置了

    本站是提供个人知识管理的网络存储空间,所有内容均由用户发布,不代表本站观点。请注意甄别内容中的联系方式、诱导购买等信息,谨防诈骗。如发现有害或侵权内容,请点击一键举报。
    转藏 分享 献花(0

    0条评论

    发表

    请遵守用户 评论公约

    类似文章 更多