word2vec 究竟学到了什么?伯克利提出可定量预测的学习理论
What exactly does word2vec learn?
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
伯克利 AI 研究团队发表新论文,首次给出 word2vec 学习过程的定量预测理论:在现实实用条件下,其学习问题可归约为无权重最小二乘矩阵分解,梯度流动态有闭式解,最终学到的表示等价于对目标矩阵 M* 做 PCA。从小初始化训练时,word2vec 按离散步骤逐次学习正交线性子空间,每步提升嵌入矩阵的秩并降低损失,这些特征即 M* 的顶部特征向量,可由语料统计和超参数预先算出。
来源:Berkeley AI Research · bair.berkeley.edu