基于Spark的机器学习实践 (十) - 降维

2019-04-18 2777

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 通过讲解PCA算法的原理，使大家明白降维算法的大致原理，以及能够实现怎么样的功能。结合应用降维算法在分类算法使用之前进行预处理的实践，帮助大家体会算法的作用。

通过讲解PCA算法的原理，使大家明白降维算法的大致原理，以及能够实现怎么样的功能。结合应用降维算法在分类算法使用之前进行预处理的实践，帮助大家体会算法的作用。

0 相关源码

1 PCA算法及原理概述

1.1 何为降维?

◆ 从高维度变为低维度的过程就是降维

◆ 例如拍照就是把处在三维空间中的人或物从转换到作为二维平面的
照片中

◆ 降维有线性的、也有非线性的方法。在机器学习中可以简化运算,减少特征量

1.2 PCA算法介绍

◆ PCA算法是一种常用的线性降维算法,算法类似于"投影”

◆ 降维简化了数据集,故可以视为一个压缩过程,在压缩过程中可能;会有信息丢失

◆ PCA除可以用来精简特征,还可以应用在图像处理中
例如基于PCA算法的特征脸法,它可以用来人脸识别

1.3 PCA算法原理简介

◆ PCA是基于K-L变换实现的一种算法

◆ PCA算法在实现上用到了协方差矩阵,以及矩阵的特征分解

◆ 基本主要内容在于求出协方差矩阵,然后求协方差矩阵的特征值与特征向量

1.4 PCA算法步骤

◆ 输入n行m列的矩阵X ,代表m条n维数据

◆ 将矩阵X的每一行进行零均值化处理

◆ 求出X的协方差矩阵C

◆ 求出协方差矩阵C的特征值与特征向量

◆ 将特征向量按照特征值的大小从上至下依次排列,取前k行,作为矩阵P

◆ 求出P与X矩阵叉乘的结果,即为降维值k维的m条数据

2 实战PCA算法实现降维

代码
特征列降维成3个

基于Spark的机器学习实践 (十) - 降维

0 相关源码

1 PCA算法及原理概述

1.1 何为降维?

1.2 PCA算法介绍

1.3 PCA算法原理简介

1.4 PCA算法步骤

2 实战PCA算法实现降维

Spark机器学习实践系列

Java技术进阶

热门文章

最新文章

相关课程

相关电子书

相关实验场景

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

基于Spark的机器学习实践 (十) - 降维

0 相关源码

1 PCA算法及原理概述

1.1 何为降维?

1.2 PCA算法介绍

1.3 PCA算法原理简介

1.4 PCA算法步骤

2 实战PCA算法实现降维

Spark机器学习实践系列

Java技术进阶

热门文章

最新文章

相关课程

相关电子书

相关实验场景