IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 人工智能 -> 主成分分析之sklearn实现和计算主成分得分 -> 正文阅读

[人工智能]主成分分析之sklearn实现和计算主成分得分

主成分分析之sklearn实现和计算主成分得分

本文是基于Python的sklearn包实现主成分分析以及计算主成分得分

首先导入依赖包

import numpy as np
import matplotlib.pyplot as plt
import pandas as pd
from sklearn.decomposition import PCA
from sklearn.datasets import load_breast_cancer
from sklearn.preprocessing import StandardScaler

导入数据并对数据进行标准化处理

data = load_breast_cancer()

# 数据用sklearn自带的癌症数据,只选前10列,降低复杂度,该数据集共有30个特征
df = pd.DataFrame(data.data, columns=data.feature_names).iloc[:, 0:10]
# 对数据进行标准化处理
X_scaler = StandardScaler().fit_transform(df)
X_scaler = pd.DataFrame(X_scaler, columns=['Z1', 'Z2', 'Z3', 'Z4', 'Z5', 'Z6', 'Z7', 'Z8', 'Z9', 'Z10'])

下面开始进行建模

pca = PCA(n_components=0.80, svd_solver='full').fit(X_scaler)

根据PCA模块计算出相应的数据

k1_spss = pca.components_ / np.sqrt(pca.explained_variance_.reshape(pca.n_components_, 1))
print('贡献方差,即特征根:', pca.explained_variance_, end='')
print('方差贡献率:', pca.explained_variance_ratio_, end='')
print('成分得分系数矩阵:', k1_spss, end='')

这里成分得分系数不是PCA包中的pca.components_,这个仅仅是成分的因子载荷矩阵,而要计算成分得分矩阵需要进行一定的变化

各自因子载荷向量除以各自因子特征值的算数平方根
即:
pca.components_ / np.sqrt(pca.explained_variance_.reshape(pca.n_components_, 1))

最后主成分得分=标准化后的因子得分系数×解释方差比例

X_score = pca.transform(X_scaler)
print('因子得分:', X_score)
# 因子得分归一化,使其服从正态分布
scaler2 = StandardScaler().fit(X_score)
X_score_scaler = pd.DataFrame(scaler2.transform(X_score), columns=['FAC1', 'FAC2', 'FAC3'])
# 正负号转化
k_sign = np.sign(k1_spss.sum(axis=1))
# 取正负号
X_score_scaler_sign = X_score_scaler * k_sign
# 综合得分
rate = pca.explained_variance_ratio_
X_score_scaler_sign['FAC_score'] = np.sum(X_score_scaler_sign * rate, axis=1)
print('主成分得分矩阵:', X_score_scaler_sign)
  人工智能 最新文章
2022吴恩达机器学习课程——第二课(神经网
第十五章 规则学习
FixMatch: Simplifying Semi-Supervised Le
数据挖掘Java——Kmeans算法的实现
大脑皮层的分割方法
【翻译】GPT-3是如何工作的
论文笔记:TEACHTEXT: CrossModal Generaliz
python从零学(六)
详解Python 3.x 导入(import)
【答读者问27】backtrader不支持最新版本的
上一篇文章      下一篇文章      查看所有文章
加:2021-08-07 12:05:08  更:2021-08-07 12:06:04 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年11日历 -2024/11/17 22:18:48-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码