IT数码 购物 网址 头条 软件 日历 阅读 图书馆
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
图片批量下载器
↓批量下载图片,美女图库↓
图片自动播放器
↓图片自动播放器↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁
 
   -> 人工智能 -> dataframe 用正态分布 随机数 替换每一行 -> 正文阅读

[人工智能]dataframe 用正态分布 随机数 替换每一行

我有一个需求,想用每一行的均值和标准差生成随机数来替换每一行。为此需要做如下操作:

  1. 求出每一行的均值和标准差
  2. 按照均值和标准差生成相同数量的随机数
  3. 用随机数替换行的值
# -*- coding: utf-8 -*-
# 你想保留的列索引列表,比如usecols=["1月销量","2月销量","3月销量"]
usecols = ["1月销量","2月销量","3月销量"]
# 读取csv文件
data = pd.read_csv(r"E:\销量报表.csv",usecols=usecols)
# drop掉存在空值的行,看你情况
data.dropna(inplace=True)
# rows表示行数,cols表示列数
rows,cols = data.shape[0],data.shape[1]
 
"""
生成mymean的Series结构,iloc表示按位置索引,选取所有行,列从0到cols,
我这里就是很简单的从0到 # cols-1,末尾不取,所以写cols,求均值用mean,
由于是求行的均值,写上axis = 1,列均值axis = 0
"""
mymean=data.iloc[:,0:cols].mean(axis =1)
# 标准差同理
mystd=data.iloc[:,0:cols].std(axis = 1)
# 获得dataframe的行索引,构造其中元素都是索引的列表
all_indexs = data._stat_axis.values.tolist()
# 。。。列索引的列表。。。
columns = data.columns.values.tolist()
# enumerate就像一个zip ,i是元素位置,index是元素值
for i,index in enumerate(all_indexs):
# 我这里排了个序,当然看你情况
    newrow=np.sort(np.random.normal(loc=mymean.loc[index],scale=mystd.loc[index],size=cols))
    data.loc[index,:]=newrow
print(data.head(100))

还是比较笨的方法,没有用到pandas提供的并行计算的力量,效率不高,有没有大佬提供一个进阶版的,求。

有人可能在读取usecols的时候可能会报错:

Non-UTF-8 code starting with '\xe5' in file

加一个??

# -*- coding: utf-8 -*-??

应该能解决问题

pandas和numpy的官方教程写的非常好,多去看看找找会有很多收获的,google stackoverflow 用英文提问也是挺有意思的

  人工智能 最新文章
2022吴恩达机器学习课程——第二课(神经网
第十五章 规则学习
FixMatch: Simplifying Semi-Supervised Le
数据挖掘Java——Kmeans算法的实现
大脑皮层的分割方法
【翻译】GPT-3是如何工作的
论文笔记:TEACHTEXT: CrossModal Generaliz
python从零学(六)
详解Python 3.x 导入(import)
【答读者问27】backtrader不支持最新版本的
上一篇文章      下一篇文章      查看所有文章
加:2022-01-16 13:03:28  更:2022-01-16 13:04:31 
 
开发: C++知识库 Java知识库 JavaScript Python PHP知识库 人工智能 区块链 大数据 移动开发 嵌入式 开发工具 数据结构与算法 开发测试 游戏开发 网络协议 系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程
数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁

360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年11日历 -2024/11/26 22:24:57-

图片自动播放器
↓图片自动播放器↓
TxT小说阅读器
↓语音阅读,小说下载,古典文学↓
一键清除垃圾
↓轻轻一点,清除系统垃圾↓
图片批量下载器
↓批量下载图片,美女图库↓
  网站联系: qq:121756557 email:121756557@qq.com  IT数码