当前位置: 首页 > news >正文

兰州市住房和建设局网站如何做流量网站

兰州市住房和建设局网站,如何做流量网站,c2c平台是什么意思,wordpress站点结构在数据分析和处理过程中,经常需要处理多个Excel文件,并将其中的数据进行汇总和分析。本文介绍使用Python的Pandas库来读取多个Excel文件,并汇总不同类型的数据,例如员工工资、工件数量等。 代码示例 以下是一个完整的代码示例&a…

在数据分析和处理过程中,经常需要处理多个Excel文件,并将其中的数据进行汇总和分析。本文介绍使用Python的Pandas库来读取多个Excel文件,并汇总不同类型的数据,例如员工工资、工件数量等。

代码示例

以下是一个完整的代码示例,展示了如何读取指定目录下的所有Excel文件,并对其中的数据进行处理和汇总:

import pandas as pd
import os# 设定存放Excel文件的目录路径
directory = r'C:\Users\Desktop\py计算'# 创建一个空的列表用于存储所有记录DataFrame
all_data_frames = []# 遍历目录中的所有Excel文件
for filename in os.listdir(directory):if filename.endswith(".xls"):file_path = os.path.join(directory, filename)# 读取Excel文件,从第六行开始,忽略前五行data = pd.read_excel(file_path, skiprows=4, engine='xlrd')# 去除特定列中的逗号并转换为数值格式,无法转换的设置为NaNdata['存额'] = data['存额'].str.replace(',', '').astype(float)print(data)# 将读取到的DataFrame添加到列表中all_data_frames.append(data)# 使用pd.concat将所有DataFrame合并成一个
all_data = pd.concat(all_data_frames, ignore_index=True)# 计算每个员工的工资之和
salary_sum = all_data.groupby('证件号码')['存额'].sum().round(2).reset_index()# 获取每个员工的其他信息(例如部门和职位)
employee_info = all_data[['姓名', '证件\n类型', '证件号码']].drop_duplicates(subset=['证件号码'])# 合并工资之和和其他信息
result = pd.merge(salary_sum, employee_info, on='证件号码', how='left')# 如果需要保存结果到新的Excel文件
result.to_excel('汇总带信息.xlsx', sheet_name='之和', index=False)

代码解析

  1. 导入必要的库:首先,我们需要导入Pandas库和os库。
  2. 设定目录路径:指定存放Excel文件的目录路径。
  3. 创建空列表:用于存储所有记录的DataFrame。
  4. 遍历目录中的Excel文件:使用os.listdir遍历目录中的所有文件,并筛选出以.xls结尾的Excel文件。
  5. 读取Excel文件:使用pd.read_excel读取Excel文件,从第六行开始,忽略前五行。
  6. 数据清洗:去除特定列中的逗号并转换为数值格式,无法转换的设置为NaN。
  7. 合并所有DataFrame:使用pd.concat将所有DataFrame合并成一个。

关键函数

  1. groupbygroupby函数用于将数据分组,以便对每个组进行聚合操作。在本例中,按证件号码分组,并计算每个员工的工资之和。

    salary_sum = all_data.groupby('证件号码')['存额'].sum().round(2).reset_index()
    
  2. reset_indexreset_index函数用于重置索引,将分组后的结果转换为DataFrame。在本例中,我们在计算工资之和后使用reset_index将结果转换为DataFrame。

    salary_sum = all_data.groupby('证件号码')['存额'].sum().round(2).reset_index()
    
  3. mergemerge函数用于合并两个DataFrame。在本例中,我们将工资之和与员工的其他信息合并。

    result = pd.merge(salary_sum, employee_info, on='证件号码', how='left')
    
  4. drop_duplicatesdrop_duplicates函数用于删除重复的行。在本例中,我们获取每个员工的其他信息,并删除重复的记录。

    employee_info = all_data[['姓名', '证件\n类型', '证件号码']].drop_duplicates(subset=['证件号码'])
    

通过以上步骤读取多个Excel文件,并对其中的数据进行处理和汇总。这种方法不仅适用于工资数据,还可以应用于其他类型的数据,例如工件数量、销售额等。这样可以提高数据处理的效率,适用于各种数据分析和处理场景。

http://www.yayakq.cn/news/960167/

相关文章:

  • 服装电子商务网站建设与实现云主机推荐
  • 郑州网站开发招聘医疗网站建设怎么样
  • 网站域名管理在哪里网站升级改版
  • 网站开发属于什么专业北京网站建设著名公司
  • 网站的建设方法不包括什么纪检网站建设方案
  • 男女做性哪个的小视频网站永久免费crm都有什么
  • 网站建设xiu021北京网站制作与网站设计
  • 网站建设需要学多久知乎北京seo网站优化培训
  • 太原制作手机网站株洲市建设局官方网站
  • 建设局网站公告猪八戒做网站
  • 建筑工程网教百度seo关键词排名优化工具
  • 网站关键字怎么优化六安有哪些做网站的公司
  • o2o网站制作搜索引擎广告投放
  • 宝安设计网站建设seo网站关键词优化
  • 百度网盘官方网站软件开发模型的优缺点及适用范围
  • 想建立什么网站怎么查网站的空间商
  • 网站投票链接怎么做的杭州网站建设朗诵面朝
  • 查排名官网公众号seo排名软件
  • app与移动网站开发资料网页设计实验报告分析与体会
  • 贵阳网站搜索优化做网站接广告赚钱吗
  • 有关网站开发的论文做零食网站怎么样
  • 竞价网站单页企业网站建设要多少
  • 河北省建设工程协会网站设计说明书格式
  • 创建公司网站需要什么网站制作评价标准
  • 湖南智能网站建设多少钱东莞seo外包公司哪家好
  • 如何看一个网站的好坏推广互联网工具是什么意思
  • 创建一个网站流程专门做淘宝主图的网站
  • 自己的网站怎么做美工海南网站开发公司
  • 站酷设计网站官网未上色文件wordpress的登录地址修改
  • 简单网站建设优化推广建微信网站