Python合并EXCEL数据（按行、按列、按sheet）

发布时间：2024年01月20日

1.按行合并多个excel文件

import pandas as pd
import numpy as np
import os
import xlrd

# 读取第一个文件
df1 = pd.read_excel('C:/你的第一个文件.xlsx')
# 读取第二个文件
df2 = pd.read_excel('C:/你的第二个文件.xlsx')
# 按行合并两个文件
result = pd.concat([df1, df2])
# 将结果保存到新的Excel文件
result.to_excel('C:/hang.xlsx', index=False)

2.按列合并多个excel文件（多个excel文件行数需一致）

import pandas as pd
import numpy as np

df1= pd.read_excel("C:/你的第一个文件.xlsx")
features1 = df1.iloc[:,1:].values

df2= pd.read_excel("C:/你的第二个文件.xlsx")
features2 = df2.iloc[:,1:].values

df3= pd.read_excel("C:/你的第三个文件.xlsx")
features3 = df3.iloc[:,1:].values

#按列合并数据
features = np.hstack((features1, features2, features3))
print(features.shape)#打出来试试，这句不需要可以删掉
dataSets = pd.DataFrame(features)
dataSets.to_excel('C:/合并.xlsx')

改进版：把需要合并的excel表格放在一个文件夹，运行代码把该文件夹中的表格合并

这个代码直接粘过去用就行，改绿色的部分即可，注意要把文件都放一个文件夹里。

import pandas as pd
import numpy as np
import os
import xlwt
import xlrd
def hebing(a):
#基本函数（ 取所有文件夹下所有子文件）
    def getLine_num(d):
         # 读取表格行数
         filename = d
         data = xlrd.open_workbook(filename)
         table = data.sheets()[0]
         line_num = table.nrows
         print(line_num)
         return line_num
    dir = a #设置工作路径
    #这段是为了自动识别行数，为了features1 = np.zeros((linenum-1,1))这一行初始化
    filename_excel = []
    for root, dirs, files in os.walk(dir):
        for file in files:
            #print(os.path.join(root,file))
            filename_excel.append(os.path.join(root,file))
            # excel转换成DataFrame
            df = pd.read_excel(os.path.join(root,file))
            #print(filename_excel)
            linenum = getLine_num(os.path.join(root,file))#696
            
    #新建列表，存放文件名（可以忽略，但是为了做的过程能心里有数，先放上）
    filename_excel = []
    #新建列表，存放每个文件数据框（每一个excel读取后存放在数据框）
    frames = []
    features1 = np.zeros((linenum-1,1))
    for root, dirs, files in os.walk(dir):
        for file in files:
            filename_excel.append(os.path.join(root,file))
            # excel转换成DataFrame
            df = pd.read_excel(os.path.join(root,file),index_col = 1)
            features = df.iloc[:,1:].values
            features1 = np.hstack((features1,features))
            frames.append(df)
    #打印文件名
    print(filename_excel)
    
    features1= np.delete(features1,np.where(~features1.any(axis=0))[0], axis=1)# 寻找并删除全零列，这句不需要的可以删掉
    dataSets = pd.DataFrame(features1)
    dataSets.to_excel('C:/你想保存到的文件夹/按列合并后的文件名.xlsx')
#以上部分是函数
#以下调用函数即可    
hebing('C:/存放待合并excel的文件夹')

3.按sheet合并，把一个文件里的多个sheet按列合并到一个sheet里面，生成一个新的文件夹。


import pandas as pd
import numpy as np
    
# 读取第一个sheet
df1 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet1',header = None)
#header=none表示第一行不是表头，读的时候不把第一行去掉。同理，列是index_col
# 读取第2个sheet
df2 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet2',header = None)
# 读取第2个sheet
df3 = pd.read_excel('待合并sheet.xlsx', sheet_name='sheet3',header = None)
#按列合并多个sheet
features = np.hstack((df1, df2, df3))
print(features.shape)
# 将结果保存到新的Excel文件
dataSets = pd.DataFrame(features)
dataSets.to_excel('C:/你要保存的文件名.xlsx', index = False,header = 0,sheet_name='合并后的sheet')

学习资源推荐

零基础Python学习资源介绍

👉Python学习路线汇总👈
Python所有方向的技术点做的整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照上面的知识点去找对应的学习资源，保证自己学得较为全面。（学习教程文末领取哈）
在这里插入图片描述

👉Python必备开发工具👈
在这里插入图片描述

温馨提示：篇幅有限，已打包文件夹，获取方式在：文末

👉Python学习视频600合集👈
观看零基础学习视频，看视频学习是最快捷也是最有效果的方式，跟着视频中老师的思路，从基础到深入，还是很容易入门的。
在这里插入图片描述

👉实战案例👈
光学理论是没用的，要学会跟着一起敲，要动手实操，才能将自己的所学运用到实际当中去，这时候可以搞点实战案例来学习。
在这里插入图片描述

👉100道Python练习题👈
检查学习结果。
在这里插入图片描述
👉面试刷题👈

资料领取

上述这份完整版的Python全套学习资料已经上传CSDN官方，朋友们如果需要可以微信扫描下方CSDN官方认证二维码输入“领取资料” 即可领取。

文章来源:https://blog.csdn.net/2301_82000445/article/details/135645645
本文来自互联网用户投稿，该文观点仅代表作者本人，不代表本站立场。本站仅提供信息存储空间服务，不拥有所有权，不承担相关法律责任。如若内容造成侵权/违法违规/事实不符，请联系我的编程经验分享网邮箱：chenni525@qq.com进行投诉反馈，一经查实，立即删除！