教你用Python代碼實(shí)現(xiàn)合并excel文件
一、安裝模塊
1、找到對(duì)應(yīng)的模塊 http://www.python-excel.org/
2、用 pip install 安裝
pip3 install xlrd
pip3 install XlsxWriter
因?yàn)槭褂玫氖?python3,所以安裝的時(shí)候采用 pip3。
二、XlsxWriter 示例
先看看簡(jiǎn)單的演示:
import xlsxwriter # 創(chuàng)建一個(gè)工作簿并添加一個(gè)工作表 workbook = xlsxwriter.Workbook("c.xlsx") worksheet = workbook.add_worksheet() # 設(shè)置列寬 worksheet.set_column("A:A", 20) # 設(shè)置格式 bold = workbook.add_format({"bold": True}) # 設(shè)置單元格的值 worksheet.write("A1", "Hello") # 帶格式的單元格 worksheet.write("A2", "World") # 寫一些數(shù)字,用行列標(biāo)識(shí) worksheet.write(2, 0, 123) worksheet.write(3, 0, 123.456, bold) # 插入一張圖片 worksheet.insert_image("B5", "s.png") # 關(guān)閉文件流 workbook.close()
運(yùn)行結(jié)果如下:
三、合并Excel數(shù)據(jù)
對(duì)于合并 excel,有兩種 case ,一種是表頭都是一樣的,一種是表頭不一樣的excel ,但是希望放到同一個(gè)表格里面,方便查看
四、表頭都一樣的 excel
這個(gè)處理很簡(jiǎn)單,具體代碼如下:
import xlrd import xlsxwriter source_xls = ["a.xlsx", "b.xlsx"] target_xls = "3.xlsx" # 讀取數(shù)據(jù) data = [] for i in c: wb = xlrd.open_workbook(i) for sheet in wb.sheets(): for rownum in range(sheet.nrows): data.append(sheet.row_values(rownum)) print(data) # 寫入數(shù)據(jù) workbook = xlsxwriter.Workbook(target_xls) worksheet = workbook.add_worksheet() font = workbook.add_format({"font_size": 14}) for i in range(len(data)): for j in range(len(data[i])): worksheet.write(i, j, data[i][j], font) # 關(guān)閉文件流 workbook.close()
Excel 是由行和列組成的,所以這里將所有文件中的所有 sheet 中的數(shù)據(jù)讀取出來(lái)組成一個(gè)二維數(shù)組,然后再寫入新的 Excel。
五、表頭都不一樣的 excel
對(duì)于表頭不一樣的 excel,可能需要手動(dòng)選取表格的一部分,然后進(jìn)行合并。具體代碼如下:
import xlrd import xlsxwriter source_xls = ["a.xlsx", "b.xlsx"] target_xls = "合并.xlsx" # 讀取數(shù)據(jù) data = [] # 重復(fù)數(shù)據(jù) dupdata = [] # 姓名列表,按照姓名去重 name = [] # 獲取excel的個(gè)數(shù) sheetcount = len(source_xls) i = 0 while i < len(source_xls): wb = xlrd.open_workbook(source_xls[i]) # 存儲(chǔ)不同excel 的數(shù)據(jù) data.append([]) # 一個(gè)excel 可能存在多張表格 for sheet in wb.sheets(): if i == 0: # 先把表頭添加進(jìn)去 dupdata.append(sheet.row_values(0)) for rownum in range(sheet.nrows): # 判斷名字是否重復(fù),表頭都是姓名開頭的,所以把姓名除去 if (sheet.row_values(rownum)[0] in name): dupdata.append(sheet.row_values(rownum)) # 給數(shù)據(jù)添加另一個(gè)表的表頭 if (sheet.row_values(rownum)[0] == '姓名'): data[i].append(sheet.row_values(rownum)) else: name.append(sheet.row_values(rownum)[0]) data[i].append(sheet.row_values(rownum)) i+=1 # 合并數(shù)據(jù) workbook = xlsxwriter.Workbook(target_xls) worksheet = workbook.add_worksheet() font = workbook.add_format({"font_size": 14}) lineNum = 0 for num in range(len(data)): # 區(qū)分來(lái)自不同excel 的數(shù)據(jù) if num== 0 : for i in range(len(data[num])): # 姓名 worksheet.write(lineNum, 0, data[num][i][0], font) # 檢查編號(hào) worksheet.write(lineNum, 1, data[num][i][1], font) # 年齡 worksheet.write(lineNum, 2, data[num][i][23], font) # 藍(lán)標(biāo) worksheet.write(lineNum, 3, data[num][i][14], font) # 黃標(biāo) worksheet.write(lineNum, 4, data[num][i][19], font) worksheet.write(lineNum, 5, data[num][i][20], font) worksheet.write(lineNum, 6, data[num][i][21], font) # 大小 worksheet.write(lineNum, 7, data[num][i][24], font) worksheet.write(lineNum, 8, data[num][i][25], font) worksheet.write(lineNum, 9, data[num][i][26], font) lineNum += 1 # 只有兩個(gè)excel ,所以直接用了 else else: for i in range(len(data[num])): lineNum += 1 # 姓名 worksheet.write(lineNum, 0, data[num][i][0], font) # 檢查編號(hào) worksheet.write(lineNum, 1, data[num][i][1], font) # 年齡 worksheet.write(lineNum, 2, data[num][i][2], font) # 藍(lán)標(biāo) worksheet.write(lineNum, 3, data[num][i][30], font) # 關(guān)閉文件流 workbook.close() # 針對(duì)重復(fù)數(shù)據(jù),連表頭一起輸出,方便后續(xù)回顧查看 workbook = xlsxwriter.Workbook("重復(fù).xlsx") worksheet = workbook.add_worksheet() font = workbook.add_format({"font_size": 14}) for i in range(len(dupdata)): for j in range(len(dupdata[i])): worksheet.write(i, j, dupdata[i][j], font) # 關(guān)閉文件流 workbook.close()
六、合并后的結(jié)果
重復(fù)列表結(jié)果如下:
到此這篇關(guān)于教你用Python代碼實(shí)現(xiàn)合并excel文件的文章就介紹到這了,更多相關(guān)Python合并excel文件內(nèi)容請(qǐng)搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關(guān)文章希望大家以后多多支持腳本之家!
相關(guān)文章
django ajax發(fā)送post請(qǐng)求的兩種方法
這篇文章主要介紹了django ajax發(fā)送post請(qǐng)求的兩種方法,本文通過(guò)實(shí)例代碼給大家介紹的非常詳細(xì),具有一定的參考借鑒價(jià)值,需要的朋友可以參考下2020-01-01分享5個(gè)方便好用的Python自動(dòng)化腳本
這篇文章主要介紹了分享5個(gè)方便好用的Python自動(dòng)化腳本,這次我們使用Python來(lái)實(shí)現(xiàn)幾個(gè)自動(dòng)化場(chǎng)景,或許可以用到你的工作中或者對(duì)你的學(xué)習(xí)有所幫助,需要的朋友可以參考一下2022-03-03Python中可復(fù)用函數(shù)的6種實(shí)踐
為了實(shí)現(xiàn)可維護(hù)性,我們的Python函數(shù)應(yīng)該:小型、只做一項(xiàng)任務(wù);沒(méi)有重復(fù);有一個(gè)層次的抽象性;有一個(gè)描述性的名字和有少于四個(gè)參數(shù),下面我們就來(lái)看看這6個(gè)特性的實(shí)踐吧2023-08-08Python數(shù)據(jù)結(jié)構(gòu)之棧、隊(duì)列及二叉樹定義與用法淺析
這篇文章主要介紹了Python數(shù)據(jù)結(jié)構(gòu)之棧、隊(duì)列及二叉樹定義與用法,結(jié)合具體實(shí)例形式分析了Python數(shù)據(jù)結(jié)構(gòu)中棧、隊(duì)列及二叉樹的定義與使用相關(guān)操作技巧,需要的朋友可以參考下2018-12-12Python 序列化和反序列化庫(kù) MarshMallow 的用法實(shí)例代碼
marshmallow(Object serialization and deserialization, lightweight and fluffy.)用于對(duì)對(duì)象進(jìn)行序列化和反序列化,并同步進(jìn)行數(shù)據(jù)驗(yàn)證。這篇文章主要介紹了Python 序列化和反序列化庫(kù) MarshMallow 的用法實(shí)例代碼,需要的朋友可以參考下2020-02-02Python+unittest+DDT實(shí)現(xiàn)數(shù)據(jù)驅(qū)動(dòng)測(cè)試
這篇文章主要介紹了Python+unittest+DDT實(shí)現(xiàn)數(shù)據(jù)驅(qū)動(dòng)測(cè)試,文中通過(guò)示例代碼介紹的非常詳細(xì),對(duì)大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價(jià)值,需要的朋友可以參考下2020-11-11關(guān)于python的bottle框架跨域請(qǐng)求報(bào)錯(cuò)問(wèn)題的處理方法
這篇文章主要介紹了關(guān)于python的bottle框架跨域請(qǐng)求報(bào)錯(cuò)問(wèn)題的處理方法,需要的朋友可以參考下2017-03-03pyinstaller打包django項(xiàng)目的實(shí)現(xiàn)步驟
本文主要介紹了pyinstaller打包django項(xiàng)目的實(shí)現(xiàn)步驟,文中通過(guò)示例代碼介紹的非常詳細(xì),具有一定的參考價(jià)值,感興趣的小伙伴們可以參考一下2021-09-09