网站首页 > 技术文章 正文
说明:【白领服务工作室】的文章、微头条以及视频等,都是本工作室在数据处理实际业务中积累的经验和技巧,均经过实际的测试和验证,绝非纸上谈兵的堆文字凑数量。本头条号是将工作室日常数据处理过程中遇到的好的方法、好的思路、好的亮点,呈现给大家,与大家共享。
处理xlsx格式的表格,是我们日常经常会遇到的事情。对于一些几十M、上百M或者几百M的xlsx格式的大表,使用最常用的pandas进行读取时,是一件很费时的事情。尤其是几十个、几百个xlsx格式的大表,要进行读取并处理时,读取的效率就是非常值得关注的。因为,读取太慢,将大大降低我们处理数据的效率。
今天,我们就给大家介绍一种方法,比使用pandas.read_excel()读取xlsx文件的效率要大大提升,速度快了很多。
测试文件是106M的xlsx文件:3.xlsx。
import time
import xlwings as xw
import pandas as pd
t1 = time.time()
wb = xw.Book('d:/fqb/3.xlsx')
t2 = time.time()
print(t2-t1)
如下图所示:
106M的xlsx文件,使用xlwings读取只用了29秒;
转为df数据集,使用了44秒;
总共使用了73秒。
这个速度,比使用pandas的read_excel()或者openpyxl的速度都要快!
提示:
1、参数header=1表示第1行是列名称,参数index=False表示不读取行索引;
2、参数expand='table'表示读取整个表格;
3、106M的xlsx表:上述代码总共使用了73秒;而openpyxl使用了122秒。
猜你喜欢
- 2024-09-23 【Tidyverse优雅编程】办公自动化:Excel考勤表清洗与两种汇总
- 2024-09-23 技术分享:Python数据分析学习(python数据分析入门课程)
- 2024-09-23 50.根据日期计算星期几(通过日期计算星期几奥数)
- 2024-09-23 如何成为Python的数据操作库Pandas的专家?
- 2024-09-23 如何在Flutter中读取和写入文件(flutter text)
- 2024-09-23 二十九、UiPathExcel写入操作(转)
- 2024-09-23 关于应收账款的账龄计算,让不少财务人都惊叹:早该这么做了
- 2024-09-23 在Vue项目中使用xlsx模块读写Excel文档内容
- 2024-09-23 01.读取Excel文件数据[文心一言+Python+Excel]
- 2024-09-23 Python数据分析基础入门(一):获取数据源
- 1514℃桌面软件开发新体验!用 Blazor Hybrid 打造简洁高效的视频处理工具
- 571℃Dify工具使用全场景:dify-sandbox沙盒的原理(源码篇·第2期)
- 512℃MySQL service启动脚本浅析(r12笔记第59天)
- 486℃服务器异常重启,导致mysql启动失败,问题解决过程记录
- 485℃启用MySQL查询缓存(mysql8.0查询缓存)
- 468℃「赵强老师」MySQL的闪回(赵强iso是哪个大学毕业的)
- 447℃mysql服务怎么启动和关闭?(mysql服务怎么启动和关闭)
- 445℃MySQL server PID file could not be found!失败
- 最近发表
- 标签列表
-
- cmd/c (90)
- c++中::是什么意思 (83)
- 主键只能有一个吗 (66)
- c#console.writeline不显示 (75)
- pythoncase语句 (81)
- es6includes (73)
- windowsscripthost (67)
- apt-getinstall-y (86)
- node_modules怎么生成 (76)
- c++int转char (75)
- static函数和普通函数 (76)
- el-date-picker开始日期早于结束日期 (70)
- js判断是否是json字符串 (67)
- checkout-b (67)
- c语言min函数头文件 (68)
- asynccallback (71)
- localstorage.removeitem (74)
- vector线程安全吗 (70)
- & (66)
- java (73)
- js数组插入 (83)
- mac安装java (72)
- eacces (67)
- 查看mysql是否启动 (70)
- 无效的列索引 (74)