• 阿桂天山的小工具:我将16个Excel文件中31万多条数据拆分成318个文件


    1.话不多说,先上图看效果

    2.技术说明及实用源码

            2.1)python+flask+pandas , 由于我的开发环境版本问题,为了能读xls,xlsx,但又不想升级,只能通过xlrd 1.2.0读取xls,xlsx文件再转换成dict字典格式,再通过 data = pd.DataFrame(dict_data)实现类型转换

            2.2)实用代码,保证不丢任何一行数据,亲测验证,绝对好用

    1. data = pd.DataFrame(dict_data)
    2. row_num, column_num = data.shape # 数据共有多少行,多少列
    3. print('the sample number is %s and the column number is %s' % (row_num, column_num))
    4. # 1000行分割
    5. for i in range(0, (row_num // 1001)+1):
    6. save_data = data.iloc[i * 1000:(i + 1) * 1000, :] # 每隔1000循环一次
    7. split_num = split_num+1
    8. splitfilename = os.path.join(config.SPLIT_FOLDERFILES, 'split_' + str(split_num) + '.xls')
    9. print("split file name:",splitfilename)
    10. save_data.to_excel(splitfilename, sheet_name='Sheet1', index=False)
    11. filenames = filenames + 'split_' + str(split_num) + '.xls '
    12. filenames = filenames + ';'

            2.3)其实重点就三行代码

            # 1000行分割
                for i in range(0, (row_num // 1001)+1):
                    save_data = data.iloc[i * 1000:(i + 1) * 1000, :]  # 每隔1000循环一次

                    save_data.to_excel(splitfilename, sheet_name='Sheet1',  index=False)

    如果对你有帮助,给个赞吧

  • 相关阅读:
    Redis配置与优化
    java入门,Map<? extends String, ?>
    Java从入门到精通
    C++重载运算符
    Redis教程(十九):Redis的Redisson布隆过滤器
    Linux—搭建Apache(httpd)服务
    在Ubuntu上安装CUDA和cuDNN以及验证安装步骤
    【C++从0到1-黑马程序员】STL常用算法
    Linux UWB Stack实现——MCPS调度接口(数据结构)
    centos 内核对应列表 内核升级 linux
  • 原文地址:https://blog.csdn.net/gui818/article/details/134457819