香港云主机最佳企业级服务商!

ADSL拨号VPS包含了中国大陆(联通,移动,电信,)

中国香港,国外拨号VPS。

当前位置:云主机 > python >

电信ADSL拨号VPS
联通ADSL拨号VPS
移动ADSL拨号VPS

Python实现的删除重复文件或图片功能示例【去重】


时间:2022-04-02 10:30 作者:admin610456


本文实例讲述了python/' target='_blank'>python实现的删除重复文件或图片功能。分享给大家供大家参考,具体如下:

通过Python爬虫或其他方式保存的图片文件通常包含一些重复的图片或文件,

通过下面的python代码可以将重复的文件删除以达到去重的目的。其中,文件目录结构如下图:

# /usr/bin/env python# -*- coding:utf-8 -*-# 运行的代码文件要放到删除重复的文件或图片所包含的目录中import osimport hashlibdef filecount():  filecount = int(os.popen('dir /B |find /V /C ""').read())  return (filecount)def md5sum(filename):  f = open(filename, 'rb')  md5 = hashlib.md5()  while True:    fb = f.read(8096)    if not fb:      break    md5.update(fb)  f.close()  return (md5.hexdigest())def delfile():  all_md5 = {}  filedir = os.walk(os.getcwd())  for i in filedir:    for tlie in i[2]:      if md5sum(tlie) in all_md5.values():        os.remove(tlie)      else:        all_md5[tlie] = md5sum(tlie)if __name__ == '__main__':  oldf = filecount()  print('去重前有', oldf, '个文件\n\n\n请稍等正在删除重复文件...')  delfile()  print('\n\n去重后剩', filecount(), '个文件')  print('\n\n一共删除了', oldf - filecount(), '个文件\n\n')

更多关于Python相关内容感兴趣的读者可查看本站专题:《Python文件与目录操作技巧汇总》、《Python文本文件操作技巧汇总》、《Python数据结构与算法教程》、《Python函数使用技巧总结》、《Python字符串操作技巧汇总》及《Python入门与进阶经典教程》

希望本文所述对大家Python程序设计有所帮助。

(责任编辑:admin)






帮助中心
会员注册
找回密码
新闻中心
快捷通道
域名登录面板
虚机登录面板
云主机登录面板
关于我们
关于我们
联系我们
联系方式

售前咨询:17830004266(重庆移动)

企业QQ:383546523

《中华人民共和国工业和信息化部》 编号:ICP备00012341号

Copyright © 2002 -2018 香港云主机 版权所有
声明:香港云主机品牌标志、品牌吉祥物均已注册商标,版权所有,窃用必究

云官方微信

在线客服

  • 企业QQ: 点击这里给我发消息
  • 技术支持:383546523

  • 公司总台电话:17830004266(重庆移动)
  • 售前咨询热线:17830004266(重庆移动)