python實(shí)現(xiàn)兩個(gè)文件夾的同步
其實(shí)無論windows還是Linux,簡單地去實(shí)現(xiàn)兩個(gè)兩個(gè)文件夾的同步只需系統(tǒng)自帶的復(fù)制命令加參數(shù)就可以了。
WINDOWS:
xcopy 源文件夾\* 目標(biāo)文件夾 /s /e /y
Linux:
cp -r 源文件夾/* 目標(biāo)文件夾
這里使用python來實(shí)現(xiàn)這些基本功能,并增加一些去重之類的增強(qiáng)功能。
1、復(fù)制源文件夾中文件至目標(biāo)文件夾
要想同步兩個(gè)文件夾中的數(shù)據(jù),基本思路首先需要遍歷源文件夾中的信息,將源文件夾中的文件復(fù)制到目標(biāo)文件夾。
遍歷文件夾采用os中的listdir函數(shù)就可以了。
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' for filename in os.listdir(path_s): filename_s = path_s+os.sep+filename print '[*] Source :',filename_s filename_t = path_t+os.sep+filename print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read())
但是很明顯這里沒有考慮源文件夾中還會(huì)存在文件夾甚至多重文件夾的情況。
2、源文件夾中存在多重文件夾
一個(gè)簡單的思路就是:在遍歷源文件夾內(nèi)的文件時(shí),先判定當(dāng)前文件這是文件還是文件夾。如果當(dāng)前文件是文件夾的話,開始遍歷此文件夾內(nèi)的文件,如果里面還有文件夾,遍歷這個(gè)文件夾,依次類推。利用遞歸的方法,代碼如下:
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' def copy_file(paths,patht): for filename in os.listdir(paths): filename_s = paths+os.sep+filename filename_t = patht+os.sep+filename if os.path.isdir(filename_s): if not os.path.exists(filename_t): os.mkdir(filename_t) #在目標(biāo)文件夾中創(chuàng)建對(duì)應(yīng)的文件夾 copy_file(filename_s,filename_t) # 遞歸 else: print '[*] Source :',filename_s print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read()) copy_file(path_s,path_t)
目前,簡單的文件夾復(fù)制功能已經(jīng)實(shí)現(xiàn)了。
3、目標(biāo)文件夾中已有文件不再復(fù)制
一個(gè)簡單的方法就是在目標(biāo)文件夾中復(fù)制文件之前先利用函數(shù)“os.path.exists”判定這個(gè)文件是否存在。
import os path_s = 'F:\\test\\s' path_t = 'F:\\test\\t' def copy_file(paths,patht): for filename in os.listdir(paths): filename_s = paths+os.sep+filename filename_t = patht+os.sep+filename if os.path.isdir(filename_s): if not os.path.exists(filename_t): os.mkdir(filename_t) copy_file(filename_s,filename_t) else: if os.path.exists(filename_t): print '[*] "%s" already exists! ' % filename_t else: print '[*] Source :',filename_s print '[*] Target :',filename_t with open(filename_s,'rb') as f_s: with open(filename_t,'wb') as f_t: f_t.write(f_s.read()) copy_file(path_s,path_t)
這個(gè)辦法避免了一部分已有文件的重復(fù)復(fù)制操作,減少了部分不必要的讀寫操作,但是卻無法消除內(nèi)容相同但名稱、路徑不同的重復(fù)文件。
4、利用MD5判定重復(fù)文件
目前判定兩個(gè)文件是否相同,除了按字節(jié)逐個(gè)對(duì)比這個(gè)笨方法外,簡單常用的辦法就是利用MD5和CRC校驗(yàn),或是按一定規(guī)律挑取文件的指定位置的數(shù)據(jù)塊就行對(duì)比。
這次利用文件的MD5值,將目標(biāo)文件夾中已有文件的MD5值保存到列表或字典中,每在源文件夾中讀取一個(gè)文件就判定該文件的MD5值是否已經(jīng)存在于MD5列表,沒有的話再進(jìn)行復(fù)制操作,并將該文件的MD5值寫入列表。
import os
import hashlib
path_s = 'F:\\test\\s'
path_t = 'F:\\test\\t'
list_file = {}
def create_file_list(path):
for name in os.listdir(path):
filename = path+os.sep+name
if os.path.isdir(filename):
create_file_list(filename)
else:
with open(filename,'rb') as f:
md5 = hashlib.md5(f.read()).hexdigest()
if md5 not in list_file:
list_file[md5] = 1
def copy_file(paths,patht):
for filename in os.listdir(paths):
filename_s = paths+os.sep+filename
filename_t = patht+os.sep+filename
if os.path.isdir(filename_s):
if not os.path.exists(filename_t):
os.mkdir(filename_t)
copy_file(filename_s,filename_t)
else:
if os.path.exists(filename_t):
print '[*] "%s" already exists! ' % filename_t
else:
with open(filename_s,'rb') as f_s:
data = f_s.read()
file_md5 = hashlib.md5(data).hexdigest()
if file_md5 not in list_file:
list_file[file_md5] = 1
print '[*] Source :',filename_s
print '[*] Target :',filename_t
with open(filename_t,'wb') as f_t:
f_t.write(data)
else:
print '[*] "%s"\'s MD5 already exists! ' % filename_t
create_file_list(path_t)
copy_file(path_s,path_t)
如下圖,運(yùn)行后內(nèi)容相同的幾個(gè)文件,只有第一次讀取到的時(shí)候才寫入目標(biāo)文件夾,其他路徑下的文件并沒有復(fù)制到目標(biāo)文件夾。

以上就是本文的全部內(nèi)容,希望對(duì)大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。
相關(guān)文章
Python初識(shí)二叉樹續(xù)之實(shí)戰(zhàn)binarytree
binarytree庫是一個(gè)Python的第三方庫,這個(gè)庫實(shí)現(xiàn)了一些二叉樹相關(guān)的常用方法,使用二叉樹時(shí),可以直接調(diào)用,不需要再自己實(shí)現(xiàn),下面這篇文章主要給大家介紹了關(guān)于Python初識(shí)二叉樹之實(shí)戰(zhàn)binarytree的相關(guān)資料,需要的朋友可以參考下2022-05-05
python GUI庫圖形界面開發(fā)之PyQt5樹形結(jié)構(gòu)控件QTreeWidget詳細(xì)使用方法與實(shí)例
這篇文章主要介紹了python GUI庫圖形界面開發(fā)PyQt5樹形結(jié)構(gòu)控件QTreeWidget詳細(xì)使用方法與實(shí)例,需要的朋友可以參考下2020-03-03
對(duì)Tensorflow中的變量初始化函數(shù)詳解
今天小編就為大家分享一篇對(duì)Tensorflow中的變量初始化函數(shù)詳解,具有很好的參考價(jià)值,希望對(duì)大家有所幫助。一起跟隨小編過來看看吧2018-07-07
Python中標(biāo)準(zhǔn)庫array數(shù)組操作舉例詳解
這篇文章主要介紹了Python中標(biāo)準(zhǔn)庫array數(shù)組操作的相關(guān)資料,Python的array模塊提供了固定類型數(shù)組類,用于高效存儲(chǔ)同類型元素,節(jié)省內(nèi)存并支持?jǐn)?shù)值計(jì)算,需要的朋友可以參考下2025-04-04

