python如何實現(xiàn)兩個文件夾-創(chuàng)新互聯(lián)

這篇文章主要介紹了python如何實現(xiàn)兩個文件夾,具有一定借鑒價值,感興趣的朋友可以參考下,希望大家閱讀完這篇文章之后大有收獲,下面讓小編帶著大家一起了解一下。

你所需要的網(wǎng)站建設(shè)服務(wù),我們均能行業(yè)靠前的水平為你提供.標(biāo)準(zhǔn)是產(chǎn)品質(zhì)量的保證,主要從事做網(wǎng)站、網(wǎng)站建設(shè)、企業(yè)網(wǎng)站建設(shè)、手機網(wǎng)站開發(fā)、網(wǎng)頁設(shè)計、品牌網(wǎng)站制作、網(wǎng)頁制作、做網(wǎng)站、建網(wǎng)站。創(chuàng)新互聯(lián)擁有實力堅強的技術(shù)研發(fā)團隊及素養(yǎng)的視覺設(shè)計專才。

其實無論windows還是Linux,簡單地去實現(xiàn)兩個兩個文件夾的同步只需系統(tǒng)自帶的復(fù)制命令加參數(shù)就可以了。

WINDOWS:

xcopy 源文件夾\* 目標(biāo)文件夾 /s /e /y

Linux:

cp -r 源文件夾/* 目標(biāo)文件夾

這里使用python來實現(xiàn)這些基本功能,并增加一些去重之類的增強功能。

1、復(fù)制源文件夾中文件至目標(biāo)文件夾

要想同步兩個文件夾中的數(shù)據(jù),基本思路首先需要遍歷源文件夾中的信息,將源文件夾中的文件復(fù)制到目標(biāo)文件夾。

遍歷文件夾采用os中的listdir函數(shù)就可以了。

import os
 
path_s = 'F:\\test\\s'
path_t = 'F:\\test\\t'
 
for filename in os.listdir(path_s):
 filename_s = path_s+os.sep+filename
 print '[*] Source :',filename_s
 filename_t = path_t+os.sep+filename
 print '[*] Target :',filename_t
 with open(filename_s,'rb') as f_s:
 with open(filename_t,'wb') as f_t:
  f_t.write(f_s.read())

但是很明顯這里沒有考慮源文件夾中還會存在文件夾甚至多重文件夾的情況。

2、源文件夾中存在多重文件夾

一個簡單的思路就是:在遍歷源文件夾內(nèi)的文件時,先判定當(dāng)前文件這是文件還是文件夾。如果當(dāng)前文件是文件夾的話,開始遍歷此文件夾內(nèi)的文件,如果里面還有文件夾,遍歷這個文件夾,依次類推。利用遞歸的方法,代碼如下:

import os
 
 
path_s = 'F:\\test\\s'
path_t = 'F:\\test\\t'
 
def copy_file(paths,patht):
 for filename in os.listdir(paths):
 filename_s = paths+os.sep+filename
 filename_t = patht+os.sep+filename
 if os.path.isdir(filename_s):
  if not os.path.exists(filename_t):
  os.mkdir(filename_t) #在目標(biāo)文件夾中創(chuàng)建對應(yīng)的文件夾
  copy_file(filename_s,filename_t) # 遞歸
 else:
  print '[*] Source :',filename_s
 
  print '[*] Target :',filename_t
  with open(filename_s,'rb') as f_s:
  with open(filename_t,'wb') as f_t:
   f_t.write(f_s.read())
 
 
copy_file(path_s,path_t)

目前,簡單的文件夾復(fù)制功能已經(jīng)實現(xiàn)了。

3、目標(biāo)文件夾中已有文件不再復(fù)制

一個簡單的方法就是在目標(biāo)文件夾中復(fù)制文件之前先利用函數(shù)“os.path.exists”判定這個文件是否存在。

import os
 
 
path_s = 'F:\\test\\s'
path_t = 'F:\\test\\t'
 
def copy_file(paths,patht):
 for filename in os.listdir(paths):
 filename_s = paths+os.sep+filename
 filename_t = patht+os.sep+filename
 if os.path.isdir(filename_s):
  if not os.path.exists(filename_t):
  os.mkdir(filename_t)
  copy_file(filename_s,filename_t)
 else:
  if os.path.exists(filename_t):
  print '[*] "%s" already exists! ' % filename_t
  else:
  print '[*] Source :',filename_s
 
  print '[*] Target :',filename_t
  with open(filename_s,'rb') as f_s:
   with open(filename_t,'wb') as f_t:
   f_t.write(f_s.read())
 
copy_file(path_s,path_t)

這個辦法避免了一部分已有文件的重復(fù)復(fù)制操作,減少了部分不必要的讀寫操作,但是卻無法消除內(nèi)容相同但名稱、路徑不同的重復(fù)文件。

4、利用MD5判定重復(fù)文件

目前判定兩個文件是否相同,除了按字節(jié)逐個對比這個笨方法外,簡單常用的辦法就是利用MD5和CRC校驗,或是按一定規(guī)律挑取文件的指定位置的數(shù)據(jù)塊就行對比。

這次利用文件的MD5值,將目標(biāo)文件夾中已有文件的MD5值保存到列表或字典中,每在源文件夾中讀取一個文件就判定該文件的MD5值是否已經(jīng)存在于MD5列表,沒有的話再進行復(fù)制操作,并將該文件的MD5值寫入列表。

import os
import hashlib
 
path_s = 'F:\\test\\s'
path_t = 'F:\\test\\t'
list_file = {}
 
def create_file_list(path):
 for name in os.listdir(path):
 filename = path+os.sep+name
 if os.path.isdir(filename):
  create_file_list(filename)
 else:
  with open(filename,'rb') as f:
  md5 = hashlib.md5(f.read()).hexdigest()
  if md5 not in list_file:
   list_file[md5] = 1
 
def copy_file(paths,patht):
 for filename in os.listdir(paths):
 filename_s = paths+os.sep+filename
 filename_t = patht+os.sep+filename
 if os.path.isdir(filename_s):
  if not os.path.exists(filename_t):
  os.mkdir(filename_t)
  copy_file(filename_s,filename_t)
 else:
  if os.path.exists(filename_t):
  print '[*] "%s" already exists! ' % filename_t
  else:
  with open(filename_s,'rb') as f_s:
   data = f_s.read()
   file_md5 = hashlib.md5(data).hexdigest()
   if file_md5 not in list_file:
   list_file[file_md5] = 1
   print '[*] Source :',filename_s
   print '[*] Target :',filename_t
   with open(filename_t,'wb') as f_t:
    f_t.write(data)
   else:
   print '[*] "%s"\'s MD5 already exists! ' % filename_t
 
create_file_list(path_t)
copy_file(path_s,path_t)

如下圖,運行后內(nèi)容相同的幾個文件,只有第一次讀取到的時候才寫入目標(biāo)文件夾,其他路徑下的文件并沒有復(fù)制到目標(biāo)文件夾。

python如何實現(xiàn)兩個文件夾

感謝你能夠認真閱讀完這篇文章,希望小編分享的“python如何實現(xiàn)兩個文件夾”這篇文章對大家有幫助,同時也希望大家多多支持創(chuàng)新互聯(lián)成都網(wǎng)站設(shè)計公司,關(guān)注創(chuàng)新互聯(lián)成都網(wǎng)站設(shè)計公司行業(yè)資訊頻道,更多相關(guān)知識等著你來學(xué)習(xí)!

另外有需要云服務(wù)器可以了解下創(chuàng)新互聯(lián)scvps.cn,海內(nèi)外云服務(wù)器15元起步,三天無理由+7*72小時售后在線,公司持有idc許可證,提供“云服務(wù)器、裸金屬服務(wù)器、網(wǎng)站設(shè)計器、香港服務(wù)器、美國服務(wù)器、虛擬主機、免備案服務(wù)器”等云主機租用服務(wù)以及企業(yè)上云的綜合解決方案,具有“安全穩(wěn)定、簡單易用、服務(wù)可用性高、性價比高”等特點與優(yōu)勢,專為企業(yè)上云打造定制,能夠滿足用戶豐富、多元化的應(yīng)用場景需求。

分享名稱:python如何實現(xiàn)兩個文件夾-創(chuàng)新互聯(lián)
網(wǎng)頁鏈接:http://www.muchs.cn/article28/ipccp.html

成都網(wǎng)站建設(shè)公司_創(chuàng)新互聯(lián),為您提供App開發(fā)、網(wǎng)站收錄、網(wǎng)站營銷定制網(wǎng)站、關(guān)鍵詞優(yōu)化小程序開發(fā)

廣告

聲明:本網(wǎng)站發(fā)布的內(nèi)容(圖片、視頻和文字)以用戶投稿、用戶轉(zhuǎn)載內(nèi)容為主,如果涉及侵權(quán)請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網(wǎng)站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內(nèi)容未經(jīng)允許不得轉(zhuǎn)載,或轉(zhuǎn)載時需注明來源: 創(chuàng)新互聯(lián)

網(wǎng)站建設(shè)網(wǎng)站維護公司