簡體   English   中英

Python讀取目錄中的文件並進行連接

[英]Python read files in directory and concatenate

我想編寫一個Python腳本,該腳本搜索當前目錄中的所有文件夾,查找所有.txt文件,並創建一個文件,該文件是當前目錄中所有這些文件(以任何順序)的串聯。 如果文件夾包含子文件夾,則不應搜索這些子文件夾。 一個例子是

main_folder
  folder_1
    sub_folder
      file1.txt
    file2.txt
  folder_2
    file3.txt

該腳本位於main_folder 它應該創建一個文件,該文件是file2.txt內部的file2.txtfile3.txt (以任何順序)的main_folder

我的問題是:如何告訴Python遍歷文件夾,查找.txt文件,而無需進入子文件夾?

使用glob

>>> import glob
>>> glob.glob('main_folder/*/*.txt')
['main_folder/folder_1/file2.txt', 'main_folder/folder_2/file3.txt']

文檔

自上而下True ,主叫方可以就地(可能使用修改dirnames中列表del或切片分配),和walk()將只迭代到他們的名字留在dirnames中的子目錄; 這可用於修剪搜索,強加特定的訪問順序,甚至可在調用者再次恢復walk()之前向walk()告知調用者創建或重命名的目錄。

使用topdown選項設置為True的os.walk()函數。 刪除返回的元組中的所有dirnames

for root, dirs, files in os.walk('/base/dir', topdown=True):
    del dirs[:]
...

如果您使用的是基於Unix的系統,那么我認為最簡單的方法是使用python subprocess模塊來使用findcat 使用find -depth選項確實有幫助,例如,使用-depth +3查找深度> = 3的所有文件。

>>> import subprocess
>>> lst = subprocess.check_output('find . -name "*.txt" -depth 2', shell=True)
>>> print lst
./folder_1/f1.txt
./folder_2/f2.txt 
>>> out_f = subprocess.check_output('cat '+lst.replace('\n', ' '), shell=True)
>>> print out_f
inside Folder_1
inside Folder 2

您可以通過分別提供每個參數來避免shell=True

暫無
暫無

聲明:本站的技術帖子網頁,遵循CC BY-SA 4.0協議,如果您需要轉載,請注明本站網址或者原文地址。任何問題請咨詢:yoyou2525@163.com.

 
粵ICP備18138465號  © 2020-2024 STACKOOM.COM