python實現文件批量編碼轉換


   起因:大三做日本交換生期間在修一門C語言圖像處理的編程課,在配套書籍的網站上下載了sample,但是由於我用的ubuntu18.04系統默認用utf-8編碼,而文件源碼是Shift_JIS編碼,因而文檔注釋是亂碼。在不改變系統默認編碼的前提下,用python將'.c'和'.h'文件的編碼轉換保存新的文件夾,其余文件原封不動復制。


 

 1 import os
 2 
 3 abspath = "/home/fanghaoyu/桌面/libraries/"  # 新文件夾的路徑
 4 try:
 5     os.makedirs(abspath)  # 創建新文件夾
 6 except FileExistsError:
 7     pass
 8 a = []  # 定義列表a,用來存放原文件的路徑
 9 b = []  # 定義列表b,用來存放新文件的路徑
10 
11 
12 # 函數用來遞歸獲取文件,更改編碼寫入到新文件夾中,如果不是.c和.h文件則復制
13 def get_file_name(path1, path2):
14     for i in os.listdir(path1):
15         if os.path.isdir(os.path.join(path1, i)):
16             try:
17                 os.makedirs(os.path.join(path2, i))
18             except FileExistsError:
19                 pass
20             get_file_name(os.path.join(path1, i), os.path.join(path2, i))
21         else:
22             a.append(os.path.join(path1, i))
23             b.append(os.path.join(path2, i))
24             if a[-1].endswith('.c') or a[-1].endswith('.h'):
25                 with open(a[-1], 'r', encoding='Shift_JIS') as fp:
26                     s = fp.read()
27                     with open(b[-1], 'w') as fp2:
28                         fp2.write(s)
29                         fp2.close()
30             else:
31                 a[-1] = a[-1].replace(' ', '\ ').replace('(', '\(').replace(')', '\)')
32                 b[-1] = b[-1].replace(' ', '\ ').replace('(', '\(').replace(')', '\)')
33                 os.system('cp {} {}'.format(a[-1].strip('\''), b[-1].strip('\'')))
34 
35     return 0
36 
37 
38 get_file_name("/home/fanghaoyu/桌面/prog978-4-7856-3179-6/", abspath)
39 print(a)
40 print(len(a))
41 print(b)
42 print(len(b))

 

運行結果如下:

/usr/bin/python3.6 /home/fanghaoyu/桌面/python/coding_change.py
['/home/fanghaoyu/桌面/prog978-4-7856-3179-6/chap06/vq.c', '/home/fanghaoyu/桌面/prog978-4-7856-3179-6/chap06/vqcode.c',...]
1970
['/home/fanghaoyu/桌面/libraries/chap06/vq.c', '/home/fanghaoyu/桌面/libraries/chap06/vqcode.c', ...]
1970

Process finished with exit code 0

 

需要注意的幾點:

  1. open打開原文件,打開方式用'r',則需要設置編碼方式encoding='Shift_JIS'
  2. python的os.system()命令中調用ubuntu的shell命令,當cp的文件名中含有' ',  '(',  ')'這三個時,需要在前面加上反斜杠'\',否則會報錯

PS:第一次寫博客,請多多指教。我分享一下我用的教科書下載sample網站

2019-10-14-13:19:21

 


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM