宜配屋

解决python3中解压zip文件是文件名乱码的问题

yipeiwu_com7年前 (2020-03-06)Python基础

在zip标准中，对文件名的 encoding 用的不是 unicode，而可能是各种软件根据系统的默认字符集来采用（此为猜测），因此zipfile中根据文件 flag 检测的时候，只支持 cp437 和 utf-8。

具体就是查找 zipfile.py 源代码找到下面的代码：

1: if flags & 0x800:
2: # UTF-8 file names extension
3: filename = filename.decode('utf-8')
4: else:
5: # Historical ZIP filename encoding
6: filename = filename.decode('cp437')

可见编码被正确识别为utf8时的情况外，都会被识别并decode为cp437编码，但如果实际是gbk等其他编码时就变为乱码了。所以解决的方法在于被decode为cp437后重新再手动转为正确的编码。

具体代码如下：

#修改代码
if flags & 0x800:
 # UTF-8 file names extension
 filename = filename.decode('utf-8')
else:
 # Historical ZIP filename encoding
 filename = filename.decode('cp437')
 #修改
 filename = filename.encode("cp437").decode('gbk')

后面一处同样如此修改

if zinfo.flag_bits & 0x800:
 # UTF-8 filename
 fname_str = fname.decode("utf-8")
else:
 fname_str = fname.decode("cp437")
 #修改
 fname_str = fname_str.encode("cp437").decode('gbk')

亲测有效！

以上这篇解决python3中解压zip文件是文件名乱码的问题就是小编分享给大家的全部内容了，希望能给大家一个参考，也希望大家多多支持【听图阁-专注于Python设计】。

解决python3中解压zip文件是文件名乱码的问题

相关文章

Python3.6连接Oracle数据库的方法详解

python回调函数中使用多线程的方法

Python中关于使用模块的基础知识

Python中asyncore的用法实例

详解python的ORM中Pony用法

© YiPeiWu.com 【宜配屋】粤ICP备17031333号

Powered By Z-BlogPHP. Theme by TOYEAN.

宜配屋

解决python3中解压zip文件是文件名乱码的问题

相关文章

Python3.6连接Oracle数据库的方法详解

python回调函数中使用多线程的方法

Python中关于使用模块的基础知识

Python中asyncore的用法实例

详解python的ORM中Pony用法

© YiPeiWu.com 【宜配屋】 粤ICP备17031333号 var _hmt = _hmt || [];(function() { var hm = document.createElement("script"); hm.src = "https://hm.baidu.com/hm.js?8aa60ae04b767b2af31903508928acc0"; var s = document.getElementsByTagName("script")[0]; s.parentNode.insertBefore(hm, s);})();

Powered By Z-BlogPHP. Theme by TOYEAN.

© YiPeiWu.com 【宜配屋】粤ICP备17031333号