700字范文,内容丰富有趣,生活中的好帮手!
700字范文 > python使用zipfile解压文件中文乱码问题

python使用zipfile解压文件中文乱码问题

时间:2023-05-25 17:52:42

相关推荐

python使用zipfile解压文件中文乱码问题

中文在编程中真实后娘养的,各种坑爹,python3下中文乱码这个问题抓破了头皮,头疼。看了alex的文章,才有种恍然大悟的感觉(链接在底部)。

一句话,就是转换成unicode,压缩前是什么编码,使用什么编码encode再decode回来

先看测试代码:

#-*- coding: utf-8 -*-import zipfile# 默认模式r,读azip = zipfile.ZipFile("/Users/a/my_file/feise.zip", 'r')# 返回所有文件夹和文件zip_list = azip.namelist()for zip_file in zip_list:print(zip_file)print(zip_file.encode('utf-8'))

真实文件名

绯色/w1985jc/沈嫣日记/8_【沈嫣日记】(33-完).txt

print(zip_file):

τ│╔½/ú≈ú▒ú╣ú╕ú╡úΩúπ/╔≥µ╠╚╒╝╟/8_í╛╔≥µ╠╚╒╝╟í┐ú¿33-═Ωú⌐.txt

print(zip_file.encode('utf-8'))

b'\xcf\x84\xe2\x94\x82\xe2\x95\x94\xc2\xbd/\xc3\xba\xe2\x89\x88\xc3\xba\xe2\x96\x92\xc3\xba\xe2\x95\xa3\xc3\xba\xe2\x95\x95\xc3\xba\xe2\x95\xa1\xc3\xba\xce\xa9\xc3\xba\xcf\x80/\xe2\x95\x94\xe2\x89\xa5\xc2\xb5\xe2\x95\xa0\xe2\x95\x9a\xe2\x95\x92\xe2\x95\x9d\xe2\x95\x9f/8_\xc3\xad\xe2\x95\x9b\xe2\x95\x94\xe2\x89\xa5\xc2\xb5\xe2\x95\xa0\xe2\x95\x9a\xe2\x95\x92\xe2\x95\x9d\xe2\x95\x9f\xc3\xad\xe2\x94\x90\xc3\xba\xc2\xbf33-\xe2\x95\x90\xce\xa9\xc3\xba\xe2\x8c\x90.txt'

废话不多说了,直接上最后成功代码,使用cp437可以正确读取部分,但是还有一部分却打印出来\u的编码,

因为看了alex的文章,又在catch中加上了utf-8的解码方式

#-*- coding: utf-8 -*-

import zipfile

# 默认模式r,读

azip = zipfile.ZipFile("/Users/a/my_file/feise.zip", 'r')

# 返回所有文件夹和文件

zip_list = azip.namelist()

for zip_file in zip_list:

print(zip_file)

print(zip_file.encode('utf-8'))

try:

zip_file = zip_file.encode('cp437').decode('gbk')

except:

zip_file = zip_file.encode('utf-8').decode('utf-8')

print(zip_file)

一句话,就是转换成unicode,压缩前是什么编码,使用什么编码encode再decode回gbk、utf-8

本文参考文档:

/CN-S/p/6566395.html

/alex3714/articles/7550940.html

本内容不代表本网观点和政治立场,如有侵犯你的权益请联系我们处理。
网友评论
网友评论仅供其表达个人看法,并不表明网站立场。