繁体   English   中英

Python编码unicode <> utf-8

[英]Python encoding unicode<>utf-8

因此,我在将Unicode转换为utf-8的过程中迷路了。 我试图定义一些包含Unicode字符的JSON,并将其写入文件。 在终端上打印时,字符表示为'\\ u2606'。 查看文件时,字符编码为'\\ u2606',请注意双反斜杠。 有人可以针对这些编码问题为我指明正确的方向吗?

# encoding=utf8

import json

data = {"summary" : u"This is a unicode character: ☆"}
print data

decoded_data = unicode(data)
print decoded_data

with open('decoded_data.json', 'w') as outfile:
    json.dump(decoded_data, outfile)

我尝试将以下代码段添加到文件的开头,但这都没有成功。

import sys
import codecs
sys.stdout = codecs.getwriter('utf8')(sys.stdout)
sys.stderr = codecs.getwriter('utf8')(sys.stderr)

首先,您要打印字典的表示形式,而python仅使用ascii字符,并使用\\uxxxx转义任何其他字符。

尝试仅使用ascii字符的json.dump也是json.dump 您可以通过以下方式强制json.dump使用unicode:

json_data = json.dumps(data, ensure_ascii=False)
with open('decoded_data.json', 'w') as outfile:
    outfile.write(json_data.encode('utf8'))

我想你也可以参考这个链接,它真的很有用

设置默认编码

暂无
暂无

声明:本站的技术帖子网页,遵循CC BY-SA 4.0协议,如果您需要转载,请注明本站网址或者原文地址。任何问题请咨询:yoyou2525@163.com.

 
粤ICP备18138465号  © 2020-2024 STACKOOM.COM