详解json.dumps中文乱码问题

发布时间：2020年09月27日 10:42:50 来源：点击量：570

【摘要】json dumps(var,ensure_ascii=False)并不能解决中文乱码的问题json dumps在不同版本的Python下会有不同的表现，注意下面提到的中文乱码问

json.dumps(var,ensure_ascii=False)并不能解决中文乱码的问题

json.dumps在不同版本的Python下会有不同的表现，注意下面提到的中文乱码问题在Python3版本中不存在。

注:下面的代码再python 2.7版本下测试通过

# -*- coding: utf-8 -*-
odata = {'a' : '你好'}
print odata

结果

{'a': 'xe4xbdxa0xe5xa5xbd'}    
1    print json.dumps(odata)

结果

{"a": "u4f60u597d"}    
1    print json.dumps(odata,ensure_ascii=False)

结果

{"a": "浣犲ソ"}    
1    print json.dumps(odata,ensure_ascii=False).decode('utf8').encode('gb2312')

结果

{"a": "你好"}

要解决中文编码，需要知道python2.7对字符串是怎么处理的：

由于# -- coding: utf-8 -- 的作用，文件内容以utf-8编码，所以print odata

输出的是utf-8编码后的结果{‘a’: ‘xe4xbdxa0xe5xa5xbd’}

json.dumps 序列化时对中文默认使用的ascii编码， print json.dumps(odata)输出unicode编码的结果

print json.dumps(odata,ensure_ascii=False)不使用的ascii编码，以gbk编码

‘你好’ 用utf8编码是 %E4%BD%A0%E5%A5%BD 用gbk解码是浣犲ソ

字符串在Python内部的表示是unicode编码。

因此，在做编码转换时，通常需要以unicode作为中间编码，即先将其他编码的字符串解码（decode）成unicode，再从unicode编码（encode）成另一种编码。

decode的作用是将其他编码的字符串转换成unicode编码

decode（’utf-8’）表示将utf-8编码的字符串转换成unicode编码。

encode的作用是将unicode编码转换成其他编码的字符串

encode(‘gb2312’)，表示将unicode编码的字符串转换成gb2312编码。

python3中没有这种问题，所以最简单的方法是引入__future__模块，把新版本的特性导入到当前版本

from __future__ import unicode_literals
print json.dumps(odata,ensure_ascii=False)

结果

{"a": "你好"}

在写入文件的时候出现了Python2.7的UnicodeEncodeError: ‘ascii’ codec can’t encode异常错误

大神的解决方法：

不使用open打开文件，而使用codecs：

from __future__ import unicode_literals
import codecs
fp = codecs.open('output.txt', 'a+', 'utf-8')
fp.write(json.dumps(m,ensure_ascii=False))
fp.close()

分享到：编辑：wangmin

上一篇：python入门基础教程下一篇：Python3 pickle模块的使用详解

就业培训申请领取

您的姓名

您的电话

意向课程

点击领取

环球青藤

官方QQ群

扫描上方二维码或点击一键加群，免费领取大礼包，加群暗号：青藤。一键加群

Python编程相关文章推荐

Python编程最新文章推荐

免费直播更多

应《中华人民共和国网络安全法》加强实名认证机制要求,同时为更加全面的体验产品服务,烦请您绑定手机号.

预约成功

本直播为付费学员的直播课节

请您购买课程后再预约

我要购买

最新文章

环球青藤移动课堂APP 直播、听课。职达未来！

安卓版

下载

iPhone版

下载

环球青藤官方微信服务平台

刷题看课 APP下载

免费直播一键购课

代报名等人工服务

Python编程热点排行