UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in position 1: ordinal not in range(128)
2015-06-07 15:16
791 查看
http://shirley-ren.iteye.com/blog/1018750
python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。查询系统默认编码可以在解释器中输入以下命令:
设置默认编码时使用:
可能会报AttributeError: 'module' object has no attribute 'setdefaultencoding'的错误,执行reload(sys),在执行以上命令就可以顺利通过。
此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。
有2种方法设置python的默认编码:
一个解决的方案在程序中加入以下代码:
另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。
另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。
python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。查询系统默认编码可以在解释器中输入以下命令:
<span style="font-size:18px;">>>>sys.getdefaultencoding()</span>
设置默认编码时使用:
<span style="font-size:18px;">>>>sys.setdefaultencoding('utf8')</span>
可能会报AttributeError: 'module' object has no attribute 'setdefaultencoding'的错误,执行reload(sys),在执行以上命令就可以顺利通过。
此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。
有2种方法设置python的默认编码:
一个解决的方案在程序中加入以下代码:
<span style="font-size:18px;">import sys reload(sys) sys.setdefaultencoding('utf8') </span>
另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
<span style="font-size:18px;"># encoding=utf8 import sys reload(sys) sys.setdefaultencoding('utf8') </span>
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。
另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。
相关文章推荐
- AngularJS 作用域Scope的继承
- HDU 1290 献给杭电五十周年校庆的礼物
- STL源码分析之hashtable
- php+MySQL图书管理系统(二)
- Quartz入门实例
- WPF案例(-)模拟Windows7 Win+Tab切换
- Discuz!X/数据库 DB:: 函数操作方法
- IoC容器Autofac(1) -- 什么是IoC以及理解为什么要使用Ioc
- Theano3.4-练习之多层感知机
- 统计学知识
- 使用eval和loop在模版中直接读取数据库内容并输出
- 漂亮的表格样式(使用CSS样式表控制表格样式)
- Linux 网络相关命令
- ACM Digital Roots
- hdu 1003
- 常用md5加密方式
- 小小的TODO,大大的世界!
- linux命令
- 架构设计师与SOA
- 黑马程序员_模版方法设计模式