python 编码问题:'ascii' codec can't encode characters in position 的解决方案
2015-09-04 00:40
691 查看
报错:
'ascii' codec can't encode characters in position 8-50: ordinal not in range(128)python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报这样的错UnicodeDecodeError: 'ascii' codec can't decode byte 0x?? in position 1: ordinal not in range(128),python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。
查询系统默认编码可以在解释器中输入以下命令:
Python代码
>>>sys.getdefaultencoding()
设置默认编码时使用:
Python代码
>>>sys.setdefaultencoding('utf8')
可能会报AttributeError: 'module' object has no attribute 'setdefaultencoding'的错误,执行reload(sys),在执行以上命令就可以顺利通过。
此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。
有2种方法设置python的默认编码:
一个解决的方案在程序中加入以下代码:
Python代码
import sys
reload(sys)
sys.setdefaultencoding('utf8')
另一个方案是在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
Python代码
# encoding=utf8
import sys
reload(sys)
sys.setdefaultencoding('utf8')
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。
另外有一种解决方案是在程序中所有涉及到编码的地方,强制编码为utf8,即添加代码encode("utf8"),这种方法并不推荐使用,因为一旦少写一个地方,将会导致大量的错误报告,我曾经遇到这种情况,错误日志压缩之后尚有70多K,全都是这一个问题,让人有很崩溃的感觉。
相关文章推荐
- Python:认识模块
- Python核心编程-练习3
- Eclipse Python配置
- python 9.2 multiprocessing
- Python核心概念之数据模型和执行模型
- 《机器学习实战》笔记之三——决策树的构造
- 使用Python2.7和火狐浏览器下载QQ空间好友相册(二)
- 用python列出当前目录的.py文件
- 2015/9/3 Python密码输入屏蔽字符
- 转载:用python爬虫抓站的一些技巧总结
- Python爬虫入门 《下》
- Java程序员如何理解Python中的一些比较特殊的关键字
- Python 集合set
- 【Python基础】Python面向对象 - 3 - 新类,静态方法,类方法,实例方法
- 轻松python之文件专题-关于目录树的一些操作
- 轻松python之文件专题-关于目录树的一些操作
- python核心编程-练习2
- python脚本
- python 脚本学习(二)
- python 脚本学习(二)