python在安装时,默认的编码是ascii,当程序中出现非ascii编码时,python的处理常常会报类似这样的错误。
UnicodeEncodeError: 'ascii' codec can't encode characters in position 14-15: ordinal not in range(128)
python没办法处理非ascii编码的,此时需要自己设置将python的默认编码,一般设置为utf8的编码格式。
查询系统默认编码:
import sys;sys.getdefaultencoding()
设置默认编码
import sys;sys.setdefaultencoding('utf8')
可能会报AttributeError: 'module' object has no attribute 'setdefaultencoding'的错误,执行reload(sys),在执行以上命令就可以顺利通过。
此时在执行sys.getdefaultencoding()就会发现编码已经被设置为utf8的了,但是在解释器里修改的编码只能保证当次有效,在重启解释器后,会发现,编码又被重置为默认的ascii了,那么有没有办法一次性修改程序或系统的默认编码呢。
有两种种方法设置python的默认编码:
方法一:在程序中加入以下代码:
Python代码
import sys
reload(sys)
sys.setdefaultencoding('utf8')
方法二:在python的Lib\site-packages文件夹下新建一个sitecustomize.py,内容为:
Python代码
# encoding=utf8
import sys reload(sys)
sys.setdefaultencoding('utf8')
注意:sitecustomize.py这个文件最好不要使用记事本这样的工具创建。
此时重启python解释器,执行sys.getdefaultencoding(),发现编码已经被设置为utf8的了,
多次重启之后,效果相同,这是因为系统在python启动的时候,自行调用该文件,设置系统的默认编码,
而不需要每次都手动的加上解决代码,属于一劳永逸的解决方法。