分享

你觉得python很难那只是你没有懂而已(大图文)

 山峰云绕 2018-05-03

你觉得python很难,那只是你没有懂而已!


             【【W3Cschool】你觉得python很难,那只是你没有懂而已!】http://toutiao.com/group/6550931721632612877/?iid=15906422033&app=explore_article&timestamp=1525362651&tt_from=copy_link&utm_source=copy_link&utm_medium=toutiao_ios&utm_campaign=client_share


在 Python 尤其是 Python2 中,编码问题是困扰开发者尤其初学者的一大问题。什么 Unicode/UTF-8/str,又是 decode/encode 的,搞得人头都大了。其实不然,看似庞大难懂,但是可以非常精细地定制需求。

0.Python 中的编码

Python 中有两个常用的由 basestring 派生出来的表示字符串的类型:str, unicode。其中,str 类似于 C 中的字符数组或者 Java 中的 byte 数组,事实上你可以将它理解为一个存储二进制内容的容器,str 不存储编码信息,果对 str 类型的字符串迭代的话,则会按照其在内存中的字节序依次迭代,意味着如果这个字符串存储的是多字节字符(Unicode/GBK等),则会截断这个字符,演示如下:

你觉得python很难,那只是你没有懂而已!

而对于 unicode 类型,Python 在内存中存储和使用的时候是按照 UTF-8 格式,在代码中的表示为字符串前加 u,如:

你觉得python很难,那只是你没有懂而已!

而 unicode 与 str 之间的转换,则用到了 encode 和 deocde 方法。decode 表示将一个 (str) 字符串按照给定的编码解析为 unicode 类型,encode 则表示将一个 unicode 字符串按照指定编码解析为字节数组 (str):

你觉得python很难,那只是你没有懂而已!

1.文件读写

你觉得python很难,那只是你没有懂而已!

内置的 open 函数打开文件时,read 方法读取的是一个 str (私以为叫做字节数组更合适),如果读取的是其它编码的文字,则需要 decode 之后再做使用。

你觉得python很难,那只是你没有懂而已!

对于使用 open 函数打开文件之后的写操作,则需要将需要写入的字符串按照其编码 encode 为一个 str ,如果直接写入,则会引发如下错误:

你觉得python很难,那只是你没有懂而已!

除此以外,codecs 模块也提供了一个 open 函数,可以直接指定好编码打开一个文本文件,那么读取到的文件内容则直接是一个 unicode 字符串。对应的指定编码后的写入文件,则可以直接将 unicode 写到文件中。通过 codecs.open 可以避免很多编码问题:

你觉得python很难,那只是你没有懂而已!

你觉得python很难,那只是你没有懂而已!

建议

对于 Python 代码中避免遇到编码问题,有一些小建议:

  • 字符编码声明:在代码开头声明编码格式

  • 使用 codecs 的 open 函数处理文本文件

  • 尽可能使用 unicode 而不是 str

    本站是提供个人知识管理的网络存储空间,所有内容均由用户发布,不代表本站观点。请注意甄别内容中的联系方式、诱导购买等信息,谨防诈骗。如发现有害或侵权内容,请点击一键举报。
    转藏 分享 献花(0

    0条评论

    发表

    请遵守用户 评论公约

    类似文章 更多