2020-05-08 python3如何使用chr()把一个大于

作者: 坚持的皮蛋 | 来源:发表于2020-05-08 10:10 被阅读0次

首先，我们看看help(chr)，可以知道Return a Unicode string of one character with ordinal i; 0 <= i <= 0x10ffff. 所以chr(i)函数实际上返回的是Unicode编码表中的一个字符，参数i指定了这个字符在Unicdoe编码表中的位置。

PS1：Unicode编码表是一个全球统一的标准，我们可以认为它为世界上所有的字符（还有一些glyph、表情之类的）都编了号。而其他一些编码，比如ASCII、GBK、cp1252等编码，则只编码了Unicode编码表中的一部分字符。当然还有utf-8和uft-16等编码则是采用不同的方式编码了所有的Unicode字符。目前Unicode已经发布到了第9版，Python 3内部采用Unicode表示所有字符，即str类型，而编码成其他编码格式后，则是Bytes类型。

ASCII编码中每个字符编码是1个Byte，且只有0-127，而128－255部分的编码属于Extended ASCII。Python默认的ASCII中是没有大于127部分的，如果执行：chr(128).encode(‘ascii’)，会得到异常’ascii’ codec can’t encode character ‘\x80’ in position 0: ordinal not in range(128)

而utf-8编码虽然支持所有的Unicode字符，但根据字符的不同，会采用13个Byte来编码字符。它对于ASCII编码是兼容的，所以0127的部分和utf-8和ascii的编码是一样的。但是大于128的那部分extended ascii中的字符，则采用了两个字节进行编码，这也是为什么你的代码得到了两个Bytes。

我猜你需要的是一个支持Extended ASCII部分字符，且采用1个Byte固定大小编码的encoding，比如ISO 8859-1，也被称为latin1。

举个例子，比如人民币钱多符号¥在Unicode中的位置是165。

>>> chr(165)
¥
>>> chr(165).encode('latin1')
b'\xa5'

其他的编码比如cp437、cp1252，也可以编码128-255中的部分字符，比如 chr(165).encode(‘cp437’)返回b’\x9d’，比如 chr(165).encode(‘cp1252’)返回b’\xa5’。但如果编码chr(128)就会报错。所以，如果你的目的是要能支持chr(i)，0 <= i <= 255，那么我还是推荐你用latin1。
————————————————
版权声明：本文为CSDN博主「AnRen.」的原创文章，遵循CC 4.0 BY-SA版权协议，转载请附上原文出处链接及本声明。
原文链接：https://blog.csdn.net/weixin_44266650/article/details/99726486

网友评论

本文标题：2020-05-08 python3如何使用chr()把一个大于

本文链接：https://www.haomeiwen.com/subject/rgmxnhtx.html

延伸阅读

深度阅读

您也可以注册成为美文阅读网的作者，发表您的原创作品、分享您的心情！

2020-05-08 python3如何使用chr()把一个大于

相关文章

网友评论

延伸阅读

深度阅读

栏目导航

热点阅读