首页 > 编程 > Python > 正文

Python中文字符串截取问题

2020-02-23 01:34:53

字体：大中小

来源：转载

供稿：网友

先来看个例子：

#-*- coding:utf8 -*-s = u'中文截取's.decode('utf8')[0:3].encode('utf8')# 结果u'中文截取

延伸阅读：

UTF-8中的汉字占用多少字节？
占2个字节的：〇
占3个字节的：基本等同于GBK，含21000多个汉字
占4个字节的：中日韩超大字符集里面的汉字，有5万多个
一个UTF-8数字占1个字节
一个UTF-8英文字母占1个字节

在查找 UTF-8 编码资料时发现，很多的帖子说的 UTF-8 编码里，一个汉字占用3个字节，有的还做了个证明，大概是这样的，创建一个没有BOM的UTF-8编码的文本文件，里面保存了几个汉字，然后查看文件的大小。我觉得这样的证明没有一点说服力，因为 UTF-8 是变长的，1-6个字节，少量的汉字检测是不能说明所有的汉字都是的。

后来我又查看了字符映射表－汉语，找到了正确的答案，少数是汉字每个占用3个字节，多数占用4个字节。

以上所述就是本文的全部内容了，希望大家能够喜欢。

上一篇：Python计算三维矢量幅度的方法

下一篇：Python中unittest模块做UT（单元测试）使用实例

学习交流

笔记本开机提示error loading os错误的问

笔记本开机提示error loading os错误的问题怎么解决...

热门图片

猜你喜欢的新闻

猜你喜欢的关注

新闻热点

雷军：小米成立10年收入突破2000亿

2020-02-23 14:27:16

特斯拉：无钴，不代表一定是磷酸铁锂电池

2020-02-22 09:45:28

豌豆荚宣布业务调整将于2月28日关闭PC版在线服务

2020-02-22 09:42:20

小米集团宣布人事任命：联合创始人王川担任小米集团首席战略官

2020-02-22 09:39:07

外媒：高通康宁合作开发毫米波5G室内解决方案

2020-02-21 16:46:56

华为终端产品与战略线上发布会：5G全场景，共联未来

2020-02-20 10:01:00

疑难解答

图片精选

网友关注