Advertisement

UTF-8编码及其非英文字符的处理和显示

阅读量:

每个char类型仅占用1个字节的空间,并能表示256种不同的信息内容。当仅用于表示英文字母及其标点符号时,一个字节已经足够容纳全部可能的表示内容。然而,在处理具有大量不同种类的'字符'(如中文)时,则需要更多的资源以实现精确表示。在编码其他语言的文字时通常会采用多样化的多字节编码方案以适应不同需求

本文源自作者撰写的教材内容; 作为个人学习与教学实践的参考资料, 读者可在遵守相关规定的情况下自由使用; 特别禁止用于商业出版或抄写改编。

教材信息如下:

  1. 由陈波与刘慧君合著的《Python编程基础及应用》一书, 出版社为高等教育出版社; 免费开放获取配套教学视频资源 Python编程基础及应用

  2. 编程实践教程类书籍中, 陈波等教授编写而成的《Python编程基础及应用实验教程》一书由高等教育出版社正式发行 Python编程基础及应用实验教程

  3. 待面世的简明C/C++语言入门教材将由陈波先生负责编写

1. 文本编码与解码

计算机采用二进制编码方式。它的数据结构和存储空间仅能存储与处理由0和1组成的序列;每个这样的序列代表一个单独的信息单元——即所谓的比特(bit)。通常将连续的8个二进制位组

全部评论 (0)

还没有任何评论哟~