当前位置:首页>科技>正文

Unicode字符编码是所有字节都占2个字节吗

2023-05-05 17:10:42 互联网 未知 科技

 Unicode字符编码是所有字节都占2个字节吗

Unicode字符编码是所有字节都占2个字节吗

Unicode 目前规划的总空间是17个平面(平面0至16),0x0000 至 0x10FFFF。每个平面有 65536 个码点。
你只是大致知道平面0(「Basic Multilingual Plane」,即「BMP」)的 65536 个码点(即 0x0000 至 0xFFFF)如何编码,这不是 Unicode 的全部。

  BMP 的字符是 Unicode 中最基础和最常用的一部分,以 UTF-16 编码时使用2字节,以 UTF-8 编码时使用1至3字节。
  超出 BMP 的字符以 UTF-16 或 UTF-8 编码都需要4字节。
  另外还有一个比较少用的编码形式,UTF-32,它编码任何 Unicode 字符都需要4个字节。

  Unicode 的基础是一个编号的字符集,在字符集之上又规定了模块化的编码等等技术层次,各种具体的编码形式并不一致,你说的「Unicode 只有两个字节」这句话根本不成立。