首页教程专区正文内容

UTF编码

教程专区

2024-02-07 04:18:10

编码字节单元传输表明

UTF编码

UTF-8就是以8位为单元对UCS进行编码。从UCS-2到UTF-8的编码方式如下：

UCS-2编码(16进制) UTF-8 字节流(二进制)

0000 - 007F 0xxxxxxx

0080 - 07FF 110xxxxx 10xxxxxx

0800 - FFFF 1110xxxx 10xxxxxx 10xxxxxx

例如“汉”字的Unicode编码是6C49。6C49在0800-FFFF之间，所以肯定要用3字节模板了：1110xxxx 10xxxxxx10xxxxxx。将6C49写成二进制是：0110 110001 001001，用这个比特流依次代替模板中的x，得到：1110011010110001 10001001，即E6 B1 89。

编码的方法是从低位到高位

现在就让我们来看看实例吧！

黄为标志位

其它着为了显示其，编码后的位置

读者可以用记事本测试一下我们的编码是否正确。需要注意，UltraEdit在打开utf-8编码的文本文件时会自动转换为UTF-16，可能产生混淆。你可以在设置中关掉这个选项。更好的工具是Hex Workshop。

UTF-16以16位为单元对UCS进行编码。对于小于0x10000的UCS码，UTF-16编码就等于UCS码对应的16位无符号整数。对于不小于0x10000的UCS码，定义了一个算法。不过由于实际使用的UCS2，或者UCS4的BMP必然小于0x10000，所以就目前而言，可以认为UTF-16和UCS-2基本相同。但UCS-2只是一个编码方案，UTF-16却要用于实际的传输，所以就不得不考虑字节序的问题。

5、UTF的字节序和BOM

UTF-8以字节为编码单元，没有字节序的问题。UTF-16以两个字节为编码单元，在解释一个UTF-16

unicode编码转换二进制

文本前，首先要弄清楚每个编码单元的字节序。例如“奎”的Unicode编码是594E，“乙”的Unicode编码是4E59。如果我们收到UTF-16字节流“594E”，那么这是“奎”还是“乙”？

Unicode规范中推荐的标记字节顺序的方法是BOM。BOM不是“Bill Of Material”的BOM表，而是Byte order Mark。BOM是一个有点小聪明的想法：

在UCS编码中有一个叫做"ZERO WIDTH NO-BREAKSPACE"的字符，它的编码是FEFF。而FFFE在UCS中是不存在的字符，所以不应该出现在实际传输中。UCS规范建议我们在传输字节流前，先传输字符"ZERO WIDTH NO-BREAK SPACE"。

这样如果接收者收到FEFF，就表明这个字节流是Big-Endian的；如果收到FFFE，就表明这个字节流是Little-Endian的。因此字符"ZERO WIDTH NO-BREAK SPACE"又被称作BOM。

UTF-8不需要BOM来表明字节顺序，但可以用BOM来表明编码方式。字符"ZERO WIDTH NO-BREAKSPACE"的UTF-8编码是EF BB BF（读者可以用我们前面介绍的编码方法验证一下）。所以如果接收者收到以EF BBBF开头的字节流，就知道这是UTF-8编码了。

Windows就是使用BOM来标记文本文件的编码方式的。

字符数组转化为十六进制数 -回复

« 上一篇

UTF-8的编码规则

下一篇 »

发表评论

推荐文章

i am a robot英语作文四年级

ever moved me 英语作文

李白英语小学生作文

对华兹华斯的we are seven 的分析解读

推荐杜甫是最伟大的诗人纪录片英语作文

热门文章

英语专业英语短篇小说教案及课后答案
2024-05-20
(完整word版)2014江苏高考英语卷及答案
2024-05-20
新教材高中英语UNIT4Exploringliterature理解课文精研读学案含解析牛...
2024-05-20
大学艺术类期中英语提纲
2024-05-20
2020-2021年八年级下册人教版英语 Unit 4 单元测试卷
2024-05-20
09级专科复习题 (答案)
2024-05-20
2022-2023学年浙江省温州市实验中学八年级下学期期中英语试题
2024-05-20
2020_2021学年新教材高中英语Unit1AnewstartPeriod2Understandi_百度文 ...
2024-05-20
2020学年【冀教版】七年级上册:Unit3《BodyPartsandFeelings》全...
2024-05-20
译林版高一英语必修第二册(2019版)_Unit4_Extended_reading_名师教案...
2024-05-20
高考英语续写-情绪描写
2024-05-20
高考英语阅读与写作备考策略专题13 读后续写梳理情节与营造冲突_百 ...
2024-05-20
charlie puth英语作文
2024-05-20
帮李华克服焦虑的英语作文60字
2024-05-20
麦田里的守望者论文
2024-05-20
用动作描写情绪的英语句子
2024-05-20
让真情流露出去作文450字信箱英文
2024-05-20
新标准大学英语综合教程2原文
2024-05-20
学会洗衣服英语作文
2024-05-20
洗衣机洗衣服英语作文
2024-05-20

最新文章

标签列表