(电脑)在ASCII后最常用
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
标准字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
。ASCII
![](https://www.godic.net/tmp/wordimg/W9Fl75J8ojyHLjwXtSQmiuOMM40=.png)
然仍是电脑运作
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
基础。但是毕竟太少。跟不上电脑应用发展
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
脚步。Unicode更强
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
。前面
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
255个Unicode字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
可以映射ASCII字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
表。
国际标准组织于1984年4月成立ISO/IEC JTC1/SC2/WG2工作组。针对各国文字、
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
号进行统一性编码。1991年美国跨国公司成立Unicode Consortium。并于1991年10月与WG2达成协议。采用同一编码字
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
。目前Unicode是采用16位编码体系。其字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
内容与ISO10646
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
BMP(Basic Multilingual Plane)相同。Unicode于1992年6月通过DIS(Draf International Standard)。目前版本V2.0于1996公布。内容包含
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
号6811个。汉字20902个。韩文拼音11172个。造字区6400个。保留20249个。
![](https://www.godic.net/tmp/wordimg/9YHlhdELKAnFSyjaJIothAU2ccY=.png)
计65534个。
随着国际互联网
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
迅速发展。要求进行数据交换
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
需求越来越
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
。不同
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
编码体系越来越成为信息交换
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
障碍。而且多种语言
![](https://www.godic.net/tmp/wordimg/9YHlhdELKAnFSyjaJIothAU2ccY=.png)
存
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
文档不断增多。单靠代码页已很难解决这些问题。于是UNICODE应运而生。
UNICODE有双重含义。首先UNICODE是对国际标准ISO/IEC10646编码
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
一种称谓(ISO/IEC10646是一个国际标准。亦称
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
。它是ISO于1993年颁布
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
一项重要国际标准。其宗旨是全球所有文种统一编码)。另外它又是由美国
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
HP、Microsoft、IBM、Apple
![](https://www.godic.net/tmp/wordimg/aazUlmDKYmwgYHMjkGmNhKC@4WE=.png)
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
企业组成
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
联盟
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
团
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
名称。成立该
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
团
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
宗旨就是要推进多文种
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
统一编码。
UNICODE同现在流行
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
代码页最显著不同点在于:UNICODE是两字节
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
全编码。对于ASCII字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
它也使用两字节表示。代码页是通过高字节
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
取值范围来确定是ASCII字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。还是汉字
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
高字节。如果发生数据损坏。某处内容破坏。则会引起其后汉字
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
混乱。UNICODE则一律使用两个字节表示一个字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。最明显
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
好处是它简化了汉字
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
处理过程。
UNICODE使用平面来描述编码空间。每个平面分为256行。256列。相对于两字节编码
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
高低两个字节。
UNICODE
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
第一个平面。称为Basic Multilingual Plane(基本多文种平面)。简称BMP。由于BMP仅用两个字节表示。所以倍受青睐。
Unicode
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
最初目标。是用1个16位
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
编码来为超过65000字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
提供映射。但这还不够。它不能覆盖全部历史上
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
文字。也不能解决传输
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
问题(implantation head-ache's)。尤其在那些基于网络
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
应用中。因此。Unicode用一些基本
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
保留字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
制定了三套编码方式。它们分别是UTF-8,UTF-16和UTF-32。正如名字所示。在UTF-8中。字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
是以8位序列来编码
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
。用一个或几个字节来表示一个字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。这种方式
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
最
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
好处。是UTF-8保留了ASCII字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
编码做为它
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
一部分。例如。在UTF-8和ASCII中。"A"
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
编码都是0x41.UTF-16和UTF-32分别是Unicode
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
16位和32位编码方式。考虑到最初
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
目
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
。通常说
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
Unicode就是指UTF-16。
多年来。计算机普遍采用美国信息交换标准代码(American Standard Code for Information Interchange,简称ASCII码)来表示字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。这些字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
可以是字母。数字。标点
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
号和控制
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。用这种编码来表示英文在内
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
不成问题
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
。但要表示其它语言文字如。阿拉伯文。中文。日文。维文。哈文...必须进行扩充。在1987年。Xerox Palo Alto研究中心
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
Joe Becker和Lee Collins。以及Apple公司
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
Mark Davis试图研究一种适用于多文种处理
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
编码。这种编码很快就得到了许多
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
公司
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
支持。这些公司都派代表参加Unicode研究组。Unicode
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
研究得到了较快
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
进展。由于Unicode
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
团
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
成员都是世界上
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
主要系统及软件制造商。所以Unicode很快就成为事实上
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
工业标准。
基于Unicode
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
系统允许使用65000个不同
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。足以善盖世界所有语言
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
所有字母。外加数千种
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
号。
其中。General Scripts区单独收录了19种语言文字。包括ASCII,Latin1,Greek,Cyrillic,Armenian,Hedrew,Arabic,Devanagari,Bengali ,Gurmukhi,Gujarati,Oriya,Tamil,Telugu,Kannada,Malayalam,Thai,Lao,Tibetan,Georgian
![](https://www.godic.net/tmp/wordimg/aazUlmDKYmwgYHMjkGmNhKC@4WE=.png)
语言文字之外。还包括汉语。日语和朝鲜语中
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
所有
![](https://www.godic.net/tmp/wordimg/yhy5Gg3b1lAptxf@@Vj0MQpYnPew=.png)
量字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
。
Unicode是一种定长
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
2B多文种字
![](https://www.godic.net/tmp/wordimg/hdu5vKL9kCJvEI6@@@zQ6Ya7E2hg=.png)
![](https://www.godic.net/tmp/wordimg/vvFjVJI8p@858gEnrwOfN6U1Il4=.png)
编码。它试图善盖现有
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
有关国家和地区
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
标准。包括GB2312,CNS11643,JIS 0208和KSC 5601
![](https://www.godic.net/tmp/wordimg/aazUlmDKYmwgYHMjkGmNhKC@4WE=.png)
。Unicode可以表示混合文字资料。也可以保证以前
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
ISO 10646。
凡顺提示:Win98以前
![](https://www.godic.net/tmp/wordimg/JFixGdWP0kUfowutoSfeQEULCn8=.png)
操作系统不支持Unicode。
欧 路 软 件