(电脑)在ASCII后最常用的标准字符集。ASCII虽然仍是电脑运作的基础。但是毕竟太少。跟不上电脑应用发展的脚步。Unicode更强大。前面的255个Unicode字符可以映射ASCII字符表。
国际标准组织
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
1984
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
4月成立ISO/IEC JTC1/SC2/WG2工作组。针对各国文字、符号进行统一性
![](https://www.godic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
。1991
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
美国跨国公司成立Unicode Consortium。并
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
1991
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
10月与WG2达成协议。采用
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
一
![](https://www.godic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
字集。目前Unicode是采用16位
![](https://www.godic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
![](https://www.frdic.com/tmp/wordimg/IpDPa6SsU4flIAiN52C3GlI4cbA=.png)
系。其字符集内容与ISO10646的BMP(Basic Multilingual Plane)相
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
。Unicode
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
1992
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
6月通过DIS(Draf International Standard)。目前版本V2.0
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
1996公布。内容包含符号6811个。汉字20902个。韩文拼音11172个。造字区6400个。保留20249个。
![](https://www.frdic.com/tmp/wordimg/9YHlhdELKAnFSyjaJIothAU2ccY=.png)
计65534个。
随着国际互联网的迅速发展。要求进行数据交换的需求越来越大。不
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
的
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
![](https://www.frdic.com/tmp/wordimg/IpDPa6SsU4flIAiN52C3GlI4cbA=.png)
系越来越成为信息交换的障碍。而且多种语言
![](https://www.frdic.com/tmp/wordimg/9YHlhdELKAnFSyjaJIothAU2ccY=.png)
存的文档不断增多。单靠代
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
页已很难解决这些问题。
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
是UNICODE应运而生。
UNICODE有双重含义。首先UNICODE是对国际标准ISO/IEC10646
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
的一种称谓(ISO/IEC10646是一个国际标准。亦称大字符集。它是ISO
![](https://dict.eudic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
1993
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
颁布的一项重要国际标准。其宗旨是全球所有文种统一
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
)。另外它又是由美国的HP、Microsoft、IBM、Apple等大企业组成的联盟集团的名称。成立该集团的宗旨就是要推进多文种的统一
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
。
UNICODE
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
现在流行的代
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
页最显著不
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
点在
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
:UNICODE是两字节的全
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
。对
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
ASCII字符它也使用两字节表示。代
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
页是通过高字节的取值范围来确定是ASCII字符。还是汉字的高字节。如果发生数据损坏。某处内容破坏。则会引起其后汉字的混乱。UNICODE则一律使用两个字节表示一个字符。最明显的好处是它简化了汉字的处理过程。
UNICODE使用平面来描述
![](https://dict.eudic.net/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
空间。每个平面分为256行。256列。相对
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
两字节
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
的高低两个字节。
UNICODE的第一个平面。称为Basic Multilingual Plane(基本多文种平面)。简称BMP。由
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
BMP仅用两个字节表示。所以倍受青睐。
Unicode的最初目标。是用1个16位的
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
来为超过65000字符提供映射。但这还不够。它不能覆盖全部历史上的文字。也不能解决传输的问题(implantation head-ache's)。尤其在那些基
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
网络的应用中。因此。Unicode用一些基本的保留字符制定了三套
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
方式。它们分别是UTF-8,UTF-16和UTF-32。正如名字所示。在UTF-8中。字符是以8位序列来
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
的。用一个或几个字节来表示一个字符。这种方式的最大好处。是UTF-8保留了ASCII字符的
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
做为它的一部分。例如。在UTF-8和ASCII中。"A"的
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
都是0x41.UTF-16和UTF-32分别是Unicode的16位和32位
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
方式。考虑到最初的目的。通常说的Unicode就是指UTF-16。
多
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
来。计算机普遍采用美国信息交换标准代
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
(American Standard Code for Information Interchange,简称ASCII
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
)来表示字符。这些字符可以是字母。数字。标点符号和控制符。用这种
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
来表示英文在内的字符不成问题的。但要表示其它语言文字如。阿拉伯文。中文。日文。维文。哈文...必须进行扩充。在1987
![](https://dict.eudic.net/tmp/wordimg/y45uk4h2jrzjmsxSG1o6jaOsXYY=.png)
。Xerox Palo Alto研究中心的Joe Becker和Lee Collins。以及Apple公司的Mark Davis试图研究一种适用
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
多文种处理的字符
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
。这种
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
很快就得到了许多大公司的支持。这些公司都派代表参加Unicode研究组。Unicode的研究得到了较快的进展。由
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
Unicode集团的成员都是世界上的主要系统及软件制造商。所以Unicode很快就成为事实上的工业标准。
基
![](https://www.godic.net/tmp/wordimg/srEn@@zQmjs@@7qJES9U1ASqgWDbU=.png)
Unicode的系统允许使用65000个不
![](https://www.godic.net/tmp/wordimg/yT0Zu0vkOhsN2g5bUWf2grFen2o=.png)
的字符。足以善盖世界所有语言的所有字母。外加数千种符号。
其中。General Scripts区单独收录了19种语言文字。包括ASCII,Latin1,Greek,Cyrillic,Armenian,Hedrew,Arabic,Devanagari,Bengali ,Gurmukhi,Gujarati,Oriya,Tamil,Telugu,Kannada,Malayalam,Thai,Lao,Tibetan,Georgian等语言文字之外。还包括汉语。日语和朝鲜语中的所有大量字符。
Unicode是一种定长的2B多文种字符集
![](https://www.frdic.com/tmp/wordimg/xgkiACmJ3tK57tZYmDV0@@1aIO6Q=.png)
![](https://www.frdic.com/tmp/wordimg/dU2ms0pLHEL1qn7wgSPKW1rHLwM=.png)
。它试图善盖现有的有关国家和地区的标准。包括GB2312,CNS11643,JIS 0208和KSC 5601等。Unicode可以表示混合文字资料。也可以保证以前的ISO 10646。
凡顺提示:Win98以前的操作系统不支持Unicode。
欧 路 软 件