Chinaunix首页 | 论坛 | 博客
  • 博客访问: 12568
  • 博文数量: 8
  • 博客积分: 305
  • 博客等级: 二等列兵
  • 技术积分: 60
  • 用 户 组: 普通用户
  • 注册时间: 2008-09-05 17:46
文章分类
文章存档

2011年(1)

2010年(7)

我的朋友
最近访客

分类:

2010-02-25 11:18:45

1、 GB2312

GB2312(1980)一共收录了7445个字符,包括6763个汉字和682个其它符号。汉字区的内码范围高字节从B0-F7,低字节从A1-FE,占用的码位是72*94=6768。其中有5个空位是D7FA-D7FE

windows中的代码页是CP936

2、 GBK

GBK最初是由微软对GB2312的扩展,也就是CP936字码表 (Code Page 936)的扩展(原来的CP936GB 2312-80一模一样),最初出现于Windows 95简体中文版中,由于Windows产品的流行和在大陆广泛被使用,中华人民共和国国家有关部门将其作为技术规范。注意GBK并非国家正式标准,只是国家技术监督局标准化司、电子工业部科技与质量监督司发布的“技术规范指导性文件”。虽然 GBK收录了所有Unicode 1.1GB 13000.1-93之中的汉字,但是编码方式与Unicode 1.1GB 13000.1-93不同。仅仅是GB 2312GB 13000.1-93之间的过渡方案。GBK收录了21886个符号,它分为汉字区和图形符号区。汉字区包括21003个字符。

GBK作为对GB2312的扩展,在现在的windows系统中仍然使用代码页CP936表示,但是同样的936的代码页跟一开始的936的代码页只支持GB2312编码不同,现在的936代码页支持GBK的编码,GBK同时也向下兼容GB2312编码。

3、 GB18030

2000年的GB18030取代了GBK1.0的正式国家标准。该标准收录了27484个汉字,同时还收录了藏文、蒙文、维吾尔文等主要的少数民族文字。现在的PC平台必须支持GB18030,对嵌入式产品暂不作要求。所以手机、MP3一般只支持GB2312

GB18030windows中的代码页是CP54936

4、 GB13000

GB13000等同于国际标准的《通用多八位编码字符集 (UCS) ISO10646.1,就是等同于Unicode的标准,代码页等等的都使用UTF的一套标准。

 

ASCIIGB2312GBKGB18030,这些编码方法是向下兼容的,即同一个字符在这些方案中总是有相同的编码,后面的标准支持更多的字符。在这些编码中,英文和中文可以统一地处理。区分中文编码的方法是高字节的最高位不为0。按照程序员的称呼,GB2312GBKGB18030都属于双字节字符集 (DBCS)
阅读(747) | 评论(0) | 转发(0) |
给主人留下些什么吧!~~