首页 五笔字根 五笔教程 打字相关 五笔下载 五笔新闻 常见问题 五笔经验 五笔相关
关于中文的几个编码GB2312、GBK、GB18030、GB13000
[位置:常见问题·常见问题][字体:  ][颜色: 绿  ][中文简体 中文繁體]

1、 GB2312

GB2312(1980年)一共收录了7445个字符,包括6763个汉字和682个其它符号。汉字区的内码范围高字节从B0-F7,低字节从A1-FE,占用的码位是72*94=6768。其中有5个空位是D7FA-D7FE。 

在windows中的代码页是CP936


2、 GBK

GBK最初是由微软对GB2312的扩展,也就是CP936字码表 (Code Page 936)的扩展(原来的CP936和GB 2312-80一模一样),最初出现于Windows 95简体中文版中,由于Windows产品的流行和在大陆广泛被使用,中华人民共和国国家有关部门将其作为技术规范。注意GBK并非国家正式标准,只是国家技术监督局标准化司、电子工业部科技与质量监督司发布的“技术规范指导性文件”。虽然 GBK收录了所有Unicode 1.1及GB 13000.1-93之中的汉字,但是编码方式与Unicode 1.1及GB 13000.1-93不同。仅仅是GB 2312到GB 13000.1-93之间的过渡方案。GBK收录了21886个符号,它分为汉字区和图形符号区。汉字区包括21003个字符。

GBK作为对GB2312的扩展,在现在的windows系统中仍然使用代码页CP936表示,但是同样的936的代码页跟一开始的936的代码页只支持GB2312编码不同,现在的936代码页支持GBK的编码,GBK同时也向下兼容GB2312编码。


3、 GB18030

2000年的GB18030取代了GBK1.0的正式国家标准。该标准收录了27484个汉字,同时还收录了藏文、蒙文、维吾尔文等主要的少数民族文字。现在的PC平台必须支持GB18030,对嵌入式产品暂不作要求。所以手机、MP3一般只支持GB2312。 

GB18030在windows中的代码页是CP54936。


4、 GB13000

GB13000等同于国际标准的《通用多八位编码字符集 (UCS)》 ISO10646.1,就是等同于Unicode的标准,代码页等等的都使用UTF的一套标准。

从ASCII、GB2312、GBK到GB18030,这些编码方法是向下兼容的,即同一个字符在这些方案中总是有相同的编码,后面的标准支持更多的字符。在这些编码中,英文和中文可以统一地处理。区分中文编码的方法是高字节的最高位不为0。按照程序员的称呼,GB2312、GBK到GB18030都属于双字节字符集 (DBCS)。



本文作者:未知

上一篇:金山打字通之五笔教程 文章浏览:3002  文章来源:五笔字根网
下一篇:什么是全角和半角
□分类阅读排行
01、五笔为何用正确的编码也打不出一些汉字?
02、五笔历史及几款五笔输入法的简单介绍
03、学五笔时,遇到了不会拆的字怎么办?
04、什么是全角和半角
05、单笔画(一丨丿丶乙)输入为何后面要加打两个L?
06、“蔻”,“靥”两个字的最后一码为何是L?
□相关文章列表
00、没有找到相关文章