专业IT网络知识平台,分享IT百科知识、生活百科知识解答!

易企推科技
易企推科技

gbk编码是什么,gbk编码详细介绍

来源:小易整编  作者:小易  发布时间:2023-03-23 05:31
摘要:gbk编码是什么,gbk编码详细介绍一.编码的发展历史计算机中,数据只能用0,1来表示存储数据,以表示不同的字符。美国科学家提出特定比特代表特定字母。字母a的录入到计算机需要用二进制(01100001),这个过程是编码,当把二进制取出来,变...

中文在Unicode的编码范围为4E00-9FCF,其中9FC4-9FCF之间的区间没被用。

研究unicode支持的中文登录此网站http://www.unicode.org/charts/PDF/

由于Unicode只是码表,要实现,常见的是UTF-8,UTF-16,UTF-32,USC-3,USC-4.

UTF8

范围

字节数

存储格式

0x0000~0x007F (0 ~ 127)

1

0xxxxxxx

0x0080~0x07FF(128 ~ 2047)

2

110xxxxx 10xxxxxx

0x0800~FFFF(2048 ~ 65535)

3

1110xxxx 10xxxxxx 10xxxxxx

0x10000~1FFFFFF(65536 ~ 2097152)

4

11110xxx 10xxxxxx 10xxxxxx 10xxxxxx

0x2000000~0x3FFFFFF

5

111110xx 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx

0x4000000~0x7FFFFFFF)

6

1111110x 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx

在这样的基础上,我们已经了解了整个编码的过程,在此基础上做一个编码的总结。除了ASCII,UTF和GBK之间是需要进行转化,否则就会出现乱码。

gbk编码是什么,gbk编码详细介绍

图2-9 不同编码的兼容性

这里列出几个常用的中文Unicode码范围,此值经常在UTF8编码的系统中通过正则标识式找出中文的方法。

语言

范围(unicode)

中文

u4e00-u9fa5

韩文

xAC00-xD7A3

韩文

x3130-x318F

日文

u0800-u4e00

但中文的文字还是博大精深,比如康熙部首等,无法找出,需要在下面unicode官网去找对于的汉字unicode值

http://www.unicode.org/charts/PDF/U2F00.pdf

http://www.unicode.org/charts/PDF/U4DC0.pdf

2.3 GB 18030在税控收款机中的应用

税控收款机是在电子收款机基础上根据中国国情开发的,纳税户销售商品在税控收款机中的记录与相关的时间等信息可在机内保留5~10年,不可修改、不可清除。税控收款机在开具发票时需要真实填写商品名称、买卖双方名称、纳税户地址等信息,而人名信息、地名信息中使用的很多汉字都没有被GB 2312-1980收入,为满足税控收款机信息实名制的需要,必须采用GB 18030编码字符集。目前税控收款机的采购使用多采取的是地方政府招投标方式,在招投标文件中要求供货商提供其税控收款机通过GB 18030标准检测的报告和GB 18030字库使用授权书

三.编码转化流程

通过上面汉字在GBK和UTF的存储上面,我们可以知道UTF8存储汉字是3个字节,而GBK是2-4个字节,两者是不能直接进行转化的。所以需要将UTF8转到Unicode再转到GBK编码,下面的图为UTF8转为UTF编码底层存储的流程

gbk编码是什么,gbk编码详细介绍

四.总结

UTF8是无法直接转成GBK,需要从UTF8转为Unicode再转成GBK,由于Unicode码表是统一了所有的编码,GBK是给中国人用的,Unicode中存在的很多字符是无法转化成GBK,无法转化的字符就变成了乱码。比如土耳其、立陶宛等文字转化为Unicode再转成GBK,GBK码表中是没有这些字符的。


本文地址:网络知识频道 https://www.hkm168.com/jiqiao/937944_3.html,易企推百科一个免费的知识分享平台,本站部分文章来网络分享,本着互联网分享的精神,如有涉及到您的权益,请联系我们删除,谢谢!

共3页 1 2 3 当前是最后一页

网络知识
小编:小易整编
相关文章相关阅读
  • 某台微机安装的是64位操作系统中,64位指的是什么

    某台微机安装的是64位操作系统中,64位指的是什么

    某台微机安装的是64位操作系统中,64位指的是cpu的字长,即cpu每次能处理64位二进制数据。字长是cpu的主要技术指标之一,指的是cpu一次能并行处理的二进制位数,字长总是8的整数倍,通常pc机的字长为32位,64位。本教程操作环境:w...

  • c语言是什么意思

    c语言是什么意思

    一:c语言是什么意思C语言是一门面向过程的、抽象化的通用程序设计语言,广泛应用于底层开发。C语言能以简易的方式编译、处理低级存储器。C语言是仅产生少量的机器语言,以及不需要任何运行环境支持便能运行的高效率程序设计语言。尽管C语言提供了许多低...

  • skype是什么软件

    skype是什么软件

    skype是一种简单的免费软件,使您能够在数分钟之内在世界上的任何角落拨打免费电话,它使用全新的p2p【对等】技术将您与其他skype用户相连接。Skype是一种简单的免费软件,使您能够在数分钟之内在世界上的任何角落拨打免费电话。Sky...

  • 计算机的三类总线分别是什么?

    计算机的三类总线分别是什么?

    计算机的三类总线分别是:控制总线、地址总线和数据总线。控制总线用于将微处理器控制单元的信号,传送到周边设备;地址总线用来指定在ram之中储存的数据的地址;数据总线用于在cpu与ram之间来回传送需要处理或是需要储存的数据。总线(Bus)是计...

  • 2k屏幕是什么意思

    2k屏幕是什么意思

    2k屏幕是指分辨率能够达到2560*1440的屏幕。2k是一个通用术语,指屏幕或者内容的水平分辨率达约2000像素的分辨率等级;又因“16:9”的比例是高清晰度视频规格的国际标准,所以2k分辨率在视频制作、显示屏等领域常见格式为2560*1...

  • mysql中的不等于符号是什么

    mysql中的不等于符号是什么

    mysql中的不等于符号有两种:“!=”和“”;它们都可用于判断数字、字符串、表达式是否不相等。对于“!=”和“”,如果两侧操作数不相等,返回值为1,否则返回值为0;如果两侧操作数有一个是null,那么返回值也是null。本教程操作环境:w...

  • ipad a1822是什么型号

    ipad a1822是什么型号

    ipada1822是苹果ipad第5代的型号;ipad第5代是苹果公司于2017年03月21日在美国加利福尼亚州发布的平板电脑;该机型采用铝镁合金材质一体成型结构;前端外框为白色或黑色;有银色、金色和深空灰色3种外观颜色。本教程操作环境:...

  • html中浮动是什么

    html中浮动是什么

    在html中,浮动就是让元素可以向左或向右移动,直到它的外边距碰到其父级的内边距或者是上一个元素的外边距,只需要给元素设置“float:left|right|none|inherit”样式即可。本教程操作环境:windows7系统、CSS3...

  • 周排行
  • 月排行
  • 年排行

精彩推荐