什么是编码格式
编码应该就是网页的一种显示形式,和电脑的字库有关系,默认的一般都是gb2132。简单来说如果你电脑上有这种编码,网页会正常显示,如果没有就会出职句接适到们指评饭现乱码。
常见的编示尔般理裂码格式
ASCII码
学过计算机的人都知道ASCII码,总共护易较许席导量因弦晚安有128个,用一个字节的低7位表示,0~31是控制字符如氢毛坐感河减换行回车删除等;32~126是打印字符,可以通过键盘输入并且能够显示出来。
GB2312
它的全称是《信息交换用汉字编码字符集基本集》,它是双字节编码,总的编码范围是A1-F7,其中从A1-A9是符号区,总共包含682个符号,从B0-F7是汉字区,包含6763个汉字。
GBK
全称叫《汉字内码扩展规范》,是国家技术监督局为windows95所制定的新的汉字内码规范,它的出现是为了扩展GB2312,加入更多的宁养州阳命婷仍息关早汉字,它的编码范围是8140~FEFE(去掉XX7F)总共有23940个码位,它能表示21003个汉字,它的编码是和教曾销述散激GB2312兼容的,也就是说用GB2312编码的汉字可以用GBK来解码,并且不会有乱码。
UTF-8
UTF-16统一采守信服才叶卷用两个字节表示一个字符,虽然在额年表示上非常简单方便,但是也有其缺点,有很大一部分字符用一个字节就可以表娘径与住示的现在要两个字节表示,存储空间放大了一倍,在现在的网络带宽还非常有限的今天,这样会增大网络传输的流量,而且也没必要。而UTF-8采用了一种变长技术,每个编码区域有不同的字码长度。不同类型的字符可以是由1~6个字节组成。
标签:格式,编号,来自