php各种编码集详解和以及在什么情况下进行使用

　　GB 18030字符集标准解决汉字、日文假名、朝鲜语和中国少数民族文字组成的大字符集计算机编码问题。该标准的字符总编码空间超过150万个编码位，收录了27484个汉字，覆盖中文、日文、朝鲜语和中国少数民族文字。满足中国大陆、香港、台湾、日本和韩国等东亚地区信息交换多文种、大字量、多用途、统一编码格式的要求。并且与Unicode 3.0版本兼容，填补Unicode扩展字符字汇“统一汉字扩展A”的内容。并且与以前的国家字符编码标准(GB2312，GB13000.1)兼容。

　　3.编码方法

　　GB 18030标准采用单字节、双字节和四字节三种方式对字符编码。单字节部分使用0×00至0×7F码(对应于ASCII码的相应码)。双字节部分，首字节码从0×81至0×FE，尾字节码位分别是0×40至0×7E和0×80至0×FE。四字节部分采用GB/T 11383未采用的0×30到0×39作为对双字节编码扩充的后缀，这样扩充的四字节编码，其范围为0×81308130到0×FE39FE39。其中第一、三个字节编码码位均为0×81至0×FE，第二、四个字节编码码位均为0×30至0×39。

　　4.包含的内容

　　双字节部分收录内容主要包括GB13000.1全部CJK汉字20902个、有关标点符号、表意文字描述符13个、增补的汉字和部首/构件80个、双字节编码的欧元符号等。　　四字节部分收录了上述双字节字符之外的，包括CJK统一汉字扩充A在内的GB 13000.1中的全部字符。

　　Unicode字符集

　　1.名称的由来

　　Unicode字符集编码是Universal Multiple-Octet Coded Character Set 通用多八位编码字符集的简称，是由一个名为 Unicode 学术学会(Unicode Consortium)的机构制订的字符编码系统，支持现今世界各种不同语言的书面文本的交换、处理及显示。该编码于1990年开始研发，1994年正式公布，最新版本是2005年3月31日的Unicode 4.1.0。

　　2.特征

　　Unicode是一种在计算机上使用的字符编码。它为每种语言中的每个字符设定了统一并且唯一的二进制编码，以满足跨语言、跨平台进行文本转换、处理的要求。

　　3.编码方法

　　Unicode 标准始终使用十六进制数字，而且在书写时在前面加上前缀“U+”，例如字母“A”的编码为 004116 和字符“?”的编码为 20AC16。所以“A”的编码书写为“U+0041”。

　　4.UTF-8 编码

　　UTF-8是Unicode的其中一个使用方式。 UTF是 Unicode Translation Format，即把Unicode转做某种格式的意思。

　　UTF-8便于不同的计算机之间使用网络传输不同语言和编码的文字，使得双字节的Unicode能够在现存的处理单字节的系统上正确传输。

　　UTF-8使用可变长度字节来储存 Unicode字符，例如ASCII字母继续使用1字节储存，重音文字、希腊字母或西里尔字母等使用2字节来储存，而常用的汉字就要使用3字节。辅助平面字符则使用4字节。

3/5 首页上一页 1 2 3 4 5 下一页尾页

php各种编码集详解和以及在什么情况下进行使用

Swoole webSocket消息服务系统压力测试解析

Swoole webSocket客服IM消息系统方案解析

Highcharts 图表中图例显示状态存储的功能设计详解

thinkphp(php)插件钩子(hooks)分析的简单实现机制

thinkphp(php)插件钩子(hooks)分析的简单实现机制

php删除路径下的所有文件夹和文件的代码

ThinkPHP5集成JS-SDK实现微信自定义分享功能

thinkphp5加layui实现图片上传功能（带图片预览）

Thinkphp结合ajaxFileUpload实现ajax异步图片传输全套

thinkphp5实用入门进阶知识点和各种常用功能代码汇总

Swoole webSocket消息服务系统压力测试解析

Swoole webSocket客服IM消息系统方案解析

Highcharts 图表中图例显示状态存储的功能设计详解

thinkphp(php)插件钩子(hooks)分析的简单实现机制

thinkphp(php)插件钩子(hooks)分析的简单实现机制

php删除路径下的所有文件夹和文件的代码

ThinkPHP5集成JS-SDK实现微信自定义分享功能

thinkphp5加layui实现图片上传功能（带图片预览）

Thinkphp结合ajaxFileUpload实现ajax异步图片传输全套

thinkphp5实用入门进阶知识点和各种常用功能代码汇总