位置: 编程技术 - 正文

详谈PHP编码转换问题(详谈php编码转换过程)

编辑:rootadmin

推荐整理分享详谈PHP编码转换问题(详谈php编码转换过程),希望有所帮助,仅作参考,欢迎阅读内容。

文章相关热门搜索词:php进行编码转换的函数,php改编码,详谈php编码转换技术,详谈php编码转换方法,php改编码,php进行编码转换的函数,详谈php编码转换技术,详谈php编码转换方法,内容如对您有帮助,希望把文章链接给更多的朋友!

最近恰好要用到unicode编码的转换,就去查了一下php的库函数,居然没找到一个函数可以对字符串进行Unicode的编码和解码!也罢,找不到的话就自己实现一下了。。。

Unicode和Utf-8编码的区别

Unicode是一个字符集,而UTF-8是Unicode的其中一种,Unicode是定长的都为双字节,而UTF-8是可变的,对于汉字来说Unicode占有的字节比UTF-8占用的字节少1个字节。Unicode为双字节,而UTF-8中汉字占三个字节。

UTF-8编码字符理论上可以最多到6个字节长,然而位BMP(Basic Multilingual Plane)字符最多只用到3字节长。下面看一下

UTF-8编码表:

xxx 的位置由字符编码数的二进制表示的位填入, 越靠右的 x 具有越少的特殊意义,只用最短的那个足够表达一个字符编码数的多字节串。 注意在多字节串中, 第一个字节的开头"1"的数目就是整个串中字节的数目。而第一行中以0开头,是为了兼容ASCII编码,为一个字节,第二行就为双字节字符串,第三行为3字节,如汉字就属于这种,以此类推。(个人认为:其实我们可以简单的把前面的1的个数看成字节数)

Unicode怎么转换成Utf-8呢

为了要将Unicode转换为UTF-8,当然要知道他们的区别到底在什么地方。下面来看一下,在Unicode中的编码是怎样转换成UTF-8的,在UTF-8中,如果一个字符的字节小于0x()则为ASCII字符,占一个字节,可以不用转换,因为UTF-8兼容ASCII编码。假如在Unicode中汉字“你”的编码为“u4F”,把它转换为二进制为,然后按照UTF-8的方法进行转换。可以将Unicode二进制从低位往高位取出二进制数字,每次取6位,如上述的二进制就可以分别取出为如下所示的格式,前面按格式填补,不足8位用0填补。

详谈PHP编码转换问题(详谈php编码转换过程)

从上面就可以很直观的看出Unicode到UTF-8之间的转换,当然知道了UTF-8的格式后,就可以进行逆运算,就是按照格式把它在二进制中的相应位置上取出,然后在转换就是所得到的Unicode字符了(这个运算可以通过“位移”来完成)。如上述的“你”的转换,由于其值大于0x小于0x,因此可以判断为三字节存储,则最高位需要向右移“”位再根据三字节格式的最高位为(0xE0)求或(|)就可以得到最高位的值了。同理第二位则是右移“6”位,则还剩下最高位和第二位的二进制值,可以通过与(0x3F)求按位于(&)操作,再和(0x)求或(|)。第三位就不用移位了,只要直接取最后六位(与(ox3F)取&),在与(0x)求或(|)。

Utf-8怎么逆转回Unicode呢

当然在UTF-8到Unicode的转换也是通过移位等来完成的,就是把UTF-8那些格式相应的位置的二进制数给揪出来。在上述例子中“你”为三个字节,因此要每个字节进行处理,有高位到低位进行处理。在UTF-8中“你”为,,。从高位起即第一个字节就是把其中的""给取出来,这个很简单只要和(0x1F)取与(&),由三字节可以得知最到位肯定位于位之前,因为每次取六位。所以还要将得到的结果左移位,最高位也就这样完成了,,。而第二位则是要把“”给取出来,则只需将第二字节和(0x3F)取与(&)。在将所得到的结果左移6位与最高字节所得的结果取或(|),第二位就这样完成了,得到的结果为,,。以此类推最后一位直接与(0x3F)取与(&),再与前面所得的结果取或(|)即可得到结果,,。

PHP代码实现

测试一下了

以上这些转换是针对中文汉字【往大了说是非ASCII】的测试,因为如果是ASCII的话,转来转去都是一样的,也用不着费那么大工夫。

还有就是这两个函数只是简单的实现了一下,只支持单个字符【一个完整的utf8字符或是一个完整的Unicode字符】互相转换,大家如果明白了得话就可以尽情去扩展了。。。

以上所述就是本文的全部内容了,希望大家能够喜欢。

php无序树实现方法 本文实例讲述了php无序树实现方法。分享给大家供大家参考。具体如下:运行效果如下图所示:php代码如下:php/*用php写的无序树*/classunorderedTree{//节点i

PHP实现简单汉字验证码 现在越来越多的网站都开始使用汉字验证码了,既增加了我们国人的亲切感,同时也增加了机器破解的难度,这里我就简单粗暴的说一下。。。创建背

PHP实现的json类实例 本文实例讲述了PHP实现的json类。分享给大家供大家参考。具体如下:这里注意json_encode只有(PHP5=5.2.0,PECLjson=1.2.0)才有php/*vim:setexpandtabtabstop=4shiftwidth=4softt

标签: 详谈php编码转换过程

本文链接地址:https://www.jiuchutong.com/biancheng/275734.html 转载请保留说明!

上一篇:在Mac上编译安装PHP7的开发环境(mac如何编译c语言)

下一篇:php无序树实现方法(无序树有几种)

  • 去年少交增值税的会计处理
  • 增值税专用发票抵扣期限
  • 旅游交什么税
  • 付钱给对方会计分录
  • 专项资金支出流程
  • 小规模纳税人运输费计入什么科目
  • 发票勾选错了已报税怎么办
  • 基本户零流水如何处理
  • 法人存到公司账户的钱怎么记账
  • 银行存款没有期初余额的总账怎么填
  • 资本公积 转增
  • 目前在建工程一览表
  • 股权变更印花税申报表怎么填写
  • 外国专家工资个税
  • 出口进项税额转出怎么做账务处理
  • 企业购买银行理财会亏吗
  • 固定基金会计分录怎么处理
  • 微信支付有优惠 系统异常
  • 应征增值税不含税销售额(3%征收率)怎么算
  • 混业经营如何缴税?
  • 已开票怎么做坏账处理
  • 汇算清缴补开票交税怎么写摘要?
  • 单位汽车按揭贷款怎么贷
  • 居民供暖税率
  • 所有者权益为什么是负债
  • 上月没交社保本人能交吗
  • 优先股分类为金融负债
  • 什么是债券持有人
  • ramaint.exe - ramaint是什么进程 有什么用
  • php基础入门
  • linux做raid命令
  • 厂家赠送的商品如何走账
  • 加权平均数的代码
  • PHP:connection_aborted()的用法_misc函数
  • 增值税不允许抵扣计入什么科目
  • 收到外汇货款
  • elementui中文网
  • b站怎么进抖音模式
  • 过来人告诉你:女人最珍贵的三种东西,舍得给你说明爱你
  • 小程序官方组件展示
  • php数学
  • 旅游公司差额征税税率是5%
  • 金税盘税控盘和税务Ukey有什么区别
  • 涂料消费税征税范围
  • phpcms插件
  • sql2008安装出现以下错误
  • 车间办公用品费用
  • 印花税申报时间填错造成逾期怎么办
  • 对公账户往来款需要归还吗
  • sql服务如何自动启动
  • 生育津贴到公司账户了多久给个人
  • 纳税人缴纳的税款叫做什么
  • 申报无票收入后期开票要冲回要备案吗
  • 税收制度政策
  • 搬迁补偿款的会计分录
  • 跨年取得的费用票怎么做账
  • 用于集体福利的进项税额怎么处理
  • 按照现行会计制度的规定,下列票据中
  • 提供劳务结转的成本计入什么科目
  • 免税货物如何开具发票
  • 企业注销递延所得税资产怎么处理
  • 中标服务费计入合同取得成本
  • 外经证是干什么用的
  • 火车票进项抵扣需要认证吗
  • 材料采购成本包括买价和采购费用
  • mysql 正则表达式 是否包含字母
  • windows开机显示正在清理
  • cmd是什么意思 视频
  • linux检查更新
  • Cocos2d-x 3.2 Lua示例 ActionTest(动作测试)
  • js跨域8种解决方案
  • 关闭默认共享和共享文件夹
  • Quick cocos2dx-Lua(V3.3R1)学习笔记(8) ---- 事件篇之单点触摸事件,让我们用精灵模仿一个按钮吧
  • [置顶] 此外,车牌号:454118(懂得都懂[doge])
  • 详解16型人格
  • 编写自己的linux系统
  • 清除垃圾的系统
  • python ip地址转换
  • SQLite之SQLiteStatement
  • 为什么国税网上申报不了
  • 免责声明:网站部分图片文字素材来源于网络,如有侵权,请及时告知,我们会第一时间删除,谢谢! 邮箱:opceo@qq.com

    鄂ICP备2023003026号

    网站地图: 企业信息 工商信息 财税知识 网络常识 编程技术

    友情链接: 武汉网站建设