在《学习PHP&MYSQL之——字符编码篇(一)》中介绍了Unicode与UTF-8的转换关系,总结了一个UTF-8的编码规则,根据这个编码规则,写一个UTF-8编码的解析程序,以下是PHP的实现: <div class="codetitle"><a style="CURSOR: pointer" data="80089" class="copybut" id="copybut80089" onclick="doCopy('code80089')"> 代码如下:<div class="codebody" id="code80089"> <?php / 程序功能,$str是中英文混合的UTF-8编码字符串, 将此字符串根据UTF-8的编码规则正确的解码并显示。 / $str = '今天非常Happy,所有决定去KFC吃可乐鸡翅!!!'; / $str 是待截取的字符串 $len 是截取的字符数 / function utf8sub($str,$len) { if($len <= 0){ return ''; } $offset = 0; // 截取高位字节时的偏移量 $chars = 0; // 截取到的字符数 $res = ''; // 存放截取的结果字符串 while($chars < $len){ // 先取字符串的第一个字节 // 将它转为十进制 // 再转为二进制 $high = ord(substr($str,$offset,1)); // echo '$high='. $high .' '; if($high == null ){ // 如果取出高位为null,证明已经取到末尾,直接break break; } if(($high>>2) === 0x3F){ // 将高位右移2位,和二进制222221比较,相同则取6个字节 // 截取2个字节 $count = 6; }else if(($high>>3) === 0x1F){ // 将高位右移2位,和二进制22222比较,相同则取5个字节 // 截取3个字节 $count = 5; }else if(($high>>4) === 0xF){ // 将高位右移2位,和二进制1111比较,相同则取4个字节 // 截取4个字节 $count = 4; }else if(($high>>5) === 0x7){ // 将高位右移2位,和二进制111比较,相同则取3个字节 // 截取5个字节 $count = 3; }else if(($high>>6) === 0x3){ // 将高位右移2位,和二进制11比较,相同则取2个字节 // 截取6个字节 $count = 2; }else if(($high>>7) === 0x0){ // 将高位右移2位,和二进制0比较,相同则取1个字节 $count = 1; } // echo '$count='.$count.' '; $res .= substr($str,$count); // 取出一个字符与$res字符串连接 $chars += 1; // 截取到的字符数+1 $offset += $count; // 截取高位偏移量向后移$count字节 } return $res; } echo utf8sub($str,100);
(编辑:李大同)
【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!
|