技术文章 > 后端开发 > php教程

字符串切分 utf-8（支持汉语、日文、韩文等，高效、）

原创: 2016-07-25 09:08:02 970浏览

因为mb_substr、mb_strlen太过低效，故而采用了此段代码。

非原创，主要原理是根据UTF-8的编码特点
0xxxxxxx
110xxxxx 10xxxxxx
1110xxxx 10xxxxxx 10xxxxxx
11110xxx 10xxxxxx 10xxxxxx 10xxxxxx
111110xx 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx
1111110x 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx 10xxxxxx
来获取字符边界，从而确定一个字所占字节数，并处理成数组。

方便对字符操作比较频繁的用户，此函数效率比mb_substr高效10倍，我曾经写过一个「N万违禁词替换类」，在开发此类过程中，详细对比过这两者的效率，此函数明显胜出。

function str_split_utf8($str) {
// place each character of the string into and array
$split = 1;
$array = array(); $len = strlen($str);
for ( $i = 0; $i < $len; ){
$value = ord($str[$i]);
if($value > 0x7F){
if($value >= 0xC0 && $value <= 0xDF)
$split = 2;
elseif($value >= 0xE0 && $value <= 0xEF)
$split = 3;
elseif($value >= 0xF0 && $value <= 0xF7)
$split = 4;
elseif($value >= 0xF8 && $value <= 0xFB)
$split = 5;
elseif($value >= 0xFC)
$split = 6;
} else {
$split = 1;
}
$key = '';
for ( $j = 0; $j < $split; ++$j, ++$i ) {
$key .= $str[$i];
}
$array[] = $key;
}
return $array;
}

复制代码

字符串切分 utf-8（支持汉语、日文、韩文等，高效、）PHP课程 HTML视频教程 CSS视频 JS视频教程 Vue视频教程

声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn核实处理。

上一条：php+txt淘宝客超精简版sina_SAE专版下一条：有效取得中文字符的长度和字符串

相关文章

查看更多

热门课程

TP6.0 搭建个人博客实战（玉女心经版）

￥71
￥79

已抢186746个
抢
php mysql实战：学生信息管理系统（玉女心经版）

￥89
￥99

已抢67331个
抢
CSS视频教程-玉女心经版

￥62
￥69

已抢353245个
抢
JavaScript极速入门_玉女心经系列

￥62
￥69

已抢667569个
抢
零基础php开发视频教程VIP视频课

￥99
￥299

已抢122772个
抢
前端基础到实战（HTML5+CSS3+ES6+NPM）

￥800
￥1200

已抢24181个
抢

打开APP，随时随地在线学习！