1. 云栖社区>
  2. PHP教程>
  3. 正文

PHP使用mb_substr()解决中文字符串截取乱码问题

作者:用户 来源:互联网 时间:2017-12-01 18:12:32

字符串中文

PHP使用mb_substr()解决中文字符串截取乱码问题 - 摘要: 本文讲的是PHP使用mb_substr()解决中文字符串截取乱码问题,PHP 自带几种字符串截取函数,其中常用到的就是 substr 和 mb_substr。前者在处理中文时,GBK 为 2 个长度单位,UTF 为 3 个长度单位,后者指定编码后,一个中文即为 1 个长度单位。mb_substr用法strin

PHP 自带几种字符串截取函数,其中常用到的就是 substr 和 mb_substr。前者在处理中文时,GBK 为 2 个长度单位,UTF 为 3 个长度单位,后者指定编码后,一个中文即为 1 个长度单位。

mb_substr用法

string mb_substr( string$str, int$start[, int$length[, string$encoding]] );

mb_substr 执行一个多字节安全的substr()操作基础上的字符数。从str的开始位置计算。第一个字符的位置为0。第二个字符的位置是1,依此类推:
str 被截取的母字符串。
start开始位置。
length 返回的字符串的最大长度,如果省略,则截取到str末尾。
encoding 参数为字符编码。如果省略,则使用内部字符编码。

那么我们可以使用一下的代码,来完成这个问题。

$mess=mb_substr($message,0,19,'gb2312');

gb2312就是中文的编码格式。

mb_substr处理中英文混合字符串

substr 有时会截 1/3 个中文或半个中文,会显示乱码,相对来说 mb_substr 更适合我们使用。不过有时候 mb_substr 就显得不那么好用了。例如我要显示一个小图片的简要信息,5 个中文正好,超过 5 个就截取前4再加上 “…”,这样处理中文是没问题了,可是处理英文或数字,这样截取就太短了。使用下面这段函数则可以解决这个问题:

<?php/** * 字符串截取 * * @author gesion * @param string $str 原始字符串 * @param int    $len 截取长度(中文/全角符号默认为 2 个单位,英文/数字为 1。 *    例如:长度 12 表示 6 个中文或全角字符或 12 个英文或数字) * @param bool   $dot 是否加点(若字符串超过 $len 长度,则后面加 "...") * @return string */class Onens {    public static function g_substr($str, $len = 12, $dot = true) {$i = 0;$l = 0;$c = 0;$a = array();while ($l < $len) {    $t = substr($str, $i, 1);    if (ord($t) >= 224) {$c = 3;$t = substr($str, $i, $c);$l += 2;    } elseif (ord($t) >= 192) {$c = 2;$t = substr($str, $i, $c);$l += 2;    } else {$c = 1;$l++;    }    // $t = substr($str, $i, $c);    $i += $c;    if ($l > $len) break;    $a[] = $t;}$re = implode('', $a);if (substr($str, $i, 1) !== false) {    array_pop($a);    ($c == 1) and array_pop($a);    $re = implode('', $a);    $dot and $re .= '...';}return $re;    }}

以上是云栖社区小编为您精心准备的的内容,在云栖社区的博客、问答、公众号、人物、课程等栏目也有的相关内容,欢迎继续使用右上角搜索按钮进行搜索字符串 中文 ,以便于您获取更多的相关知识。

弹性可伸缩的计算服务,助您降低 IT 成本,提升运维效率

40+云计算产品,6个月免费体验

稳定可靠、可弹性伸缩的在线数据库服务,全球最受欢迎的开源数据库之一

云服务器9.9元/月,大学必备