久久r热视频,国产午夜精品一区二区三区视频,亚洲精品自拍偷拍,欧美日韩精品二区

您的位置:首頁技術(shù)文章
文章詳情頁

PHP使用mb_substr()解決中文字符串截取亂碼問題

瀏覽:2日期:2022-09-13 13:33:46

PHP 自帶幾種字符串截取函數(shù),其中常用到的就是 substr 和 mb_substr。前者在處理中文時,GBK 為 2 個長度單位,UTF 為 3 個長度單位,后者指定編碼后,一個中文即為 1 個長度單位。

mb_substr用法

string mb_substr( string$str, int$start[, int$length[, string$encoding]] );

mb_substr 執(zhí)行一個多字節(jié)安全的substr()操作基礎(chǔ)上的字符數(shù)。從str的開始位置計算。第一個字符的位置為0。第二個字符的位置是1,依此類推:

str 被截取的母字符串。start開始位置。length 返回的字符串的最大長度,如果省略,則截取到str末尾。encoding 參數(shù)為字符編碼。如果省略,則使用內(nèi)部字符編碼。

那么我們可以使用一下的代碼,來完成這個問題。

$mess=mb_substr($message,0,19,’gb2312’);

gb2312就是中文的編碼格式。

mb_substr處理中英文混合字符串

substr 有時會截 1/3 個中文或半個中文,會顯示亂碼,相對來說 mb_substr 更適合我們使用。不過有時候 mb_substr 就顯得不那么好用了。例如我要顯示一個小圖片的簡要信息,5 個中文正好,超過 5 個就截取前4再加上 “…”,這樣處理中文是沒問題了,可是處理英文或數(shù)字,這樣截取就太短了。使用下面這段函數(shù)則可以解決這個問題:

<?php/** * 字符串截取 * * @author gesion * @param string $str 原始字符串 * @param int $len 截取長度(中文/全角符號默認(rèn)為 2 個單位,英文/數(shù)字為 1。 * 例如:長度 12 表示 6 個中文或全角字符或 12 個英文或數(shù)字) * @param bool $dot 是否加點(若字符串超過 $len 長度,則后面加 '...') * @return string */class Onens { public static function g_substr($str, $len = 12, $dot = true) {$i = 0;$l = 0;$c = 0;$a = array();while ($l < $len) { $t = substr($str, $i, 1); if (ord($t) >= 224) {$c = 3;$t = substr($str, $i, $c);$l += 2; } elseif (ord($t) >= 192) {$c = 2;$t = substr($str, $i, $c);$l += 2; } else {$c = 1;$l++; } // $t = substr($str, $i, $c); $i += $c; if ($l > $len) break; $a[] = $t;}$re = implode(’’, $a);if (substr($str, $i, 1) !== false) { array_pop($a); ($c == 1) and array_pop($a); $re = implode(’’, $a); $dot and $re .= ’...’;}return $re; }}

標(biāo)簽: PHP
相關(guān)文章:
主站蜘蛛池模板: 长汀县| 通化市| 晴隆县| 资兴市| 临高县| 苏尼特左旗| 郓城县| 崇明县| 文登市| 扶风县| 长治县| 旅游| 闸北区| 含山县| 凌海市| 乌拉特中旗| 黎川县| 进贤县| 德格县| 英山县| 锡林郭勒盟| 大丰市| 名山县| 虹口区| 汝阳县| 丰城市| 扶风县| 泽库县| 白城市| 三原县| 香格里拉县| 日土县| 讷河市| 沂水县| 龙山县| 天峨县| 泾阳县| 连州市| 兴文县| 玉门市| 桓仁|