PHP使用mb_substr()解決中文字元串截取亂碼問題

2023-08-01 07:33:11

根據百度百科查閱的資料：

string mb_substr( string$str, int$start[, int$length[, string$encoding]] );

mb_substr 執行一個多位元組安全的substr()操作基礎上的字元數。從str的開始位置計算。第一個字元的位置為0。第二個字元的位置是1，依此類推。

str 被截取的母字元串。

start開始位置。

length 傳回的字元串的最大長度,如果省略，則截取到str末尾。

encoding 參數為字元編碼。如果省略，則使用内部字元編碼。

那麼我們可以使用一下的代碼，來完成這個問題。

$mess=mb_substr($message,0,19,'gb2312'); gb2312就是中文的編碼格式。

當然啦，我也看到了http://blog.onens.com/php-substr.html提供的代碼，也是一個不錯的解決方法。

PHP 自帶幾種字元串截取函數，其中常用到的就是 substr 和 mb_substr。前者在進行中文時，GBK 為 2 個長度機關，UTF 為 3 個長度機關，後者指定編碼後，一個中文即為 1 個長度機關。

substr 有時會截 1/3 個中文或半個中文，會顯示亂碼，相對來說 mb_substr 更适合我們使用。不過有時候 mb_substr 就顯得不那麼好用了。例如我要顯示一個小圖檔的簡要資訊，5 個中文正好，超過 5 個就截取前4再加上 “…”，這樣進行中文是沒問題了，可是處理英文或數字，這樣截取就太短了。

以下代碼是http://blog.onens.com/php-substr.html提供的，我試過是可以使用的：

<?php
/**
 * 字元串截取
 *
 * @author gesion<[email protected]>
 * @param string $str 原始字元串
 * @param int    $len 截取長度（中文/全角符号預設為 2 個機關，英文/數字為 1。
 *                    例如：長度 12 表示 6 個中文或全角字元或 12 個英文或數字）
 * @param bool   $dot 是否加點（若字元串超過 $len 長度，則後面加 "..."）
 * @return string
 */
classOnens {
    publicstatic function g_substr($str,$len= 12, $dot= true) {
        $i= 0;
        $l= 0;
        $c= 0;
        $a= array();
        while($l< $len) {
            $t= substr($str,$i, 1);
            if(ord($t) >= 224) {
                $c= 3;
                $t= substr($str,$i,$c);
                $l+= 2;
            }elseif(ord($t) >= 192) {
                $c= 2;
                $t= substr($str,$i,$c);
                $l+= 2;
            }else{
                $c= 1;
                $l++;
            }
            // $t = substr($str, $i, $c);
            $i+= $c;
            if($l> $len)break;
            $a[] = $t;
        }
        $re= implode('',$a);
        if(substr($str,$i, 1) !== false) {
            array_pop($a);
            ($c== 1) andarray_pop($a);
            $re= implode('',$a);
            $dotand $re .= '...';
        }
        return$re;
    }
}

參考文獻：http://blog.onens.com/php-substr.html

原文位址：http://www.tonitech.com/102.html

PHP使用mb_substr()解決中文字元串截取亂碼問題

繼續閱讀

Centos 7 Apache配置虛拟主機

PHP進階學習之session寫入資料庫

php寫一個簡潔的登入頁面

Apache與PHP環境下配置本地虛拟主機

Testlink安裝部署之XAMPP

TestLink 圖表中文亂碼問題

ecshop屬性排序

Ubuntu16.04安裝Apache+MySQL+PHP1. 安裝Apache2. 安裝MySQL3. 安裝PHP4. 安裝phpMyAdmin

版本号隐藏

Netty——自定義協定解決TCP粘包拆包問題什麼是TCP粘包拆包自定義協定解決拆包粘包問題

Apache配置SSLApache配置SSL

配置apache支援PHP（win7）

Cloud Studio初體驗

NOSQL安全攻擊

php 去掉字元串的最後一個字元及截取原字元串1,2,3,4,5,6,

php——水印