亚洲乱码中文字幕综合,中国熟女仑乱hd,亚洲精品乱拍国产一区二区三区,一本大道卡一卡二卡三乱码全集资源,又粗又黄又硬又爽的免费视频

smarty中英文多編碼字符截取亂碼問(wèn)題解決方法

 更新時(shí)間:2014年10月28日 09:16:10   投稿:shichen2014  
這篇文章主要介紹了smarty中英文多編碼字符截取亂碼問(wèn)題解決方法,涉及到對(duì)原有smartTruncate的修改,非常具有實(shí)用價(jià)值,需要的朋友可以參考下

本文實(shí)例講述了smarty中英文多編碼字符截取亂碼問(wèn)題解決方法,分享給大家供大家參考。具體方法如下:

一般網(wǎng)站頁(yè)面的顯示都不可避免的會(huì)涉及子字符串的截取,這個(gè)時(shí)候truncate就派上用場(chǎng)了,但是它只適合英文用戶,對(duì)與中文用戶來(lái)說(shuō),使用 truncate會(huì)出現(xiàn)亂碼,而且對(duì)于中文英文混合串來(lái)說(shuō),截取同樣個(gè)數(shù)的字符串,實(shí)際顯示長(zhǎng)度上卻不同,視覺上會(huì)顯得參差不齊,影響美觀。這是因?yàn)橐粋€(gè)中文的長(zhǎng)度大致相當(dāng)于兩個(gè)英文的長(zhǎng)度。此外,truncate也不能同時(shí)兼容GB2312, UTF-8等編碼。
改良的smartTruncate: 文件名:modifier.smartTruncate.php
具體代碼如下:

復(fù)制代碼 代碼如下:
<?php
function smartDetectUTF8($string)
{
    static $result = array();
    if(! array_key_exists($key = md5($string), $result))
    {
        $utf8 = "
            /^(?:
                [\x09\x0A\x0D\x20-\x7E]                            # ASCII
                | [\xC2-\xDF][\x80-\xBF]                             # non-overlong 2-byte
                | \xE0[\xA0-\xBF][\x80-\xBF]                       # excluding overlongs
                | [\xE1-\xEC\xEE\xEF][\x80-\xBF]{2}           # straight 3-byte
                | \xED[\x80-\x9F][\x80-\xBF]                      # excluding surrogates
                | \xF0[\x90-\xBF][\x80-\xBF]{2}                 # planes 1-3
                | [\xF1-\xF3][\x80-\xBF]{3}                          # planes 4-15
                | \xF4[\x80-\x8F][\x80-\xBF]{2}                  # plane 16
            )+$/xs
        ";
        $result[$key] = preg_match(trim($utf8), $string);
    }
    return $result[$key];
}
function smartStrlen($string)
{
    $result = 0;
    $number = smartDetectUTF8($string) ? 3 : 2;
    for($i = 0; $i < strlen($string); $i += $bytes)
    {
        $bytes = ord(substr($string, $i, 1)) > 127 ? $number : 1;
        $result += $bytes > 1 ? 1.0 : 0.5;
    }
    return $result;
}
function smartSubstr($string, $start, $length = null)
{
    $result = '''';
    $number = smartDetectUTF8($string) ? 3 : 2;
    if($start < 0)
    {
        $start = max(smartStrlen($string) + $start, 0);
    }
    for($i = 0; $i < strlen($string); $i += $bytes)
    {
        if($start <= 0)
        {
            break;
        }
        $bytes = ord(substr($string, $i, 1)) > 127 ? $number : 1;
        $start -= $bytes > 1 ? 1.0 : 0.5;
    }
    if(is_null($length))
    {
        $result = substr($string, $i);
    }
    else
    {
        for($j = $i; $j < strlen($string); $j += $bytes)
        {
            if($length <= 0)
            {
                break;
            }
            if(($bytes = ord(substr($string, $j, 1)) > 127 ? $number : 1) > 1)
            {
                if($length < 1.0)
                {
                    break;
                }
                $result .= substr($string, $j, $bytes);
                $length -= 1.0;
            }
            else
            {
                $result .= substr($string, $j, 1);
                $length -= 0.5;
            }
        }
    }
    return $result;
}
function smarty_modifier_smartTruncate($string, $length = 80, $etc = ''...'',
                                       $break_words = false, $middle = false)
{
    if ($length == 0)
        return '''';
    if (smartStrlen($string) > $length) {
        $length -= smartStrlen($etc);
        if (!$break_words && !$middle) {
            $string = preg_replace(''/\s+?(\S+)?$/'', '''', smartSubstr($string, 0, $length+1));
        }
        if(!$middle) {
            return smartSubstr($string, 0, $length).$etc;
        } else {
            return smartSubstr($string, 0, $length/2) . $etc . smartSubstr($string, -$length/2);
        }
    } else {
        return $string;
    }
}
?>

以上代碼完整實(shí)現(xiàn)了truncate的原有功能,而且可以同時(shí)兼容GB2312和UTF-8編碼,在判斷字符長(zhǎng)度的時(shí)候,一個(gè)中文字符算1.0,一個(gè)英文字符算0.5,所以在截取子字符串的時(shí)候不會(huì)出現(xiàn)參差不齊的情況.
插件的使用方式?jīng)]有特別之處,這里簡(jiǎn)單測(cè)試一下:
復(fù)制代碼 代碼如下:
{$content|smartTruncate:5:".."}($content等于"A中B華C人D民E共F和G國(guó)H")

顯示:A中B華C.. (中文符號(hào)長(zhǎng)度算1.0,英文符號(hào)長(zhǎng)度算0.5,并且考慮省略符號(hào)的長(zhǎng)度)
不管你是使用GB2312編碼還是UTF-8編碼,你會(huì)發(fā)現(xiàn)結(jié)果都正確,這也是為什么我在插件名字里加上smart字樣的原因之一。

希望本文所述對(duì)大家的PHP程序設(shè)計(jì)有所幫助。

相關(guān)文章

最新評(píng)論