真正根據(jù)utf8編碼的規(guī)律來進行截取字符串的函數(shù)(utf8版sub_str )
更新時間:2012年10月24日 01:53:08 作者:
真正根據(jù)utf8編碼的規(guī)律來進行截取的字符的函數(shù),utf8版sub_str 支持1~6個字節(jié)的字符的截取,而非只針對中文,比網(wǎng)上的全
復制代碼 代碼如下:
/*
* 功能: 作用跟substr一樣,除了它不會造成亂碼
* 參數(shù):
* 返回:
*/
function utf8_substr( $str , $start , $length=null ){
// 先正常截取一遍.
$res = substr( $str , $start , $length );
$strlen = strlen( $str );
/* 接著判斷頭尾各6字節(jié)是否完整(不殘缺) */
// 如果參數(shù)start是正數(shù)
if ( $start >= 0 ){
// 往前再截取大約6字節(jié)
$next_start = $start + $length; // 初始位置
$next_len = $next_start + 6 <= $strlen ? 6 : $strlen - $next_start;
$next_segm = substr( $str , $next_start , $next_len );
// 如果第1字節(jié)就不是 完整字符的首字節(jié), 再往后截取大約6字節(jié)
$prev_start = $start - 6 > 0 ? $start - 6 : 0;
$prev_segm = substr( $str , $prev_start , $start - $prev_start );
}
// start是負數(shù)
else{
// 往前再截取大約6字節(jié)
$next_start = $strlen + $start + $length; // 初始位置
$next_len = $next_start + 6 <= $strlen ? 6 : $strlen - $next_start;
$next_segm = substr( $str , $next_start , $next_len );
// 如果第1字節(jié)就不是 完整字符的首字節(jié), 再往后截取大約6字節(jié).
$start = $strlen + $start;
$prev_start = $start - 6 > 0 ? $start - 6 : 0;
$prev_segm = substr( $str , $prev_start , $start - $prev_start );
}
// 判斷前6字節(jié)是否符合utf8規(guī)則
if ( preg_match( '@^([\x80-\xBF]{0,5})[\xC0-\xFD]?@' , $next_segm , $bytes ) ){
if ( !empty( $bytes[1] ) ){
$bytes = $bytes[1];
$res .= $bytes;
}
}
// 判斷后6字節(jié)是否符合utf8規(guī)則
$ord0 = ord( $res[0] );
if ( 128 <= $ord0 && 191 >= $ord0 ){
// 往后截取 , 并加在res的前面.
if ( preg_match( '@[\xC0-\xFD][\x80-\xBF]{0,5}$@' , $prev_segm , $bytes ) ){
if ( !empty( $bytes[0] ) ){
$bytes = $bytes[0];
$res = $bytes . $res;
}
}
}
return $res;
}
測試數(shù)據(jù)::
復制代碼 代碼如下:
<?php
$str = 'dfjdjf測13f試65&2數(shù)據(jù)fdj(1就mfe&……就';
var_dump( utf8_substr( $str , 22 , 12 ) ); echo ' <br /> ';
var_dump( utf8_substr( $str , 22 , -6 ) ); echo ' <br /> ';
var_dump( utf8_substr( $str , 9 , 12 ) ); echo ' <br /> ';
var_dump( utf8_substr( $str , 19 , 12 ) ); echo ' <br /> ';
var_dump( utf8_substr( $str , 28 , -6 ) ); echo ' <br /> ';
顯示結(jié)果::(截取無亂碼, 歡迎大家測試, 提交bug)
string(12) "據(jù)fdj"
string(26) "據(jù)fdj(1就mfe&…"
string(13) "13f試65&2數(shù)"
string(12) "數(shù)據(jù)fd"
string(20) "dj(1就mfe&…"
您可能感興趣的文章:
- Oracle將字符編碼從GBK轉(zhuǎn)到UTF8,如何操作比較穩(wěn)妥?
- php字符編碼轉(zhuǎn)換之gb2312轉(zhuǎn)為utf8
- PHP截斷標題且兼容utf8和gb2312編碼
- JoshChen_web格式編碼UTF8-無BOM的小細節(jié)分析
- js 編碼轉(zhuǎn)換 gb2312 和 utf8 互轉(zhuǎn)的2種方法
- 基于php導出到Excel或CSV的詳解(附utf8、gbk 編碼轉(zhuǎn)換)
- MySql修改數(shù)據(jù)庫編碼為UTF8避免造成亂碼問題
- PHP utf-8編碼問題,utf8編碼,數(shù)據(jù)庫亂碼,頁面顯示輸出亂碼
- php驗證手機號碼(支持歸屬地查詢及編碼為UTF8)
- 查看修改mysql編碼方式讓它支持中文(gbk或者utf8)
- 多種語言(big5\gbk\gb2312\utf8\Shift_JIS\iso8859-1)的網(wǎng)頁編碼切換解決方案歸納
- Mysql數(shù)據(jù)庫編碼問題 (修改數(shù)據(jù)庫,表,字段編碼為utf8)
- ASP關(guān)于編碼的幾個有用的函數(shù)小結(jié)(utf8)
- XMLHTTP 亂碼的解決方法(UTF8,GB2312 編碼 解碼)
- PHP UTF8編碼內(nèi)的繁簡轉(zhuǎn)換類
- UTF8編碼內(nèi)的繁簡轉(zhuǎn)換的PHP類
- PHP 截取字符串 分別適合GB2312和UTF8編碼情況
- utf8編碼檢測方法分享
相關(guān)文章
Windows Server 2008 R2和2012中PHP連接MySQL過慢的解決方法
這篇文章主要介紹了Windows Server 2008 R2和2012中PHP連接MySQL過慢的解決方法,同時對Windows 7和8的本地開發(fā)環(huán)境也有效,需要的朋友可以參考下2016-07-07Mysql的Root密碼忘記,查看或修改的解決方法(圖文介紹)
本篇文章是對關(guān)于Mysql中的Root密碼忘記,查看或修改的解決方法進行了詳細的分析介紹,需要的朋友參考下2013-06-06php中preg_replace正則替換用法分析【一次替換多個值】
這篇文章主要介紹了php中preg_replace正則替換用法,結(jié)合實例形式對比分析了preg_replace一次替換多個值的具體使用技巧,需要的朋友可以參考下2017-01-01header中Content-Disposition的作用與使用方法
本文章詳細的介紹了關(guān)于php header中Content-disposition用法詳細,有需要了解header用法的朋友可參考一下2012-06-06PHP ADODB生成HTML表格函數(shù)rs2html功能【附錯誤處理函數(shù)用法】
這篇文章主要介紹了PHP ADODB生成HTML表格函數(shù)rs2html功能,結(jié)合實例形式分析了php使用ADODB類使用函數(shù)rs2html輸出結(jié)果集生成HTML表格相關(guān)操作技巧,并附錯誤處理函數(shù)errorMsg用法,需要的朋友可以參考下2018-05-05