我想过滤我的变量并删除所有多字节字符,除了其中一些字符(我有一个波斯字符列表)。
我怎么能用PHP做到这一点?
编辑#1:
这是我的字符串代码:
// variable
$str = ' سلامoff3 ';
// array of persian characters
$to = ['ا', 'ب', 'پ', 'ت', 'ث', 'ج', 'چ', 'ح', 'خ', 'د', 'ذ',
'ر', 'ز', 'ژ', 'س', 'ش', 'ص', 'ض', 'ط', 'ظ', 'ع', 'غ',
'ف', 'ق', 'ک', 'گ', 'ل', 'م', 'ن', 'و', 'ه', 'ی', 'ء',];
我想替换除波斯字符以外的所有多字节字符(有数字3 后有波斯字符和一个多字节隐藏字符)。
编辑#2:
隐藏的角色不可见,但在phpStorm中它是可见的。我认为StackOverFlow正在过滤无效字符(我想做什么)。
答案 0 :(得分:1)
执行此操作的直接方法是使用mb_string
:
$str = ' سلامoff3 '; // variable
$to = ['ا', 'ب', 'پ', 'ت', 'ث', 'ج', 'چ', 'ح', 'خ', 'د', 'ذ', 'ر', 'ز', 'ژ', 'س', 'ش', 'ص', 'ض', 'ط', 'ظ', 'ع', 'غ', 'ف', 'ق', 'ک', 'گ', 'ل', 'م', 'ن', 'و', 'ه', 'ی', 'ء',]; //
$cleaned = "";
for ($i = 0;$i <mb_strlen($str);$i++) {
$char = mb_substr($str,$i,1);
if (mb_strlen($char) == strlen($char) || in_array($char,$to)) {
$cleaned .= $char;
}
}
print_r($cleaned);
想法是遍历每个字符(通过mb函数获取实际字符),并在将其添加到新字符串之前检查它是单字节还是允许列表。
请注意,此解决方案需要mb_string