检查目录下php文件是否含有bom

类似WINDOWS自带的记事本等软件,在保存一个以UTF-8编码的文件时,会在文件开始的地方插入三个不可见的字符(0xEF 0xBB 0xBF,即BOM)。它是一串隐藏的字符,用于让记事本等编辑器识别这个文件是否以UTF-8编码。对于一般的文件,这样并不会产生什么麻烦。但对于 PHP来说,BOM是个大麻烦。

PHP并不会忽略BOM,所以在读取、包含或者引用这些文件时,会把BOM作为该文件开头正文的一部分。根据嵌入式语言的特点,这串字符将被直接执行(显示)出来。由此造成即使页面的 top padding 设置为0,也无法让整个网页紧贴浏览器顶部,因为在html一开头有这3个字符呢!

最大的麻烦还不是这个。受COOKIE送出机制的限制,在这些文件开头已经有BOM的文件中,COOKIE无法送出(因为在COOKIE送出前PHP已经送出了文件头),所以登入和登出功能失效。一切依赖COOKIE、SESSION实现的功能全部无效。

去除BOM,把如下的代码保存为tool.php,放到目标目录,然后在浏览器访问tool.php即可。

<?php
/**
 * 去除bom头信息
 */
header("Content-Type:text/html; charset=utf-8");
if (isset($_GET['dir'])){ //设置文件目录
    $basedir=$_GET['dir'];
} else {
    $basedir = '.';//修改此行为需要检测的目录,点表示当前目录
}
$auto = 1;//是否自动移除发现的BOM信息。1为是,0为否。

checkdir($basedir);

function checkdir($basedir){
    if ($dh = opendir($basedir)) {
        while(($file = readdir($dh)) !== false) {
            if($file != '.' && $file != '..'){
                if(!is_dir($basedir . "/" . $file)) {
                    echo "文件名称: $basedir/$file " . checkBOM("$basedir/$file") . " ";
                } else {
                    $dirname = $basedir . "/" . $file;
                    checkdir($dirname);
                }
            } 
        }
        closedir($dh);
    }
}

function checkBOM($filename) {
    global $auto;
    $contents = file_get_contents($filename);
    $charset[1] = substr($contents, 0, 1);
    $charset[2] = substr($contents, 1, 1);
    $charset[3] = substr($contents, 2, 1);
    if(ord($charset[1]) == 239 && ord($charset[2]) == 187 && ord($charset[3]) == 191) {
        if ($auto == 1) {
            $rest = substr($contents, 3);
            rewrite ($filename, $rest);
            return ("发现BOM并且已自动删除");
        } else {
            return ("发现BOM");
        }
    }
    else return ("没有发现BOM");
}

function rewrite($filename, $data) {
    $filenum = fopen($filename, "w");
    flock($filenum, LOCK_EX);
    fwrite($filenum, $data);
    fclose($filenum);
}

如需转载,请注明出处: https://chadou.me/p/101

最新发布