php去除bom头代码
utf-8 bom又叫utf-8 签名,其实utf-8 的bom对uft-8没有作用,是为了支援utf-16,utf-32才加上的bom,bom签名的意思就是告诉编辑器当前文件采用何种编码,方便编辑器识别,但是bom虽然在编辑器中不显示,但是会产生输出,就像多了一个空行,
如果您在修改任何php文件後发生:
* 不能登入或者不能登出;
* 页顶出现一条空白;
* 页顶出现错误警告;
* 其它不正常的情况。
本程序采用utf-8编码。现在几乎所有的文本编辑软件都可以显示并编辑utf-8编码的文件。但是很遗憾,其中很多软件的表现并不理想。
类似windows自带的记事本等软件,在保存一个以utf-8编码的文件时,会在文件开始的地方插入三个不可见的字符(0xef 0xbb 0xbf,即bom)。它是一串隐藏的字符,用于让记事本等编辑器识别这个文件是否以utf-8编码。对于一般的文件,这样并不会产生什么麻烦。但对于 php来说,bom是个*烦。
php并不会忽略bom,所以在读取、包含或者引用这些文件时,会把bom作为该文件开头正文的一部分。根据嵌入式语言的特点,这串字符将被直接执行(显示)出来。由此造成即使页面的 top padding 设置为0,也无法让整个网页紧贴浏览器顶部,因为在html一开头有这3个字符呢!
最大的麻烦还不是这个。受cookie送出机制的限制,在这些文件开头已经有bom的文件中,cookie无法送出(因为在cookie送出前php已经送出了文件头),所以登入和登出功能失效。一切依赖cookie、session实现的功能全部无效。
因此,在编辑、更改任何文本文件时,请务必使用不会乱加bom的编辑器。linux下的编辑器应该都没有这个问题。windows下,请勿使用记事本等编辑器。推荐的编辑器是: editplus 2.12版本以上、emeditor、ultraedit(需要取消‘添加bom’的相关选项)、dreamweaver(需要取消‘添加bom’的相关选项) 等。
对于已经添加了bom的文件,要取消的话,可以用以上编辑器另存一次。(editplus需要先另存为gb,再另存为utf-8。) ,以下是程序解决方案:
if (isset ($_get['dir'])) { //设置文件目录 $basedir = $_get['dir'];} else { $basedir = '.';}$auto = 1;checkdir($basedir);function checkdir($basedir) { if ($dh = opendir($basedir)) { while (($file = readdir($dh)) !== false) { if ($file != '.' && $file != '..') { if (!is_dir($basedir . / . $file)) { echo filename: $basedir/$file . checkbom($basedir/$file) . ; } else { $dirname = $basedir . / . $file; checkdir($dirname); } } } closedir($dh); }}function checkbom($filename) { global $auto; $contents = file_get_contents($filename); $charset[1] = substr($contents, 0, 1); $charset[2] = substr($contents, 1, 1); $charset[3] = substr($contents, 2, 1); if (ord($charset[1]) == 239 && ord($charset[2]) == 187 && ord($charset[3]) == 191) { if ($auto == 1) { $rest = substr($contents, 3); rewrite($filename, $rest); return (bom removed.); } else { return (bom found.); } } else return (bom not found.);}function rewrite($filename, $data) { $filenum = fopen($filename, w); flock($filenum, lock_ex); fwrite($filenum, $data); fclose($filenum);}
