您现在的位置是:首页 > 网站建设常见问答网站建设常见问答

php删除html标签和标签内的内容的方法

2017-04-04【网站建设常见问答】1668 人已围观

简介一段干活的代码,记录下. 经常扒别人网站文章的坑们;我是指那种批量式采集的压根不看内容的,少不了都会用到删除html标签的函数;这里介绍3种不同用途上的方法;...

一段干活的代码,记录下.

经常扒别人网站文章的坑们;我是指那种批量式采集的压根不看内容的,少不了都会用到删除html标签的函数;这里介绍3种不同用途上的方法;

1
$str=\'

这里是p标签

\"这里是img标签\"这里是a标签
\';

1:删除全部或者保留指定html标签

    php自带的函数strip_tags即可满足要求,

    使用方法:strip_tags(string,allow);

              string:需要处理的字符串;

              allow:需要保留的指定标签,可以写多个;

1
2
3

    此函数的优点是简单粗暴,但是缺点也很明显;如果有一大堆标签;而我只是想删除指定的某一个;那要写很多需要保留的标签;        所以有了第二个方法;

2:删除指定的html标签

    使用方法:strip_html_tags($tags,$str);

              $tags:需要删除的标签(数组格式)

              $str:需要处理的字符串;

1
2
3
4
5
6
7
8
9
10
    function strip_html_tags($tags,$str){ 
        $html=array();
        foreach ($tags as $tag) {
            $html[]=\"/(<(?:\\/\".$tag.\"|\".$tag.\")[^>]*>)/i\";
        }
        $data=preg_replace($html, \'\', $str); 
        return $data;
    } 
    echo strip_html_tags(array(\'p\',\'img\'),$str);
   //输出:
这里是p标签这里是a标签
;

3:删除标签和标签的内容

    使用方法:strip_html_tags($tags,$str);

              $tags:需要删除的标签(数组格式)

              $str:需要处理的字符串;

1
2
3
4
5
6
7
8
9
10
11
function strip_html_tags($tags,$str){ 
    $html=array();
    foreach ($tags as $tag) {
        $html[]=\'/<\'.$tag.\'.*?>[\\s|\\S]*?<\\/\'.$tag.\'>/\';
        $html[]=\'/<\'.$tag.\'.*?>/\';
    }
    $data=preg_replace($html,\'\',$str);
    return $data;
echo strip_html_tags(array(\'a\',\'img\'),$str);
//输出

这里是p标签


    很多网站文章里面会带上网站名和链接,比如白俊遥博客;这个函数就是专治这种; 别拿这个函数采集本站啊;不然保证不打死你;

4:终极函数,删除指定标签;删除或者保留标签内的内容;

    使用方法:strip_html_tags($tags,$str,$content);

              $tags:需要删除的标签(数组格式)

              $str:需要处理的字符串;

              $ontent:是否删除标签内的内容 0保留内容 1不保留内容

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
    /**
     * 删除指定的标签和内容
     * @param array  $tags 需要删除的标签数组
     * @param string $str 数据源
     * @param boole  $content 是否删除标签内的内容 默认为false保留内容  true不保留内容
     * @return string
     */
    function strip_html_tags($tags,$str,$content=false){
        $html=array();
        foreach ($tags as $tag) {
            if($content){
                $html[]=\'/(<\'.$tag.\'.*?>[\\s|\\S]*?<\\/\'.$tag.\'>)/\';
            }else{
                $html[]=\"/(<(?:\\/\".$tag.\"|\".$tag.\")[^>]*>)/i\";
            }
        }
        $data=preg_replace($html, \'\', $str);
        return $data;
    }
    echo strip_html_tags(array(\'a\'),$str,1);
   //输出

这里是p标签

\"这里是img标签\"
;

前面扯了那么多;其实最后这个函数才是干货;一口气搞定各种标签删除的疑难杂症不费劲;



关注宁波网站建设博客,更多精彩分享,敬请期待!
 

Tags:

很赞哦! ()

文章评论

点击排行

本站推荐

站点信息