微信公众号搜"智元新知"关注
微信扫一扫可直接关注哦!

总结php删除html标签和标签内的内容的方法

经常扒别人网站文章的坑们;我是指那种批量式采集的压根不看内容的,少不了都会用到删除html标签函数;这里介绍3种不同用途上的方法

$str='<div><p>这里是p标签</p><img src="" alt="这里是img标签"><a href="">这里是a标签</a><br></div>';

1:删除全部或者保留指定html标签

    PHP自带函数strip_tags即可满足要求,

    使用方法:strip_tags(string,allow);

              string:需要处理的字符串;

              allow:需要保留的指定标签,可以写多个;

   <?PHP

       echo strip_tags($str,'<p><a>');

        

   ?>

   //输出:<p>这里是p标签</p><a href="">这里是a标签</a>

    此函数的优点是简单粗暴,但是缺点也很明显;如果有一大堆标签;而我只是想删除指定的某一个;那要写很多需要保留的标签;        所以有了第二个方法

2:删除指定的html标签

    使用方法:strip_html_tags($tags,$str);

              $tags:需要删除标签(数组格式)

              $str:需要处理的字符串;

  <?PHP

    function strip_html_tags($tags,$str){ 

        $html=array();

        foreach ($tags as $tag) {

            $html[]="/(<(?:/".$tag."|".$tag.")[^>]*>)/i";

        }

        $data=preg_replace($html,'',$str); 

    } 

    echo strip_html_tags(array('p','img'),$str);

     

   ?>

   //输出<div>这里是p标签<a href="">这里是a标签</a><br></div>;

3:删除标签标签内容

    使用方法:strip_html_tags($tags,$str){ 

        $html=array();

        foreach ($tags as $tag) {

            $html[]='/(<'.$tag.'.*?>[s|S]*?</'.$tag.'>)/';

        }

        $data=preg_replace($html,$str);

    } 

    echo strip_html_tags(array('a',$str);

     

   ?>

   //输出<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;

    很多网站文章里面会带上网站名和链接,比如<a href="http://www.baijunyao.com">白俊遥博客</a>;这个函数就是专治这种; 别拿这个函数采集本站啊;不然保证不打死你;

4:终极函数删除指定标签删除或者保留标签内的内容

    使用方法:strip_html_tags($tags,$str,$content);

              $tags:需要删除标签(数组格式)

              $str:需要处理的字符串;

  <?PHP

    /**

     * 删除指定的标签内容

     * @param array $tags 需要删除标签数组

     * @param string $str 数据源

     * @param string $content 是否删除标签内的内容 认为0保留内容    1不保留内容

     * @return string

     */

    function strip_html_tags($tags,$content=0){

        if($content){

            $html=array();

            foreach ($tags as $tag) {

                $html[]='/(<'.$tag.'.*?>[s|S]*?</'.$tag.'>)/';

            }

            $data=preg_replace($html,$str);

        }else{

            $html=array();

            foreach ($tags as $tag) {

                $html[]="/(<(?:/".$tag."|".$tag.")[^>]*>)/i";

            }

            $data=preg_replace($html,$str);

        }

        return $data;

    }

    echo strip_html_tags(array('a'),1);

   ?>

   //输出<div><p>这里是p标签</p><img src="" alt="这里是img标签"><br></div>;

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 [email protected] 举报,一经查实,本站将立刻删除。

相关推荐