帝国CMS   发布时间:2022-05-06  发布网站:大佬教程  code.js-code.com
大佬教程收集整理的这篇文章主要介绍了如果去除采集内容里的链接和广告大佬教程大佬觉得挺不错的,现在分享给大家,也给大家做个参考。

概述

一般我们采集规则写好后,比较郁闷的就是内容里的链接了,因为我不想看到内容里有别人网站的链接,当然更不用说广告了。这里需要说明的是,下面的方式只可以替换掉一些规则或者相对规则的链接和广告,只要那些比较变

一般我们采集规则写好后,比较郁闷的就是内容里的链接了,因为我不想看到内容里有别人网站的链接,当然更不用说广告了。这里需要说明的是,下面的方式只可以替换掉一些规则或者相对规则的链接和广告,只要那些比较变态的网站在内容里加很多随机文字的,那就没办法了。

过滤广告最简单的方式是在“过滤广告正则”的输入框里输入相应的正则,4.7以前的没有带,4.7以后的系统带的有,下面是个比较全些的广告过滤正则:

<a[!--ad--]>,</a>,<A[!--ad--]>,</A>,<div[!--ad--]>,</div>,<DIV[!--ad--]>,</DIV>,<iframe[!--ad--]</iframe>,<IFRAME[!--ad--]</IFRAME>

基本上已经够了。

如果过滤内容里的链接呢?这里可以在 过滤选项 的 替换:(针对标题内容) 里输入正则,多个用逗号分开,但是不要在这里写<a[!--ad--]>,</A>,这样的正则,因为这样你会采不到页面,呵呵,它把你采集的页面都给过滤了。

大佬总结

以上是大佬教程为你收集整理的如果去除采集内容里的链接和广告全部内容,希望文章能够帮你解决如果去除采集内容里的链接和广告所遇到的程序开发问题。

如果觉得大佬教程网站内容还不错,欢迎将大佬教程推荐给程序员好友。

本图文内容来源于网友网络收集整理提供,作为学习参考使用,版权属于原作者。
如您有任何意见或建议可联系处理。小编QQ:384754419,请注明来意。
标签: