网站怎么采集 wordpress怎样实现手动采集

WordPress是一种使用PHP语言开发的建站程序平台,现在做博客用wp的早已好多了,很多网站制作培训都使用的是wp,特别是在做采集站的时侯wordpress的共能太强悍。下面就给你们介绍怎样实现wp的手动采集功能。

安装网站采集插件:WP-AutoPost(插件下载地址:)

点击“新建任务”后,输入任务名称,即可创建新任务,创建好新任务以后可以在任务列表中查看到该任务,就可对该任务进行更多设置。(这一部分不需要更改设置,唯一须要改动的就是采集的时间。)文章来源设置。在该选项卡下我们须要设置文章来源的文章列表网址及具体文章的匹配规则。我们以采集”新浪互联网新闻“为例,文章列表网址为,因此在手工指定文章列表网址中输入该网址即可,如下所示:

文章网址匹配规则。文章网址匹配规则的设置特别简单,无需复杂设置,提供两种匹配模式,可以使用URL键值匹配,也可以使用CSS选择器进行匹配wordpress 文章采集,通常使用URL键值匹配较为简单,但有时使用CSS选择器更为精确。使用URL键值匹配。通过点击列表网址上的文章,我们可以发觉整篇文章的URL都为如下结构:,因此将URL中变化的数字或字母替换为键值(*)即可,如:(*)/(*).shtml 。重复的网址可以使用301重定向。使用CSS选择器进行匹配。使用CSS选择器进行匹配,我们只须要设置文章网址的CSS选择器即可,通过查看列表网址的源代码即可轻松设置,找到列表网址下文章超链接的代码,如下所示:

可以看见,文章的超链接A标签在class为“contList”的标签内部,因此文章网址的CSS选择器只须要设置为.contList a 即可,如下所示:

设置完成以后,不知道设置是否正确,可以点击上图中的测试按键wordpress 文章采集,如果设置正确,将列举该列表网址下所有文章名称和对应的网页地址,如下所示:

其他的设置可以不用更改。以上采集方法适用于WordPress多站点功能。

       优采云采集器是一个根据用户提供的关键词,云端自动采集相关文章并发布到用户网站的网站采集器。它能够自动识别各种网页上的标题、正文等信息,不需要用户编写任何采集规则就可以实现全网采集。采集到内容后,会自动计算内容与所设定的关键词的相关度,只把相关的文章推送给用户。支持标题前缀、关键词自动加粗、插入固定链接、自动提取Tag标签、自动内链、自动配图、自动伪原创、内容过滤和替换、电话号码和网址清理、定时采集、百度主动提交等一系列SEO功能。用户只需设置好关键词和相关需求,就能实现全托管、零维护的网站内容更新。不限网站数量,不管是单个网站还是大批量站群,都可以非常方便的进行管理。

此文由“快兔兔AI采集器”自动生成,目的为演示采集器效果,若侵权请及时联系删除。

原文链接:https://www.ucaiyun.com/article/1265

更多内容