首页 > CMS教程 > WordPress > 正文

wordpress支持采集吗

发布: 2019-07-16 15:48:36
原创
2132人浏览过

wordpress支持采集吗

wordpress是一种使用php语言开发的建站程序平台,现在做博客用wp的已经很多了,很多网站制作培训都使用的是wp,特别是在做采集站的时候wordpress的功能很强大。下面就给大家介绍如何实现wp的自动采集功能。

安装网站采集插件:WP-AutoPost

1.jpg

点击“新建任务”后,输入任务名称,即可创建新任务,创建好新任务之后可以在任务列表中查看到该任务,就可对该任务进行更多设置。(这一部分不需要修改设置,唯一需要改动的就是采集的时间。)

文章来源设置。在该选项卡下我们需要设置文章来源的 文章列表网址 及 具体文章的匹配规则。我们以采集”新浪互联网新闻“为例,文章列表网址为http://roll.tech.sina.com.cn/internet_worldlist/index.shtml,因此在 手工指定文章列表网址 中输入该网址即可,如下所示:

2.jpg

文章网址匹配规则。文章网址匹配规则的设置非常简单,无需复杂设置,提供两种匹配模式,可以使用URL通配符匹配,也可以使用CSS选择器进行匹配,通常使用URL通配符匹配较为简单,但有时使用CSS选择器更为精确。

 使用URL通配符匹配。通过点击列表网址 http://roll.tech.sina.com.cn/internet_worldlist/index.shtml 上的文章,我们可以发现每篇文章的URL都为如下结构:http://tech.sina.com.cn/i/2013-06-27/16328485884.shtml,因此将URL中变化的数字或字母替换为通配符  (*)  即可,如:http://tech.sina.com.cn/i/(*)/(*).shtml 。重复的网址可以使用301重定向。

使用CSS选择器进行匹配。使用CSS选择器进行匹配,我们只需要设置文章网址的CSS选择器即可,通过查看列表网址http://roll.tech.sina.com.cn/internet_worldlist/index.shtml的源代码即可轻松设置,找到列表网址下文章超链接的代码,如下所示:

3.jpg

可以看到,文章的超链接A标签在class为“contList”的标签内部,因此文章网址的CSS选择器只需要设置为  .contList a  即可,如下所示:

4.jpg

设置完成之后,不知道设置是否正确,可以点击上图中的测试按钮,如果设置正确,将列出该列表网址下所有文章名称和对应的网页地址,如下所示:

5.jpg

其他的设置可以不用修改。

以上采集方法适用于WordPress多站点功能。

更多wordpress相关技术文章,请访问wordpress教程栏目进行学习!

以上就是wordpress支持采集吗的详细内容,更多请关注php中文网其它相关文章!

WPS零基础入门到精通全套教程!
WPS零基础入门到精通全套教程!

全网最新最细最实用WPS零基础入门到精通全套教程!带你真正掌握WPS办公! 内含Excel基础操作、函数设计、数据透视表等

下载
来源:php中文网
本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn
最新问题
开源免费商场系统广告
热门教程
更多>
最新下载
更多>
网站特效
网站源码
网站素材
前端模板
关于我们 免责申明 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送
PHP中文网APP
随时随地碎片化学习
PHP中文网抖音号
发现有趣的

Copyright 2014-2025 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号