Dedecms采集功能的使用方法 --- 图片集（二）(2)

日期：2020-06-02 栏目：程序人生浏览：次

回到图23，可发现有“17小时前”，由此可见，这里采集数字17就可以了。采集规则为“[内容]小时前”。这里不需要使用过滤规则。填写后，如图30所示，

Dedecms采集功能的使用方法 --- 图片集（二）

图30-文章发布时间的采集规则

2.1.5 获取图片集合以及图集内容的采集规则

这个部分是编写采集规则的重点，也是难点。需要特别注意。

图片集合：如果把采集的匹配规则填写在这里的话，系统就会把所采集到的图片，以图集的形式保存起来，注意这里只采集图片。

图集内容：在显示图集的时候，所需显示的说明性文字或者图片。

具体操作步骤：

（a）在打开的内容页面的源代码中，找到内容的开始部分“一些壁纸”，如图31所示，

Dedecms采集功能的使用方法 --- 图片集（二）

图31-内容的开始部分

分析一下这个源代码可知，以下两点：

（1）“一些壁纸”是这个图集的内容，因此可以把“条评论 ”作为匹配图集内容的开始部分。但是这样采集到的内容会包含有，应该在过滤规则中使用“{dede:trim replace=""}{/dede:trim}”过滤掉。

（2）“<div class=”show_content_pic”><ul>”可作为匹配图片集合的开始部分，而且每一个图片及其相关信息都是在“<li class=”art_content_listli”>”和”</li>”之间的。注意到这段代码中有两个地方都出现了<img>，通过对比原文可发现，”<img src=http://www.dede58.com/”/images/zoomit1.gif” class=”jdjz”>”是一个图标的源代码，这里是不应该被采集到的。为了过滤掉这个图标，需要在匹配规则中填写“{dede:trim replace=""}(.*){/dede:trim}”。

填写后，如（图32）所示，

Dedecms采集功能的使用方法 --- 图片集（二）