您现在的位置是:首页 > 教程 > dedecms教程dedecms教程
织梦dedecms采集规则和使用方法
幻柏2023-10-05 22:47:59dedecms教程已有人查阅
导读楚截图和文字分不清楚,因此用粉色背景来区分。第一步、确定采集的网站(我们以DEDE的官方站做为采集站做示范)第二步、确定被采集站的编码。打开被采集的网
楚截图和文字分不清楚,因此用粉色背景来区分。
第一步、确定采集的网站(我们以DEDE的官方站做为采集站做示范)
第二步、确定被采集站的编码。打开被采集的网页之后,查看源代码(IE:查看 - > 源代码)在 之间找到 charset 这个,后面就显示网页的编码了,截图的是 “gb2312”
第三步、采集列表获取规则写法
[var:分页]
文章网址需包含 网址不能包含 这两个一般不用写,用于采集列表范围有很多不需要的连接才用到他来做过滤使用。如果只有一个列表页,那么在来源网址就直接写上网址就OK了。注意这里,最关键就是这里。
下面就是“采集获取文章列表的规则写法”,就是上面打开的被采集页面的源代码文件,找到文章列表之前 和本页面没有其他相同的代码在DedeCms官方站的列表页文章列表之前和之后最近的且没有相同的是“”和“ ”,分别写入“起始HTML”和“结束HTML”,写法看截图
第四步、采集文章标题,文章内容,文章作者,文章来源等规则写法,分页采集等。
“起始HTML”和“结束HTML”写法参考第三步中的“获取文章列表的规则写法”
下面讲的是如何采集分页内容 看截图圈着的地方文档是否分页 里面选择“全部列出的分页列表”“起始HTML”和“结束HTML”写法参考第三步中的“获取文章列表的规则写法”当然 上面这些不能用来采集带有视频的,因为已经过滤了,后面的四行是过滤掉视频的。
第一步、确定采集的网站(我们以DEDE的官方站做为采集站做示范)
第二步、确定被采集站的编码。打开被采集的网页之后,查看源代码(IE:查看 - > 源代码)在 之间找到 charset 这个,后面就显示网页的编码了,截图的是 “gb2312”
第三步、采集列表获取规则写法
[var:分页]
文章网址需包含 网址不能包含 这两个一般不用写,用于采集列表范围有很多不需要的连接才用到他来做过滤使用。如果只有一个列表页,那么在来源网址就直接写上网址就OK了。注意这里,最关键就是这里。
下面就是“采集获取文章列表的规则写法”,就是上面打开的被采集页面的源代码文件,找到文章列表之前 和本页面没有其他相同的代码在DedeCms官方站的列表页文章列表之前和之后最近的且没有相同的是“”和“ ”,分别写入“起始HTML”和“结束HTML”,写法看截图
第四步、采集文章标题,文章内容,文章作者,文章来源等规则写法,分页采集等。
“起始HTML”和“结束HTML”写法参考第三步中的“获取文章列表的规则写法”
下面讲的是如何采集分页内容 看截图圈着的地方文档是否分页 里面选择“全部列出的分页列表”“起始HTML”和“结束HTML”写法参考第三步中的“获取文章列表的规则写法”当然 上面这些不能用来采集带有视频的,因为已经过滤了,后面的四行是过滤掉视频的。
本文标签:
很赞哦! ()
相关文章
- 织梦dedecms添加RSS订阅功能的代码实例
- 织梦dedecms系统的安装方法步骤教程
- 织梦dedecms给栏目加一个英文栏目名字段的实现方法
- 织梦dedecms如何让文章列表实现隔行换色的代码实例
- 织梦dedecms提示“数据校验不对”错误的修复方法
- linux主机实现织梦dedecms的tags标签静态化
- 织梦dedecms修改TAG的title字数限制的方法
- 织梦dedecms网站的专题调用标签代码示例
- 织梦dedecms使用SQL删除指定栏目全部文章的方法
- 织梦dedecms删除文章时不删除HTML不删除附件图片的实现方法
- 《织梦dedecms二次开拓文档手册》措施目次详解以及数据表布局字
- 织梦dedecms二次开发实现图集缩略图的分页样式
随机图文
-
织梦地图sitemap路径怎么修改
今天给大家分享的是织梦的sitemap路径修改方法。我们知道网站地图对一个网站来说非常重要,至少在seo方面。那么织梦默认的sitemap路径是在/data/sitemap.html。 -
织梦dedecms5.6实现点击图片进入下一页之后一页进入下一篇
织梦5.6图片集默认是不能点击图片之后一页进入下一篇的,并且老是弹出图示没有了,下面跟大家分享织梦DeDeCms5.6点击图片进入下一页,之后一页进入下一篇的方法: -
dedecms织梦后台文章列表页码异常的解决办法
因为DeDeCMS有缓存机制,有些比较费时的SQl查询会在数据库中缓存,所以集中发布文章时,在后台的文章列表页的页码会过了缓存周期才能正确显示,解决的办法是: -
织梦cms如何调用dz x1.5的相关数据
最近帮朋友整合了DEDECSM V5.6和discuz x1.5后,朋友又再次找到我,咨询如何实现在织梦CMS的相关栏目中调用论坛的相关数据。于是我尝试调用“活跃会员”
留言与评论 (共有 条评论) |
大家在看
本栏推荐
相关标签
大家喜欢
- 织梦dedecms后台设置“附件保存形式(按data函数日期参数)”参数无效
- 织梦CMS地图sitemap.html怎么更改路径和模板
- DedeCMS5.3自定义模型使用方法详解
- 织梦dedecms5.7SP1 /plus/download.php url重定向漏洞的解决方法
- 织梦列表页有图片显示缩略图无图片不显示的方法
- dedecms5.7怎么用SQL语句调用数据库任意内容示例
- BOM问题导致织梦dede生成的页面头部空白的解决方法
- 织梦dedecms网站解决虚拟主机空间商禁用fsockopen函数的方法
- 织梦dedecms简略标题调用标签和调用代码分享
- 织梦内容页调用SEO标题描述关键字的方法