首页 > 软件下载 > 办公软件

红叶文章采集器 v3.6中文绿色版

2024-06-04

资源介绍

超级强大的网站文章采集器,本软件全名为红叶文章采集器,英文名称Fast_Spider,属于蜘蛛爬虫类程序,用于从指定网站采集海量精华文章,将直接丢弃其中的垃圾网页信息,仅保存具备阅读价值和浏览价值的精华文章,自动执行HTM-TXT转换。本软件为绿色软件解压即可使用!

image.png

软件特色

(1)本软件采用北大天网MD5指纹排重算法,对于相似相同的网页信息,不再重复保存。

(2)采集信息含义:[[HT]]表示网页标题,[[HA]]表示文章标题,[[HC]]表示10个权重关键字,[[UR]]表示网页中的图片链接,[[TXT]]之后为正文。

(3)蜘蛛性能:本软件开启300个线程来保证采集效率。通过采集100万精华文章来执行压力测试,以普通网民的联网计算机为参考标准,单台计算机可以在一天内遍历200万网页、采集20万精华文章,100万精华文章仅需5天就可采集完毕。

(4) 正式版与免费版的区别在于:正式版允许将采集的精华文章数据自动保存为ACCESS数据库。购买正式版请联系QQ(970093569)。

操作方法

(1)使用前,必须确保你的计算机可以连通网络,且防火墙不要拦截本软件。

(2)运行SETUP.EXE和setup2.exe,以安装操作系统system32支持库。

(3)运行spider.exe,输入网址入口,先点"人工添加"按钮,再点"启动"按钮,将开始执行采集。

注意事项

(1)抓取深度:填写0表示不限制抓取深度;填写3表示抓到第3层。

(2)通用蜘蛛模式与分类蜘蛛模式的区别:假定网址入口为“http://youxi.baidu.com/”,若选择

展开全部

版权声明

1 本站所有资源(含游戏)均是软件作者、开发商投稿,任何涉及商业盈利目的均不得使用,否则产生的一切后果将由您自己承担!

2 本站资源下载后不得用于商业用途,所有资源请在下载后24小时内删除。

3 若有关在线投稿、无法下载等问题,请与本站客服人员联系。

4 如侵犯了您的版权、商标等,请立刻联系我们并具体说明情况后,本站将尽快处理删除,联系QQ:2499894784

最近更新

热门排行

最需网客户端 软件问题一手掌握

去 App Store 免费下载 iOS 客户端