2019-8-2 5:13:37 | 作者:老铁SEO | 0个评论 | 人浏览
八爪鱼采集器是任何一个需要从网页获取信息的孩纸必备的一款神器,这个是一款可以让你的信息采集可以变得很简单的工具。八爪鱼转变了传统对于网络上的数据思维方法,它让用户在网上抓取资料编的更加简单和容易了。
操作简单,完全可视化图形操作,无需专业IT人员,任何会使用电脑上网的人都可以轻松掌握。
采集任务自动分配到云端多台服务器同时执行,提高采集效率,可以很短的时间内 获取成千上万条信息。
模拟人的操作思维模式,可以登陆,输入数据,点击链接,按钮等,还能对不同情况采取不同的采集流程。
内置可扩展的OCR接口,支持解析图片中的文字,可将图片上的文字提取出来。
采集任务自动运行,可以按照指定的周期自动采集,并且还支持最快一分钟一次的实时采集。
内置从入门到精通所需要的视频教程,2分钟就能上手使用,另外还有文档,论坛,qq群等。
它是免费的,并且免费版本没有任何功能限制,你现在就可以试一试,立即下载安装。
简单来讲,使用八爪鱼可以非常容易的从任何网页精确采集你需要的数据,生成自定义的、规整的数据格式。八爪鱼数据采集系统能做的包括但并不局限于以下内容:
10. 在各大电商平台之间同步商品信息,做到在一个平台发布,其他平台自动更新。
先我们新建一个任务-->
进入流程设计页面-->
添加一个循环步骤到流程中-->
选中循环步骤-->
勾选上软件右方的URL 列表勾选框-->
打开URL列表文本框-->
将准备好的URL列表填写到文本框中
接下来往循环中拖入一个打开网页的步骤-->
选中打开网页步骤-->
勾选上使用当前循环里的URL作为导航地址-->
点击保存。系统会在界面下方的浏览器中打开循环中选中的URL对应的网页
到这里,循环打开网页的流程就配置完成了,运行流程的时候,系统会逐个的打开循环中设置的URL。最后我们不需要配置一个采集数据的步骤,这里就不在多讲,大家可以参考从入门到精通系列1:采集单个网页 这篇文章。下图就是最终和流程
【自定义模式】新增触发器功能,可根据特定条件进行采集,点击查看详细教程:
【自定义模式】提供八爪鱼6内核模式,有效解决部分网站在八爪鱼7上打不开的问题
【自定义模式】选中所有链接时,新增「采集以下元素Inner Html」和「采集以下元素Outer Html」选项