WebHarvy
软件描述
使用 WebHarvy,您可以轻松地从任何网站抓取文本、HTML、图片、URL 和电子邮件,并将抓取的数据保存为多种格式。
官方网站
访问软件的官方网站了解更多信息
www.webharvy.com
什么是 WebHarvy?
WebHarvy 是一款 Windows 桌面应用程序,通过简单易用的点按式用户界面,可从任意网站抓取无限量数据。
主要功能
🌎 从任意网站抓取数据
? 抓取文本、图片、URL、电子邮件、页面截图、HTML 内容等
🌲 抓取多级分类列表(例如电商网站的商品分类)
🔑 向搜索表单提交多个关键词并抓取结果
📃 支持网站使用的所有类型分页技术
🔏 支持使用代理(并自动轮换)实现匿名抓取
💾 将抓取的数据保存为文件——CSV、XML、Excel、TSV、JSON
🌐 将抓取的数据保存到数据库——MySQL、SQL Server、Oracle
🌎 自动化浏览器操作——点击、滚动、下拉选择、输入文本等
👤 使用用户名和密码登录网站
👩?💻 在页面上运行自定义 JavaScript 代码
👩?💻 使用正则表达式(RegEx)精确选取数据
? 定时抓取——无需人工干预的周期性抓取
👩?💻 支持命令行调用——可从其他应用或脚本中启动 WebHarvy
💻 本地安装于您的计算机
💰 一次性授权费用,无持续付费
与云端抓取平台不同,您抓取数据的数量及网站数量均无限制。我们为用户提供优质的客户支持,这使我们在与企业级网络抓取平台的竞争中脱颖而出。
🔄 替代方案
82 个选择ZennoPoster 是一款功能强大的自动化工具,适用于网络爬虫、数据提取和任务自动化,非常适合数字营销人员、开发者和企业主。

Web Robots
Web Robots 是一个专为应对现代网页而构建的网络爬取平台。它可与任何可在 Chrome 浏览器中打开的网站配合使用,能够处理 JavaScript、AJAX、Cookies、会话和重定向、表单、登录及点击操作。

DiffBot
软件
* 自动从网页获取数据: Diffbot 的计算机视觉 API 将网络变为您的数据库。 * 自动化 API:自动提取 从文章、产品及其他常见页面类型中获取结构化内容。







