共 16 篇相关内容
后羿采集器是一款免费的可视化网页数据采集软件,基于人工智能算法智能识别网页数据,无需编写代码即可完成采集。
火车头采集器(LocoySpider)是国产老牌数据采集与发布软件,支持网页抓取、数据处理及自动发布到各类网站系统。
集搜客GooSeeker是国内较早的网页数据抓取与文本分析平台,集采集、分词、情感分析于一体,广泛应用于学术研究。
爬山虎采集器是一款免费的可视化数据采集软件,智能识别网页结构,无需编程即可抓取各类网站数据。
Scrapy 是最流行的 Python 开源爬虫框架,提供从请求调度、数据提取到存储管道的完整数据采集解决方案。
ParseHub 是一款国外知名的可视化网页数据采集工具,通过点选操作即可抓取包含 JavaScript 的动态网页数据。
Octoparse 是面向全球用户的可视化数据采集平台,提供模板采集、云采集与 API 服务,无需编程即可抓取网页数据。
Web Scraper 是流行的 Chrome 浏览器采集插件,通过 Sitemap 配置抓取规则,另有云端版本支持大规模定时采集。
Import.io 是企业级网页数据提取平台,将任意网页转化为结构化数据,广泛服务于零售情报与市场分析领域。
Bright Data 是全球领先的网页数据平台,提供代理网络、采集 API、Web Unlocker 与现成数据集等产品。
Apify 是云端网页抓取与自动化平台,通过 Actor 机制运行各类采集程序,市场内置数千个现成爬虫可直接调用。
Mozenda 是企业级云端数据采集平台,通过桌面 Agent Builder 配置抓取任务,云端运行并将数据交付到企业系统。
Dexi.io 是云端数据提取与自动化平台,支持构建采集机器人处理复杂网页交互,并与企业数据流程集成。
Zyte 是 Scrapy 框架背后的商业公司,提供智能采集 API、代理管理与云端爬虫托管等一站式网页数据服务。
Crawlee 是 Apify 开源的现代化网页爬取框架,支持 Node.js 与 Python,内置请求队列、代理轮换与反封锁能力。
可视化网页数据采集工具,无需代码基础,适配各类公开数据爬取场景