由于 trendforge.devlive.top 访问受限,请切换到 trendforge.devlive.org 域名

scraper

话题找到数量

firecrawl/firecrawl

面向AI的网页数据API——将整个网站转换为LLM就绪的Markdown或结构化数据🔥

157k
9k
761
+523
排名 #7
7月28日
查看详情

D4Vinci/Scrapling

🕷️ 一个自适应网络爬虫框架,能够处理从单个请求到大规模爬取的所有任务!

67k
6.7k
721
+280
排名 #11
6月30日
查看详情

Panniantong/Agent-Reach

为您的AI代理赋予观察整个互联网的能力。读取并搜索Twitter、Reddit、YouTube、GitHub、Bilibili、小红书——一个命令行工具,零API费用。

66k
5.5k
559
+956
排名 #5
8月4日
查看详情

huginn/huginn

创建可监控并代您执行的智能体。您的智能体随时待命!

49k
4.3k
616
+63
排名 #14
8月2日
查看详情

NaiboWang/EasySpider

易采集:一个可视化无代码/免编程的网络爬虫工具,支持通过图形化界面设计和执行采集任务。别名:ServiceWrapper面向Web应用的智能化服务封装系统。

44k
5.4k
674
+81
排名 #3
6月21日
查看详情

iawia002/lux

👾 使用 Go 语言编写的快速简洁视频下载库与命令行工具

31k
3.3k
408
+3
排名 #13
7月5日
查看详情

ScrapeGraphAI/Scrapegraph-ai

基于人工智能的Python爬虫工具

28k
2.8k
165
+26
排名 #10
7月30日
查看详情

apify/crawlee

Crawlee——一个用于构建可靠爬虫的Node.js网络爬取和浏览器自动化库。支持JavaScript与TypeScript。可为人工智能、大语言模型、检索增强生成或GPT提取数据。从网站下载HTML、PDF、JPG、PNG等文件。兼容Puppeteer、Playwright、Cheerio、JSDOM及原始HTTP请求。支持有头模式与无头模式。提供代理轮换功能。

24k
1.6k
674
+48
排名 #6
7月24日
查看详情

getmaxun/maxun

🔥 开源无代码网页抓取、爬虫、搜索与AI数据提取平台 • 数分钟内将网站转为结构化API 🔥

16k
1.4k
569
+88
排名 #12
7月1日
查看详情

instaloader/instaloader

从Instagram下载图片(或视频)及其标题和其他元数据。

12k
1.5k
338
+14
排名 #15
5月3日
查看详情

yusufkaraaslan/Skill_Seekers

将文档网站、GitHub仓库和PDF文件转换为Claude AI技能,并具备自动冲突检测功能。

12k
1.2k
712
+158
排名 #5
4月3日
查看详情

tiagozip/cap

面向现代网络的隐私优先、自托管验证码解决方案。

6.8k
465
550
+15
排名 #9
6月6日
查看详情

truelockmc/streambert

一款跨平台的Electron桌面应用,可流媒体播放和下载全球任何电影、电视剧或动漫,零广告且无追踪。

5.9k
522
409
+12
排名 #6
7月25日
查看详情

omkarcloud/botasaurus

构建无懈可击爬虫的全能框架

5.5k
479
288
+211
排名 #12
7月1日
查看详情

gosom/google-maps-scraper

从谷歌地图抓取数据。提取每个地点的名称、地址、电话号码、网站URL、评分、评论数量、经纬度、评论内容、电子邮件等信息。

5.4k
841
575
+785
排名 #12
7月31日
查看详情

AhmadIbrahiim/Website-downloader

💡 使用Node.js下载任意网站的完整源代码(包含所有资源文件)。[ JavaScript文件、样式表、图像 ]

5k
1.1k
527
+2.1k
排名 #3
7月31日
查看详情

Mathieu2301/TradingView-API

📈 从TradingView获取实时股票数据

4.1k
773
405
+27
排名 #7
6月30日
查看详情

edoardottt/cariddi

获取域名列表,爬取网址并扫描端点、密钥、API密钥、文件扩展名、令牌等

3.6k
322
313
+28
排名 #5
7月27日
查看详情

any4ai/AnyCrawl

AnyCrawl 🚀:一款基于Node.js/TypeScript的爬虫工具,可将网站转化为适用于大语言模型的就绪数据,并能从谷歌、必应、百度等搜索引擎提取结构化搜索结果。原生支持多线程以进行批量处理。

3.4k
358
368
+86
排名 #8
7月12日
查看详情

TeamNewPipe/NewPipeExtractor

NewPipe用于从流媒体网站提取数据的核心库

1.9k
567
667
+19
排名 #21
5月31日
查看详情

GodsScion/Auto_job_applier_linkedIn

通过使用此自动申请器自动化您的申请流程,让您的求职变得轻松。

1.6k
458
414
+20
排名 #5
2月19日
查看详情

elixir-crawly/crawly

Crawly,一个用于 Elixir 的高层级网络爬取与抓取框架。

1.1k
123
282
+3
排名 #11
7月15日
查看详情

nirholas/XActions

⚡ 完整的X/Twitter自动化工具包——包含爬虫、AI代理MCP服务器(Claude/GPT)、命令行工具、浏览器脚本。无需API费用。开源。自动取关未回关用户。实时监控分析数据。自动关注、点赞、评论、采集,无需API。

329
72
434
+4
排名 #9
6月22日
查看详情

Solr159/JavBoss

开箱即用的本地JAV/视频刮削、管理、播放软件,支持命令行一键安装和docker部署。只需简单添加目录,即可打造你的私人JAV/视频媒体库,带给你顶级的浏览体验,懒人必备。| 你的本地JAV/视频管理器。

301
27
27
+25
排名 #7
8月2日
查看详情
助手