标签:网页爬取
包含标签「网页爬取」的全部资源
共 65 个结果
网页爬取服务器
Firecrawl MCP Server是一个集成网页爬取、内容提取和搜索功能的服务器实现,适用于数据收集和研究场景。
网页抓取与分析工具
一个用于抓取、爬取和分析网页的服务器工具,支持29种功能,包括SEO审计、内容提取、性能检查和跟踪审计等。
资助爬虫系统
一个24/7自主运行的资助发现系统,具备MCP网页爬取、A2A分布式代理和Google Sheets自动化功能,适用于AI机构。
微信内容爬取工具
这是一个可以爬取阅读网页内容的工具,主要面向百度网页,链接以https://www.baidu.com/bh开头,适用于需要获取阅读网页内容的场景。
网页数据爬取服务器
一个基于Selenium的网页数据爬取和提取服务器,支持多种数据提取方式和REST API接口。
网页爬取服务
基于Spring Boot的MCP服务器,用于调用Crawl4ai API进行网页爬取,支持指定策略、深度和输出格式。
网页爬取与RAG服务
Crawl4AI RAG MCP Server是一个集成网页爬取和检索增强生成(RAG)功能的服务,专为AI代理和AI编程助手设计,支持高级网页爬取、内容存储和智能检索。
网页爬取服务
Firecrawl Server for MCP是一个提供网页爬取和内容抓取功能的Express API服务器,适用于需要批量处理URL或爬取整个网站的场景。
网页爬取服务器
一个生产就绪的MCP协议网页爬取服务器,提供智能内容提取、链接分析、站点地图生成和网页搜索功能。
网页爬取服务
一个基于FastAPI的高性能微服务,专为AI和LLM优化的网页爬取工具,可将网页转换为结构化的Markdown格式,适用于RAG系统、AI代理和数据管道。
网页爬取服务器
Firecrawl MCP Server 是一个多架构支持的高性能网页爬取与数据抓取服务,适用于需要自动化收集网页内容的开发场景。
网页爬取集成工具
该工具集成了Firecrawl的网页爬取能力与Cursor MCP服务器,通过改进网页内容处理来增强AI辅助功能。
网页内容提取服务器
一个与Agent.ai API集成的MCP服务器,提供网页文本提取、网页截图和YouTube转录功能,通过动态函数加载系统实现。
网页爬取与数据提取服务
Firecrawl Lite MCP Server是一款隐私优先的网页爬取和数据提取工具,通过本地浏览器自动化和用户自己的LLM密钥,为任何MCP客户端提供网页抓取和结构化数据提取功能。
多源研究爬虫平台
MCPSearch是一个自托管的研究堆栈,结合了多引擎网页搜索、HTTP和浏览器爬取、社交媒体收集和结构化内容提取功能。
网页爬取服务
Firecrawl MCP Server是一个集成了Firecrawl的模型上下文协议服务器,提供网页爬取、搜索、内容提取和深度研究等功能,适用于数据采集和分析场景。
网页爬取与数据提取服务器
Hyperbrowser的模型上下文协议(MCP)服务器,提供网页爬取、结构化数据提取和通用浏览器代理工具。
网页爬取工具
使用Playwright MCP和LLM调用的端到端网页爬取工作流,用于提取和解析房地产列表页面的数据,并导出为Excel文件。
网页爬取与RAG服务
为AI代理和AI编程助手提供高级网页爬取和检索增强生成(RAG)能力的服务。
AI代理Web交互工具
Spectrawl是一个自托管的一体化Web交互工具包,为AI代理提供搜索、浏览、爬取、提取和平台操作功能。
网页爬取API
Purify是一个高效的网页爬取API服务,专为AI代理设计,提供干净的内容提取、批量爬取和递归爬取功能,适用于AI代理、RAG管道、交易机器人和研究助手等场景。
网页爬取与学术搜索服务器
一个基于Crawl4AI的Model Context Protocol服务器,提供智能网页爬取、学术搜索和内容分析功能,适用于学术研究、市场调研和技术文档整理。
网页爬取服务
一个提供网页爬取功能并输出Markdown格式内容的MCP服务器,适用于LLM处理。
必应搜索工具
一个基于MCP协议的中文必应搜索工具,支持网页内容获取和AI工具调用。
