MCP Servers / web-scraping / Webclaw

Webclaw

JSON →
none1,192web-scraping

Web content extraction for LLM pipelines — clean markdown or structured JSON from any URL using browser-grade TLS fingerprinting, no headless browser required. CLI, REST API, and MCP server.

Install
How to run this server
[ { "cmd": "npx create-webclaw", "imports": [] } ]
server path: webclaw
Tools
What this server exposes
scrape
Extract one URL as markdown, text, JSON, LLM format, or HTML
crawl
Follow same-origin links and extract discovered pages
map
Discover URLs without extracting every page
batch
Scrape multiple URLs in parallel
extract
Convert page content into structured data
summarize
Summarize a page
diff
Compare page content snapshots
brand
Extract colors, fonts, logos, and metadata
search
Search the web and scrape results
research
Multi-source research workflow
Configuration
Environment & auth
authnone
envWEBCLAW_API_KEY
envOLLAMA_HOST
envOPENAI_API_KEY
envOPENAI_BASE_URL
envANTHROPIC_API_KEY
envANTHROPIC_BASE_URL
Resources
Webclaw — MCP Server · libregistry