HyperCrawl
HyperCrawl
Motor de automatización web autohospedado y consciente de cookies. Convierte cualquier sitio web en herramientas MCP invocables (basadas en selectores DOM), las ejecuta en modo headless con sigilo en nuestros propios servidores y extrae cookies de autenticación en vivo bajo demanda desde un navegador real con sesión iniciada. Herramienta interna de NEB: funciona junto con Apify.
Estado: en producción en la VM de GCE hypercrawl-vm (Caddy auto-TLS + puerta de Firebase-Auth, hypercrawl.service). Capacidades: la escalera de capacidades acquire() (hypercrawl_acquire — replay/hidratación de API → herramienta aprendida → agente DOM → conjunto de marcas → visión → especialista), descubrimiento multipágina (hypercrawl_map, hypercrawl_crawl_site), seguimiento de cambios entre rastreos (previousHashes sin estado o flujos track con respaldo en BD, ambas intenciones), búsqueda web (hypercrawl_search), además de transporte HTTP MCP, ProxyPool y el adaptador de respaldo de Apify. Consulta docs/USAGE.md (herramientas) y deploy/gcp/README.md (despliegue/actualización — incluye los pasos necesarios de npm install + npx playwright install).
Sesiones de navegador
Más allá de la adquisición de una sola vez, HyperCrawl expone una superficie de navegador con estado: 15
herramientas MCP hypercrawl_browser_* que manejan una única página activa a lo largo de muchas llamadas, por lo que un
agente puede leer una página, hacer clic en ella, rellenar un formulario y enviarlo; cada paso aterriza en la
misma pestaña. hypercrawl_browser_open devuelve un sessionId que todas las demás herramientas reciben.
Las sesiones son un recurso limitado: cada una fija un contexto real de Chromium, por lo que el servidor limita
la concurrencia (HYPERCRAWL_MAX_SESSIONS, por defecto 4) y elimina las sesiones inactivas después de cinco
minutos. Cierra la tuya cuando termines. Un sessionId desconocido es un error rotundo, nunca una página
nueva en silencio.
Junto a ellas: hypercrawl_analyze / hypercrawl_quality (estructura de la página, y si los
selectores de una plantilla almacenada siguen resolviéndose en la página activa — la señal de que
un rediseño la rompió), hypercrawl_auth_save / _auth_list, y hypercrawl_metrics / _events /
_speed / _setup para la observabilidad dentro del proceso. Referencia de herramientas y todas las variables de entorno:
docs/USAGE.md.
Dos capacidades solo se conectan cuando el servidor se inicia mediante hypercrawl serve — el
par de autenticación y hypercrawl_setup — porque sus implementaciones residen en el paquete CLI.
Cuando no están conectadas, lo indican en lugar de devolver un resultado vacío que se leería como «nada
configurado».
Related MCP server: OmniMCP
Despliegue en GCP
Para ejecutar el motor completo (incluido el scraping con extracción de cookies autenticadas) en una VM de GCE dedicada con Caddy
auto-TLS y una puerta de token de Firebase Auth, usa los scripts de aprovisionamiento idempotentes y el
runbook de operador en deploy/gcp/README.md. Diseño:
docs/superpowers/specs/2026-05-29-hypercrawl-gcp-deploy-design.md.
Tool Schema Changelog
Recent tool additions, removals, and schema changes observed during successful MCP inspections. Dates show when Glama detected each change.
No tool schema history has been recorded yet.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Stealth web browser for agents: search, fetch, click, download and type in persistent MCP sessions.
One MCP for the Web. Easily search, crawl, navigate, and extract websites without getting blocked.…
AI-powered browser automation — navigate, click, fill forms, and extract data from any website.
Scrape, crawl and search the web for AI agents via MCP.
Related MCP Servers
- AlicenseBqualityCmaintenanceBrowser automation MCP server with persistent memory for AI assistants, enabling automated web testing and workflow replay with self-healing selectors.543MIT
- FlicenseNot gradedqualityCmaintenanceTurns any website into a rich set of MCP tools for scraping, crawling, structured data extraction, and automatic API mounting via OpenAPI specs.-
- AlicenseCqualityCmaintenanceProvides browser automation and web scraping as MCP tools, enabling autonomous URL ingestion, crawling, extraction, and anti-bot handling with interactive browser control.625MIT
- FlicenseNot gradedqualityCmaintenanceHeadless browser automation for LLM agents via REST API or MCP tools. Enables navigating pages, reading structured content, clicking elements, filling forms, and executing JavaScript.-
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/JoinSyndicate/hypercrawl'
If you have feedback or need assistance with the MCP directory API, please join our Discord server