HyperCrawl
HyperCrawl
Самостоятельно размещаемый движок веб-автоматизации с поддержкой cookie. Превращает любой сайт в вызываемые MCP-инструменты (на основе DOM-селекторов), запускает их в headless-режиме со stealth на наших серверах и по запросу получает живые авторизационные cookie из реального браузера, в котором выполнен вход. Внутренний инструмент NEB — работает вместе с Apify.
Статус: продакшн на GCE VM hypercrawl-vm (Caddy auto-TLS + шлюз Firebase-Auth, hypercrawl.service). Возможности: лестница возможностей acquire() (hypercrawl_acquire — повтор/гидратация API → выученный инструмент → DOM-агент → set-of-marks → зрение → специалист), многостраничное обнаружение (hypercrawl_map, hypercrawl_crawl_site), отслеживание изменений между обходами (stateless previousHashes или track-потоки на основе БД, оба интента), веб-поиск (hypercrawl_search), а также HTTP MCP-транспорт, ProxyPool и запасной адаптер Apify. См. docs/USAGE.md (инструменты) и deploy/gcp/README.md (развертывание/обновление — включает необходимые шаги npm install + npx playwright install).
Браузерные сессии
Помимо разового получения возможностей, HyperCrawl предоставляет stateful-интерфейс браузера: 15 MCP-инструментов hypercrawl_browser_*, которые управляют одной живой страницей в рамках многих вызовов, так что агент может прочитать страницу, кликнуть по ней, заполнить форму и отправить её — каждый шаг оказывается на той же вкладке. hypercrawl_browser_open возвращает sessionId, который принимает каждый остальной инструмент.
Сессии — ограниченный ресурс: каждая занимает реальный контекст Chromium, поэтому сервер ограничивает параллелизм (HYPERCRAWL_MAX_SESSIONS, по умолчанию 4) и вычищает сессии, бездействующие более пяти минут. Закрывайте свои, когда закончите. Неизвестный sessionId — это явная ошибка, а не бесшумное открытие новой страницы.
Наряду с ними: hypercrawl_analyze / hypercrawl_quality (структура страницы и проверка того, разрешаются ли селекторы сохранённого шаблона на живой странице — сигнал того, что редизайн сломал её), hypercrawl_auth_save / _auth_list, а также hypercrawl_metrics / _events / _speed / _setup для внутрипроцессной наблюдаемости. Справочник инструментов и все переменные окружения: docs/USAGE.md.
Две возможности подключаются только при запуске сервера через hypercrawl serve — пара auth и hypercrawl_setup — потому что их реализации находятся в CLI-пакете. В неподключённом состоянии они сообщают об этом, а не возвращают пустой результат, который можно было бы прочитать как «ничего не настроено».
Related MCP server: OmniMCP
Развертывание в GCP
Чтобы запустить полный движок (включая авторизованный скрапинг с извлечением cookie) на выделенной GCE VM с Caddy auto-TLS и шлюзом Firebase Auth token, используйте идемпотентные скрипты подготовки и операционный ранбук в deploy/gcp/README.md. Дизайн: docs/superpowers/specs/2026-05-29-hypercrawl-gcp-deploy-design.md.
Tool Schema Changelog
Recent tool additions, removals, and schema changes observed during successful MCP inspections. Dates show when Glama detected each change.
No tool schema history has been recorded yet.
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Stealth web browser for agents: search, fetch, click, download and type in persistent MCP sessions.
One MCP for the Web. Easily search, crawl, navigate, and extract websites without getting blocked.…
AI-powered browser automation — navigate, click, fill forms, and extract data from any website.
Scrape, crawl and search the web for AI agents via MCP.
Related MCP Servers
- AlicenseBqualityCmaintenanceBrowser automation MCP server with persistent memory for AI assistants, enabling automated web testing and workflow replay with self-healing selectors.543MIT
- FlicenseNot gradedqualityCmaintenanceTurns any website into a rich set of MCP tools for scraping, crawling, structured data extraction, and automatic API mounting via OpenAPI specs.-
- AlicenseCqualityCmaintenanceProvides browser automation and web scraping as MCP tools, enabling autonomous URL ingestion, crawling, extraction, and anti-bot handling with interactive browser control.625MIT
- FlicenseNot gradedqualityCmaintenanceHeadless browser automation for LLM agents via REST API or MCP tools. Enables navigating pages, reading structured content, clicking elements, filling forms, and executing JavaScript.-
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/JoinSyndicate/hypercrawl'
If you have feedback or need assistance with the MCP directory API, please join our Discord server