Github Trends®
6814 findingsmedian surprise 0.00341window 3 days
UNIT / TREND-MONITOR · REV 2.6
[ 3 days window ]
SOURCE: own snapshots
РЕПО НЕТ В ОКНЕ 30D. ПОКАЗАН FINDING ИЗ ОКНА 3D (3 days) — РАНГ #83.
FINDING #83 · UNIT ID 1255768549
dondai1234/master-fetch
MCP server for web fetching with Cloudflare bypass, Trafilatura extraction, and smart routing. Free, self-hosted, no API keys.
[ PYTHON ]ЗАРАБОТОК D · 41/100[ GITHUB ↗ ]
SURPRISE SCORE
0.00

Score Breakdown

SURPRISE0.13
ENGAGEMENT1.19
FRESHNESS1.00
SCORE = SURPRISE × ENGAGEMENT^0.7 × FRESHNESS × VISIBILITY × CONFIDENCE
SURPRISE = WINDOW STARS / DAYS / (AUDIENCE + FLOOR)
7% OF STARS IN ARCHIVE

Growth Telemetry

VELOCITY /D
17.00
ACCEL
-17.00
RETENTION
25.0%
PEAK 2026-07-24 · FORK-RETENTION 71.4% · 51 STARS / WINDOW

Author Audience

AUDIENCE
88
FOLLOWERS
15
OWNER ★
731

Engagement Signals

FORKS
58
ISSUE AUTH
0
PR AUTH
0
UNIQUE STARGAZERS 51 / 51 (DIVERSITY 1.00)

Потенциал заработка

D41/100
СПРОС78
Деньги в теме есть: web scraping и AI-agent рынки растут, а конкуренты уже продают search/scraping/browser API за десятки–тысячи долларов в месяц.
ЗАХВАТ28
Удержание ценности слабое: MIT, локальная архитектура, лёгкость форка и сильные funded-конкуренты с брендом, infra, proxies, SLA и enterprise-продажами.
ДОСТУП58
MIT разрешает коммерциализацию, но production требует infra, legal, observability, billing, support; bus-factor малый, проект очень молодой.
«Заработок возможен в self-hosted-нише; capture топят MIT, локальность и funded-конкуренты.»

Рыночный анализ · Обзор

Hound — локальный MCP-сервер, который даёт AI-агенту веб-поиск, fetch, crawl, PDF/OCR и частичный обход bot-wall без API-ключей и платного SaaS.
AI agent web access / web scraping / web search / MCP toolingЗРЕЛОСТЬ · РАСТЁТ
ЯЗЫК
Python
ЛИЦЕНЗИЯ
MIT
РЕЕСТР
npm
РЕЛИЗ
v12.4.1
КОНТРИБЬЮТОРЫ
3
УСТАНОВКА: npm install master-fetch
Что делает

Hound запускается на машине пользователя и предоставляет агентам шесть инструментов для веб-исследований: поиск, загрузку страниц, crawling, screenshot, очистку кеша и проверку версии. Он возвращает markdown и структурированные сигналы вроде релевантности, типа страницы, stale-флагов и ошибок. README делает акцент на self-hosted, $0, no accounts, no API keys и MCP-интеграции с Claude Code, Cursor, OpenCode, Pi и другими клиентами.

Какую боль решает

Решает боль, когда AI-агенту нужен живой веб в чистом виде, а платные search/scraping API дороги или требуют аккаунтов, ключей и передачи данных третьей стороне.

Сценарии использования
  • Web research agent: найти источники, скачать страницы, вернуть citations.
  • RAG ingestion: конвертировать сайты и PDF в markdown.
  • Competitive/product monitoring малого объёма без SaaS-счёта.
  • Coding agent: читать docs, GitHub pages, StackOverflow и changelog’и.
  • Локальный privacy-first агент: запросы не идут через Firecrawl, Tavily или Exa.
Целевой пользователь

AI-agent power users, разработчики MCP-инструментов, indie hackers, small teams и privacy-sensitive пользователи, которым важен нулевой marginal cost.

Open-source аналоги

FirecrawlСИЛЬНЕЕ155,400
Hosted API + OSS, сильный cloud/product слой и open-core/AGPL-контекст; Hound локальнее и бесплатнее.
Browser UseСМЕЖНЫЙ98,800
Агент управляет браузером для задач; Hound больше про fetch/search/crawl-контекст через MCP.
Crawl4AIСИЛЬНЕЕ74,797
LLM-friendly crawler/scraper; Hound добавляет MCP-first UX, keyless search, PDF/OCR и stealth routing.
ScrapyСМЕЖНЫЙ61,900
Классический scraping framework, не agent/MCP-first, требует разработки spiders.
Playwright MCPСИЛЬНЕЕ33,805
Браузерная automation через accessibility tree; Hound даёт готовый research pipeline.
StagehandСМЕЖНЫЙ22,000
AI browser automation SDK, связан с Browserbase cloud; Hound проще как локальный MCP-сервер.
Jina ReaderСИЛЬНЕЕ11,000
URL/search → LLM-friendly text через hosted reader; Hound self-hosted и шире по инструментам.
Позиционирование

Hound не лидер. Это быстро растущий нишевый underdog: сильная упаковка «бесплатный локальный web MCP для агента», но рядом уже есть крупные OSS-проекты с десятками тысяч звёзд и коммерческими командами.

Коммерческие аналоги

FirecrawlB2BFREEMIUM
Search/scrape/crawl/interact API для AI-ready web data.
155.4K GitHub stars на сайте; TechCrunch писал про $14.5M Series A, 350K developers и клиентов Shopify/Replit/Zapier, но это данные на август 2025.
Free1,000 credits
Hobby$16/mo yearly
Standard$83/mo
Growth$333/mo
Scale$599/mo
Enterprisecustom
TavilyB2BFREEMIUM
Search API для AI agents.
2M+ developers по pricing page.
Free1,000 credits/mo
PAYG$0.008/credit
Projectfrom $0/mo
Enterprisecustom
ExaB2BПО ПОТРЕБЛЕНИЮ
AI-native search, contents, answer и research API.
Product scale: company search indexes 50M+ companies.
Search neural/auto$5/1K requests for 1–25 results
Search keyword$2.5/1K requests
Contents$1/1K pages
Answer$5/1K requests
BrowserbaseB2BFREEMIUM
Cloud browser infrastructure, search/fetch APIs, agent identity, captcha/stealth.
Stripe case: hundreds of customers, hundreds of millions of browser-session minutes/month, millions in first-year revenue.
Free$0
Developer$20/mo
Startup$99/mo
Scalecustom
Search overage$7/1K calls
Fetch overage$1/1K, with proxies $4/1K
Extract overage$4–7/1K
Browser Use CloudB2B / B2CПО ПОТРЕБЛЕНИЮ
Hosted browser agents, stealth browsers, proxy и skill execution.
Public customer logos есть; точный users/revenue не подтверждён. OSS repo 98.8K stars.
PAYG$0/mo, $0.06/browser-hour, $10/GB proxy
Starter$100/mo monthly or $83/mo yearly
Business$500/mo monthly or $400/mo yearly
Scaleup$2,500/mo monthly or $2,000/mo yearly
BrowserlessB2BFREEMIUM
Hosted browser automation infrastructure.
Точный users/revenue не подтверждён.
Free$0
Prototyping$25/mo yearly, 20K units
Starter$140/mo yearly, 180K units
Scale$350/mo yearly, 500K units
Enterprisecustom
ApifyB2BFREEMIUM
Actor marketplace, scraping/crawling platform, proxies и MCP.
Pricing page claims 28M+ AI chats for Intercom Fin and 800+ retailers for EU Commission use cases.
Free$0 with $5 usage
Starter$29/mo + PAYG
Scale$199/mo
Business$999/mo
Compute Unit$0.20/$0.16/$0.13
Residential proxy$8/$7.5/$7 per GB
SERP proxy$2.5/$2/$1.7 per 1K SERPs
Managed data extraction, proxies, CAPTCHA и browser rendering.
400M+ monthly residential IPs по pricing overview.
Free5K records/mo
PAYG$1.5/1K records
Scale$499/mo with 384K records and $1.3/1K additional
Enterprisecustom
ScrapingBeeB2BFREEMIUM
Web scraping API with headless browsers, rotating proxies and Google Search API.
Точный users/revenue не подтверждён.
Trial1,000 free credits
Freelance$49/mo
Startup$99/mo
Business$249/mo
Business+$599/mo
Customcustom
ScraperAPIB2BFREEMIUM
Scraping API with JS rendering, premium proxies, anti-bot and parsing.
Точный users/revenue не подтверждён.
Trial5,000 credits
Hobby$49/mo, 100K credits
Startup$149/mo, 1M credits
Business$299/mo, 3M credits
Scaling$475/mo, 5M credits
Professional$975/mo, 10.5M credits
Advanced$1,975/mo, 21.5M credits
Enterprisecustom
Zyte APIB2BПО ПОТРЕБЛЕНИЮ
Automated scraping API with target complexity tiers, rendering, captcha and sessions.
Maintains Scrapy; Scrapy repo 61.9K stars.
PAYG HTTP$0.13–$1.27/1K
PAYG browser rendered$1.01–$16.08/1K
$100/mo commitmentHTTP $0.10–$0.95/1K
$500/mo commitmentHTTP $0.06–$0.61/1K
Enterprisecustom
DataForSEO SERP APIB2BПО ПОТРЕБЛЕНИЮ
SERP API for search result data.
Точный users/revenue не подтверждён.
PAYG SERPfrom $0.0006 per SERP page
AI Summary$0.01/task
Minimum payment$50
Trial$1 trial credit
Текущая монетизация проекта

Подтверждённой платной версии, cloud, paid support или GitHub Sponsors для dondai1234/master-fetch не найдено. README и публичное позиционирование проекта говорят `$0`, no API keys, no SaaS dependency. Сейчас это выглядит как hobby/portfolio OSS, не open-core business.

Коммерческий потенциал

ПОТЕНЦИАЛ · СРЕДНИЙ

Заработать можно, но не как «ещё один Firecrawl API». Лучший путь — private/self-hosted web research MCP для команд: on-prem/VPC deployment, enterprise support, domain-specific recipes и compliance guardrails.

Спрос и рынок

Спрос высокий: web scraping software market оценён в $909.9M в 2024 и $1.9B к 2030 при 13.4% CAGR; другие оценки дают $8.657B к 2032 при 14.4% CAGR. AI agents market оценивается в $7.84B в 2025 и $52.62B к 2030 при 46.3% CAGR. Эти цифры взяты из собранного анализа и не перепроверялись здесь.

Ров / защищённость

Сейчас ров слабый. Возможные рвы: domain-specific success database, local/private deployment trust, MCP-native structured outputs, low-token tool design и community adoption среди coding-agent пользователей. Не ров: Cloudflare bypass claims, multi-search backend fan-out, markdown extraction и MIT code.

Модели монетизации
  • Paid support / enterprise support: SLA, обновления anti-bot профилей, private Slack, debugging.
  • Managed private deployment: Hound in customer VPC, Docker/Kubernetes, observability, secrets, proxy integration.
  • Domain packs: recipes для docs, filings, ecommerce, job boards, PDFs и government sites.
  • Hosted Hound Cloud для teams: privacy, audit logs, MCP gateway, rate controls.
  • BYO-proxy/BYOK orchestration: панель для ключей Tavily/Exa/Firecrawl/Serper, fallback routing и cost control.
  • Security/compliance wrapper: allowlist, robots policy, PII redaction, SSRF protection, audit trail.
Что нужно, чтобы сделать продукт
  • Stable hosted endpoint или reproducible enterprise deployment.
  • Dashboard: logs, cost, success rate by domain, retries, blocked engines.
  • Auth, orgs, billing, quotas, audit logs.
  • Proxy marketplace/integration и domain routing table.
  • Legal/compliance controls: robots, ToS flags, allow/deny lists.
  • Hardening MCP security: local network block, file URL block, secrets isolation.
  • Independent benchmarks вместо README-only claims.
  • Release provenance, signed builds, SBOM, security policy.
  • Support channel и docs для production incidents.
  • Выровнять distribution story: входные данные говорят npm install master-fetch, package.json содержит private=true, README даёт pip install hound-mcp.
⚖ ЛИЦЕНЗИЯ · МОЖНО ЛИ КОММЕРЦИАЛИЗИРОВАТЬ
MIT — коммерческое использование свободно. Можно использовать, модифицировать, продавать closed-source производные и hosted service при сохранении copyright/license notice. Лицензия не топит проект; топят capture, legal/compliance и operational burden.
Риски и подводные камни
ВЫСОКИЙЮР. СЕРАЯ ЗОНА
Anti-bot bypass, scraping search engines и Cloudflare/DataDome обход могут нарушать ToS и создавать риск для B2B-клиентов.
ВЫСОКИЙКОНКУРЕНЦИЯ
Firecrawl, Browserbase, Browser Use и Apify уже монетизируют категорию и могут скопировать local MCP UX.
ВЫСОКИЙПРОЧЕЕ
Stealth ломается при изменениях anti-bot систем и требует постоянного тестирования, proxies и fingerprint maintenance.
ВЫСОКИЙЗАВИСИМОСТЬ ОТ АВТОРА
3 контрибьютора, новый проект, одиночный owner-user и малый социальный след владельца.
ВЫСОКИЙПРОЧЕЕ
MCP fetch/browser tooling потенциально может ходить в local/internal IP и вытаскивать sensitive data; риск выведен по классу инструмента.
СРЕДНИЙПРОЧЕЕ
Distribution story конфликтует: входные данные говорят npm install master-fetch, package.json содержит private=true, README даёт pip install hound-mcp.
СРЕДНИЙПРОЧЕЕ
Быстрый star spike даёт внимание, но enterprise trust требует времени, security policy и подтверждённой эксплуатации.
СРЕДНИЙКОММОДИТИЗАЦИЯ
Free/local позиционирование усложняет переход к paid; hosted browser/proxy costs быстро съедают маржу.
НИЗКИЙЛИЦЕНЗИЯ
MIT коммерчески удобна и не мешает монетизации.

Достоверность разбора

УВЕРЕННОСТЬ · СРЕДНЯЯgpt-5.5 · 2026-07-24 · ОКНО 1D
Оговорки / что не проверено
  • Веб-поиск не выполнялся; все данные структурированы только из предоставленного собранного разбора и фактов воронки.
  • Звёзды и масштабы OSS-аналогов, кроме фактов воронки по Hound, не перепроверялись через GitHub API; часть значений взята со страниц/каталогов из собранного анализа.
  • Цены коммерческих аналогов не перепроверялись на актуальность; Exa pricing прямо помечен как неуверенный current из старого кэша exa.sh.
  • Масштаб Firecrawl, Tavily, Browserbase, Apify, Bright Data и других продуктов взят из собранного анализа; не подтверждён здесь двумя независимыми источниками.
  • Users/revenue для Browser Use Cloud, Browserless, ScrapingBee, ScraperAPI и DataForSEO не подтверждены.
  • Market size и CAGR для web scraping и AI agents взяты из собранного текста без URL-источников в задаче; считаются неподтверждёнными здесь.
  • Выводы про security/SSRF, compliance/ToS и operational burden частично основаны на общих знаниях о классе MCP fetch/browser/scraping инструментов, а не на отдельном аудите Hound.
  • README claims про Cloudflare/DataDome bypass, benchmark и 673 теста не проверялись независимо.
  • Монетизация самого Hound оценена по отсутствию подтверждений в собранном анализе и README-позиционированию, без отдельной проверки GitHub Sponsors или внешних каналов.
  • Distribution inconsistency npm/private/PyPI взята из предоставленных фактов и README; npm registry не перепроверялся.
ИСТОЧНИКИ (38)

Why This Is A Finding

dondai1234/master-fetch собрал 51 звёзд за окно, тогда как у автора всего 15 подписчиков — эффективная аудитория ≈ 88. Это даёт surprise-индекс 0.13 (звёзды относительно охвата автора, а не в абсолюте). Удержание форков 71.4% и 0 внешних контрибьюторов отделяют реальный инструмент от разовой вспышки. Акселерация отрицательная — внимание остывает после пика.

METRICS IN CONTEXT

MEDIAN ACROSS ALL 6814 FINDINGS · Δ vs MEDIAN · PERCENTILE = SHARE RANKED BELOW
METRICVALUEMEDIANΔ MEDPERCENTILE
SCORE0.150.00+0.15ABOVE 99%
VELOCITY17.005.33+11.67ABOVE 84%
RETENTION25.0%25.0%0.0 PPABOVE 48%
FORKS58420-362ABOVE 18%
SURPRISE0.130.00+0.13ABOVE 97%