Архив · репо вне текущей выдачи
FIRST SEEN 2026-07-24 · LAST SEEN 2026-09-16
Потенциал заработка
D41/100
СПРОС78
Деньги в теме есть: web scraping и AI-agent рынки растут, а конкуренты уже продают search/scraping/browser API за десятки–тысячи долларов в месяц.
ЗАХВАТ28
Удержание ценности слабое: MIT, локальная архитектура, лёгкость форка и сильные funded-конкуренты с брендом, infra, proxies, SLA и enterprise-продажами.
ДОСТУП58
MIT разрешает коммерциализацию, но production требует infra, legal, observability, billing, support; bus-factor малый, проект очень молодой.
«Заработок возможен в self-hosted-нише; capture топят MIT, локальность и funded-конкуренты.»
Рыночный анализ · Обзор
Hound — локальный MCP-сервер, который даёт AI-агенту веб-поиск, fetch, crawl, PDF/OCR и частичный обход bot-wall без API-ключей и платного SaaS.
AI agent web access / web scraping / web search / MCP toolingЗРЕЛОСТЬ · РАСТЁТ
УСТАНОВКА: npm install master-fetch
Что делает
Hound запускается на машине пользователя и предоставляет агентам шесть инструментов для веб-исследований: поиск, загрузку страниц, crawling, screenshot, очистку кеша и проверку версии. Он возвращает markdown и структурированные сигналы вроде релевантности, типа страницы, stale-флагов и ошибок. README делает акцент на self-hosted, $0, no accounts, no API keys и MCP-интеграции с Claude Code, Cursor, OpenCode, Pi и другими клиентами.
Какую боль решает
Решает боль, когда AI-агенту нужен живой веб в чистом виде, а платные search/scraping API дороги или требуют аккаунтов, ключей и передачи данных третьей стороне.
Сценарии использования
- +Web research agent: найти источники, скачать страницы, вернуть citations.
- +RAG ingestion: конвертировать сайты и PDF в markdown.
- +Competitive/product monitoring малого объёма без SaaS-счёта.
- +Coding agent: читать docs, GitHub pages, StackOverflow и changelog’и.
- +Локальный privacy-first агент: запросы не идут через Firecrawl, Tavily или Exa.
Целевой пользователь
AI-agent power users, разработчики MCP-инструментов, indie hackers, small teams и privacy-sensitive пользователи, которым важен нулевой marginal cost.
Open-source аналоги
Hosted API + OSS, сильный cloud/product слой и open-core/AGPL-контекст; Hound локальнее и бесплатнее.
Агент управляет браузером для задач; Hound больше про fetch/search/crawl-контекст через MCP.
LLM-friendly crawler/scraper; Hound добавляет MCP-first UX, keyless search, PDF/OCR и stealth routing.
Классический scraping framework, не agent/MCP-first, требует разработки spiders.
Браузерная automation через accessibility tree; Hound даёт готовый research pipeline.
AI browser automation SDK, связан с Browserbase cloud; Hound проще как локальный MCP-сервер.
URL/search → LLM-friendly text через hosted reader; Hound self-hosted и шире по инструментам.
Позиционирование
Hound не лидер. Это быстро растущий нишевый underdog: сильная упаковка «бесплатный локальный web MCP для агента», но рядом уже есть крупные OSS-проекты с десятками тысяч звёзд и коммерческими командами.
Коммерческие аналоги
Search/scrape/crawl/interact API для AI-ready web data.
155.4K GitHub stars на сайте; TechCrunch писал про $14.5M Series A, 350K developers и клиентов Shopify/Replit/Zapier, но это данные на август 2025.
Free1,000 credits
Hobby$16/mo yearly
Standard$83/mo
Growth$333/mo
Scale$599/mo
Enterprisecustom
Search API для AI agents.
2M+ developers по pricing page.
Free1,000 credits/mo
PAYG$0.008/credit
Projectfrom $0/mo
Enterprisecustom
AI-native search, contents, answer и research API.
Product scale: company search indexes 50M+ companies.
Search neural/auto$5/1K requests for 1–25 results
Search keyword$2.5/1K requests
Contents$1/1K pages
Answer$5/1K requests
Cloud browser infrastructure, search/fetch APIs, agent identity, captcha/stealth.
Stripe case: hundreds of customers, hundreds of millions of browser-session minutes/month, millions in first-year revenue.
Free$0
Developer$20/mo
Startup$99/mo
Scalecustom
Search overage$7/1K calls
Fetch overage$1/1K, with proxies $4/1K
Extract overage$4–7/1K
Hosted browser agents, stealth browsers, proxy и skill execution.
Public customer logos есть; точный users/revenue не подтверждён. OSS repo 98.8K stars.
PAYG$0/mo, $0.06/browser-hour, $10/GB proxy
Starter$100/mo monthly or $83/mo yearly
Business$500/mo monthly or $400/mo yearly
Scaleup$2,500/mo monthly or $2,000/mo yearly
Hosted browser automation infrastructure.
Точный users/revenue не подтверждён.
Free$0
Prototyping$25/mo yearly, 20K units
Starter$140/mo yearly, 180K units
Scale$350/mo yearly, 500K units
Enterprisecustom
Actor marketplace, scraping/crawling platform, proxies и MCP.
Pricing page claims 28M+ AI chats for Intercom Fin and 800+ retailers for EU Commission use cases.
Free$0 with $5 usage
Starter$29/mo + PAYG
Scale$199/mo
Business$999/mo
Compute Unit$0.20/$0.16/$0.13
Residential proxy$8/$7.5/$7 per GB
SERP proxy$2.5/$2/$1.7 per 1K SERPs
Managed data extraction, proxies, CAPTCHA и browser rendering.
400M+ monthly residential IPs по pricing overview.
Free5K records/mo
PAYG$1.5/1K records
Scale$499/mo with 384K records and $1.3/1K additional
Enterprisecustom
Web scraping API with headless browsers, rotating proxies and Google Search API.
Точный users/revenue не подтверждён.
Trial1,000 free credits
Freelance$49/mo
Startup$99/mo
Business$249/mo
Business+$599/mo
Customcustom
Scraping API with JS rendering, premium proxies, anti-bot and parsing.
Точный users/revenue не подтверждён.
Trial5,000 credits
Hobby$49/mo, 100K credits
Startup$149/mo, 1M credits
Business$299/mo, 3M credits
Scaling$475/mo, 5M credits
Professional$975/mo, 10.5M credits
Advanced$1,975/mo, 21.5M credits
Enterprisecustom
Automated scraping API with target complexity tiers, rendering, captcha and sessions.
Maintains Scrapy; Scrapy repo 61.9K stars.
PAYG HTTP$0.13–$1.27/1K
PAYG browser rendered$1.01–$16.08/1K
$100/mo commitmentHTTP $0.10–$0.95/1K
$500/mo commitmentHTTP $0.06–$0.61/1K
Enterprisecustom
SERP API for search result data.
Точный users/revenue не подтверждён.
PAYG SERPfrom $0.0006 per SERP page
AI Summary$0.01/task
Minimum payment$50
Trial$1 trial credit
Текущая монетизация проекта
Подтверждённой платной версии, cloud, paid support или GitHub Sponsors для dondai1234/master-fetch не найдено. README и публичное позиционирование проекта говорят `$0`, no API keys, no SaaS dependency. Сейчас это выглядит как hobby/portfolio OSS, не open-core business.
Коммерческий потенциал
ПОТЕНЦИАЛ · СРЕДНИЙ
Заработать можно, но не как «ещё один Firecrawl API». Лучший путь — private/self-hosted web research MCP для команд: on-prem/VPC deployment, enterprise support, domain-specific recipes и compliance guardrails.
Спрос и рынок
Спрос высокий: web scraping software market оценён в $909.9M в 2024 и $1.9B к 2030 при 13.4% CAGR; другие оценки дают $8.657B к 2032 при 14.4% CAGR. AI agents market оценивается в $7.84B в 2025 и $52.62B к 2030 при 46.3% CAGR. Эти цифры взяты из собранного анализа и не перепроверялись здесь.
Ров / защищённость
Сейчас ров слабый. Возможные рвы: domain-specific success database, local/private deployment trust, MCP-native structured outputs, low-token tool design и community adoption среди coding-agent пользователей. Не ров: Cloudflare bypass claims, multi-search backend fan-out, markdown extraction и MIT code.
Модели монетизации
- +Paid support / enterprise support: SLA, обновления anti-bot профилей, private Slack, debugging.
- +Managed private deployment: Hound in customer VPC, Docker/Kubernetes, observability, secrets, proxy integration.
- +Domain packs: recipes для docs, filings, ecommerce, job boards, PDFs и government sites.
- +Hosted Hound Cloud для teams: privacy, audit logs, MCP gateway, rate controls.
- +BYO-proxy/BYOK orchestration: панель для ключей Tavily/Exa/Firecrawl/Serper, fallback routing и cost control.
- +Security/compliance wrapper: allowlist, robots policy, PII redaction, SSRF protection, audit trail.
Что нужно, чтобы сделать продукт
- +Stable hosted endpoint или reproducible enterprise deployment.
- +Dashboard: logs, cost, success rate by domain, retries, blocked engines.
- +Auth, orgs, billing, quotas, audit logs.
- +Proxy marketplace/integration и domain routing table.
- +Legal/compliance controls: robots, ToS flags, allow/deny lists.
- +Hardening MCP security: local network block, file URL block, secrets isolation.
- +Independent benchmarks вместо README-only claims.
- +Release provenance, signed builds, SBOM, security policy.
- +Support channel и docs для production incidents.
- +Выровнять distribution story: входные данные говорят npm install master-fetch, package.json содержит private=true, README даёт pip install hound-mcp.
⚖ ЛИЦЕНЗИЯ · МОЖНО ЛИ КОММЕРЦИАЛИЗИРОВАТЬ
MIT — коммерческое использование свободно. Можно использовать, модифицировать, продавать closed-source производные и hosted service при сохранении copyright/license notice. Лицензия не топит проект; топят capture, legal/compliance и operational burden.
Риски и подводные камни
ВЫСОКИЙЮР. СЕРАЯ ЗОНА
Anti-bot bypass, scraping search engines и Cloudflare/DataDome обход могут нарушать ToS и создавать риск для B2B-клиентов.
ВЫСОКИЙКОНКУРЕНЦИЯ
Firecrawl, Browserbase, Browser Use и Apify уже монетизируют категорию и могут скопировать local MCP UX.
ВЫСОКИЙПРОЧЕЕ
Stealth ломается при изменениях anti-bot систем и требует постоянного тестирования, proxies и fingerprint maintenance.
ВЫСОКИЙЗАВИСИМОСТЬ ОТ АВТОРА
3 контрибьютора, новый проект, одиночный owner-user и малый социальный след владельца.
ВЫСОКИЙПРОЧЕЕ
MCP fetch/browser tooling потенциально может ходить в local/internal IP и вытаскивать sensitive data; риск выведен по классу инструмента.
СРЕДНИЙПРОЧЕЕ
Distribution story конфликтует: входные данные говорят npm install master-fetch, package.json содержит private=true, README даёт pip install hound-mcp.
СРЕДНИЙПРОЧЕЕ
Быстрый star spike даёт внимание, но enterprise trust требует времени, security policy и подтверждённой эксплуатации.
СРЕДНИЙКОММОДИТИЗАЦИЯ
Free/local позиционирование усложняет переход к paid; hosted browser/proxy costs быстро съедают маржу.
НИЗКИЙЛИЦЕНЗИЯ
MIT коммерчески удобна и не мешает монетизации.
Достоверность разбора
УВЕРЕННОСТЬ · СРЕДНЯЯgpt-5.5 · 2026-07-24 · ОКНО 1D
Оговорки / что не проверено
- +Веб-поиск не выполнялся; все данные структурированы только из предоставленного собранного разбора и фактов воронки.
- +Звёзды и масштабы OSS-аналогов, кроме фактов воронки по Hound, не перепроверялись через GitHub API; часть значений взята со страниц/каталогов из собранного анализа.
- +Цены коммерческих аналогов не перепроверялись на актуальность; Exa pricing прямо помечен как неуверенный current из старого кэша exa.sh.
- +Масштаб Firecrawl, Tavily, Browserbase, Apify, Bright Data и других продуктов взят из собранного анализа; не подтверждён здесь двумя независимыми источниками.
- +Users/revenue для Browser Use Cloud, Browserless, ScrapingBee, ScraperAPI и DataForSEO не подтверждены.
- +Market size и CAGR для web scraping и AI agents взяты из собранного текста без URL-источников в задаче; считаются неподтверждёнными здесь.
- +Выводы про security/SSRF, compliance/ToS и operational burden частично основаны на общих знаниях о классе MCP fetch/browser/scraping инструментов, а не на отдельном аудите Hound.
- +README claims про Cloudflare/DataDome bypass, benchmark и 673 теста не проверялись независимо.
- +Монетизация самого Hound оценена по отсутствию подтверждений в собранном анализе и README-позиционированию, без отдельной проверки GitHub Sponsors или внешних каналов.
- +Distribution inconsistency npm/private/PyPI взята из предоставленных фактов и README; npm registry не перепроверялся.
ИСТОЧНИКИ (38)