로컬 에이전트를 위한 가장 쉬운 웹 스크래핑 방법 (Markdown MCP)
Easiest way to give your local agents reliable web scraping capabilities (Markdown MCP)
핵심 요약
로컬 에이전트가 웹 데이터를 쉽게 가져올 수 있도록 돕는 Markdown 기반의 MCP 서버를 소개합니다.
- 깔끔한 마크다운 변환 — LLM이 처리하기 쉬운 텍스트 형식으로 웹 페이지를 즉시 변환함.
- JS 및 캡차 우회 — 복잡한 웹 렌더링 과정을 백엔드에서 처리하여 스크래핑을 단순화함.
- 합리적인 비용 모델 — 월 구독료 없이 사용한 만큼만 지불하는 마이크로 트랜잭션 방식을 채택함.
- 간편한 MCP 통합 — Cursor나 Claude Desktop 등 MCP를 지원하는 모든 프레임워크와 즉시 연동됨.
로컬 에이전트를 만드는 건 재밌지만, 실제 웹과 상호작용해야 하는 순간부터 골치가 아파집니다. 대부분의 간단한 requests.get()은 최신 SPA에서 실패하고, LLM과 함께 전체 Playwright 스택을 실행하면 RAM과 개발 시간을 엄청나게 잡아먹죠.
저는 바로 사용할 수 있는 솔루션을 원했고, 그래서 Markdown Scraper MCP 서버를 만들었습니다.
제가 이걸 만든 이유:
- 깔끔한 마크다운: LLM은 지저분한 HTML이 아니라 깔끔한 텍스트가 필요합니다. 이 도구는 어떤 URL이든 AI가 바로 읽을 수 있는 마크다운으로 변환합니다.
- JS/캡차 우회: 뒤에서 성가신 렌더링 과정을 모두 처리합니다.
- 종량제 방식: 표준 스크래핑 API의 월 50달러 최소 비용이 너무 싫었습니다. 이건 마이크로 트랜잭션 모델(요청당 0.005달러)로 운영됩니다. 5달러만 충전해도 몇 달 동안 프로토타이핑하기 충분합니다.
Model Context Protocol을 사용하므로 Cursor, Claude Desktop 등 호환되는 프레임워크나 클라이언트와 즉시 통합할 수 있습니다.
저장소 및 설정 방법은 여기 있습니다: https://github.com/guimaster97/api_scraper_markdown
웹 접근이 필요한 에이전트 워크플로우를 어떻게 만들고 계신지 알려주세요!

