LangChain 에이전트가 외부 도메인에 접근하기 전 도메인을 검증하는 트러스트 게이트를 만들었습니다
I built a trust gate that checks domains before your LangChain agent fetches from them
핵심 요약
LangChain 에이전트가 외부 URL을 가져오기 전 도메인의 신뢰성을 검증하여 피싱이나 악성 사이트 접근을 차단하는 도구를 개발했습니다.
- 보안 게이트웨이 — 에이전트가 외부 콘텐츠를 가져오기 전 도메인 신뢰도를 결정론적으로 검증함
- 인바운드 보안 — 에이전트가 신뢰할 수 없는 사이트에서 데이터를 가져오는 위험을 방지함
- 기술 스택 — WHOIS, DNS, TLS, 위협 피드 정보를 활용해 접근 여부를 결정함
- 사용 편의성 — LangChain 도구로 쉽게 통합 가능하며 무료 티어 제공
LangChain 에이전트가 외부 URL을 가져오기 전 도메인을 검증하는 트러스트 게이트를 만들었습니다
외부 URL에서 데이터를 가져오는 에이전트를 만들면서 계속 같은 문제에 부딪혔습니다. 에이전트가 아무 도메인에서나 콘텐츠를 가져와 요약하는 것이죠. 피싱 페이지든, 도메인 스쿼팅 사이트든, 새로 등록된 의심스러운 사이트든 상관없이 말입니다. 에이전트는 모든 것을 똑같이 신뢰할 수 있는 것처럼 가져와서 합성합니다.
그래서 저는 검색과 합성 사이에 위치하는 도구를 만들었습니다. 한 번의 호출로 WHOIS 나이, DNS 설정, TLS, 위협 피드 교차 참조 등 결정론적 신뢰 파이프라인을 통해 도메인을 확인하고, 콘텐츠가 모델 컨텍스트에 도달하기 전에 진행/샌드박스/거부 결정을 내립니다.
표준 LangChain 도구로 플러그인할 수 있습니다:
pip install entropy0-langchain
from entropy0_langchain import Entropy0Tool
tools = [Entropy0Tool(api_key="sk_ent0_xxxx")]
agent = initialize_agent(tools, llm, agent=AgentType.OPENAI_FUNCTIONS)
그 후 에이전트는 데이터를 가져오기 전에 모든 외부 URL을 확인합니다. 도메인이 임계값보다 낮은 점수를 받으면 검색이 발생하기 전에 차단되거나 샌드박스 처리됩니다.
GitHub: https://github.com/entropy0dev/sdk
Docs: https://entropy0.ai/docs
무료 티어는 월 150회 조회 가능하며, 신용카드는 필요 없습니다.
다른 분들은 에이전트 파이프라인에서 소스 신뢰성을 어떻게 처리하고 계신지 궁금합니다. 아니면 대부분 아직 이 부분에 대해 생각하지 않고 계신가요? 여러분이 어떻게 하고 계신지 듣고 싶습니다.

