RAG의 컨텍스트 노후화 문제를 해결하기 위한 '시간적 감쇠(Temporal Decay)' 스코어링 API를 만들었습니다. 48시간 스트레스 테스트 진행 중 (무료 API 키 제공)
I built a "Temporal Decay" scoring API for RAG to fix context rot. Running a 48h stress test (Free API keys).
핵심 요약
RAG 검색 시 오래된 정보를 걸러내고 최신성을 보장하는 '시간적 감쇠' 스코어링 API를 개발하여 테스트 중입니다.
- 시간적 감쇠 API — RAG 검색 시 데이터의 최신성을 평가하여 오래된 정보를 배제함.
- 다중 플랫폼 크롤링 — GitHub, arXiv 등 14개 플랫폼에서 비동기 방식으로 데이터를 수집함.
- 컨텍스트 오케스트레이션 — LLM이 답변하기 전 'days_until_stale' 지표를 통해 데이터의 유효성을 판단함.
- 베타 테스트 진행 — 48시간 동안 스트레스 테스트를 수행하며 개발자들에게 무료 API 키를 제공함.
여러분 안녕하세요,
저는 에이전트 워크플로우를 구축하면서 검색 계층이 시간에 대해 무지하다는 점에 완전히 질려버렸습니다. 모든 RAG 튜토리얼은 벡터 DB에 청크를 집어넣으라고만 하지, 그 데이터가 3년이나 지났을 때 무슨 일이 일어나는지는 아무도 말해주지 않죠.
여러분의 LLM은 의미적 유사성이 높다는 이유만으로 구식 LangChain 통합 정보나 오래된 StackOverflow 답변을 가져오고, 매우 자신 있게 환각을 일으킵니다.
이 문제를 해결하기 위해 저는 Knowledge Universe API를 만들었습니다.
단순히 스크래핑만 하는 것이 아니라, 컨텍스트 오케스트레이션 엔진 역할을 합니다:
- 병렬 크롤링: 14개 플랫폼(GitHub, arXiv, YouTube, Kaggle, Semantic Scholar 등)을 동시에 완전히 비동기 방식으로 크롤링합니다.
- 수학적 계산: 모든 컨텍스트 조각에 '시간적 감쇠 점수(Temporal Decay Score)'를 적용하고, LLM에 도달하기 전에
days_until_stale정수 값을 반환합니다. - 기술 스택: Upstash Redis 캐싱 계층, 3키 비동기 로테이션, 차단된 SDK를 우회하기 위한 직접적인 HTTPX 통합으로 구축되었습니다.
48시간 스트레스 테스트 저는 어젯밤 Redis 캐시와 로드 밸런서를 연결하는 작업을 마쳤고, 이것이 잘 작동하는지 확인해야 합니다. 이번 주말에 엔드포인트를 스트레스 테스트하기 위해 분산 해커톤을 운영하고 있습니다.
만약 이번 주말에 에이전트, 래퍼, 또는 MVP를 구축 중이고 환각 없는 검색 계층을 테스트하고 싶다면, 댓글을 남기거나 DM을 보내주세요.
개발자 문서와 함께 즉시 사용할 수 있는 고유 API 키를 보내드리겠습니다(시작 시 500회 무료 요청—멋진 것을 만들어서 제한에 도달하면, 완료할 수 있도록 무료로 엔터프라이즈 티어로 업그레이드해 드립니다).
감쇠 계산이 실제로 작동하는 모습을 보고 싶다면 라이브 UI 데모를 확인하세요: https://huggingface.co/spaces/vlsiddarth/Knowledge-Universe
캐시를 한번 깨뜨려 봅시다. 다들 이번 주말에 무엇을 만들고 계신가요?
