LangGraph 실행 실패가 짜증 나서 직접 도구를 만들어봤습니다. 다른 분들은 어떻게 해결하시나요?
Built something around LangGraph after getting annoyed with failed runs. Curious if anyone else has solved this differently.
핵심 요약
LangGraph의 반복적인 실행 실패와 비용 문제를 해결하기 위해 중간 단계부터 재실행이 가능한 SDK 'Sylo'를 개발했습니다.
- 실행 실패 문제 — API 호출 실패 시 전체 워크플로우가 다시 실행되어 비용이 낭비됨
- Sylo SDK 개발 — LangGraph, CrewAI 등에서 중간 단계부터 재개할 수 있는 래퍼 라이브러리
- 주요 기능 — 마지막 성공 단계부터 재개, 런타임 권한 확인, 승인 게이트 및 실행 로그 기록
- 커뮤니티 의견 요청 — 체크포인팅 기능을 그대로 쓰는지 아니면 별도의 레이어를 구축하는지 질문
LangGraph를 한동안 사용하면서 계속 같은 문제로 짜증이 났습니다.
워크플로우 실행:
LLM
↓
Tool
↓
LLM
↓
API call ❌
API 호출이 실패합니다.
이제 재시도합니다.
그 앞의 모든 과정이 다시 실행됩니다.
어떨 때는 괜찮지만, 어떨 때는 동일한 LLM 호출 비용을 다시 지불해야 한다는 뜻이기도 합니다.
LangGraph에 체크포인팅 기능이 있다는 건 알지만, CrewAI나 OpenAI Agents SDK, 심지어 일반 파이썬 코드에서도 사용할 수 있는 무언가가 필요했습니다.
그래서 Sylo라는 작은 SDK를 만들었습니다.
기본적으로 다음 기능을 처리하는 래퍼입니다:
- 마지막으로 완료된 단계부터 재개
- 런타임 권한 확인
- 파괴적인 작업 전 승인 게이트
- 실행 로그
LangGraph를 대체하려는 건 전혀 아닙니다.
다들 요즘 이 문제를 어떻게 해결하고 계신지 궁금합니다.
그냥 LangGraph의 체크포인팅에 의존하시나요, 아니면 직접 레이어를 구축하셨나요?
Repo:
https://github.com/saketjndl/Sylo
PyPi:
pip install sylo-sdk
