AI API 호출이 너무 느려요! 해결 방법이 있을까요?
AI API calls take too much! Any solution?
핵심 요약
여러 LLM API를 호출하는 AI 에이전트 구축 중 응답 시간이 지나치게 길어 해결책을 찾는 상황입니다.
- API 응답 지연 — 여러 LLM API 호출 시 40~137초가 소요되어 성능 최적화가 필요한 상황임.
- 직접 UI 사용 — 웹 UI에서는 몇 초 만에 응답이 오는데 API 호출 시에만 속도가 현저히 느려짐.
- 병렬 처리 한계 — 중간 단계의 결과값이 다음 작업에 필수적이라 스트리밍이나 병렬 처리를 적용하기 어려움.
AI 에이전트를 만들고 있는데 ChatGPT, DeepSeek, Claude 등 여러 LLM API를 호출하고 있습니다. 그런데 응답 시간이 40초에서 137초까지 걸리는데, 너무 느린 것 같아요.
직접 UI에서 같은 질문을 하면 몇 초밖에 안 걸리거든요.
혹시 이런 경험 있으신 분 계신가요? 이게 순차적인 문제인지, 특정 API가 병목 현상을 일으키는 건지, 아니면 다른 이유가 있는지 궁금합니다.

