Kubernetes에 AI 에이전트를 배포하기 위한 아키텍처가 궁금합니다.
Curious as to what architectures are out there for deploying ai agents in K8s?
핵심 요약
홈랩 환경에서 GTX 4090을 활용해 Kubernetes 기반 AI 에이전트를 구축하려는 사용자의 질문입니다.
- 하드웨어 환경 — GTX 4090과 6대의 Dell Optiplex로 구성된 홈랩 보유
- 배포 고민 — Kubernetes 환경에서 AI 에이전트 운영을 위한 아키텍처 탐색
- 기술적 조언 — 인그레스 기반의 단순 배포와 모델 서빙/오케스트레이션/도구 실행의 계층화 제안
다들 안녕하세요. 친구한테 GTX 4090을 아주 좋은 가격에 구하게 돼서, 제 로컬 워크스테이션에서 AI 에이전트의 세계로 깊숙이 빠져보려고 합니다. 현재 홈랩으로 Dell Optiplex 6대를 돌리고 있는데, 아직 AI 관련은 아무것도 없네요. k8s에 로컬 AI 에이전트를 설정하는 방법에 대한 문서를 알려주실 분 계신가요?
이 목적으로 kgateway를 사용하라는 말을 여러 번 들었는데, 그걸 꼭 써야 할지 100% 확신이 안 서네요. AI 에이전트를 호스팅하기 위한 아키텍처는 보통 어떻게 구성하나요?


