Gemini 웹과 Playwright를 OpenAI 호환 API로 바꿔서 유료 API 비용을 아껴본 사람 있나요?
Has anyone tried turning Gemini Web + Playwright into an OpenAI-compatible API to skip paid API purchases?
핵심 요약
Gemini 웹을 브라우저 자동화로 구동해 OpenAI API를 대체하려는 실험적 시도에 대한 의견을 구하는 글입니다.
- API 비용 절감 — 유료 API 대신 브라우저 자동화로 Gemini를 직접 구동함
- 기술적 구현 — FastAPI와 Playwright를 사용해 Gemini 웹을 OpenAI 형식으로 변환함
- 주요 한계점 — UI 변경 시 깨지는 안정성과 서비스 이용 약관 위반 위험이 존재함
- 확장성 고민 — 대규모 운영 시 발생하는 IP 차단 및 성능 문제에 대한 조언을 구함
항상 AI 기반 애플리케이션을 만들면서 비싼 API 비용을 피할 방법이 없을까 고민해왔음.
그래서 이런 생각을 해봤음: 공식 API를 사용하는 대신, 웹 브라우저를 자동화해서 Gemini와 직접 상호작용하게 하면 어떨까?
나는 OpenAI 호환 LLM 엔드포인트처럼 작동하지만, API 비용을 내는 대신 브라우저 자동화(Playwright)를 통해 Google Gemini 웹을 사용하는 FastAPI 서버를 만들었음. 모든 요청은 새로운 Gemini 탭을 열고, 프롬프트를 입력하고, 응답을 기다린 뒤 OpenAI의 JSON 형식으로 반환함. API 키도 없고, 과금도 없음. 그냥 브라우저가 Gemini를 구동하는 것임.
이 방식은 상태를 저장하지 않고(요청당 탭 하나), 수평 확장이 가능하며, 프롬프트 엔지니어링을 통해 도구 호출(tool-calling)도 지원함. 여전히 지연 시간(Latency)이 문제긴 하지만, 개인용 AI 에이전트 같은 프로젝트에는 충분히 잘 작동함.
이게 왜 흥미롭냐면, 돈을 쓰지 않고도 OpenAI 스타일의 앱을 프로토타입으로 만들 수 있기 때문임. 하지만 취약하다는 단점이 있음. Gemini UI가 바뀌면 선택자(selector)가 깨지고, 서비스 이용 약관(ToS)이나 속도 제한(rate-limit) 위험도 있음.
혹시 이걸 대규모로 시도해 본 사람 있음? 뭐가 제일 먼저 고장 났음? UI 변경이나 인증을 우회할 기발한 방법이 있을까? 경고나 팁, 경험담을 공유해 주면 정말 좋겠음.


