DeepSeek-v4-flash가 이미지를 처리할 수 있게 해주는 프록시를 만들어서 Claude 구독료를 아끼게 됨
Built a proxy that lets DeepSeek-v4-flash handle images, so I can stop paying for Claude
핵심 요약
DeepSeek-v4-flash에 이미지 인식 기능을 추가해 Claude를 대체할 수 있는 프록시 도구 개발.
- 이미지 처리 프록시 — DeepSeek-v4-flash가 이미지를 인식하도록 중간에 비전 모델을 거치는 프록시를 구축함
- 비용 절감 효과 — Claude 구독료를 내지 않고도 저렴한 비전 모델을 활용해 멀티모달 기능을 구현함
- 범용 호환성 — OpenAI 호환 URL을 사용하는 모든 에이전트(Cursor, Trae 등)에서 즉시 사용 가능함
DeepSeek-v4-flash는 가격 대비 성능은 미쳤지만 멀티모달이 아니라서, 에이전트가 스크린샷이나 목업을 보내는 순간 맛이 감.
이걸 해결하려고 작은 프록시를 만들었음. 에디터와 모델 사이에 위치해서, 요청에 이미지가 포함되어 있으면 저렴한 비전 모델(GPT 5.6-luna 사용 중)로 이미지를 보내고, 그 결과를 DeepSeek에 전달해서 추론과 코드 생성을 하게 함. 나머지는 그냥 통과시킴.
결과적으로 Claude 구독료보다 훨씬 저렴하게 멀티모달 모델처럼 작동하는 드롭인 엔드포인트가 완성됨. OpenAI 호환 베이스 URL만 바꾸면 되니까 Codex, Cursor, Trae, OpenCode 등 어떤 에이전트에서도 작동함.
Repo: https://github.com/camilopenalver/deepseek-v4-flash-vision


