Codex 덕분에 브라우저 기반 오픈소스 AI 영상 편집기를 '바이브 코딩'으로 만들었습니다
Thanks to Codex, I vibe-coded an open-source browser AI video editor with voiceovers, face detection, background removal, and talking avatars
핵심 요약
Codex를 활용해 음성 생성, 배경 제거, 아바타 기능 등을 갖춘 브라우저 기반 AI 영상 편집기를 개발했습니다.
- AI 영상 편집기 — 브라우저에서 작동하는 오픈소스 영상 편집 도구 개발함
- 주요 기능 — 음성 생성, 배경 제거, 아바타 생성 등 다양한 AI 기능 탑재함
- 기술 스택 — WebGPU와 ONNX Runtime을 활용해 브라우저 내 가속 지원함
- 바이브 코딩 — Codex를 활용해 아이디어를 빠르게 구현하고 반복 개선함
Codex를 사용해 '바이브 코딩'을 실험해 왔는데, 제가 만들고 있는 프로젝트를 공유하게 되어 기쁩니다. 바로 브라우저 기반의 오픈소스 AI 영상 편집기입니다.
Codex의 도움을 받아 아이디어를 탐색하고, 문제를 디버깅하고, 빠르게 반복하면서 여러 AI 기반 기능을 추가했습니다:
- 브라우저 기반 AI 음성 생성
- 얼굴 및 피사체 감지
- 인물 배경 제거
- 스마트 자막 배치 및 피사체 인식 크롭
- 자동 자막 및 타임라인 정렬
- JoyVASA 및 LivePortrait ONNX를 사용한 말하는 아바타 파이프라인
- 혼합 FP16 모델을 사용한 WebGPU 가속
- 로컬 타임라인 편집 및 브라우저 측 영상 내보내기
말하는 아바타 기능은 아직 실험 단계입니다. 가끔 불완전한 프레임이 생성될 수 있고, 초기 모델 로딩과 렌더링이 느릴 수 있습니다. 하지만 전체 파이프라인이 이제 브라우저 내부에서 실행되며, 속도와 안정성, 시각적 품질을 점진적으로 개선할 수 있을 것이라 생각합니다.
이 프로젝트는 아직 완벽과는 거리가 멀지만, 바로 그 점이 이 과정을 흥미롭게 만듭니다. 바이브 코딩 덕분에 아이디어를 훨씬 빠르게 작동하는 기능으로 바꾸고, 실제 문제로부터 배우며, 결과를 지속적으로 개선할 수 있었습니다.
이 프로젝트는 이제 오픈소스입니다:
GitHub:
https://github.com/MartinDelophy/ai-video-editor
라이브 데모:
https://video-editor.ai-creator.top
브라우저 ONNX 모델은 Hugging Face에서도 확인할 수 있습니다:
https://huggingface.co/haixin/timeline-studio-onnx-models
피드백, 아이디어, 버그 리포트, 기여를 해주시면 정말 감사하겠습니다. 특히 WebGPU, ONNX Runtime Web, LivePortrait, 브라우저 기반 영상 편집, 또는 말하는 아바타 기술을 다루시는 분들의 의견을 듣고 싶습니다.
이 프로젝트를 바이브 코딩하고 계속 발전시킬 수 있게 도와준 Codex에게 큰 감사를 전합니다. 아직 초기 단계지만, 어디까지 발전할 수 있을지 기대됩니다.



