텍스트-이미지 생성 일괄 처리 방법
Batch create text to image generation
핵심 요약
ChatGPT 수준의 품질을 유지하면서 텍스트-이미지 생성을 자동화하는 워크플로우를 찾는 질문입니다.
- 일괄 생성 요구사항 — 수동 작업 없이 10~40개의 고품질 역사적 이미지 생성 희망
- 품질 저하 문제 — API 사용 시 수동 생성보다 디테일과 정확도가 떨어지는 현상 발생
- 프롬프트 확장 — API는 원본 프롬프트를 그대로 사용하여 ChatGPT의 내부 확장 기능이 누락됨
- 추천 도구 — ComfyUI와 LoRA를 활용한 Flux 모델 조합으로 일관성 확보 가능
텍스트-이미지 일괄 생성을 위한 더 나은 워크플로우를 찾고 있습니다.
제 목표는 매번 수동으로 복사/붙여넣기하고 생성 버튼을 누르는 대신, 개별 프롬프트로부터 10~40개의 이미지를 생성하는 것입니다.
저는 정확도(군복, 소품, 손, 장비, 시대적 디테일)가 중요한 역사 다큐멘터리 스타일의 이미지를 만들고 있습니다.
문제는 ChatGPT 이미지 생성(DALL-E / GPT 이미지)을 수동으로 사용할 때, 제가 사용할 수 있는 성공률은 85~90% 정도라는 점입니다.
API 접근 권한을 활용한 커스텀 HTML 일괄 처리 도구를 직접 만들어보기도 했고(Claude의 도움을 받았습니다), OpenAI 이미지 모델을 테스트하거나 Flux 같은 다른 옵션들도 실험해 봤지만, 일괄 처리/API 결과물은 훨씬 일관성이 떨어졌습니다. 아티팩트가 더 많고, 역사적 정확도도 떨어지며, 건질 만한 이미지의 비율도 낮았습니다.
꼭 한 번에 40개의 이미지가 필요한 건 아닙니다. 5~10개의 프롬프트라도 ChatGPT 수준의 품질을 유지하면서 일괄 처리할 수 있다면 작업 속도가 엄청나게 빨라질 것입니다.
다음 항목들을 위한 안정적인 워크플로우를 사용하는 분 계신가요?
- 텍스트 프롬프트 일괄 처리
- 파일명 자동 저장
- 일관된 고품질 이미지 출력
- 역사적/영화적 사실주의
수동 ChatGPT 이미지 품질과 실제로 동일한 수준을 보여주는 실용적인 워크플로우, 도구, 또는 API 설정을 찾고 있습니다.
