Base44가 복잡한 제품 개발 및 엔지니어링 작업에 Anthropic의 Claude Fable 5를 신뢰하는 이유를 소개한다.
Base44는 기술적 배경과 관계없이 누구나 풀스택 애플리케이션과 웹사이트를 만들 수 있는 바이브 코딩(vibe-coding) 플랫폼이다. 개발자가 없는 소규모 사업체부터 완성형 SaaS 제품 개발에 활용하는 기업까지, 다양한 고객층을 보유하고 있다.
Base44의 첫 번째 직원으로 입사해 현재 프로덕트를 총괄하는 요아브 올레브(Yoav Orlev)는, 이 일에서 가장 보람을 느끼는 순간 중 하나가 소규모 사업체들이 플랫폼으로 이뤄내는 성과를 목격할 때라고 말한다. 시간도, 예산도, 전문 지식도 없어 엄두를 못 냈던 일들, 예컨대 온라인 스토어 구축이나 식당 직원 교대 관리 앱 개발 같은 것들이다. 그의 팀이 추구하는 목표는 단 하나, 누구나 쓸 수 있는 사용성을 유지하면서도 플랫폼의 기능 범위를 계속 넓혀나가는 것이다.
Base44의 프로덕트·엔지니어링 팀은 항상 빠르게 움직여왔다. 특히 중소 규모의 기능을 출시할 때는 더욱 그랬다. 하지만 서로 맞물린 여러 부분에 영향을 미치는 플랫폼 핵심 영역의 변경 작업만큼은, 가장 시니어급 엔지니어에게만 맡길 수 있었다.
대표적인 병목 지점이 두 곳이었다. 하나는 Base44의 시스템 프롬프트와 수백 가지에 달하는 변형들이었다. 첫 번째 앱인지 다섯 번째 앱인지, 무료 사용자인지 구독자인지, 그리고 만들고 있는 앱의 카테고리와 기능에 따라 프롬프트가 달라지기 때문이다. 다른 하나는 네이티브 모바일 인프라 변경 작업으로, 모바일 전문 지식을 갖춘 엔지니어만이 다룰 수 있었다.
올레브에 따르면, 2025년 초 Base44 앱 생성 엔진의 기반을 담당해온 이전 Claude 모델들은 이런 작업을 맡기기 어려웠다. 예를 들어 모델이 오류에서 막히면, 코드베이스 어딘가에 이미 해법이 존재할 수 있다는 사실을 인식하고 그 부분을 찾아보는 대신, 눈앞의 지점만 계속 파고드는 경향이 있었다.
"다음에 무엇을 할지 결정하는 것이 핵심인데, 이전 모델들은 대부분 너무 단순한 방식으로 접근했습니다." 그의 말이다.
올레브는 Claude Fable 5가 소프트웨어가 어떻게 만들어지는지를 이해하는 것처럼 추론할 수 있었던 첫 번째 모델이었다고 말한다.
Base44는 새로운 Claude 모델이 나올 때마다 다양한 앱 유형에 걸쳐 평가(eval)를 진행하며 지연 시간, 비용, 빌드 오류를 측정한다. 게임 물리 엔진과 메커니즘을 어떻게 처리하는지 확인하기 위해 마인크래프트 클론 제작 같은 테스트도 함께 진행한다.
Claude Fable 5에서는 두 가지가 눈에 띄었다. 작업을 훨씬 적은 턴(turn)으로 완료했고, 첫 번째 프롬프트에서부터 이전 모델들이 건너뛰던 엣지 케이스(edge case)까지 포함한 더 완성도 높은 앱을 만들어냈다.
그래서 팀은 기존에 가장 시니어급 엔지니어들에게만 맡겼던 작업, 즉 Base44 시스템 프롬프트 재구축을 Fable 5에게 맡겨보기로 했다. 약 한 시간의 질의응답을 거친 뒤, Claude Fable 5는 네 시간 동안 독자적으로 작업을 진행해 팀이 필요로 하는 결과물의 90~95%를 내놓았다. 팀은 A/B 테스트 인프라를 활용해 그날 오후 바로 변경 사항을 측정하고 배포할 수 있었다. 작업 도중 Claude Fable 5는 Base44의 자체 평가에서 놓치고 있던 부분도 짚어냈다. 프롬프트 변경이 캐시를 깨뜨릴 수 있는데도 팀이 캐시 히트(cache hit)를 테스트하지 않고 있었던 것이다. 수백만 명의 사용자 규모에서 이는 곧 비용 증가로 이어진다. 모델이 맹점을 발견하고 스스로 바로잡은 셈이었다.
Claude Fable 5가 Base44 인앱(in-app) 에이전트 하네스(harness) 수정 작업에서 막혔을 때, 같은 문제가 코드베이스의 다른 곳에서 이미 해결됐을 가능성이 있다고 스스로 판단하고 해당 부분을 찾아가 해결책을 가져왔다. 올레브는 말한다. "'이 문제는 아마 다른 곳에서 이미 해결됐을 테니 거기서 찾아봐야겠다'는 식의 추론은 다른 모델에서는 자주 보지 못했습니다."
올레브는 Claude Fable 5와 협업하는 것을 시니어 엔지니어와 일하는 것에 비유한다. 주니어 엔지니어에게는 모든 단계를 일일이 설명하고 지속적으로 확인해야 하지만, 시니어 엔지니어에게는 목표와 이유만 간략히 설명하면 충분하다.
이런 활용은 엔지니어링 팀에만 그치지 않는다. 한 프로덕트 매니저가 Base44 내에 네이티브 모바일 앱 빌딩 기능을 도입하고자 Claude Fable 5에게 작업을 맡겼고, 약 두 시간 반 만에 프로덕션 이관에 필요한 결과물의 90% 수준을 갖춘 작동 환경을 얻어냈다.
Claude Fable 5 이전에는 이런 작업이 가능해지려면 Base44의 핵심 엔지니어 세 명이나 해당 분야 전문가의 시간이 날 때까지 기다려야 했다. 이제는 모델이 작업을 수행하는 동안, 올레브의 팀이 코드를 검토하고 테스트하며 승인한 뒤 배포하는 방식으로 운영된다.

Claude 모델의 역량이 발전함에 따라, Base44 팀의 플랫폼 목표도 함께 높아지고 있다. 팀은 Base44를 단순히 앱을 만드는 도구에서, 사용자가 만든 것을 관리하고 성장시키는 것까지 돕는 플랫폼으로 발전시키는 것을 목표로 한다. 현재 공개된 Base44 Superagents는 이러한 앱을 중심으로 워크플로를 실행한다.
Fable 5에게 복잡한 작업을 믿고 맡길 수 있다는 확신이 생기면서, 올레브는 이제 프로덕트 매니저와 디자이너들도 이전에는 뭔가 망가질까 봐 손대기를 꺼렸던 플랫폼 영역에 적극적으로 관여하도록 독려하고 있다.
"Fable 덕분에 우리는 더 과감한 결정을 내릴 수 있는 자신감을 얻었습니다. 이전이라면 솔직히 두려워서 시도조차 못 했을 새로운 영역과 가능성으로 제품을 가져가고 있습니다." 올레브의 말이다.
지금 시작하기: Claude Fable 5.