Nuro, Gusto, Garner Health 같은 고객사들이 자동 모드(auto mode)를 활용해 더 안전하고 장시간 실행 가능한 코딩 워크플로우를 구축하는 방법을 소개합니다.
자동 모드가 이제 기본값으로 설정됩니다. Claude Code에서 에이전트가 실행하려는 명령마다 승인을 요청하는 대신, 분류기(classifier)가 각 작업을 평가해 잠재적으로 위험한 동작을 차단합니다.
자동 모드는 에이전트 기반 코딩에서 오랫동안 이어진 딜레마, 즉 속도 대 안전성의 균형 문제를 해결합니다. 모든 명령을 검토하면 사람이 중간에 개입할 수 있지만, 세션이 몇 시간씩 이어지거나 여러 세션이 병렬로 돌아가다 보면 오히려 그 감시 과정 자체가 병목이 됩니다. 권한 확인 절차를 완전히 건너뛰면 속도는 빨라지지만, 프롬프트 인젝션(prompt injection)이나 작업 범위 이탈, 그리고 프로덕션 리소스가 삭제되는 사고가 발생할 수 있습니다.
자동 모드는 이 간극을 대부분 메워줍니다. 내부 평가에서 분류기는 개발자가 직접 권한 프롬프트를 클릭하며 확인하는 것보다 위험한 작업을 더 많이 잡아냈으며, 서드파티 레드팀 테스트에서도 이 성능을 유지했습니다. 세션이 중단되는 빈도도 크게 줄어, 기존 기본값 대비 Claude가 중단 없이 작업을 이어가는 시간이 전체 Claude Code 사용 기준으로 9배 늘었습니다.
자동 모드가 실제 프로덕션 환경에서 얼마나 잘 동작하는지 살펴보기 위해, Nuro, Gusto, Garner Health 팀과 이야기를 나눴습니다. 이들이 자동 모드를 일상적인 도구로 삼아 속도와 안전성의 균형을 어떻게 맞추고 있는지 소개합니다.
범용 레벨 4 자율주행 기술을 개발하는 피지컬 AI 기업 Nuro는 2025년 말 Claude Code를 도입했고, 3월이 되자 사내에서 가장 많이 쓰이는 에이전트 기반 코딩 도구로 자리 잡았습니다.
자동 모드가 출시되기 전, 스태프 소프트웨어 엔지니어 Kai Zhou는 이미 내부 대안을 직접 만들고 있었습니다. 보류 중인 작업마다 소형 모델에 전달하고, 일상적인 90%는 자동 승인하되 민감한 작업은 Slack으로 라우팅해 사람이 검토하는 훅(hook) 방식의 프로토타입이었습니다. 이 프로토타입은 현실적인 긴장감을 해소하기 위한 것이었습니다. 엔지니어들은 승인 프롬프트를 계속 지켜봐야 하는 상황을 싫어했지만, 보안과 법적 관점에서 권한 확인을 완전히 건너뛰는 건 용납하기 어려웠기 때문입니다. 자동 모드가 출시되자 Kai는 그 사이드 프로젝트를 접었습니다.
지금은 모든 코딩 작업에 자동 모드를 사용합니다.
"계속 앉아서 승인 버튼을 클릭하고 싶지 않았어요," Kai가 말했습니다. "코딩 작업 100%에 자동 모드를 씁니다. 대부분은 자동 모드로 세 개, 네 개 세션을 동시에 띄워두고 필요할 때만 확인하는 방식으로 작업해요."
예외는 다른 팀과 연관된 작업입니다. 예를 들어 Claude Code가 대신 풀 리퀘스트(Pull Request)를 리뷰할 때는 인터랙티브 모드로 전환해 하나씩 직접 확인한 뒤 전송합니다.
자동 모드가 아무런 제약 없이 동작하는 것도 아닙니다. Nuro는 스킬(skills)을 적극 활용하며, 재귀적 삭제처럼 특히 위험한 명령은 설정에서 아예 차단해 두었습니다. 분류기는 이러한 가드레일 안에서 판단을 내립니다.
그러나 자동 모드가 가져온 더 큰 변화는, 엔지니어가 퇴근한 뒤에도 작업이 계속 실행될 수 있다는 점입니다. 특히 Kai의 팀은 자율주행 스택의 평가 지표를 최적화하는 장시간 리서치 에이전트를 자동 모드로 돌리고 있습니다. 에이전트가 명확하고 측정 가능한 신호를 기반으로 스스로 반복 개선할 수 있는 작업들입니다.
밤새 에이전트는 평가 스위트가 플래그한 거짓 음성(false negative)을 분석하고, 제안서를 작성하고, 실험을 실행한 뒤 결과를 계속 개선해 나갑니다. 이 방식은 명확한 평가 기준이 있는 모든 작업에 적용할 수 있습니다. Nuro의 다른 팀은 특정 바이너리의 메모리 사용량을 줄이는 데 같은 방식을 활용하고 있는데, 지표 자체가 에이전트에게 개선되고 있는지 아닌지를 알려주기 때문입니다.
"얼마 전에 밤 10시에 에이전트를 실행했는데, 새벽 5시까지 계속 돌아가더니 아침에 PR 세 개를 내놨어요," Kai가 말했습니다. "정말 인상적이라고 생각해요. 이런 작업 방식은 자동 모드만 가능해요."
중소기업 기술 분야의 선도 기업인 Gusto에서 자동 모드로의 전환은 보안 강화를 위한 선제적 조치로 시작되었습니다.
사내 AI Dev Tools 팀에서 일하는 Martin Emde는 권한 피로(permission fatigue)가 팀 속도를 저하시키는 것을 지켜봤습니다. 자동 모드 덕분에 통제력이나 보안을 포기하지 않고도 동일한 속도를 유지할 수 있었고, 엔지니어링 전반에 자동 모드가 자리를 잡으면서 전체적인 권한 처리 부담도 눈에 띄게 줄었습니다.
Martin은 12월 이후 자동 모드를 주력으로 2,425개의 Claude Code 세션을 실행했습니다. 폴더 접근 승인 때문에 막히던 크로스 레포 작업이 이제는 막힘 없이 진행되고, GitHub, Slack, Jira의 일일 노트를 취합하는 작업처럼 사람이 지켜보지 않아도 되는 작업도 자동으로 돌아갑니다. 팀 자체 분석에 따르면, 2026년 5월 중순 이후 세션 기록의 약 10%에서 자동 모드의 차단 기록이 확인됐습니다. 분류기가 실질적인 역할을 하면서도 정상적인 작업을 방해하지 않는다는 증거입니다.
"자동 모드 덕분에 속도와 통제 사이에서 더 안전한 균형을 찾을 수 있었습니다," Martin이 말했습니다. "반복적인 프롬프트를 없애고 안전성을 타협하지 않으면서도 생산성을 높일 수 있었어요. 자동 모드가 적절한 타이밍에 차단한다는 게 눈으로 확인되니, 빠르게 움직일 수 있다는 자신감이 생겼습니다."
Gusto의 AIT Cloud Engineering 팀원인 Chad Kunsman은 반대 방향에서 같은 결론에 도달했습니다. 그의 업무인 엔드포인트 조사, 로그 감사, 커넥터 관리, 여러 MCP 서버에 걸친 문서 수집은 밤새 실행되는 방식이 아니라 20분 단위의 짧은 작업으로 이루어집니다. 그가 원한 건 더 긴 실행 시간이 아니었습니다. 권한 우회(bypass permissions)처럼 손이 덜 가는 방식을 원했지만, 잘못된 프롬프트나 프롬프트 인젝션이 뚫릴 위험은 피하고 싶었습니다.
"프롬프트 인젝션 방어 기능과, 실제 수행 중인 작업이 원래 요청과 일치하는지 확인하는 방식을 보면, 권한 우회보다 안전하고 권한 프롬프트보다 훨씬 빠른 선택지라는 게 분명합니다," Chad가 말했습니다.
분류기가 개입하는 드문 경우에도 Chad는 그 판단이 적확하다고 말합니다. "멈춰 세울 때는 이유가 납득이 됐어요. 원래 요청에서 벗어나고 있었고, 그 시점에 확인을 요청한 거죠. 전혀 틀린 판단이 아니었습니다."
Chad도 가장 민감한 작업에서는 자동 모드를 해제합니다. Terraform, AWS, 라이브 API에 대한 직접 POST 호출처럼 프로덕션 인프라를 다루는 세션에서는 편집 승인(accept edits) 모드로 전환해 각 도구 호출을 직접 확인합니다. "절약하는 시간과 실수가 발생할 가능성, 그리고 그 실수가 얼마나 치명적일지를 함께 따져봐야 해요," 그가 말했습니다. "결국 발생한 일에 대한 책임은 본인에게 있습니다."
이러한 판단은 더 넓은 심층 방어(defense-in-depth) 체계 안에서 이루어집니다. Gusto는 MCP 트래픽을 도구 가드와 프롬프트 검사 기능을 갖춘 관리형 프록시 레이어를 통해 라우팅합니다. 자동 모드가 판단을 내리기 전에, 에이전트는 이미 엄격하게 제한된 권한 범위 안에서 동작합니다.
헬스케어 기술 기업 Garner Health는 2월에 전 직군 550명 전원을 대상으로 Claude Code를 도입했습니다. Salesforce, Zendesk, Snowflake 등 핵심 시스템과 연동되어 있으며, 직원들은 반복적인 업무를 자동화하는 데 주당 약 2시간을 쓰도록 권장받고 있습니다.
자동 모드 이전에는 이 규모 자체가 부담이었습니다. Garner의 플랫폼 엔지니어링 매니저 Evan Magnussen은 승인된 명령어 목록을 일일이 관리하고, 파이프 명령이 거부되는 상황을 반복해서 지켜봐야 했던 권한 관리를 지루한 악순환이라고 표현합니다.
지금은 Evan을 비롯한 대부분의 동료들이 코드베이스 조사부터 MCP를 통한 외부 연동 관리까지, 모든 세션에서 자동 모드를 사용합니다.
"자동 모드가 있었기에 엔지니어링 조직 전체를 위한 표준화된 소프트웨어 개발 생명주기를 구축할 수 있었습니다," Evan이 말했습니다. "직원들 입장에서는 짐을 하나 덜어낸 느낌이에요. 더 이상 에이전트를 몇 시간씩 지켜보지 않아도 되니까요."
이 생명주기는 표준화된 스킬을 플러그인 형태로 엮어서 운영됩니다. 에이전트가 작업을 받으면 접근 가능한 컨텍스트를 탐색하고, 컨텍스트 파일을 레포지토리에 커밋한 뒤, Evan이 '대립적 리서치(antagonistic research)'라고 부르는 과정을 통해 자신의 가정을 검증하고, 구현 단계로 넘어갑니다. 스스로 찾을 수 없는 컨텍스트가 필요할 때만 사람에게 확인을 요청합니다. 리서치 집약적인 단계들은 자동 모드 이전에는 불가능했다고 Evan은 말합니다.
기본 설정에서 분류기는 별도 튜닝이 거의 필요하지 않았습니다. Evan이 유일하게 조정한 부분은 Nuro의 Kai와 같습니다. Slack 메시지나 이메일 전송처럼 다른 사람과의 소통이 수반되는 작업은 자동 모드가 승인하지 않도록 설정했습니다.
"다른 사람과 소통할 때 Claude가 제 대신 알아서 행동하는 건 원하지 않아요," 그가 말했습니다. 핵심 지식재산을 다루는 팀들, 즉 자동 모드 이전에 권한 건너뛰기를 가장 회의적으로 봤던 팀들은 분류기에 주입되는 프롬프트를 각자 업무에 맞게 더 허용적으로 또는 더 제한적으로 조정하는 방법을 익혔습니다.
다른 기업에 도입을 권한다면 어떻게 하겠냐는 질문에 그의 조언은 이렇습니다. 적극적으로 도입하되, 엔지니어의 자율성을 보장하면서도 안전한 배포를 담보할 수 있는 적절한 통제 체계를 함께 구축하라고 말합니다. "각자 알아서 워크플로우를 만들고, 텔레메트리(telemetry)가 전혀 없다면 굉장히 위험할 거예요," Evan이 말했습니다. "텔레메트리가 있고, 비교적 표준화된 워크플로우를 구축해 놨기 때문에 훨씬 자신 있게 운영할 수 있습니다."
Claude Code에서 자동 모드를 지금 시작해 보세요.