Thomson Reuters 팀이 Claude Fable 5를 지식 노동 분야 AI의 결정적 진화로 평가하는 이유를 살펴본다.
글로벌 콘텐츠·기술 기업 Thomson Reuters는 175년 넘는 세월 동안 중요한 결정을 내리는 전문가와 기관을 위한 신뢰할 수 있는 콘텐츠와 기술을 구축해 왔다. 이 오랜 미션은 오늘날 법률, 세무, 회계, 컴플라이언스를 비롯한 고위험 전문 업무 분야의 AI 개발 방향을 결정하는 근간이 되고 있다.
Thomson Reuters의 CTO Joel Hron은 "우리는 정확성과 정밀성이 요구되는 전문직에 집중하는 기술 기업"이라고 말한다.
Thomson Reuters의 제품들은 해당 전문직군이 실제로 의존하는 핵심 참고 도구들이다. Westlaw와 Practical Law는 법률 리서치와 실무 가이드를 제공하며, 전문가급 법률 AI 플랫폼인 CoCounsel Legal은 법률 전문가가 더 나은 성과를 낼 수 있도록 설계됐다. 이 플랫폼이 제시하는 답변은 근거를 갖추고 있으며, 실질적인 가치를 제공한다. Hron은 4년 전 자신이 운영하던 스타트업이 Thomson Reuters에 인수되면서 합류했고, 이후 제품·기술·전략이 교차하는 지점에서 일해 왔다. 그는 그 기간 동안 AI가 소프트웨어 개발의 의미 자체를 바꿔 놓았다고 말한다. 올바른 기술 파트너를 선택하는 일이 그 어느 때보다 중요해진 것이다.
이 제품들을 구동할 LLM을 선택하는 기준은 유달리 구체적이다. Hron과 그의 팀은 새 모델을 평가할 때 "변호사가 실무에 활용하기 전에 거치는 전문가적 검토를 견딜 수 있는가"를 핵심 기준으로 삼는다.
법률 AI 도구를 만드는 기업은 많지만, 변호사가 자신의 이름을 걸고 쓸 수 있는 도구를 만드는 기업은 극히 드물다. Thomson Reuters가 범용 시스템이 쉽게 따라올 수 없는 이유는 세 가지다. 권위 있는 콘텐츠, 깊은 도메인 전문성, 그리고 워크플로우 통합이 그것이다.
Hron은 변호사가 Westlaw의 답변을 신뢰할 수 있는 이유가 모델 자체에 있지 않다고 말한다. 수십 년에 걸쳐 큐레이션된 판례법, 매일 그 콘텐츠를 주석하고 보강하는 전 세계 2,700명 이상의 도메인 전문가들의 작업, 그리고 Thomson Reuters가 Claude와 같은 모델 위에 구축한 평가 체계가 그 신뢰의 근거다. "최종 결과물에 대한 책임은 여전히 인간 전문가에게 있습니다."
Claude는 중요한 모델 파트너이지만, 전문가급 시스템은 Anthropic의 프런티어 모델과 Thomson Reuters의 권위 있는 콘텐츠, 깊은 도메인 전문성, 워크플로우 통합, 그리고 평가 인프라가 결합될 때 비로소 완성된다.
Thomson Reuters는 이러한 접근 방식을 'Fiduciary-Grade AI™'라고 부른다. 권위 있는 콘텐츠에 기반하고, 깊은 도메인 전문성으로 다듬어지며, 전문 업무 워크플로우에 직접 내재화된 AI다. 덕분에 결과물은 투명하고 검증 가능하며, 위험 부담이 높은 상황에서도 그 근거를 명확히 설명할 수 있다.
이러한 책임성 때문에 이 분야에서는 유창함보다 검증이 더 중요하다. Thomson Reuters는 법률 리서치를 에이전트 중심으로 재설계하면서, "단순 검색이나 검색 결과 반환에 그치지 않고 인용 출처 검증과 확인"을 핵심 기능으로 삼았다. 전문가가 직접 검토하고 확인하며 판단을 적용할 수 있도록, 인용 출처를 검증하고 소스를 명확히 제시하는 시스템이 요구된다.
이러한 변화는 고객들의 반응에서 실감할 수 있다. Hron에 따르면, "수십 시간이 걸리던" 리서치가 이제 "몇 분 안에" 완성된다. 전문가는 이를 평가하고 다듬어 바로 활용할 수 있는 고품질 출발점을 얻게 됐다. "딥 리서치는 법률 리서치의 패러다임을 바꿔 놓은 혁신입니다."
Thomson Reuters에게 에이전트 구축은 더 스마트한 챗봇을 만드는 일이 아니다. 기존 제품을 전달하는 방식을 근본적으로 바꾸는 일이다. Hron과 그의 팀은 에이전트가 Thomson Reuters가 기존에 독립형 소프트웨어로 제공하던 모든 도구를 사용할 수 있도록 훈련하는 데 집중했다. 이제 단일 에이전트가 수백 개의 사내 도구에 동시에 접근할 수 있다.
이 변화는 Thomson Reuters가 모델을 평가하는 방식도 바꿔 놓았다. Hron은 "Claude에 대한 핵심 평가 기준은 계획을 얼마나 잘 수립하고, 이 도구들을 얼마나 효과적으로 정확하게 활용하는가"라고 말한다.
CoCounsel Legal이 그 결과물이다. 이전에는 기능들이 순차적으로 실행됐지만, Claude Agent SDK 기반으로 재구축된 지금은 여러 도구와 콘텐츠 소스를 실시간으로 계획·위임·조율한다. 덕분에 전문가는 매 단계를 일일이 지시하는 대신 원하는 결과를 정의하는 데만 집중하면 된다. 고객 데이터는 철저히 보호되며, 서드파티 모델 학습에 사용되지 않는다.
Hron은 이 파트너십의 출발점을 두 회사가 처음 함께 일하기 시작했던 시점으로 거슬러 올라간다. Thomson Reuters는 Anthropic의 초기 엔터프라이즈 고객 중 하나였으며, 선택의 결정적 요인은 벤치마크 점수가 아니었다. "가장 크게 와닿은 것은 엔터프라이즈 AI를 구축하는 Anthropic의 방식이었습니다." Hron은 투명성, 안전성, 그리고 책임 있는 AI 개발 철학을 그 이유로 꼽았다. 첫 번째 성과는 법률 분야의 딥 리서치로, 양 팀이 Anthropic 엔지니어들이 Thomson Reuters가 이미 출시한 방식 그대로 도구를 사용하고 있다는 점을 발견하면서 함께 만들어 낸 결과물이다.

이러한 프로젝트들을 거치며 Hron의 팀은 Thomson Reuters가 모델을 신뢰하기 위해 반드시 충족해야 하는 네 가지 조건을 정립했다.
첫째, CoCounsel Legal 시스템의 일부로서 모델은 자체적으로 인용 출처를 검증해야 한다. 소스를 찾아내는 데서 그치는 것이 아니라, 인간이 최종 검토와 확인을 하기 전에 시스템 스스로 인용 내용을 검증해야 한다.
또한 이 시스템에서 모델은 긴 도구 호출 체인 전반에 걸쳐 일관성을 유지해야 한다. 작업이 길어질수록 더 뛰어난 컨텍스트 관리와 안정적인 도구 활용이 요구된다. 수많은 단계와 시스템을 가로지르면서도 맥락을 놓치지 않아야, 에이전트가 중간에 멈추지 않고 실제 작업을 완수할 수 있다.
모델은 답변만 내놓는 것이 아니라, 작업 과정에 사람을 참여시킬 수 있어야 한다. 가장 까다로운 업무에서 Hron이 원하는 것은 "에이전트가 혼자 한 번에 답을 내놓는 것에 의존하는 게 아니라, 인간이 결과물을 만들어 가는 과정에 함께 참여하도록 이끄는" 모델이다.
마지막으로, 모델은 Thomson Reuters 팀이 이전에는 엄두를 내지 못했던 업무를 가능하게 해야 한다. Thomson Reuters는 복잡한 법률 업무를 위한 고급 초안 작성 기능을 개발하고 있다. 전문가가 "며칠에서 몇 주를 쏟아야 완성할 수 있는" 신청서나 소장 작성이 그 예다. Hron에 따르면, 이 작업은 "항상 기존 모델이 감당하기에는 너무 많은 컨텍스트와 정밀함을 요구했다." Claude Fable 5와 함께라면, 이제 현실이 됐다.
Hron은 AI의 투자 대비 수익에 대해 남다른 시각을 갖고 있으며, 이는 모델 도입을 추진하는 다른 리더들에게도 참고할 만한 관점이다. "수익률 계산에 지나치게 최적화하려 들면, 나무만 보다가 숲을 놓치게 됩니다." 그는 비용 대비 성과를 따지기 전에, 먼저 팀이 문화적·사고방식의 전환을 직접 체감해야 한다고 강조한다. 그 전환이 일어나면 성과는 자연히 따라온다는 것이다.
물론 DORA(DevOps Research and Assessment)나 아이디어부터 프로덕션까지의 소요 시간 같은 전통적인 엔지니어링 지표도 여전히 추적한다. 그는 Claude 기반으로 구축한 내부 오류 수정 도구를 사례로 들었다. 이 도구 덕분에 프로덕션 장애의 근본 원인 분석이 기존 3시간에서 4분으로 줄었다. "몇 시간이 아닌 몇 분 안에 정상화할 수 있다는 것은 실질적인 차이입니다."
Hron이 말하는 더 근본적인 변화는 일 자체가 달라지고 있다는 것이다.
"코드를 한 줄씩 작성하는 행위가 더 이상 엔지니어의 본업이 아닙니다." Hron은 엔지니어들에 대해 이렇게 말한다. 이제 가장 중요한 역량은 시스템적 사고, 판단력, 그리고 감각이다. 그는 이러한 변화가 엔지니어링을 넘어 더 넓은 영역으로 퍼져나가고 있다고 본다. AI가 사람들을 "더 T자형 인재"로 만들어, 제품·디자인·재무 등 다양한 분야에 걸쳐 기여할 수 있게 한다는 것이다.

Hron과 그의 팀은 Claude Fable 5와 향후 Claude 모델로 더 많은 것을 이뤄내고자 한다. 더 장기적인 작업 수행, 향상된 컨텍스트 관리, 그리고 에이전트가 실행하는 작업 체인 전반에서 믿을 수 있는 도구 호출이 그 목표다.
그는 이 모델들을 자신의 업무에 직접 활용하는 데도 적극적이다. Claude Code 덕분에 "다시 훨씬 더 기술적으로 일할 수 있게 됐다"고 말한다. 몇 달간 손을 놓았던 코드베이스를 하루가 아닌 몇 분 만에 파악할 수 있게 됐고, Claude Cowork를 활용해 CFO나 전략 담당 임원의 시각에서 아이디어를 검증하기도 한다.
Claude Fable 5와 같은 모델들이 나아가는 방향이 바로 이것이며, 최종적으로 법정에서도 통해야 하는 업무를 다루는 Hron에게 이는 다음으로 밀어붙여야 할 프런티어다. 결국 전문가용 AI는 "거의 맞는 것"으로는 충분하지 않은 환경에서 작동해야 하기 때문이다.
지금 바로 Claude Fable 5를 시작해 보세요.