주요 컨텐츠로 이동
의료 및 생명 공학

프로토타이핑 비용이 귀사의 AI 로드맵을 망치고 있습니다

에이전틱 데이터 엔지니어링이 구축 방식을 바꾸는 방법 — 그리고 한 헬스케어 기업이 이를 실제로 적용하며 얻은 교훈

작성자: Navdeep Alam , Zhe Sun

  • "프로토타이핑 비용(prototyping tax)", 파편화된 컨텍스트, 사일로화된 도메인 지식, API 경계 등은 아이디어 단계에서 작동하는 프로토타입 단계 사이에서 AI 이니셔티브를 지연시켜, 팀이 제품을 출시하기도 전에 추진 동력을 상실하게 만듭니다.
  • 비즈니스 시맨틱에 기반한 플랫폼 네이티브 에이전트(예: Databricks Genie + Unity Catalog)는 처음부터 에이전트에게 거버넌스가 적용된 컨텍스트를 제공함으로써 이러한 비용을 제거하며, 일반 코딩 에이전트의 정확도(56~72%) 대비 대략 절반의 비용으로 77%의 정확도를 달성합니다.
  • Abacus Insights는 HIPAA 등급 환경 내에 에이전트 기반 데이터 엔지니어링을 배포하여 신규 고객 온보딩 시간을 약 50% 단축하고 수동 데이터 매핑 작업을 40% 줄임으로써, 규제가 엄격한 산업에서도 이 접근 방식이 효과적임을 입증했습니다.

어떤 느낌인지 잘 아실 겁니다. 팀에서 AI 기반 파이프라인에 대한 훌륭한 아이디어를 냈습니다. 새로운 데이터 제품일 수도 있고, 아무도 수동으로 하고 싶어 하지 않는 워크플로우를 자동화하는 에이전트일 수도 있죠. 경영진 스폰서는 기대에 부풀어 있고, 엔지니어링 리드는 화이트보드에 아키텍처를 그립니다. 하지만 그 후... 몇 주가 흘러갑니다. 환경을 프로비저닝해야 하고, 팀 간에 컨텍스트가 손실됩니다. 프로토타입이 준비될 때쯤이면 경영진 스폰서는 다른 일로 관심을 돌렸고, 팀은 동력을 잃었으며, 이 이니셔티브는 더 새로운 다른 프로젝트에 밀려 조용히 사라집니다.

“한번 해보자”와 작동하는 프로토타입 사이의 이 간극을 우리는 '프로토타이핑 비용(prototyping tax)'이라고 부릅니다. 그리고 이는 그 어떤 모델의 한계보다 더 많은 AI 로드맵을 망치고 있습니다.

이 비용이 계속해서 누적되는 이유

병목 현상은 엔지니어가 코드를 얼마나 빨리 작성하느냐가 아니라, 조직 전체의 R&D 효율성에 있습니다. 전통적인 R&D는 사람이 탐색하도록 설계되었습니다. 대규모 소프트웨어 개발을 가능하게 만들었지만, AI 에이전트를 위해 구축된 것은 아닙니다. 세 가지 요인이 이 비용을 가중시킵니다.

  • 파편화된 컨텍스트. AI 에이전트가 여러 팀, 코드베이스, 도구에 걸쳐 작동할 때, 경계를 넘을 때마다 다음 단계에서 의존하던 컨텍스트가 유실됩니다. 에이전트가 더 바보가 되는 것이 아니라, 단지 흐름을 놓치는 것뿐입니다.
  • 장벽이 된 캡슐화. API는 사람을 위해 서비스를 구성하는 훌륭한 방법이었습니다. 하지만 엔드투엔드 워크로드 전반에서 추론할 수 있는 에이전트에게는 이러한 경계가 인터페이스가 아니라 보이지 않는 상태에서 넘어야 하는 장벽처럼 보이기 시작합니다.
  • 사일로화된 도메인 지식. 데이터 뒤에 숨겨진 의미(이 컬럼이 왜 존재하는지, 해당 상태 코드가 실제로 무엇을 의미하는지, 어떤 예외 상황이 중요한지 등)는 사람들의 머릿속과 팀 위키에만 존재합니다. 에이전트는 계약(contract)은 보지만 그 뒤에 숨겨진 의도는 보지 못합니다.

이러한 마찰은 빌더들이 끊임없이 보고하는 현상을 설명해 줍니다. 바로 AI 에이전트가 개인 프로젝트에서는 혁신적으로 느껴지지만, 프로덕션 코드베이스에서는 기대에 미치지 못한다는 점입니다. 에이전트가 더 바보가 된 것이 아닙니다. 단지 코드베이스가 에이전트가 탐색할 수 있도록 구축되지 않았을 뿐입니다.

이것이 바로 프로토타이핑 비용입니다. 저희가 지켜본 대부분의 AI 로드맵은 어떤 형태로든 이 비용을 지불하고 있습니다. 앞서 나가는 팀은 이 비용을 지불하지 않는 방법을 알아낸 팀들입니다.

다른 출발점

앞서 나가는 팀들이 더 뛰어난 에이전트를 사용하는 것은 아닙니다. 이들은 에이전트에게 단순한 구문(syntax)이 아닌 비즈니스 의미론(semantics)에 기반한 더 나은 출발점을 제공하고 있습니다. 에이전트가 이미 이러한 컨텍스트를 가지고 있으면, 구축 방식에서 두 가지 변화가 일어납니다.

의도가 곧 사양이 됩니다. 원하는 바를 명확하게 설명하는 것만으로도 시작하기에 충분하며, 누군가 구축을 시작하기 전에 사람이 의도를 기술적 요구사항으로 변환하던 기존의 번거로운 과정이 구축 세션 자체로 통합됩니다. 거버넌스가 루프 안으로 들어옵니다. 데이터 계보(lineage), 액세스 제어, 규정 준수 제약 조건이 구축이 진행되는 동안 실시간으로 적용되므로, 나중에 누군가 "잠깐만요, 이 데이터를 실제로 사용할 수 있나요?"라고 물어본 후에야 뒤늦게 확인하는 일이 없어집니다.

이 중 어느 것도 결과물의 소유자를 바꾸지는 않습니다. 다만 소유한다는 것의 의미가 달라집니다. 빌더는 작성자에서 아키텍트, 검토자, 가이드로 역할이 전환됩니다. 즉, 타이핑하는 시간은 줄어들고 의사 결정에 더 많은 시간을 쓰게 됩니다. 에이전트는 판단을 대체하는 것이 아니라 판단력을 배가시켜 주는 역할을 합니다.

변하는 것과 변하지 않는 것

여기서 중요한 역전 현상이 발생합니다. 전통적인 개발에서는 구축하기 전에 정렬(align)을 맞춥니다. 사양을 작성하고, 설계 문서를 공유하고, 요구사항 회의를 진행하지만, 이 모든 것은 현실의 시뮬레이션일 뿐입니다. 그런 다음 구현에 들어가고, 예상치 못한 문제에 부딪히고, 범위를 재조정하고, 다시 구현합니다. 그렇게 몇 주가 흘러갑니다.

에이전틱 개발에서는 구축을 통해 정렬이 이루어집니다. 가정을 작성하면 에이전트가 몇 시간 만에 작동하는 MVP를 구축하며, 사양은 그 반대가 아니라 작동하는 코드에서 자연스럽게 도출됩니다. 설계 문서는 상상이 아닌 현실에서 도출되므로 구조적으로 정확해집니다.

앞부분은 압축하고, 뒷부분은 유지하세요. 프로덕션 경로는 변경되지 않습니다. 동일한 CI/CD, 동일한 코드 검토, 동일한 엄격함이 적용됩니다. AI가 생성한 코드라고 해서 지름길은 없습니다. 달라지는 점은 동력을 잃기 전에 프로토타입이 안정화 및 배포(harden-and-ship) 단계에 도달한다는 것입니다.

루프가 작동하고 있음을 증명하는 지표

세 가지 지표를 통해 프로토타이핑 비용이 실제로 줄어들고 있는지, 아니면 단순히 일회성 워크숍만 잘 끝난 것인지 알 수 있습니다.

측정 대상

지표

중요한 이유

압축 속도

프로토타입 제작 시간(Time-to-prototype) - 아이디어에서 데모 가능한 MVP까지

선행 지표. 이 수치가 줄어들지 않는다면 루프가 제대로 작동하지 않는 것입니다.

압축 품질

초기 통과 수용률(First-pass acceptance rate) - 재작업 주기 없이 수용 기준을 충족한 비율(%)

에이전트가 단순히 빠른 것이 아니라 올바른 것을 구축했음을 증명합니다.

결과물의 내구성

PoC-to-production 비율 - 90일 이내에 CI/CD를 통해 배포된 비율(%)

후행 지표. 프로토타입이 그냥 사라지는 데모에 그치지 않음을 증명합니다.

팀별로 이 세 가지를 모두 추적하고, 지금 기준선(baseline)을 설정한 다음, 한 분기 동안의 추이를 지켜보세요. 프로토타입 제작 시간은 줄어들었지만 PoC-to-production 비율이 따라오지 못한다면, 제품을 배포하는 것이 아니라 데모만 만들어내고 있는 것입니다.

플랫폼 네이티브 에이전트가 판도를 바꾸는 부분

일반적인 코딩 에이전트는 구문, 파일, API를 다루는 데 정말 뛰어납니다. 하지만 이들이 모르는 것은 바로 귀사의 비즈니스입니다. 스키마와 그 의미, 거버넌스 모델, 배포 패턴 등을 알지 못하죠. 그래서 이들은 플랫폼이 이미 보유하고 있는 컨텍스트를 재구축하기 위해 토큰과 시간을 낭비하며 하나씩 탐색해 나갑니다.

이러한 탐색 과정이 얼마나 많은 비용을 초래하는지 보여주는 수치가 있습니다. 401개의 실제 데이터 작업에 대한 벤치마크에서 플랫폼 네이티브 데이터 에이전트는 작업당 약 절반의 비용으로 77%의 정확도를 기록한 반면, 주요 일반 코딩 에이전트는 56~72%에 그쳤습니다. 일반적으로 예상되는 품질과 비용 간의 절충(tradeoff)은 존재하지 않았습니다. 전문성이 결합되면서 정확도, 속도, 비용 절감이 동시에 실현되었습니다.

Databricks에서는 이것이 Unity Catalog에 직접 구축된 자율형 데이터 에이전트인 Genie Code와 에이전트에게 단순한 컬럼 이름이 아닌 비즈니스 의미를 제공하는 거버넌스형 시맨틱 레이어인 Genie Ontology의 결합으로 나타납니다. 에이전트는 테이블의 의미를 추측하는 대신 직접 읽어 들이며, 기본적으로 액세스 제어 및 거버넌스를 상속받습니다.

Abacus Insights: 헬스케어 분야의 에이전틱 데이터 엔지니어링

규제 산업만큼 출발점이 중요한 곳은 없습니다. 데이터가 민감하고 거버넌스를 타협할 수 없는 상황에서 일반 코딩 에이전트의 "탐색 및 추측" 방식은 시간만 낭비하는 것이 아니라 컴플라이언스 리스크를 초래합니다.

Abacus Insights는 HIPAA 등급의 에어갭(air-gapped) 제어 하에 6,500만 명 이상의 회원을 위한 헬스케어 데이터를 처리합니다. 이곳은 "탐색 및 추측" 방식이 단순한 시간 낭비를 넘어 리스크가 되는 전형적인 환경입니다. PHI를 함부로 다룰 수 없고, 거버넌스 모델을 추측할 수도 없으며, 잘못된 가정 하나하나가 단순한 오류 수정이 아닌 컴플라이언스 문제로 이어지기 때문입니다.

이들의 팀은 데이터 매핑 및 파이프라인 에이전트를 프로덕션에 도입했으며, 엔지니어들은 매일 Genie Code를 활용하고 있습니다. Genie Code는 처음부터 모든 것을 설명할 필요 없이 이미 데이터를 이해하고 거버넌스 내에서 작동하기 때문입니다. 그리고 이들은 이미 데이터 인텔리전스 작업 전반에서 의미 있는 효율성 향상을 경험하고 있습니다. 그 성과는 수치로 입증됩니다. 신규 고객 온보딩 시 첫 가치를 창출하는 데 걸리는 시간이 약 절반으로 단축되었으며, 데이터 매핑 및 파이프라인 구축에 드는 수동 작업이 약 40% 감소했습니다.

"저희 데이터 엔지니어들은 매일 수천만 건이 수집되는 수십억 건의 헬스케어 청구 기록이라는 엄청난 규모의 작업을 수행합니다. Genie Code는 저희의 판도를 바꾸어 놓았습니다. 이미 우리의 스키마, 거버넌스, 에어갭 요구사항을 이해하고 있습니다. 엔지니어들은 도구에 환경을 설명하는 데 시간의 절반을 허비하는 대신, 실제 문제를 해결하는 데 시간을 쓰고 있습니다. 40%의 수동 작업 감소는 시작에 불과합니다. 에이전트 기반 개발 노력을 더욱 심화함에 따라, 신규 고객 유치부터 첫 가치 창출까지의 속도가 획기적으로 빨라질 것이라 확신합니다."- Nav Alam, CTO, Abacus Insights

결론

프로토타이핑 비용은 실재하며, 측정 가능하고, 선택 사항입니다. 이를 깨달은 팀들은 구축하기 전에 정렬을 맞추기 위해 기다리지 않습니다. 이들은 구축하면서 정렬을 맞추고, 동력을 잃기 전에 배포합니다.

(이 글은 AI의 도움을 받아 번역되었습니다. 원문이 궁금하시다면 여기를 클릭해 주세요)

최신 게시물을 이메일로 받아보세요

블로그를 구독하고 최신 게시물을 이메일로 받아보세요.