주요 컨텐츠로 이동
파트너

Unity Catalog에서 Workday Data Connect 페더레이션 지원을 발표합니다

Unity Catalog가 엔드투엔드로 거버닝하는 제로 카피 액세스를 통해, Databricks에서 Workday HR 및 재무 데이터를 이동 없이 바로 쿼리해 보세요. 현재 Beta 버전으로 제공됩니다.

작성자: Dan Zuckerberg, John Spencer, Kosta Bizetic , 케이티 커미스키

  • Workday 데이터에 대한 제로 카피 액세스: 새로운 Workday Data Connect 커넥터(Beta)를 통해 Unity Catalog는 수집 파이프라인이나 중복 데이터 없이 클라우드 스토리지에서 Workday의 공유 Iceberg 테이블을 직접 읽을 수 있습니다.
  • 거버넌스 및 우수한 성능: 쿼리는 카탈로그, 스키마, 테이블 수준 권한, 실시간 Workday HR 및 재무 데이터에 대한 리니지를 포함한 Unity Catalog 거버넌스를 바탕으로 Databricks 컴퓨트에서 실행됩니다.
  • Genie를 통한 인력 및 재무 인사이트 확보: 새로운 Workday Data Connect 커넥터(Beta)를 사용하여 현재 인력 및 재무 데이터를 이동 없이 바로 쿼리하고, 이를 이미 Databricks에 있는 고객, 시장 및 운영 데이터와 결합할 수 있습니다. 또한 신뢰할 수 있고 거버넌스가 적용된 데이터를 바탕으로 Genie 기반의 자연어 탐색, 실시간 재무 계획, 인력 분석, AI를 활용할 수 있습니다.

Unity Catalog용 Workday Data Connect 페더레이션 커넥터의 공개 베타 출시 소식을 기쁘게 알려드립니다. 이 커넥터는 Databricks에 있는 다른 기업 데이터와 함께 Workday HR 및 재무 데이터가 필요한 데이터 플랫폼 및 분석 팀을 위해 구축되었습니다. 이제 Workday Data Connect가 정식 출시(GA)됨에 따라, Databricks는 이 새로운 제로 카피(zero-copy) 기능을 Databricks Data + AI Platform에 도입합니다.

이번 출시는 Databricks가 Workday Data Cloud 출시 파트너로 선정되었던 Workday Rising 2025에서 발표된 파트너십을 기반으로 합니다. 이번 출시를 통해 Databricks는 Workday Data Cloud의 출시 Data & AI 플랫폼 파트너 중 최초로 네이티브 Workday Data Connect 페더레이션 커넥터를 공개적으로 제공하는 파트너 중 하나가 되었으며, Workday의 제로 카피 데이터 액세스를 Databricks Data + AI Platform으로 직접 확장합니다.

데이터 팀은 Lakehouse Federation을 통해 데이터의 중복 복사본을 유지하지 않고도 Databricks Data + AI Platform에서 직접 Workday Data Cloud의 HR 및 재무 데이터를 쿼리할 수 있습니다. 이 데이터가 Unity Catalog를 통해 제공되면, 팀은 Databricks SQL, AI/BI, 노트북 및 Genie를 사용하여 다른 기업 데이터와 함께 현재 Workday 데이터를 탐색할 수 있습니다. 이를 통해 HR 및 재무 팀은 거버넌스가 적용된 방식으로 신뢰할 수 있는 데이터로부터 시의적절한 답변과 의사 결정을 이끌어낼 수 있습니다.

Workday Data Connect 페더레이션의 작동 방식

이 커넥터는 관리자에게 Workday 공유부터 거버넌스가 적용된 Databricks 쿼리에 이르는 간결한 경로를 제공합니다:

  1. Workday 관리자가 Workday Data Cloud를 통해 승인된 HR 및 재무 테이블을 공유하고, Workday Integration System User에게 읽기 권한을 부여합니다.
  2. Databricks 관리자가 Unity Catalog에서 하나의 OAuth 연결과 외부 카탈로그(foreign catalog)를 생성합니다.
  3. Unity Catalog이 외부 카탈로그 메타데이터를 확인하고, Databricks 컴퓨팅이 Workday에서 해당하는 데이터를 읽습니다.
  4. Databricks 관리자가 Unity Catalog의 강력한 테이블 수준 액세스 제어를 통해 외부 카탈로그에 대한 액세스를 제어합니다.
  5. 사용자는 Databricks에서 표준 SQL을 사용하거나 Genie를 통해 자연어로 결과 카탈로그를 쿼리합니다.

즉, 다음과 같은 작업이 가능합니다:

  • 수집 파이프라인 없는 데이터 액세스: Databricks에서 공유된 Workday 테이블을 검색하고 쿼리할 수 있습니다. 액세스는 읽기 전용이므로 Workday는 HR 및 재무 데이터의 기준 시스템(system of record)으로 유지됩니다.
  • Unity Catalog을 통한 액세스 제어: 카탈로그, 스키마, 테이블 수준의 권한을 적용하고, 다른 Unity Catalog 자산과 함께 외부 카탈로그에 제공되는 리니지(lineage) 및 감사 기능을 사용할 수 있습니다.
  • Databricks에서 분석 실행: Databricks가 Workday의 관리형 오브젝트 스토리지에서 직접 공유 데이터를 읽고 쿼리를 실행하므로, 팀은 Databricks SQL, AI/BI, 노트북, Genie 및 다운스트림 데이터와 AI 워크로드에 Workday 데이터를 활용할 수 있습니다.
“Databricks Workday Data Connect 페더레이션 커넥터는 Unity Catalog에서 Workday 데이터를 검색하고 카탈로그화할 수 있는 거버넌스가 적용된 제로 카피 방식을 제공합니다. 최신 인사 및 재무 데이터를 다른 기업 데이터와 함께 쉽게 액세스할 수 있도록 함으로써, 새로운 분석 및 AI 사용 사례를 가속화하는 데 도움이 되고 있습니다.”—Jonathan Rogers, 최고 정보 책임자(CIO), FactSet

거버넌스가 적용된 Workday 데이터로 구축할 수 있는 것

Workday의 인사 및 재무 데이터가 Unity Catalog로 페더레이션되면, 데이터를 전혀 이동하지 않고도 다른 기업 데이터와 결합할 수 있습니다:

  • Genie로 Workday 데이터 탐색: Unity Catalog에서 Workday HR 및 재무 데이터를 사용할 수 있게 됨에 따라, 팀은 Genie를 사용하여 인력 및 재무 트렌드에 대해 자연어로 질문할 수 있습니다.

실시간 재무 계획: Workday 재무 데이터를 Databricks의 시장, 리스크 또는 영업 데이터와 통합하여 예측 및 시나리오 계획을 지원하고 결산을 가속화할 수 있습니다.

  • 인력 분석: Workday 인력 및 인재 데이터를 운영 메트릭과 혼합하여 어떤 팀이 가장 큰 영향력을 발휘하는지 파악하고, 유지율 및 성과를 모델링할 수 있습니다.
  • 신뢰할 수 있는 데이터 기반의 AI 및 에이전트: 오래된 내보내기 파일이나 불안정한 맞춤형 통합 없이, 거버넌스가 적용된 최신 Workday 데이터를 Databricks의 AI 애플리케이션, 모델 및 에이전트에 공급할 수 있습니다.

데이터가 신뢰할 수 있는 단일 원천(source of truth)을 벗어나지 않고 Unity Catalog가 모든 읽기 작업을 제어하므로, HR 및 재무 팀이 요구하는 통제력을 유지하면서 신선하고 신뢰할 수 있는 데이터를 얻을 수 있습니다. 이를 통해 조직은 분석 및 AI 워크로드 전반에서 일관된 액세스 제어를 유지하면서 개방적이고 거버넌스가 적용된 데이터를 기반으로 엔터프라이즈 AI를 구축할 수 있습니다.

Workday 데이터를 Databricks로 가져오는 세 가지 방법

팀마다 필요한 Workday 데이터의 형태가 다릅니다. 이력 보고를 위한 영구 복사본, 온디맨드 조회, 또는 분석을 위한 거버넌스가 적용된 라이브 뷰 등이 있습니다. Databricks는 이제 세 가지 상호 보완적인 경로를 제공하므로, 모든 것을 단일 파이프라인으로 강제하는 대신 사용 사례별로 적합한 경로를 선택할 수 있습니다.

경로작동 방식데이터 이동가장 적합한 용도
Lakeflow Connect — Workday Reports, Workday HCM 및 Workday Activity LogsUnity Catalog의 Delta 테이블로 완전 관리형 증분 수집레이크하우스로 수집되는 데이터영구 복사본, 이력 추적(SCD2), 맞춤형 보고서 및 HCM 모듈에 대한 예약된 파이프라인
Workday Data Connect 페더레이션(신규, 베타)Workday 카탈로그를 Unity Catalog로 페더레이션, Databricks 컴퓨팅에서 쿼리 실행제로 카피, Workday Data Cloud에 사전 수집된 데이터로부터 제자리에서 읽기(read in place)Workday 카탈로그를 Unity Catalog로 페더레이션하고 데이터를 제자리에서 쿼리하려는 Workday Data Cloud 사용 고객.
Live Data Query — JDBC 연결Unity Catalog JDBC 연결을 통해 Workday Live Data Query로 발행되는 온디맨드 쿼리. 단, 기본 메타데이터를 Unity Catalog로 가져오지는 않음쿼리 시점에 가져옴Workday Data Cloud 데이터의 실시간 임시(ad-hoc) 조회.

세 가지 방법 모두 플랫폼에 네이티브로 제공됩니다. 즉, Unity Catalog에 의해 거버넌스가 적용되며 Databricks SQL, AI/BI, Genie 및 다운스트림 AI 애플리케이션과 에이전트에서 바로 사용할 수 있습니다. 이번 출시를 통해 Databricks는 Workday Data Cloud 데이터에 제자리에서 액세스할 수 있는 최신 방법으로 카탈로그 페더레이션을 도입합니다.

시작하기

Workday Data Connect 페더레이션을 활성화하려면 Workday 관리자와 Databricks 관리자 간의 간단한 협업이 필요합니다:

  1. Workday에서: 테넌트에 대해 Workday Data Connect를 활성화하고 Iceberg REST 카탈로그를 통해 쿼리하려는 테이블을 공유합니다.
  2. JWT Bearer Grant를 사용하여 API 클라이언트를 등록하고, 공개 키를 업로드한 다음, 공유 테이블에 대한 읽기 권한을 부여하는 역할의 주체(principal)로 Integration System User (ISU)를 등록합니다. Workday Data Lake 시작하기 및 Data Lake용 API 클라이언트 등록(JWT Bearer Grant)을 참조하세요.
  3. Databricks에서: 연결 및 외부 카탈로그를 생성한 다음, 권한을 부여하고 쿼리합니다. Databricks가 사용자를 대신해 Workday의 Iceberg REST 카탈로그와 OAuth 토큰 교환을 수행하므로, 사용자가 Workday 토큰 엔드포인트를 직접 관리할 필요가 없습니다.

요구 사항: Unity Catalog가 활성화된 워크스페이스 및 Databricks Runtime 19 이상 버전의 Databricks 컴퓨팅. 커넥터가 베타 버전이므로 워크스페이스 관리자가 미리 보기(Previews) 페이지에서 이를 활성화해야 합니다. 이 커넥터는 데이터를 Databricks로 수집하거나 복사하지 않으며, Workday용 Lakeflow Connect 수집 커넥터와는 별개입니다.

자주 묻는 질문(FAQ)

Databricks의 Workday Data Connect 페더레이션이란 무엇인가요?

Workday Data Connect 페더레이션은 현재 베타 버전인 Unity Catalog용 Lakehouse Federation 커넥터입니다. 이를 통해 Databricks는 클라우드 스토리지에서 직접 Workday의 공유 Iceberg 테이블을 읽어 Workday HR 및 재무 데이터를 제자리에서 쿼리할 수 있습니다. 수집 파이프라인이 필요 없으며 데이터의 중복 복사본도 생성되지 않습니다.

카탈로그 페더레이션은 쿼리 페더레이션과 어떻게 다른가요?

쿼리 페더레이션은 SQL을 외부 데이터베이스로 전송하고 해당 시스템의 컴퓨트에서 실행합니다. Workday Data Connect가 사용하는 카탈로그 페더레이션은 Workday의 Iceberg REST 카탈로그에서 테이블 메타데이터를 가져옵니다. 그런 다음 Databricks 컴퓨트가 Workday의 관리형 오브젝트 스토리지에서 데이터를 직접 읽어 쿼리를 자체적으로 실행합니다. 어떤 방식이든 Unity Catalog가 액세스를 제어합니다.

Workday 커넥터가 데이터를 Databricks로 복사하나요?

아닙니다. 액세스는 제로 카피 및 읽기 전용으로 이루어지므로 Workday Data Cloud가 인사 및 재무 데이터의 기준 시스템으로 유지됩니다. 이력 추적(SCD2)이 포함된 영구 복사본이 필요한 경우, 대신 Workday Reports 및 Workday HCM용 Lakeflow Connect를 사용하세요.

Databricks에서 Workday 데이터는 어떻게 관리되나요?

Unity Catalog는 페더레이션된 Workday 데이터에 대한 모든 쿼리를 제어합니다. 관리자는 카탈로그, 스키마 및 테이블 수준에서 권한을 설정할 수 있습니다. 리니지 및 감사는 다른 Unity Catalog 자산과 동일한 방식으로 작동합니다.

Workday 데이터를 Databricks로 가져오는 방법에는 어떤 것들이 있나요?

다음 세 가지 방법이 있으며, 모두 Unity Catalog에 의해 거버넌스가 적용됩니다.

  • Lakeflow Connect: 영구 복사본 및 예약된 파이프라인을 위해 Delta 테이블로 관리형 증분 수집을 수행합니다.
  • Workday Data Connect 페더레이션(Beta): 다른 엔터프라이즈 데이터와 조인된 Workday의 공유 Iceberg 테이블에 대한 제로 카피 분석을 제공합니다.
  • JDBC 연결을 통한 Live Data Query: 아무것도 저장하지 않는 온디맨드 실시간 조회를 수행합니다.

Workday 데이터를 Genie와 함께 어떻게 사용할 수 있나요?

Unity Catalog 외부 카탈로그를 통해 Workday Data Cloud 데이터를 사용할 수 있고 적절한 권한이 부여되면, 팀은 Genie에서 거버넌스가 적용된 다른 Databricks 데이터와 함께 이 데이터를 사용할 수 있습니다. 질문 예시는 다음과 같습니다.

  • 이번 분기에 인원 수가 가장 빠르게 증가한 코스트 센터는 어디인가요?
  • 지역 및 직군별로 퇴사율이 어떻게 다른가요?
  • 인력 변화를 수주액 또는 영업 비용과 비교하면 어떤가요?

Workday 데이터를 Databricks Data + AI 플랫폼으로 가져올 준비가 되셨나요?

(이 글은 AI의 도움을 받아 번역되었습니다. 원문이 궁금하시다면 여기를 클릭해 주세요)

최신 게시물을 이메일로 받아보세요

블로그를 구독하고 최신 게시물을 이메일로 받아보세요.