주요 컨텐츠로 이동
APACHE SPARK™ 선언형 파이프라인

신뢰할 수 있는 데이터 파이프라인을 간편하게 실행

자동화된 안정성과 기본 내장 데이터 품질로 batch및 스트리밍 ETL을 간소화합니다.
lakedflow declarative pipelines
최고의 팀은 지능형 데이터 파이프라인으로 성공합니다
장점

체계화된 데이터 파이프라인 모범 사례

필요한 데이터 변환을 선언하기만 하면 나머지는 Spark 선언형 파이프라인이 처리합니다.

효율적인 수집

프로덕션에 바로 사용할 수 있는 ETL 파이프라인을 구축하는 첫 단계는 수집입니다. Spark Declarative Pipelines를 사용하면 데이터 엔지니어, Python 개발자, data scientists 및 SQL 분석가가 데이터를 효율적으로 수집할 수 있습니다. Databricks Platform에서 배치, 스트리밍, CDC 등 Apache Spark™가 지원하는 모든 소스로부터 데이터를 로드할 수 있습니다.

인텔리전트 트랜스포메이션

단 몇 줄의 코드만으로 Spark 선언형 파이프라인은 배치 또는 스트리밍 데이터 파이프라인을 구축하고 실행하는 가장 효율적인 방법을 결정하며, 복잡성을 최소화하면서 비용 또는 성능에 맞춰 자동으로 최적화합니다.

자동화된 운영

Spark Declarative Pipelines는 기본적으로 제공되는 모범 사례를 코드화하고 종속성 관리, 확장 및 복구, 데이터 품질 규칙 등을 자동화하여 파이프라인 개발을 간소화합니다. Spark 선언적 파이프라인을 사용하면 엔지니어는 파이프라인 인프라를 운영하고 유지 관리하는 대신 고품질 데이터를 제공하는 데 집중할 수 있습니다.

기능

데이터 파이프라인을 단순화하도록 구축되었어요.

데이터 파이프라인을 구축하고 운영하는 것은 어려울 수 있어요. 하지만 꼭 그럴 필요는 없어요. Spark Declarative Pipelines는 강력한 단순성을 위해 구축되었으므로 단 몇 줄의 코드로 강력한 ETL을 수행할 수 있습니다.

Genie Code를 사용하여 자연스러운 대화를 통해 ETL 워크로드를 자동화하고, query를 최적화하며, 파이프라인을 구축하세요.

Agent-Ready Pipelines

기타 기능

통합 거버넌스 및 스토리지

Unity 카탈로그와 오픈 테이블 형식이라는 레이크하우스의 기본 표준을 기반으로 구축됐어요.

자세히

Serverless 컴퓨트

데이터 수집 시 최대 5배 향상된 가격 대비 성능과 복잡한 변환 작업 시 98%의 비용 절감 효과를 제공합니다.

자세히

작업 오케스트레이션

일련의 개별 Apache Spark™ 작업을 수동으로 정의하는 대신 변환을 정의하면 Spark 선언형 파이프라인이 올바른 순서로 실행되도록 보장합니다.

자세히

오류 처리 및 실패 복구

데이터 파이프라인 실행 오류의 원활한 복구

자세히

CI/CD 및 버전 관리

개발, 테스트 및 프로덕션 환경에서 파이프라인을 격리하도록 구성을 손쉽게 지정할 수 있습니다.

자세히

파이프라인 모니터링 및 옵저버빌리티

데이터 리니지, 업데이트 기록, 데이터 품질 보고를 비롯한 기본 내장 모니터링 및 관찰 기능.

자세히

유연한 refresh 일정

파이프라인 요구사항에 따라 지연 시간 또는 비용을 쉽게 최적화합니다.

자세히
사용 사례

데이터 파이프라인 간소화

declarative etl

소스, 변환, 대상을 단순하게 만드세요

선언적 프로그래밍은 단 몇 줄의 코드로 Databricks 플랫폼에서 ETL의 강력한 기능을 활용할 수 있음을 의미합니다.

가격

사용량 기반 가격 책정으로
지출 통제

사용한 제품에 대해서만 초 단위로 비용을 지불하세요.
관련 제품

더 자세히 알아보기

Databricks 플랫폼에서 다른 통합된 지능형 제품을 살펴보세요.

LakeFlow Connect

모든 소스로부터의 효율적인 데이터 수집 커넥터와 Databricks Platform과의 네이티브 통합은 통합 거버넌스를 통해 분석 및 AI에 대한 간편한 액세스를 지원합니다.

Lakeflow Jobs

ETL, 분석, Machine Learning 파이프라인을 위한 다중 작업 워크플로를 손쉽게 정의, 관리, 모니터링하세요. 데이터 팀은 다양한 지원 작업 유형, 심층적인 관측 기능 및 높은 안정성을 기반으로 모든 파이프라인을 보다 효과적으로 자동화 및 오케스트레이션하고 생산성을 높일 수 있습니다.

Genie Code

데이터 작업을 위한 자율적인 AI 파트너입니다.

레이크하우스 스토리지

모든 분석과 AI 워크로드에 대해 레이크하우스에 있는 모든 형식과 유형의 데이터를 통합하세요.

Unity Catalog

Databricks 플랫폼에 내장된 업계 유일의 통합된 개방형 데이터 및 AI 거버넌스 솔루션으로 모든 데이터 자산을 원활하게 관리하세요.

Databricks Platform

Databricks Platform이 데이터 및 AI 워크로드를 지원하는 방법을 알아보세요.

다음 단계 수행

Spark Declarative Pipelines

데이터 및 AI 기반 기업이 될 준비가 되셨나요?

변화의 첫 걸음 내딛기