メインコンテンツへジャンプ

Get Started with Databricks for Data Engineering - Japanese

このコースでは、Databricks Data Intelligence Platform で基本的なデータエンジニアリングのワークフローを実行するために必要な基礎スキルを学びます。ワークスペースを操作し、Unity Catalog を使用しながら、データエンジニアが Databricks で日常的に活用する基本的な構成要素を習得します。


このコースは実践的な構成になっています。まずワークスペースの基本を理解し、その後、各トピックについてデモとラボのノートブックをペアで進めていきます。デモではインストラクターまたはガイド付きノートブックとともに概念を確認し、ラボでは学んだ内容を自分自身で実践します。


このコースで扱う内容は次のとおりです。

• Databricks Data Intelligence Platform の概要と、Databricks workspace、Unity Catalog、ノートブックの連携方法。

• Delta Lake テーブルの作成と管理。

• INSERT、UPDATE、DELETE によるデータの変更。

• Delta テーブルのバージョン履歴とタイムトラベルの確認。

• Lakeflow Connect のオプション(CTAS、アップロード UI、COPY INTO)を使用したデータの取り込み。

• ブロンズ、シルバー、ゴールド の各レイヤーを通じてデータを変換するメダリオンアーキテクチャのパイプラインの構築。

• Lakeflow ジョブ によるパイプラインの自動化。

• (ボーナス)Spark Declarative Pipelines を使用した宣言型パイプラインの構築。


Languages Available: English | 日本語 | Português BR | 한국어

Skill Level
Onboarding
Duration
3h
Prerequisites

• クラウドデータプラットフォームに関する基本的な知識。データベース、テーブル、クエリが何であるかを概念レベルで理解していること。

• SQL の実務的な知識。WHERE、GROUP BY、集計関数を含む SELECT 文を読み書きでき、INSERT、UPDATE、DELETE を理解していること。

• データの取り込み、変換、パイプラインといったデータエンジニアリングの概念に関する一般的な知識があると役立ちますが、必須ではありません。基礎についてはこのコースで扱います。

Self-Paced

Custom-fit learning paths for data, analytics, and AI roles and career paths through on-demand videos

See all our registration options

Registration options

Databricks has a delivery method for wherever you are on your learning journey

Runtime

Self-Paced

Custom-fit learning paths for data, analytics, and AI roles and career paths through on-demand videos

今すぐ登録

Instructors

Instructor-Led

Public and private courses taught by expert instructors across half-day to two-day courses

今すぐ登録

Learning

Blended Learning

Self-paced and weekly instructor-led sessions for every style of learner to optimize course completion and knowledge retention. Go to Subscriptions Catalog tab to purchase

Purchase now

Scale

Skills@Scale

Comprehensive training offering for large scale customers that includes learning elements for every style of learning. Inquire with your account executive for details

Upcoming Public Classes

Machine Learning Practitioner

Feature Engineering at Scale - Japanese

このコースでは、Databricks プラットフォーム上でエンドツーエンドの特徴量エンジニアリングパイプラインを設計、スケール、および運用化する方法について包括的な理解を深めます。カリキュラムは3つの段階的なモジュールで構成されています。Spark の分散実行と最適化の基礎をマスターすること、Auto Loader と宣言型 LakeFlow パイプラインを使用したスケーラブルなデータ取り込みの実装、そして Databricks Feature Store を活用した本番運用グレードの MLOps への発展です。

Catalyst オプティマイザと Spark UI を使用した Spark パフォーマンスのデバッグ、自動品質チェックを備えたブロンズ・シルバー・ゴールドのメダリオンアーキテクチャの構築、SparkML を使用したスケーラブルな特徴量の変換処理の実装など、実践的な学習体験に取り組んでいただきます。コースの集大成として、Online Feature Store を通じたリアルタイムの特徴量サービングのデプロイ、オンデマンド変換処理を伴う FeatureSpec の定義、そして Unity Catalog によるガバナンスとリネージトラッキングの適用を行います。

コース修了時には、エンタープライズスケールでの機械学習における完全な特徴量ライフサイクルを管理する能力を身に付け、パフォーマンスが高く、信頼性があり、ガバナンスが整備された、本番運用に対応したパイプラインを設計できるようになります。

注:SCORM講義ファイルの場合は、コンテンツの完了後にSCORMウィンドウを閉じてください。‘Next Lesson’ボタンはクリックしないでください。クリックすると、SCORMモジュールが完了済みとして記録されない可能性があります。

Paid & Subscription
3h
Lab
Professional

Get Started with Databricks: End to End - Japanese

このコースは、Databricks Data Intelligence Platform への包括的なハンズオン入門です。ワークスペースからスタートし、AI と機械学習の入門までを網羅する一連のエンドツーエンドの学習を通じて、Databricks でデータを扱うために必要な日常的なスキルを習得します。

コースの内容:

Databricks ワークスペース、コンピュートオプション、および Lakehouse と Genie のエクスペリエンスのナビゲーション。Unity Catalog を使用したデータの理解とインジェスト(ファイルのアップロードや Catalog Explorer を含む)。Databricks ノートブックでの作業と、Genie Code を使用したコードの記述およびデバッグ。SQL によるデータのクエリ、保存済みクエリの管理、ダッシュボードおよびビジュアライゼーションの構築。Genie Agents を使用した自然言語によるデータの探索。MLflow と Data Science Agent を使用した AI および機械学習の入門。

コースを修了すると、Databricks のナビゲーション、Unity Catalog でのデータの検索とガバナンス、AI アシスタンスを活用した SQL およびノートブックコードの記述、ダッシュボードの構築、Genie を使用したデータ探索を自信を持って行えるようになります。

注:SCORM講義ファイルの場合は、コンテンツを完了した後、SCORMウィンドウを閉じてください。「Next Lesson」ボタンはクリックしないでください。クリックすると、SCORMモジュールが完了として記録されない場合があります。

Languages Available: English | 日本語 | 한국어 | 普通话 | Português | Español | Français

Paid & Subscription
3h
Lab
Onboarding

Questions?

If you have any questions, please refer to our Frequently Asked Questions page.