Monitoring and Optimizing Apache Spark Workloads on Databricks - Japanese

このコースでは、セキュアなデータガバナンス、アクセスコントロール、リネージトラッキングのためのUnity Catalogを中心に、スケーラブルなデータワークフローのためのレイクハウスアーキテクチャとメダリオン設計を探求します。カリキュラムには、Delta Lakeを使用した信頼性の高いACID準拠のパイプラインの構築も含まれます。パーティショニング、キャッシング、クエリチューニングなどのSpark最適化テクニックを検証し、パフォーマンスモニタリング、トラブルシューティング、効率的なデータエンジニアリングとアナリティクスのベストプラクティスを学び、現実世界の課題に取り組みます。

Languages Available: English | 日本語 | 한국어

Skill Level

Associate

Duration

Prerequisites

プログラミングの基礎知識
Pythonに精通している
SQLクエリの基本的な理解（SELECT、JOIN、GROUP BY）
データ処理の概念に精通している
SparkやDatabricksの経験は問いません

Outline

Databricks上のApache Sparkワークロードの監視と最適化

Apache SparkとDatabricks
Delta LakeでApache Sparkを使う
デモ: Delta Lakeの紹介
ラボ: Delta Lakeの紹介
Apache Sparkの最適化
デモ: Apache Sparkの最適化
ラボ: Apache Sparkの最適化

Public Class Registration

If your company has purchased success credits or has a learning subscription, please fill out the Training Request form. Otherwise, you can register below.

Customer registration Partner registration

Private Class Request

If your company is interested in private training, please submit a request.

Request Private Training

See all our registration options

Registration options

Databricks has a delivery method for wherever you are on your learning journey

Self-Paced

Custom-fit learning paths for data, analytics, and AI roles and career paths through on-demand videos

今すぐ登録

Instructor-Led

Public and private courses taught by expert instructors across half-day to two-day courses

今すぐ登録

Blended Learning

Self-paced and weekly instructor-led sessions for every style of learner to optimize course completion and knowledge retention. Go to Subscriptions Catalog tab to purchase

Purchase now

Skills@Scale

Comprehensive training offering for large scale customers that includes learning elements for every style of learning. Inquire with your account executive for details

Upcoming Public Classes

Building ETL Pipelines with SQL - Japanese

このコースでは、Databricks Data Intelligence Platform で純粋な SQL を使用して、本番運用に対応した ETL パイプラインを構築する方法を学びます。受講者は、増分インジェストのための Auto Loader を使用したストリーミングテーブル、Silver-to-Gold 変換のための増分更新を伴うマテリアライズドビュー、宣言型 SCD タイプ 1 およびタイプ 2 ディメンション管理のための AUTO CDC (FLOW AUTO CDC)、および本番オーケストレーションのための SQL ファイルタスクを使用した Lakeflow ジョブについて学習します。このコースでは、メダリオンアーキテクチャ(ブロンズ → シルバー → ゴールド)を通じて、現実的な小売データセットに従います。

注記：Databricks Academyでは、Databricks環境内での教室セッションをノートブック形式に移行し、講義用スライドデッキの使用を終了します。講義ノートブックはVocareumラボ環境でアクセス可能です。

Machine Learning Practitioner

Generative AI Application Deployment and Monitoring - Japanese

このコースでは、生成AIアプリケーションのデプロイ、運用化、モニタリングの方法について詳しく説明します。このコースは、モデルサービングなどのツールを使用して生成AIアプリケーションを展開するスキルを習得するのに役立ちます。ベストプラクティスや推奨されるアーキテクチャに従って生成 AI アプリケーションを運用化する方法についても説明します。最後に、このコースではレイクハウスモニタリングを使用した生成AIアプリケーションとそのコンポーネントのモニタリングの概念について説明します。

Languages Available: English | 日本語 | Português BR | 한국어

Machine Learning Practitioner

Agent Evaluation on Databricks - Japanese

このコースでは、MLflow の評価frameworkを使用して AI エージェントを体系的に評価する方法を学び、従来のソフトウェアテストでは対処できない非決定論的 AI システム固有の課題に対処します。学生は、正確性や安全性などの一般的な基準のための組み込みのジャッジ、ビジネス固有の要件のためのガイドラインのジャッジ、特殊なニーズのためのカスタムジャッジなど、さまざまな評価アプローチを実装する方法を学びます。このコースでは、キュレーションされたデータセットを使用したオフライン評価とオンラインの本番モニタリングの両方をカバーし、MLflow のトレース機能を使用してエージェントの実行パターンを理解し、さまざまなタイプの関係者から人間によるフィードバックを収集する実践的な経験を積むことができます。実践的なデモンストレーションとラボを通じて、受講者はAIエージェント開発ライフサイクル全体を通じて継続的な品質改善を推進する評価workflowsを作成するスキルを身に付けます。

注意：Databricks Academyでは、Databricks環境内でのクラスルームセッションをノートブックベースのフォーマットに移行しており、スライドデッキを用いた講義は廃止されます。講義用ノートブックには、Vocareumラボ環境からアクセスできます。

Languages Available: English | 日本語 | Português BR | 한국어