Ir al contenido principal

Catalog Management and Data Organization - Spanish

En este curso, aprenderás cómo diseñar, implementar y gobernar estructuras de catálogo y organización de datos a gran escala en la Databricks Data Intelligence Platform. Ofrece una vista comprensiva de Unity Catalog como la capa de gobernanza centralizada para un lakehouse empresarial. Dividido en cinco módulos, comienza ubicando Unity Catalog dentro del modelo de despliegue en nube — cubriendo el Account Console, creación de metastore y la jerarquía de roles de administrador. Luego traducirás topología organizacional (unidades de negocio, regiones y ambientes dev/QA/prod) en un diseño escalable de catálogo y esquema usando convenciones de nomenclatura, patrones de propiedad y delegación MANAGE. El curso luego cubre integración segura de almacenamiento con credenciales de almacenamiento, locaciones externas, la jerarquía de almacenamiento administrado, tablas administradas versus externas y UC Volumes para datos no tabulares. A continuación, aplicarás patrones de acceso y estrategias de aislamiento — la cadena GRANT de tres niveles, vinculación workspace-catálogo y políticas de Control de Acceso Basado en Atributos (ABAC) a nivel de esquema — para hacer cumplir protección de datos de grano fino a escala. Finalmente, el curso cierra con mejores prácticas para diseño de catálogo, automatización, permisos de menor privilegio y administración de acceso basada en grupos. 


Nota: Databricks Academy está realizando la transición a un formato basado en notebooks para las sesiones en el aula dentro del entorno de Databricks, descontinuando el uso de presentaciones de diapositivas para las clases. Puede acceder a los notebooks de las clases en el entorno de laboratorio de Vocareum.

Skill Level
Associate
Duration
4h
Prerequisites

En este curso, el contenido fue desarrollado para participantes con las siguientes habilidades/conocimientos/competencias:

• Familiaridad con la Databricks Data Intelligence Platform y operaciones básicas de workspace (crear clusters y SQL Warehouses, ejecutar SQL y Python en notebooks, navegación básica de notebook)

• Conocimiento práctico de fundamentos de Unity Catalog, incluyendo el namespace de tres niveles (metastore → catálogo → esquema → tabla) y los objetos securizables centrales (tablas, vistas, volúmenes, modelos)

• Experiencia práctica con workspaces habilitados para Unity Catalog, incluyendo crear y administrar catálogos, esquemas y tablas vía SQL

• Entendimiento sólido de conceptos de administración de identidad y acceso (usuarios, grupos, service principals, autenticación, autorización) y la diferencia entre administración a nivel de cuenta y workspace

• Conocimiento práctico de principios de gobernanza de datos — control de acceso, clasificación de datos, cumplimiento y auditoría — y cómo se mapean a características de plataforma

• Familiaridad con conceptos de almacenamiento de objetos en nube (S3, ADLS o GCS), incluyendo roles IAM, rutas a nivel de bucket y el papel de credenciales de almacenamiento en acceso cross-servicio

• Familiaridad introductoria con Delta Lake (tablas administradas vs externas, ciclo de vida Delta) y Lakeflow para orquestar flujos de trabajo de datos

• Experiencia práctica con arquitectura empresarial en organizaciones más grandes — topología multi-unidad-de-negocio, residencia de datos regional y separación de ambientes dev/QA/prod

Outline

Papel de Unity Catalog en Arquitectura en Nube

• Unity Catalog en la Nube

• De Cuenta a Habilitación de Workspace

• Demo: Recorrido del Account Console: Configurando/administrando un metastore


Diseñando y Estructurando Catálogos y Namespaces

• Del Modelo de Organización a Topología de Catálogo

• Propiedad, MANAGE y Delegación

• Herencia de Privilegios que Escala

• Vinculación Workspace-Catálogo y Solo Lectura

• Demo: Diseñando Catálogos y Esquemas

• Lab: Diseño de Catálogo Empresarial para una Organización Multinacional


Administración de Datos y Almacenamiento

• De Metadatos a Tablas y Volúmenes

• Locaciones Administradas y Credenciales de Almacenamiento

• Locaciones Externas y Catálogos Foráneos

• Demo: Credenciales de Almacenamiento y Locaciones Externas

• Lab: Integración de Almacenamiento en Nube y Administración de Datos


Patrones de Acceso, Estrategias de Aislamiento y FGAC en UC

• Aislamiento por Ambiente y Unidad de Negocio

• Privilegios en la Práctica

• Acceso de Grano Fino con RLS y Enmascaramiento

• ABAC: Cómo Se Ve el Éxito

• Validando Resultados y Señales de Auditoría

• Demo: Aislamiento de Catálogos, Patrones de Acceso y FGAC

• Lab: Aislamiento de Datos Empresarial y Gobernanza de Acceso


Mejores Prácticas
• Mejores Prácticas

Inscripción a clases públicas

Si su empresa ha adquirido créditos de servicio (Success Credits) o cuenta con una suscripción de aprendizaje, por favor complete el formulario de Solicitud de Capacitación. De lo contrario, puede registrarse a continuación.

Solicitud de clase privada

Si su empresa está interesada en capacitación privada, envíe una solicitud.

Ver todas nuestras opciones de inscripción

Registration options

Databricks ofrece modalidades de aprendizaje para acompañarlo en todo su recorrido.

Runtime

A tu propio ritmo

Rutas de aprendizaje personalizadas para roles y trayectorias profesionales de datos, analítica e IA, con videos a pedido.

Regístrese ahora

Instructors

Instruido por expertos

Cursos públicos y privados impartidos por instructores expertos en sesiones de medio día o dos días.

Regístrese ahora

Learning

Aprendizaje combinado (Blended Learning)

Sesiones semanales dirigidas por un instructor, junto con opciones a tu propio ritmo, para todos los estilos de aprendizaje, optimizando la finalización y la retención del conocimiento. Visite la pestaña “Catálogo de suscripciones” para comprar.

Comprar ahora

Scale

Skills@Scale

Oferta de capacitación integral para clientes a gran escala que incluye elementos para todos los estilos de aprendizaje. Consulte con su ejecutivo de cuenta para obtener más detalles.

Próximas clases públicas

Automated Deployment with Declarative Automation Bundles - Spanish

Este curso ofrece una revisión exhaustiva de los principios de DevOps y su aplicación a proyectos de Databricks. Comienza con una descripción general de los conceptos fundamentales de DevOps, DataOps, integración continua (CI), despliegue continuo (CD) y pruebas, y explora cómo estos principios pueden aplicarse a los Pipelines de Ingeniería de datos.

El curso se centra luego en el despliegue continuo dentro del proceso de CI/CD, examinando herramientas como la REST API, el SDK y el CLI de Databricks para el despliegue de proyectos. Aprenderás sobre los Declarative Automation Bundles (DABs) y cómo encajan en el proceso de CI/CD. Profundizarás en sus componentes clave, la estructura de carpetas y cómo agilizan el despliegue en diversos entornos de destino en Databricks. También aprenderás a añadir variables, modificar, validar, desplegar y ejecutar Declarative Automation Bundles para múltiples entornos con diferentes configuraciones mediante el CLI de Databricks.

Finalmente, el curso presenta Visual Studio Code como Entorno de Desarrollo Interactivo (IDE) para construir, probar y desplegar Declarative Automation Bundles de forma local, optimizando el proceso de desarrollo. El curso concluye con una introducción a la automatización de Pipelines de despliegue mediante GitHub Actions para mejorar el Flujo de trabajo de CI/CD con Declarative Automation Bundles.

Al finalizar este curso, estarás preparado para automatizar los despliegues de proyectos de Databricks con Declarative Automation Bundles, mejorando la eficiencia mediante las prácticas de DevOps.

Nota: Databricks Academy está pasando a un formato basado en cuadernos para las sesiones presenciales en el entorno de Databricks, dejando de utilizar presentaciones de diapositivas para las clases. Puedes acceder a los cuadernos de las clases en el entorno de laboratorio de Vocareum.

Languages Available: English | 日本語 | Português BR | 한국어

Paid
4h
Lab
instructor-led
Professional

Advanced Techniques with Apache Spark Declarative Pipelines - Spanish

Este curso explora Declarative Pipelines de Apache Spark de Databricks (SDP) para construir pipelines de transmisión de nivel de producción. Aprenderás patrones de diseño avanzados, aplicación robusta de calidad de datos e integración multiplataforma esenciales para la ingeniería de lakehouse en el mundo real.

A lo largo del curso, profundizarás en técnicas modernas de ingesta de datos y procesamiento, dominando herramientas como liquid clustering para la optimización del diseño y el patrón Multiplex Streaming para eventos con esquemas mixtos. Al finalizar los módulos, sabrás cómo manejar con confianza la evolución del esquema, automatizar change data capture (CDC) y garantizar la integridad de los datos.

A través de clases y demostraciones prácticas, podrás:

• Construir pipelines de múltiples flujos para ingestar datos de múltiples fuentes en una Tabla Bronce unificada.

• Aplicar liquid clustering y Expectativas de Calidad de Datos en las capas Plata y oro.

• Implementar el patrón Multiplex con Iceberg UniForm para el acceso a datos multiplataforma.

• Automatizar el seguimiento del historial SCD Tipo 2 mediante AUTO CDC INTO.

• Diseñar pipelines de cuarentena sin pérdida de datos para auditar y administrar registros no válidos.

Nota: Databricks Academy está pasando a un formato basado en cuadernos para las sesiones presenciales en el entorno de Databricks, dejando de utilizar presentaciones de diapositivas para las clases. Puedes acceder a los cuadernos de las clases en el entorno de laboratorio de Vocareum.

Languages Available: English | 日本語 | Português BR | 한국어

Paid
4h
Lab
instructor-led
Professional

¿Preguntas?

Si tiene alguna pregunta, consulte nuestra página de Preguntas frecuentes (FAQ).