Ir al contenido principal

Databricks Data Privacy - Spanish

Este contenido proporciona una guía completa para gestionar la privacidad de los datos dentro de Databricks. Cubre temas clave como la arquitectura de Delta Lake, el aislamiento de datos por región, el cumplimiento de GDPR/CCPA y el uso de Change Data Feed (CDF). A través de demostraciones prácticas y laboratorios hands-on, los participantes aprenden a utilizar las funciones de Unity Catalog para proteger datos sensibles y garantizar el cumplimiento, lo que les permite salvaguardar la Integridad de los datos de manera efectiva.


Languages Available: English | 日本語 | Português BR | 한국어

Skill Level
Professional
Duration
4h
Prerequisites

En este curso, el contenido se desarrolló para participantes con las siguientes habilidades, conocimientos y aptitudes:

• Capacidad para realizar tareas básicas de desarrollo de código utilizando el workspace de Ingeniería de datos y ciencia de datos de Databricks (crear clusters, ejecutar código en Notebooks, usar operaciones básicas de notebook, importar Repos desde Git, etc.)

• Experiencia de programación intermedia con PySpark

• Extraer datos de una variedad de formatos de archivo y fuentes de datos

• Aplicar una serie de transformaciones comunes a Datos limpios

• Reorganizar y manipular datos complejos utilizando funciones avanzadas incorporadas

• Experiencia de programación intermedia con Delta Lake (crear tablas, realizar actualizaciones completas e incrementales, compactar archivos, restaurar versiones anteriores, etc.)

• Experiencia de nivel inicial en la configuración y programación de Pipelines de datos utilizando el Editor de Lakeflow Pipelines

• Experiencia de nivel inicial en la definición de Apache Spark™ Declarative Pipelines con PySpark

• Ingerir y procesar datos utilizando Auto Loader y la sintaxis de PySpark

• Procesar feeds de change data capture con la sintaxis APPLY CHANGES INTO

Outline

Almacenamiento seguro de datos

• Cumplimiento Normativo

• Privacidad de datos


Unity Catalog

• Conceptos y componentes clave

• Audite sus datos

• Aislamiento de datos

• Demo: Protección de datos en Unity Catalog


Seguridad de Datos PII

• Seudonimización y anonimización

• Resumen y mejores prácticas

• Demo: Seguridad de datos de PII


Datos en transmisión y CDF

• Captura de datos modificados

• Eliminación de datos en Databricks

• Demo: Procesamiento de registros desde CDF y propagación de cambios

• Laboratorio: Propagating Changes with CDF Lab

Inscripción a clases públicas

Si su empresa ha adquirido créditos de servicio (Success Credits) o cuenta con una suscripción de aprendizaje, por favor complete el formulario de Solicitud de Capacitación. De lo contrario, puede registrarse a continuación.

Solicitud de clase privada

Si su empresa está interesada en capacitación privada, envíe una solicitud.

Ver todas nuestras opciones de inscripción

Registration options

Databricks ofrece modalidades de aprendizaje para acompañarlo en todo su recorrido.

Runtime

A tu propio ritmo

Rutas de aprendizaje personalizadas para roles y trayectorias profesionales de datos, analítica e IA, con videos a pedido.

Regístrese ahora

Instructors

Instruido por expertos

Cursos públicos y privados impartidos por instructores expertos en sesiones de medio día o dos días.

Regístrese ahora

Learning

Aprendizaje combinado (Blended Learning)

Sesiones semanales dirigidas por un instructor, junto con opciones a tu propio ritmo, para todos los estilos de aprendizaje, optimizando la finalización y la retención del conocimiento. Visite la pestaña “Catálogo de suscripciones” para comprar.

Comprar ahora

Scale

Skills@Scale

Oferta de capacitación integral para clientes a gran escala que incluye elementos para todos los estilos de aprendizaje. Consulte con su ejecutivo de cuenta para obtener más detalles.

Próximas clases públicas

Building Reliable Conversational Agents with Genie - Spanish

Este curso le enseña a diseñar, crear y mantener un Databricks Genie Space, una interfaz de lenguaje natural que permite a los usuarios de negocio formular preguntas sobre datos gobernados y obtener respuestas basadas en SQL sin necesidad de escribir código.

Aprenderá cómo se integra Genie en la familia de productos de IA/BI de Databricks y cómo traduce el lenguaje natural en consultas SQL fiables. El curso se centra en los aspectos clave para crear un Genie Space que ofrezca resultados precisos, coherentes y dignos de confianza.

Seguirá un flujo de trabajo integral, desde la comprensión de los datos de origen y la definición de puntos de referencia hasta la configuración y el perfeccionamiento de un Genie Space, utilizando el conjunto completo de herramientas de curación del Knowledge Store. Estas herramientas incluyen metadatos, sinónimos, coincidencia de prompts, lógica SQL, ejemplos de consultas e instrucciones de texto.

También aprenderá a compartir Genie Spaces con usuarios de negocio a través de Databricks One, a comprender cómo se aplica automáticamente la gobernanza de Unity Catalog y a utilizar la supervisión y los comentarios de los usuarios para mejorar continuamente la calidad a lo largo del tiempo.

Al finalizar el curso, será capaz de crear y gestionar un Genie Space listo para producción que ofrezca análisis conversacionales de autoservicio y gobernados a gran escala.

Nota: Databricks Academy está pasando a un formato basado en cuadernos para las sesiones presenciales en el entorno de Databricks, dejando de utilizar presentaciones de diapositivas para las clases. Puedes acceder a los cuadernos de las clases en el entorno de laboratorio de Vocareum.

Paid
4h
Lab
instructor-led
Associate

Advanced Machine Learning with Databricks - Spanish

Este curso está dirigido a científicos de datos y profesionales de machine learning y consta de dos módulos de cuatro horas.

Machine Learning at Scale

En este curso, adquirirás conocimientos teóricos y prácticos sobre la arquitectura de Apache Spark y su aplicación a cargas de trabajo de machine learning dentro de Databricks. Aprenderás cuándo utilizar Spark para la preparación de datos, el entrenamiento de modelos y la implementación, al mismo tiempo que obtendrás experiencia práctica con Spark ML y las APIs de Pandas en Spark. Este curso te introducirá en conceptos avanzados como el ajuste de hiperparámetros y el escalado de Optuna con Spark. Este curso utilizará características y conceptos presentados en el curso asociado, como MLflow y Unity Catalog, para el empaquetado y la gobernanza integral de modelos.

Advanced Machine Learning Operations

En este curso, recibirás una comprensión integral del ciclo de vida del machine learning y MLOps, con énfasis en las mejores prácticas para la gestión de datos y modelos, pruebas y arquitecturas escalables. Cubre los componentes clave de MLOps, incluidos CI/CD, la gestión de pipeline y la separación de entornos, al tiempo que presenta las herramientas de Databricks para la automatización y la gestión de infraestructura, como Declarative Automation Bundles (DABs), Lakeflow Jobs y Model Serving. Aprenderás sobre monitoreo, Métricas personalizadas, detección de deriva, estrategias de despliegue de modelos, pruebas A/B y los principios de los sistemas MLOps confiables, proporcionando una vista holística de la implementación y gestión de proyectos de ML en Databricks.

Nota: Databricks Academy está pasando a un formato basado en cuadernos para las sesiones presenciales en el entorno de Databricks, dejando de utilizar presentaciones de diapositivas para las clases. Puedes acceder a los cuadernos de las clases en el entorno de laboratorio de Vocareum.

Paid
8h
Lab
instructor-led
Professional

¿Preguntas?

Si tiene alguna pregunta, consulte nuestra página de Preguntas frecuentes (FAQ).