Puedes leer todo sin registrarte. Solo crearemos un perfil anónimo cuando decidas guardar tu progreso.
Lección 2 de 5
Plano de control y plano de datos
El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.
- Duración
- 17 min aprox.
- Objetivo
- El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.
- Siguiente paso
- Continuar con la siguiente lección
Ver detalles del módulo
Data Intelligence Platform y arquitectura lakehouse
Construye un modelo mental preciso de almacenamiento, cómputo, gobierno y superficies de trabajo.
- Explicar la separación entre storage y compute
- Relacionar Delta Lake, Unity Catalog y motores de ejecución
- Elegir la superficie adecuada para cada carga
02ImplementaciónPlano de control y plano de datos
El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.
+
Plano de control y plano de datos
El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.
Mostrar prerrequisitos
- Dificultad
- Associate
- Prerrequisitos
- Ninguno obligatorio
El plano de control contiene servicios de interfaz, APIs, configuración y orquestación. El plano de cómputo alberga los recursos que ejecutan Spark o SQL y acceden al almacenamiento mediante las identidades configuradas.
En serverless, Databricks gestiona el plano de cómputo y su red; en compute clásico, la organización controla más elementos de la red y de las instancias. Esta diferencia afecta tiempo de arranque, responsabilidad operativa y controles de conectividad, no la ubicación lógica de las tablas en Unity Catalog.
Modelo mental
Un despliegue Databricks se entiende mejor como dos ámbitos de responsabilidad coordinados. El plano de control mantiene la experiencia del producto: configuración del workspace, APIs, definiciones de Jobs y coordinación de recursos. El plano de cómputo ejecuta instrucciones y accede a datos con una identidad autorizada. Esta división no significa que todo dato de usuario viaje al plano de control ni que el plano de cómputo decida permisos por sí mismo. El modelo mental útil sigue una solicitud: una persona o servicio declara qué ejecutar, el control plane autentica y orquesta, y el compute plane materializa el trabajo cerca de las fuentes gobernadas, sujeto a red e identidad.
Servicios administrados que ofrecen interfaz, APIs, configuración y coordinación de la plataforma.
Ubica correctamente autenticación y orquestación al analizar una arquitectura.Recursos donde drivers y executors procesan datos y materializan resultados.
Concentra las decisiones de red, capacidad e identidad efectiva del workload.Distribución explícita de tareas operativas y de seguridad entre Databricks, el proveedor cloud y el cliente.
Evita asumir que serverless elimina la obligación de gobernar datos, identidades y uso.{
"control_plane": ["workspace config", "jobs orchestration"],
"compute_plane": ["Spark execution", "data access"]
}Úsalo como lista de comprobación al revisar un diagrama de arquitectura.
Puntos clave
- El plano de control no es la ubicación de las tablas
- Serverless reduce la operación de infraestructura
- La conectividad debe diseñarse según el tipo de compute
Evita
- Afirmar que el plano de control ejecuta las transformaciones Spark
- Suponer que classic y serverless comparten idénticas opciones de red
Recuerdo activo