Saltar al contenido

Plataforma

Menú

Puedes leer sin crear un espacio. Créalo solo cuando quieras guardar.

Guardar progreso

Lección 2 de 5

Plano de control y plano de datos

El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.

17 min aprox.

Detalles

Data Intelligence Platform y arquitectura lakehouse

Construye un modelo mental preciso de almacenamiento, cómputo, gobierno y superficies de trabajo.

Reto observable

Ante un caso de negocio, dibuja una arquitectura lakehouse que separe almacenamiento, cómputo y gobierno, y justifica cada superficie con una decisión verificable.

Al terminar podrás
  • Explicar la separación entre storage y compute
  • Relacionar Delta Lake, Unity Catalog y motores de ejecución
  • Elegir la superficie adecuada para cada carga
Prerrequisitos
Ninguno obligatorio
Última revisión
25 ago 2026
Nivel
Associate
Ruta relacionada
core
Dominios blueprint
Databricks Intelligence Platform · Arquitectura
Estado
Revisión editorial interna
Fuentes principales
Data engineering with Databricks · Arquitectura lakehouse
Reportar un error
02
Implementación

Plano de control y plano de datos

El plano de control administra configuración y metadatos; el plano de cómputo procesa los datos dentro del perímetro definido para la cuenta.

El plano de control contiene servicios de interfaz, APIs, configuración y orquestación. El plano de cómputo alberga los recursos que ejecutan Spark o SQL y acceden al almacenamiento mediante las identidades configuradas.

En serverless, Databricks gestiona el plano de cómputo y su red; en compute clásico, la organización controla más elementos de la red y de las instancias. Esta diferencia afecta tiempo de arranque, responsabilidad operativa y controles de conectividad, no la ubicación lógica de las tablas en Unity Catalog.

JSONSeparar responsabilidades
{
  "control_plane": ["workspace config", "jobs orchestration"],
  "compute_plane": ["Spark execution", "data access"]
}

Úsalo como lista de comprobación al revisar un diagrama de arquitectura.

¿Qué cambia principalmente al elegir serverless?

Profundiza

Un despliegue Databricks se entiende mejor como dos ámbitos de responsabilidad coordinados. El plano de control mantiene la experiencia del producto: configuración del workspace, APIs, definiciones de Jobs y coordinación de recursos. El plano de cómputo ejecuta instrucciones y accede a datos con una identidad autorizada. Esta división no significa que todo dato de usuario viaje al plano de control ni que el plano de cómputo decida permisos por sí mismo. El modelo mental útil sigue una solicitud: una persona o servicio declara qué ejecutar, el control plane autentica y orquesta, y el compute plane materializa el trabajo cerca de las fuentes gobernadas, sujeto a red e identidad.

Control plane

Servicios administrados que ofrecen interfaz, APIs, configuración y coordinación de la plataforma.

Ubica correctamente autenticación y orquestación al analizar una arquitectura.
Compute plane

Recursos donde drivers y executors procesan datos y materializan resultados.

Concentra las decisiones de red, capacidad e identidad efectiva del workload.
Responsabilidad compartida

Distribución explícita de tareas operativas y de seguridad entre Databricks, el proveedor cloud y el cliente.

Evita asumir que serverless elimina la obligación de gobernar datos, identidades y uso.
Resumen

Puntos clave

  • El plano de control no es la ubicación de las tablas
  • Serverless reduce la operación de infraestructura
  • La conectividad debe diseñarse según el tipo de compute

Evita

  • Afirmar que el plano de control ejecuta las transformaciones Spark
  • Suponer que classic y serverless comparten idénticas opciones de red

Vista de lectura · sin ejecución

Learn Databricks

Learn Databricks · commit 08c378c

README.md

Módulo 01

Contenido del módulo