Saltar al contenido
Lakehouse LabLakehouse LabPreparación Databricks Data Engineer
Módulo 10 · Lección

Parámetros y task values

Contenido abierto

Puedes leer todo sin registrarte. Solo crearemos un perfil anónimo cuando decidas guardar tu progreso.

Lección 3 de 5

Parámetros y task values

Retries, if/else y for-each modelan recuperación y control flow sin duplicar lógica.

Duración
17 min aprox.
Objetivo
Retries, if/else y for-each modelan recuperación y control flow sin duplicar lógica.
Siguiente paso
Continuar con la siguiente lección
Ver detalles del módulo

Lakeflow Jobs: DAG, tareas y triggers

Convierte ejecuciones manuales en workflows parametrizados, idempotentes y observables.

Al terminar podrás
  • Diseñar un DAG con paralelismo seguro
  • Configurar tareas, parámetros y dependencias
  • Elegir triggers temporales o dirigidos por datos
Ver fuentes y revisión

Metadatos editoriales

Última revisión
21 jul 2026
Nivel
Associate + Professional
Ruta relacionada
core
Dominios blueprint
Working with Lakeflow Jobs · Orchestration
Estado
Revisión editorial interna
Fuentes principales
Lakeflow Jobs · Control flow
Reportar un error
03
Operación

Parámetros y task values

Retries, if/else y for-each modelan recuperación y control flow sin duplicar lógica.

Mostrar prerrequisitos
Dificultad
Associate + Professional
Prerrequisitos
m09
Reportar un error en esta lección

Retry atiende fallos transitorios si la tarea es idempotente; if/else evalúa una condición y for-each repite sobre una lista acotada.

Una rama no sustituye validación de datos y un bucle masivo puede crear demasiadas tareas.

Modelo mental

Retries recuperan fallos transitorios; if/else elige una rama por una condición; for each repite una tarea parametrizada sobre una colección acotada. Son primitivas de control flow, no sustitutos de lógica de datos ni de un diseño idempotente. Un retry seguro presupone que volver a ejecutar la tarea no duplica efectos. La condición debe depender de un valor pequeño y estable, no del estado invisible de una sesión. Un loop necesita límite de concurrencia, identidad por elemento y estrategia para fallos parciales. Modelar estos caminos en Jobs hace visibles intentos y ramas; esconderlos en un gran notebook reduce observabilidad y obliga a repetir trabajo ya correcto.

Retry

Nuevo intento automático de una tarea fallida bajo una política de número, intervalo y timeout determinada.

Solo es seguro cuando los efectos de la tarea son idempotentes y el error puede ser transitorio.
Condition task

Nodo de control que evalúa dos operandos y determina qué dependencias de outcome quedan habilitadas.

Hace visible una decisión operacional como publicar, cuarentenizar o detener según una métrica pequeña.
For each task

Control que ejecuta una tarea anidada por cada elemento de una colección parametrizada con concurrencia limitada.

Simplifica backfills o fan-out acotados sin confundir orquestación con paralelismo de filas de Spark.
YAMLRetry controlado
task_key: publish
max_retries: 2
min_retry_interval_millis: 60000
timeout_seconds: 1800

Clasifica errores permanentes para no reintentarlos inútilmente.

Puntos clave

  • Retry exige idempotencia
  • If/else decide rutas
  • For-each requiere límites

Evita

  • Retry de append no idempotente
  • For-each con miles de elementos

Recuerdo activo

¿Qué debe comprobarse antes de activar retry?

Borrador privado · solo en este navegador
5 lecciones pendientes

Vista de lectura · sin ejecución

Learn Databricks

Learn Databricks · commit 08c378c

README.md