Nota
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare ad accedere o modificare le directory.
L'accesso a questa pagina richiede l'autorizzazione. È possibile provare a modificare le directory.
È possibile creare e gestire processi di notebook direttamente nell'interfaccia utente del notebook. Se un notebook è già assegnato a uno o più processi, è possibile creare e gestire le pianificazioni di tali processi. Se un notebook non è assegnato a un compito, è possibile creare un compito e una pianificazione per eseguire il notebook. Per altre informazioni sulla pianificazione dei processi, vedere Eseguire processi in base a una pianificazione.
Pianificare un'attività di notebook
Tip
Indicare a Genie Code (modalità agente) di eseguire questa operazione:
Schedule this notebook to run daily at 9am PST.
Per pianificare l'esecuzione periodica di un'attività del notebook:
Nel notebook fare clic
Pianificazione in alto a destra.
Se non esistono job per questo notebook, verrà visualizzata la finestra di dialogo Nuova pianificazione.
Se i processi esistono già per il notebook, nella finestra di dialogo Pianificazioni viene visualizzato l'elenco dei processi. Per aggiungere una nuova pianificazione, fare clic su Aggiungi pianificazione.
Nella finestra di dialogo Nuova pianificazione inserire un nome per l'attività facoltativamente. Il nome predefinito corrisponde al nome del notebook.
Selezionare Semplice per eseguire il processo in base a una pianificazione semplice, ad esempio ogni giorno o Avanzate per definire una pianificazione personalizzata per l'esecuzione del processo, ad esempio un'ora specifica ogni giorno. Usare gli elenchi a discesa per specificare la frequenza. Se si sceglie Avanzate, è anche possibile usare la sintassi cron per specificare la frequenza.
Nell'elenco a discesa Calcolo selezionare la risorsa di calcolo per eseguire l'attività.
Se il notebook è collegato a un SQL warehouse, il sistema di calcolo predefinito è lo stesso SQL warehouse.
Se l'area di lavoro è abilitata per Unity Catalog e i processi serverless sono abilitati, la scelta di calcolo predefinita è serverless.
Se si dispone dell'entitlement Consenti la creazione di cluster senza restrizioni , è possibile fare clic su Aggiungi nuovo cluster di processi per configurare e creare un nuovo cluster di processi.
È anche possibile selezionare una risorsa di calcolo all-purpose esistente.
Se utilizzi serverless, selezionare la modalità di prestazione. Vedere Selezionare una modalità di prestazioni.
Facoltativamente, in Altre opzioni è possibile specificare gli indirizzi di posta elettronica per ricevere notifiche sugli eventi del processo. Vedere Aggiungere notifiche in un processo.
Facoltativamente, in Altre opzioni, immettere i parametri da passare all'attività. Cliccare Add (Aggiungi) e specificare la chiave e il valore di ogni parametro. I parametri impostano il valore del widget del notebook specificato dalla chiave del parametro . Usare riferimenti a valori dinamici per passare un set limitato di valori dinamici come parte di un valore di parametro.
Cliccare su Crea.
Eseguire un'operazione di notebook
Per eseguire manualmente un processo del notebook:
- Nel notebook fare clic
Pianificazione in alto a destra.
- Fare clic
accanto al processo pianificato, quindi fare clic su Esegui immediatamente.
- Per visualizzare i dettagli dell'esecuzione del processo, fare clic sul nome del processo.
Visualizzare l'ultima esecuzione riuscita e aggiornare il notebook
Esistono diversi modi per visualizzare l'ultima esecuzione pianificata riuscita direttamente dall'interfaccia utente dei notebook:
- Fare clic su Pianifica in alto a destra. Passare il puntatore del mouse sulla pianificazione a cui si è interessati, quindi fare clic
Visualizzare l'ultima esecuzione riuscita.
- Fare clic
Visualizzazioni notebook e dashboard in alto a destra, quindi fare clic
Visualizzare l'ultima esecuzione riuscita per la visualizzazione notebook o la visualizzazione dashboard.
- Fare clic
Cronologia delle versioni nella barra laterale destra, quindi fare clic su Ultima esecuzione pianificata riuscita.
La visualizzazione del notebook dell'ultima esecuzione corretta mostra i risultati dell'esecuzione più recenti negli output delle celle.
- Per aggiornare il notebook all'ultima esecuzione, fare clic su Aggiorna notebook con esecuzione nella parte superiore.
- Per uscire da questa visualizzazione e tornare al notebook originale, fare clic su Modifica notebook.
Gestire le attività dei notebook pianificati
Per visualizzare i processi associati a questo notebook, fare clic Pianificazione. Viene visualizzata la finestra di dialogo Pianificazioni che mostra tutti i processi attualmente definiti per questo notebook. Per gestire i processi, fare clic
A destra di un processo nell'elenco.
In questo menu è possibile modificare la pianificazione, clonare il processo, visualizzare i dettagli di esecuzione del processo, sospendere il processo, riprendere il processo o eliminare un processo pianificato.
Quando si clona un processo pianificato, viene creato un nuovo processo con gli stessi parametri dell'originale. Il nuovo lavoro appare nell'elenco con il nome Clone of <initial job name>.
La modalità di modifica di un incarico dipende dalla complessità della pianificazione dell'incarico. Viene visualizzata la finestra di dialogo Pianifica o il pannello dei dettagli dell'attività, permettendo di modificare la pianificazione, il cluster, i parametri e così via. Vedere Automatizzare i processi con pianificazioni e trigger.
Ripristino delle sessioni per job serverless
Importante
Questa funzionalità è in versione beta. Gli amministratori dell'area di lavoro possono controllare l'accesso a questa funzionalità dalla pagina Anteprime . Vedere Gestire le anteprime di Azure Databricks.
Ripristina le variabili Python e la sessione Spark da un lavoro di calcolo serverless esegui in un nuovo notebook interattivo, così puoi fare il debug di un guasto o esplorare i risultati senza rieseguire l'intero lavoro. Azure Databricks cattura automaticamente lo snapshot per le run idonee. Il quaderno restaurato è una copia: le modifiche che fai non cambiano né il quaderno originale né il lavoro.
Per ripristinare lo stato, devi essere l'utente configurato per l'esecuzione dell'esecuzione.
Per ripristinare lo stato dopo una esecuzione del lavoro:
- Visualizza i dettagli dell'esecuzione del lavoro e apri la vista notebook dell'esecuzione.
- Clicca su Clona nel nuovo notebook, oppure Fai il Debug nel nuovo notebook in caso di esecuzione fallita.
- Azure Databricks crea un nuovo notebook chiamato
Job Run of <notebook name> at <timestamp> (Run <run ID>)nella cartella Home e ripristina le variabili Python e la sessione Spark della run su di esso. Una notifica mostra lo stato di esecuzione ripristinato nel notebook al termine del caricamento.
Il ripristino della sessione ricostruisce le variabili Python e la sessione Spark. Lo stato legato al processo dell'esecuzione originale, quali le risorse relative all'I/O, potrebbe non essere ripristinato. Se manca uno stato, riesegui le celle del quaderno per ricostruirlo. Quando si fa il debug di un lavoro eseguito con Genie Code, può anche ripristinare lo stato dell'esecuzione come parte della sua diagnosi.
Limitazioni
- Solo l'utente run-as può ripristinare lo stato di una run, e solo per compiti del notebook.
- Lo stato viene acquisito automaticamente quando un'esecuzione idonea non riesce, dura 30 minuti o più, viene annullata o supera il tempo limite. Le esecuzioni idonee usano il calcolo serverless con versione dell'ambiente 5 o successiva. La soglia di 30 minuti misura il tempo di esecuzione e non conta il tempo di attesa per il calcolo, quindi un'esecuzione che ha atteso il calcolo potrebbe non qualificarsi anche se il suo tempo totale supera i 30 minuti. Lo stato non viene catturato nel calcolo AI Runtime. Gli snapshot vengono conservati per 7 giorni dopo il completamento della corsa.
- Se un'attività del notebook utilizza valori provenienti da task a monte, tali input potrebbero non essere disponibili quando ripristini l'esecuzione singolarmente, fuori dal contesto del workflow.
- Il notebook ripristinato deve rimanere associato all'ambiente di calcolo serverless. Modificare il calcolo durante il ripristino impedisce che lo stato venga ripristinato.