Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Important
La reprise après sinistre gérée est soumise à des restrictions. Demandez l’accès auprès de votre équipe de compte Azure Databricks. Azure Databricks active la reprise d’activité gérée pour votre compte une fois votre demande acceptée.
Cette page fournit une référence pour la states table du replication schéma système, qui suit l’état de réplication de Azure Databricks récupération d’urgence managée (DR). Chaque ligne est un événement d’état pour un groupe de basculement, émis régulièrement et chaque fois que le groupe de basculement change. Utilisez ce tableau pour surveiller l’état actuel et historique de réplication de vos groupes de basculement, y compris le décalage de réplication et toutes les erreurs qui bloquent la réplication d’au moins une ressource.
Chemin d’accès de la table : system.replication.states
Comment lire le statut de la réplication
Les événements de statut sont émis à intervalles réguliers. Chaque événement rapporte l’état agrégé du groupe de basculement, le délai actuel, ainsi que toute erreur bloquant la réplication d’au moins un actif. Il ne liste pas quels objets individuels ont été répliqués avec succès.
Lorsque replication_lag_ms n’est pas null, tout ce qui n’est pas couvert par une erreur dans cet événement a été répliqué jusqu’à ce décalage. D’autres actifs dans le champ continuent de se répliquer et restent à jour face au décalage, même lorsque le errors tableau n’est pas vide. Pendant INITIAL_REPLICATION, avant que tous les actifs dans le champ d’application n’aient été répliqués une fois, replication_lag_ms peut être null: l’événement peut encore lister des erreurs de blocage, mais il ne mesure pas encore la complétude.
Les types d’actifs que DR géré ne prend pas en charge du tout n’apparaissent pas dans le tableau, ni comme un succès ni comme une erreur. Leur absence ne signifie pas qu’ils se sont reproduits. Consultez Limitations. Les éléments dans le champ de contrôle qui utilisent une fonctionnalité non prise en charge, tels que des filtres de lignes, des masques de colonne ou un contrôle d’accès basé sur des attributs (ABAC), apparaissent dans le tableau comme des échecs.
Pour confirmer qu’un actif spécifique existe dans le secondaire, inspectez l’objet à cet endroit. Comme les catalogues secondaires dans le cadre sont en lecture seule, Azure Databricks recommande un espace de travail séparé pour le moniteur en lecture seule dans la région secondaire. Voir Configurer la réplication.
Informations de référence sur le schéma de table d’états
Le states tableau utilise le schéma suivant :
| Nom de la colonne | Type de données | Description | Example |
|---|---|---|---|
event_id |
string | Identificateur unique de l’événement d’état. | ca886134-876c-4671-a38b-332edf48c602 |
event_time |
timestamp | Horodatage de l’émission de l’événement. | 2024-01-05T00:00:00.000+00:00 |
account_id |
string | ID du compte auquel appartient le groupe de basculement. | ca886134-876c-4671-a38b-332edf48c602 |
failover_group_name |
string | Nom complet du groupe de basculement. | accounts/account1/failover-group/group1 |
replication_state |
string | État de la réplication lorsque l’événement a été émis. Les valeurs possibles sont INITIAL_REPLICATION, , ACTIVECREATED, UPDATEDDELETEDFAILOVER_STARTEDFAILOVER_FINISHED, et .FAILOVER_ABORTED |
ACTIVE |
errors |
tableau | Lorsque replication_state est INITIAL_REPLICATION ou ACTIVE, une liste agrégée des erreurs qui bloquent la réplication d’au moins un actif, y compris le nombre d’éléments affectés par chaque erreur. Consultez les informations de référence sur les erreurs. |
Consultez les informations de référence sur les erreurs |
replication_lag_ms |
long | Millisecondes depuis la dernière réplication réussie de toutes les ressources dans l’étendue lorsque l’événement a été émis. Une null valeur indique qu’au moins une ressource n’a jamais été répliquée de la source vers le réplica. Une valeur croissante signifie que la récupération d’urgence ne peut pas répliquer au moins une ressource dans l’étendue, mais que les modifications apportées à d’autres ressources dans l’étendue continuent d’être répliquées. |
2323 |
effective_primary_region |
string | Région primaire du groupe de basculement au moment de l’émission de l’événement. | us-west-2 |
managed_assets |
struct | Ressources gérées par le groupe de basculement lorsque l’événement a été émis. Consultez la référence des ressources managées. | Consultez les informations de référence sur les ressources managées |
Informations de référence sur les erreurs
La errors colonne contient un tableau des erreurs qui bloquent la réplication. Chaque élément du tableau est un struct avec les champs suivants :
| Nom du champ | Type de données | Description |
|---|---|---|
error |
struct | Détails sur l’erreur. Contient error_class (chaîne), un nom de classe pour l’erreur ; parameters (map), des paramètres clé-valeur avec des détails sur l’erreur et message (chaîne), un message d’erreur lisible par l’homme. |
affected_assets_counts |
tableau | Une entrée par type de ressource affecté. Chaque entrée contient asset_type (chaîne), le type de la ressource affectée et failing_count (long), le nombre de ressources de ce type que l’erreur affecte. |
Informations de référence sur les ressources managées
La managed_assets colonne est un struct qui décrit les ressources gérées par le groupe de basculement lorsque l’événement a été émis. Elle contient les champs suivants :
| Nom du champ | Type de données | Description |
|---|---|---|
metastore_ids |
tableau | Les identifiants des métastores gérés par le groupe de basculement. |
workspace_sets |
tableau | L’espace de travail est géré par le groupe de basculement. Chaque entrée contient name (chaîne) et workspace_ids (tableau). |
catalogs |
tableau | Catalogues gérés par le groupe de basculement. Chaque entrée contient name (chaîne). |
Considérations relatives à la lecture du tableau
Prenez note des éléments suivants lorsque vous analysez la states table :
- Les données peuvent prendre jusqu’à 3 heures pour remplir une fois qu’un événement se produit.
- La table contient des événements pour tous les groupes de basculement dans le compte Azure Databricks.
Exemples de requêtes
La requête suivante retourne l’état de réplication le plus récent pour un groupe de basculement donné, y compris son décalage de réplication actuel replication_state, son décalage de réplication et toutes les erreurs bloquantes :
SELECT
event_time,
replication_state,
replication_lag_ms,
errors
FROM system.replication.states
WHERE failover_group_name = :failover_group_name
ORDER BY event_time DESC
LIMIT 1
La requête suivante retourne la distribution du décalage de réplication pour un groupe de basculement donné :
SELECT histogram_numeric(replication_lag_ms, 20) AS replication_lag_distribution
FROM system.replication.states
WHERE failover_group_name = :failover_group_name