Monitorowanie przebiegów potoków w usłudze Fabric Data Factory

W tym artykule przedstawiono sposób monitorowania przebiegów potoku. Niezależnie od tego, czy chcesz sprawdzić, jak przebiegają procesy, czy rozwiązać konkretny problem, możesz śledzić postępy, wcześnie wykrywać problemy i utrzymywać płynność pracy. Monitorowanie ułatwia wczesne przechwytywanie problemów i śledzenie przepływów pracy.

Monitorowanie przebiegów potoków

  1. Aby monitorować przebiegi potoku, umieść kursor nad potokiem w obszarze roboczym. Przycisk Więcej opcji (...) znajduje się po prawej stronie nazwy potoku.

    Zrzut ekranu przedstawiający miejsce znalezienia większej liczby opcji potoku.

  2. Wybierz pozycję Więcej opcji (...), aby wyświetlić listę opcji. Następnie wybierz pozycję Wyświetl historię uruchamiania. Ta akcja powoduje otwarcie wysuwanego okna po prawej stronie ekranu, które zawiera wszystkie ostatnie przebiegi i ich statusy.

    Zrzut ekranu przedstawiający, gdzie wybrać opcję Wyświetl historię uruchamiania.

    Zrzut ekranu przedstawiający najnowszą listę przebiegów.

  3. Wybierz pozycję Przejdź do monitora na poprzednim zrzucie ekranu, aby wyświetlić więcej szczegółów i filtrować wyniki. Użyj filtru, aby znaleźć określone uruchomienia potoku na podstawie kilku kryteriów.

    Zrzut ekranu przedstawiający opcje filtrowania.

  4. Wybierz jeden z przebiegów potoku, aby wyświetlić szczegółowe informacje. Możesz wyświetlić wygląd potoku i wyświetlić więcej właściwości, takich jak identyfikator przebiegu lub błędy, jeśli uruchomienie potoku nie powiodło się.

    Zrzut ekranu przedstawiający ostatnie szczegóły przebiegu.

  5. Jeśli masz więcej niż 2000 uruchomień działań w potokach, wybierz pozycję Załaduj więcej , aby wyświetlić więcej wyników na tej samej stronie monitorowania.

    Zrzut ekranu przedstawiający aktywności z wyróżnionym polem tekstowym 'Pokaż więcej'.

    Zrzut ekranu wszystkich załadowanych szczegółów przebiegu aktywności.

  6. Użyj filtru, aby filtrować według stanu działania lub opcji Kolumna , aby zmienić kolumny wyświetlane w widoku monitorowania.

    Zrzut ekranu opcji filtru aktywności.

    Zrzut ekranu przedstawiający opcje kolumny.

    Możesz również wyszukać nazwę działania, typ działania lub identyfikator przebiegu działania za pomocą pola Filtruj według słowa kluczowego.

    Zrzut ekranu przedstawiający pole filtru słowa kluczowego.

    Zrzut ekranu przedstawiający wyniki filtrowania słów kluczowych.

  7. Aby wyeksportować dane monitorowania, wybierz pozycję Eksportuj do pliku CSV.

    Zrzut ekranu przedstawiający opcję eksportu do pliku CSV.

  8. Aby uzyskać więcej informacji o uruchomieniu potoku Dane wejściowe i Dane wyjściowe, wybierz linki Dane wejściowe lub Dane wyjściowe po prawej stronie odpowiedniego wiersza w sekcji Uruchomienia działania.

  9. Wybierz Aktualizuj potok danych, aby wprowadzić zmiany w potoku danych na tym ekranie. Ta akcja powoduje powrót do kanwy potoku.

  10. Wybierz pozycję Uruchom ponownie, aby ponownie uruchomić potok. Wybierz ponowne uruchomienie całego potoku lub ponowne uruchomienie tylko z działania, które zakończyło się niepowodzeniem.

    Zrzut ekranu przedstawiający działanie ponownego uruchamiania, które zakończyło się niepowodzeniem.

  11. Aby wyświetlić szczegóły wydajności, wybierz aktywność z listy Uruchomienia aktywności. Zostanie otwarte okienko szczegółów wydajności.

    Zrzut ekranu ekranu szczegółów kopiowania danych.

    Więcej szczegółów znajdziesz w sekcjach Podział według czasu trwania i Zaawansowane.

    Zrzut ekranu przedstawiający dodatkowe szczegóły dotyczące przebiegu kopiowania danych.

Widok wykresu Gantta

Widok wykresu Gantta zapewnia jasny, wizualny sposób śledzenia przebiegów potoków w czasie. Każde uruchomienie jest wyświetlane jako pasek, pogrupowany według nazwy potoku, a długość paska pokazuje, jak długo trwało uruchomienie. Ten widok służy do wykrywania wzorców, porównywania czasów trwania i identyfikowania opóźnień, nakładających się lub anomalii na pierwszy rzut oka.

Zrzut ekranu przedstawiający miejsce przełączania się między widokami.

Długość paska reprezentuje czas trwania uruchomienia potoku. Możesz wybrać pasek, aby wyświetlić więcej szczegółów.

Zrzut ekranu przedstawiający widok wykresu Gantta przedstawiający różne długości słupków.

Zrzut ekranu ukazujący szczegóły uruchomienia potoku z widoku Gantta.

Monitorowanie obszaru roboczego dla potoków

Monitorowanie w obszarze roboczym zapewnia wgląd na poziomie dzienników dla wszystkich elementów w obszarze roboczym, w tym potoków danych.

  1. Aby włączyć monitorowanie obszaru roboczego, przejdź do pozycji Ustawienia obszaru roboczego w obszarze roboczym Fabric i wybierz pozycję Monitorowanie.

  2. Dodaj eventhouse monitorowania i włącz opcję Rejestruj aktywność obszaru roboczego. Fabric tworzy bazę danych Kusto Query Language (KQL) w magazynie zdarzeń w Twoim obszarze roboczym do przechowywania dzienników.

    Zrzut ekranu przedstawiający sposób przełączania monitorowania obszaru roboczego.

  3. Przejdź do bazy danych KQL utworzonej przez system Fabric. Możesz go znaleźć za pośrednictwem linku Monitorowanie bazy danych w ustawieniach monitorowania lub bezpośrednio w obszarze roboczym.

    Zrzut ekranu przedstawiający elementy wygenerowane na podstawie monitorowania obszaru roboczego.

  4. W bazie danych KQL tabela ItemJobEventLogs rejestruje zdarzenia na poziomie potoku danych występujące w Twoim obszarze roboczym (nazywane również monitorowaniem L1). Dzienniki obejmują nazwę potoku, status przebiegu, znaczniki czasu i diagnostykę systemu.

    Zrzut ekranu przedstawiający tabelę monitorowania obszaru roboczego potoku.

Użyj zapytań KQL w centrum zdarzeń monitorowania, aby przeanalizować:

  • Trendy sukcesów i niepowodzeń
  • Performance metrics (Metryki wydajności)
  • Szczegóły błędów dla rozwiązywania problemów

Monitorowanie wykorzystania pojemności

Administratorzy pojemności usługi Fabric mogą korzystać z aplikacji Microsoft Fabric Capacity Metrics do wyświetlania zasobów pojemności. Ta aplikacja pokazuje, ile zasobów procesora CPU, czasu przetwarzania i pamięci zużywają potoki, przepływy danych i inne elementy w obszarach roboczych z włączoną pojemnością. Służy do identyfikowania przyczyn przeciążenia, szczytowych czasów zapotrzebowania i najbardziej intensywnie korzystających z zasobów elementów.