Czym jest agent inżynierii danych Fabric (Project Osmos)? (wersja zapoznawcza)

Fabric data engineering agent (Project Osmos) to autonomiczna zdolność inżynierii danych dla Microsoft Fabric. Wykonuje trwałe zadania, które planują, wykonują i walidują prace inżynierii danych na podstawie zasobów Fabric, do których masz uprawnienia.

W obsługiwanym kliencie wiersza polecenia wprowadzasz wynik projektu (opis kompletnego zadania inżynierii danych od początku do końca) i wybierasz środowisko lakehouse usługi Fabric, w którym znajduje się to zadanie. Project Osmos może przeglądać dane, tworzyć i testować notatniki Spark, transformować dane, pisać tabele Delta oraz weryfikować wyniki. Zadania nadal działają w Fabric po rozłączeniu się lokalnego klienta.

Important

Agent inżynierii danych (Project Osmos) jest dostępny w wersji zapoznawczej. Funkcje podglądowe są udostępniane z ograniczonymi możliwościami i podlegają osobnym, uzupełniającym warunkom zapowiedzi. Nie są przeznaczone do użytku produkcyjnego, nie podlegają umowom SLA i mogą być dostępne tylko w wybranych regionach. Aby uzyskać więcej informacji, zobacz Informacje o wersji zapoznawczej usługi Microsoft Fabric.

Kluczowe możliwości

Agent inżynierii danych (Project Osmos) implementuje i wykonuje zadania inżynierii danych w zarządzanym zadaniu Fabric. Wykorzystuje SparkCore, stan trwały, kontrolę dostępu, śledzenie postępów oraz walidację względem danych docelowych. Wielu skoordynowanych agentów tworzy i ocenia różne opcje wdrożenia, aby dostarczyć wyniki o jakości produkcyjnej.

Project Osmos dodaje możliwości specyficzne dla Fabric:

  • Wykonywanie hostowane na platformie Fabric: Operacje na kodzie i danych są wykonywane za pomocą usługi Fabric Spark i OneLake, a nie wyłącznie w lokalnym środowisku programistycznym.
  • Trwały stan zadania: Zadanie nadal działa, po rozłączeniu się lokalnego klienta i można je wznowić bez konieczności rozpoczęcia od nowa.
  • Kontekst elementu lakehouse: Project Osmos określa obszar roboczy Fabric i domyślny element lakehouse dla sesji Spark na podstawie podanego adresu URL elementu lakehouse.
  • Zabezpieczenia operacyjne: Przed wykonaniem przeglądasz ustawienia uprawnień, bezpieczeństwa zapisu, zachowania przy ponownym uruchomieniu, ewolucji schematu, artefaktów oraz nakładu na rozumowanie.
  • Zintegrowana walidacja: Zadanie może uruchamiać generowany kod i sprawdzać liczbę wierszy, null, schematy i inne kryteria sukcesu w środowisku docelowym.
  • Wspólna widoczność: Każdy, kto ma dostęp do domku nad jeziorem, w którym uruchomiłeś zadanie, może sprawdzić jego postęp i w razie potrzeby przekazać swoje informacje.

Te możliwości zamieniają wynik Project w zarządzaną jednostkę pracy inżynierii danych, a nie w przelotną odpowiedź na czacie.

Jak działa agent inżynierii danych (Project Osmos)

Project Osmos wykorzystuje zarządzany cykl życia dla każdego zadania inżynierii danych:

  • Zdefiniuj: Wynik projektu określa pełne zadanie inżynierii danych od początku do końca, a adres URL lakehouse wskazuje lakehouse usługi Fabric, który je hostuje.
  • Plan: Project Osmos analizuje dostępny kontekst i zaleca ustawienia operacyjne do przeglądu.
  • Wykonaj: Zadanie działa w Fabric i może tworzyć, testować oraz udoskonalać artefakty inżynierii danych.
  • Walidacja: Zadanie sprawdza swoje wyniki względem określonych kryteriów sukcesu i raportuje wyniki.
  • Monitor: Zadanie jest nadal dostępne zarówno w kliencie wiersza polecenia, jak i w środowisku zadań usługi Lakehouse.

Wybrany domek nad jeziorem jest domyślnym domem nad jeziorem podczas sesji Spark. Nie jest automatycznie jedynym źródłem ani celem podróży. Wynik projektu, uprawnienia Fabric oraz przejrzane ustawienia operacyjne określają zakres zadania.

Aby uzyskać kroki do stworzenia pierwszego zadania, zobacz: Zacznij z Project Osmos.

Wybierz odpowiedni przypadek użycia

Project Osmos został zaprojektowany do pracy inżynierii danych nastawionej na wyniki, która korzysta z autonomicznego planowania, realizacji i walidacji.

Przypadek użycia Przykładowy rezultat
Przygotowywanie danych Czyść pliki sprzedażowe, standaryzować typy, usuwać nieprawidłowe wiersze i pisać zweryfikowaną tabelę Delta.
Integracja tabelowa Połącz zamówienia, klientów i dane produktowe, a następnie stwórz wyselekcjonowaną tabelę do analizy dalszej.
Modernizacja domów nad jeziorem Przekonwertować istniejącą transformację na Spark, wygenerować przetestowany notes i zweryfikować nowy wynik.
Architektura medalionu Twórz transformacje na poziomie brązowym, srebrnym i złotym z plików źródłowych w ramach jednego kompletnego zadania.
Naprawa jakości danych Profiluj tabelę, zidentyfikuj problemy z jakością, stosuj zatwierdzone poprawki i raportuj metryki przed i po.
Poprawa wydajności Przeglądaj tabele Delty, rekomenduj podziały lub zmiany układu, wdrażaj zatwierdzone zmiany i mierz wyniki.
Pomoc w migracji Przekształć starsze wyciągi w model przygotowany do pracy w Fabric, zachowując reguły biznesowe i weryfikując sumy.

Project Osmos został stworzony, aby rozwiązywać wyzwania związane z inżynierią danych. Nie jest przeznaczony do szybkiego zapytania, zmiany raportu Power BI ani innych zadań niezwiązanych z inżynierią danych.

Praca między CLI i Fabric

Project Osmos wykorzystuje dwa powiązane doświadczenia. Tworzysz i sterujesz zadaniami z linii poleceń oraz widzisz postępy w aplikacji Fabric:

  • Doświadczenie z wierszem poleceń: Użyj GitHub Copilot CLI, Codexu lub kodu Claude, aby utworzyć zadanie, wprowadzić wynik Project, przejrzeć ustawienia operacyjne i wysłać dalsze wskazówki.
  • Doświadczenia z domem nad jeziorem Fabric: Przeglądaj zadania domku nad jeziorem, sprawdzaj status, otwieraj zadanie, przeglądaj działania i błędy oraz przeglądaj wyprodukowane rezultaty.

Oba doświadczenia odnoszą się do tego samego ID zadania i zadania hostowanego w Fabric.

Następne kroki