Che cos'è il collegamento semantico?

Il collegamento semantico è una funzione che permette di stabilire un collegamento tra modelli semantici e Data Science in Microsoft Fabric. L'uso del collegamento semantico è supportato solo in Microsoft Fabric.

  • Per Fabric Runtime 1.2 (Spark 3.4) e versioni successive, il collegamento semantico è disponibile nel runtime predefinito e non è necessario installarlo.

  • Per eseguire l'aggiornamento alla versione più recente del collegamento semantico, eseguire il comando seguente:

    %pip install -U semantic-link
    

Gli obiettivi principali del collegamento semantico sono:

  • Facilitare la connettività dei dati.
  • Abilitare la propagazione delle informazioni semantiche.
  • Integrazione senza problemi con gli strumenti consolidati usati dai data scientist, ad esempio i notebook.

Il collegamento semantico consente di mantenere le conoscenze del dominio sulla semantica dei dati in modo standardizzato consentendo di velocizzare l'analisi dei dati e ridurre gli errori.

Il flusso di dati del collegamento semantico inizia con modelli semantici che contengono dati e informazioni semantiche. Il collegamento semantico colma il divario tra Power BI e il carico di lavoro Data Science.

Un diagramma che mostra il flusso di dati da Power BI ai notebook in Data Science e poi di nuovo a Power BI.

Utilizzando il collegamento semantico, puoi utilizzare modelli semantici di Power BI nel carico di lavoro Data Science per svolgere compiti come analisi statistiche approfondite e modellazione predittiva utilizzando tecniche di machine learning. È possibile archiviare l'output del lavoro di data science in OneLake usando Apache Spark e inserire l'output archiviato in Power BI usando Direct Lake.

Connettività di Power BI

Un modello semantico funge da singolo modello di oggetti tabulari che fornisce origini affidabili per le definizioni semantiche, ad esempio le misure di Power BI. Il collegamento semantico si connette ai modelli semantici negli ecosistemi seguenti, semplificando il funzionamento dei data scientist nel sistema con cui hanno più familiarità.

  • Python pandas attraverso l'ecosistema della libreria SemPy Python.
  • Ecosistema Apache Spark, tramite il connettore nativo Spark. Questa implementazione supporta vari linguaggi, tra cui PySpark, Spark SQL, R e Scala.

Applicazioni di informazioni semantiche

Le informazioni semantiche nei dati includono Power BI categorie di dati come indirizzo e codice postale, relazioni tra tabelle e informazioni gerarchica.

Queste categorie di dati comprendono metadati che il collegamento semantico propaga nell’ambiente di Data Science per consentire nuove funzionalità e mantenere la tracciabilità dei dati.

Alcune applicazioni di esempio di collegamento semantico includono:

Il collegamento semantico è uno strumento potente che consente agli analisti aziendali di usare i dati in modo efficace in un ambiente di data science completo.

Il collegamento semantico semplifica la collaborazione tra i data scientist e i business analyst eliminando la necessità di riimplementare la logica di business incorporata nelle misure di Power BI. Questo approccio garantisce che entrambe le parti possano lavorare in modo efficiente e produttivo, ottimizzando il potenziale delle informazioni dettagliate basate sui dati.

Struttura dei dati FabricDataFrame

FabricDataFrame è la principale struttura dati che il collegamento semantico utilizza per propagare le informazioni semantiche dai modelli semantici all'ambiente Data Science.

Diagramma che mostra il flusso di dati dai connettori ai modelli semantici a FabricDataFrame alle funzioni semantiche.

Classe FabricDataFrame:

  • Supporta tutte le operazioni Pandas.
  • Sottoclassa il dataframe pandas e aggiunge metadati, ad esempio informazioni semantiche e derivazione.
  • Espone funzioni semantiche e il metodo add-measure che consente di usare le misure di Power BI nel lavoro di data science.