Hadoop Pig-Aufgabe

Gilt für:SQL Server SSIS Integration Runtime in Azure Data Factory

Mithilfe eines Hadoop Pig-Tasks können Sie ein Pig-Skript in einem Hadoop-Cluster ausführen.

Um einen Hadoop Pig-Task hinzuzufügen, ziehen Sie ihn per Drag & Drop in den Designer. Doppelklicken Sie anschließend auf den Task, oder klicken Sie mit der rechten Maustaste darauf, und klicken Sie auf Bearbeiten, um das Hadoop-Dialogfeld Editor für den Pig-Task zu öffnen.

Hadoop-Editor für den Pig-Task

Optionen

Konfigurieren Sie die folgenden Optionen im Dialogfeld Hadoop Pig Task Editor.

Feld BESCHREIBUNG
Hadoop-Verbindung Geben Sie einen vorhandenen Hadoop-Verbindungs-Manager an, oder erstellen Sie einen neuen. Dieser Verbindungs-Manager gibt an, wo der Dienst WebHCat gehostet wird.
SourceType Geben Sie den Quelltyp der Abfrage an. Mögliche Werte sind ScriptFile und DirectInput.
InlineScript Wenn der Wert von SourceTypeDirectInputist, geben Sie das Pig-Skript an.
HadoopScriptFilePath Wenn der Wert von SourceTypeScriptFileist, geben Sie den Pfad der Skriptdatei auf Hadoop an.
TimeoutInMinutes Geben Sie einen Timeoutwert in Minuten an. Wenn der Hadoop-Job vor Ablauf des Timeouts nicht abgeschlossen wurde, wird er abgebrochen. Geben Sie 0 ein, wenn der Hadoop-Job asynchron ausgeführt werden soll.