Merk
Tilgang til denne siden krever autorisasjon. Du kan prøve å logge på eller endre kataloger.
Tilgang til denne siden krever autorisasjon. Du kan prøve å endre kataloger.
Funksjonen ai.classify kategoriserer hver inngangsrad ved å bruke etikettene du oppgir.
Note
- Denne artikkelen handler
ai.classifyom PySpark. For pandaer, se Bruk ai.klassifiser med pandaer. - For alle AI-funksjoner og forutsetninger, se oversikt over AI-funksjoner.
- Endre standardkonfigurasjonen for AI-funksjoner med PySpark.
Oversikt
Funksjonen ai.classify er tilgjengelig for Spark DataFrames. Du må angi navnet på en eksisterende inndatakolonne som en parameter, sammen med en liste over klassifiseringsetiketter.
Funksjonen returnerer en ny DataFrame med etiketter som samsvarer med hver rad med inndatatekst, lagret i en utdatakolonne.
Syntaks
df.ai.classify(labels=["category1", "category2", "category3"], input_col="text", output_col="classification")
Parametere
| Name | Beskrivelse |
|---|---|
labels Obligatorisk |
En matrise med strenger som representerer settet med klassifiseringsetiketter som samsvarer med tekstverdier i inndatakolonnen. |
input_col Obligatorisk |
En streng som inneholder navnet på en eksisterende kolonne med inndatatekstverdier som skal klassifiseres i henhold til de egendefinerte etikettene. |
output_col Valgfritt |
En streng som inneholder navnet på en ny kolonne der du vil lagre en klassifiseringsetikett for hver inndatatekstrad. Hvis du ikke angir denne parameteren, genereres et standardnavn for utdatakolonnen. |
error_col Valgfritt |
En streng som inneholder navnet på en ny kolonne. Den nye kolonnen lagrer eventuelle OpenAI-feil som skyldes behandling av hver rad med inndatatekst. Hvis du ikke angir denne parameteren, genereres et standardnavn for feilkolonnen. Hvis det ikke er noen feil for en rad med inndata, er verdien i denne kolonnen null. |
Returnerer
Funksjonen returnerer en Spark DataFrame som inneholder en ny kolonne som inneholder klassifiseringsetiketter som samsvarer med hver inndatatekstrad. Hvis en tekstverdi ikke kan klassifiseres, er den tilsvarende etiketten null.
Eksempel
# This code uses AI. Always review output for mistakes.
df = spark.createDataFrame([
("This duvet, lovingly hand-crafted from all-natural fabric, is perfect for a good night's sleep.",),
("Tired of friends judging your baking? With these handy-dandy measuring cups, you'll create culinary delights.",),
("Enjoy this *BRAND NEW CAR!* A compact SUV perfect for the professional commuter!",)
], ["descriptions"])
categories = df.ai.classify(labels=["kitchen", "bedroom", "garage", "other"], input_col="descriptions", output_col="categories")
display(categories)
Output:
Multimodal inngang
For å klassifisere bilder, PDF-er eller tekstfiler, sett input_col_type="path". For oppsett, se Bruk multimodal input med AI-funksjoner.
# This code uses AI. Always review output for mistakes.
results = custom_df.ai.classify(
labels=["Master", "PhD", "Bachelor", "Other"],
input_col="file_path",
input_col_type="path",
output_col="highest_degree",
)
display(results)
Relatert innhold
- Bruk ai.classify med pandaer.
- Lær mer om AI-funksjoner.
- Bruk multimodal input med AI-funksjoner.
- Endre standardkonfigurasjonen for AI-funksjoner med PySpark.
- Forstå fakturering for AI-funksjoner.