Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Den här artikeln beskriver de toppmoderna öppna modeller som stöds av Api:er för Databricks Foundation-modell.
Anmärkning
Se Grundmodeller som stöds för modellservering för regiontillgänglighet för dessa modeller och de funktionsområden som stöds.
Anmärkning
På Azure Databricks finns OpenAI och Google Gemini-modeller, tillsammans med Zhipu AI GLM 5.3 Flash och GLM 5.2, Moonshot AI Kimi K3, Thinking Machine Labs Inkling och DeepSeek V4 Flash, tillgängliga via ADI Services, som tillhandahålls av Databricks. För installation och åtkomst, se ADI Services.
Du kan skicka frågeförfrågningar till dessa modeller med hjälp av de pay-per-token-slutpunkter som är tillgängliga på din Databricks-arbetsyta. Se Använd grundmodeller och tabellen för modeller som stöds av betalning per token för namnen på de modellslutpunkter som ska användas.
Förutom att stödja modeller i pay-per-token-läge erbjuder Foundation Model API:er också ett reserverat dataflödesläge. Databricks rekommenderar tilldelad kapacitet för produktionsarbetslaster. Det här läget stöder alla modeller i en modellarkitekturfamilj, inklusive de finjusterade och anpassade förtränade modeller som stöds i pay-per-token-läge. Se API:er för etablerad dataflödesmodell för listan över arkitekturer som stöds.
Du kan interagera med dessa modeller som stöds med hjälp av AI Playground.
För OpenAI, Google Gemini och Anthropic-modeller matchar kontextfönstret och maximala utdatatoken de värden som publicerats av respektive modellleverantör.
OpenAI GPT-5.6 Sol
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-6-sol
Indata som stöds: text, bild
GPT-5.6 Sol, även kallad GPT-5.6, är OpenAI:s flaggskeppsmodell i GPT-5.6-familjen och levererar toppmodern prestanda inom agentisk kodning, långhorisontsresonemang och komplex verktygsanvändning, med stöd för en ny maximal resonemangsinsats. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.6 Terra
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-6-terra
Indata som stöds: text, bild
GPT-5.6 Terra är den balanserade modellen i OpenAIs GPT-5.6-familj för vardagliga agentiska och resonerande arbetsbelastningar, och erbjuder prestanda som kan konkurrera med GPT-5.5 till en lägre kostnad. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.6 Luna
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-6-luna
Indata som stöds: text, bild
GPT-5.6 Luna är den snabba, kostnadseffektiva modellen i OpenAI:s GPT-5.6-familj, som erbjuder starkt resonemang och agentisk kapacitet till den lägsta kostnaden i sortimentet. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.5 Pro
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
GPT-5.5 Pro använder utökad prompt-cache. Cachade tensorer lagras i GPU-lokal lagring i högst 24 timmar.
Anmärkning
Denna modell stöds inte i AI Playground. Använd Responses API för att interagera med denna modell.
Slutpunktsnamn: databricks-gpt-5-5-pro
Indata som stöds: text, bild
GPT-5.5 Pro är en variant av GPT-5.5 med högre precision som riktar sig mot de svåraste problemen, inklusive djup forskning, avancerad matematik och resonemang med höga insatser. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.5
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
GPT-5.5 använder utökad prompt-cache. Cachade tensorer lagras i GPU-lokal lagring i högst 24 timmar.
Anmärkning
Denna modell stöds inte i AI Playground. Använd Responses API för att interagera med denna modell.
Slutpunktsnamn: databricks-gpt-5-5
Indata som stöds: text, bild
GPT-5.5 är OpenAIs starkaste frontmodell för arbetsflöden för företagsagenter, komplex dokumentresonemang och långsiktiga kodningsagenter. GPT-5.5 driver också Codex, OpenAI:s kodagent. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.4
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-4
Indata som stöds: text, bild
GPT-5.4 är en allmän stor språkmodell med resonemangsförmåga utvecklad av OpenAI. Den levererar förbättrad prestanda på komplexa uppgifter med ökad noggrannhet och mer genomtänkt resonemang. Denna modell stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.4 mini
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-4-mini
Indata som stöds: text, bild
GPT-5.4 mini är en kostnadsoptimerad allmän modell för stora språk med resonemangsförmåga utvecklad av OpenAI. Byggd på GPT-5.4-arkitekturen levererar denna modell förbättrad prestanda på väldefinierade uppgifter som kräver tillförlitlig resonemang, precist språk och snabb utdata. Den stöder multimodala ingångar.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.4 nano
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-4-nano
Indata som stöds: text, bild
GPT-5.4 nano är en allmän stor språkmodell med resonemangsförmåga utvecklad av OpenAI. Byggd på GPT-5.4-arkitekturen utmärker sig denna modell vid högkapacitetsuppgifter som enkel instruktionsföljning eller klassificering av rutinmässiga affärsprocesser eller mobilapplikationer. Den stöder multimodala ingångar.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.3-kodex
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Anmärkning
Denna modell stöds inte i AI Playground. Använd Responses API för att interagera med denna modell.
Slutpunktsnamn: databricks-gpt-5-3-codex
Indata som stöds: text, bild
GPT-5.3 Codex är OpenAIs mest avancerade agentiska kodningsmodell, utformad för att hantera komplexa, långvariga uppgifter som involverar forskning, verktygsanvändning och genomförande. Den kombinerar avancerad kodningsprestanda med logik och professionell kunskap från GPT-5.2, samtidigt som den fungerar 25% snabbare. Modellen stödjer multimodala indata.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.2
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-2
Indata som stöds: text, bild
GPT-5.2 är en allmän modell för stora språk med resonemangsförmåga utvecklad av OpenAI. Denna modell bygger direkt på GPT-5.1 och erbjuder högre noggrannhet, förbättrad tokeneffektivitet på medel- till komplexa uppgifter och mer genomtänkt stödkonstruktion. Denna modell utmärker sig vid strukturerad extraktion, flerstegsarbetsflöden och multimodala uppgifter. Den stöder multimodala ingångar.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5.1
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-1
Indata som stöds: text, bild
GPT-5.1 är en allmän modell för stort språk med resonemangsförmåga utvecklad av OpenAI. Denna modell har både Instant- och Thinking-lägen för snabba samtal eller djupt resonerande, och justerar automatiskt för enkla eller komplexa uppgifter. Modellen utmärker sig i innehållsskapande, handledning, teknisk support och kodning, med mindre beroende av strikt prompt-engineering än tidigare versioner. Den stöder multimodala ingångar. Läs mer om GPT-5.1.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5
Indata som stöds: text, bild
GPT-5 är en toppmodern, generell modell för stort språk och en resonemangsmodell som skapats och tränats av OpenAI. Den stöder multimodala ingångar. Modellen är byggd för kodning, chatt, resonemang och agentdrivna uppgifter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5 mini
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-mini
Indata som stöds: text, bild
GPT-5 mini är en toppmodern, generell, stor språkmodell och resonemangsmodell som skapats och tränats av OpenAI. Den stöder multimodala ingångar. Modellen är kostnadsoptimerad för resonemang och chattarbetsbelastningar och utmärker sig för väldefinierade uppgifter som kräver tillförlitligt resonemang, exakt språk och snabba utdata för text och bilder.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT-5 nano
Viktig
Kunder ansvarar för att säkerställa att de följer tillämpliga modellvillkor.
Slutpunktsnamn: databricks-gpt-5-nano
Indata som stöds: text, bild
GPT-5 nano är en toppmodern, generell, stor språkmodell och resonemangsmodell som skapats och tränats av OpenAI. Den stöder multimodala ingångar. Modellen utmärker sig på uppgifter med högt dataflöde som enkel instruktionsföljning eller klassificering för rutinmässiga affärsprocesser eller mobila program.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.7 Flash
Viktig
Se tillämpliga modellvillkor för Gemini 3.7 Flash.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-7-flash
Indata som stöds: text, bild, video, ljud
Gemini 3.7 Flash är en multimodal AI-modell utvecklad och tränad av Google. Den stödjer funktionsanrop och hybridresonemang för allmänna och multimodala arbetsbelastningar. Parametern reasoning_effort accepterar värden , "medium""low"(standard), eller "high". Gemini 3.7 Flash stöder "minimal"inte .
Läs mer om Gemini 3.7 Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.6 Flash
Viktig
Se tillämpliga modellvillkor för Gemini 3.6 Flash.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-6-flash
Indata som stöds: text, bild, video, ljud
Gemini 3.6 Flash är en högpresterande, kostnadseffektiv och multimodal AI-modell utvecklad och tränad av Google. Som efterföljare till Gemini 3.5 Flash erbjuder denna modell starkare resonemang, avancerade multimodala funktioner och förbättrad prisprestanda för produktionsskaluinstallationer. Gemini 3.6 Flash är optimerad för högkapacitetsarbetsbelastningar såsom komplex videoanalys, datautvinning och visuella frågor och svar. Lär dig mer om Gemini 3.6 Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.5 Flash
Viktig
Se tillämpliga modellvillkor för Gemini 3.5 Flash.
Slutpunktsnamn: databricks-gemini-3-5-flash
Indata som stöds: text, bild, video, ljud
Gemini 3.5 Flash är en högpresterande, kostnadseffektiv och multimodal AI-modell utvecklad och tränad av Google. Som ett betydande steg upp från Gemini 3 Flash erbjuder denna modell starkare resonemang, avancerade multimodala funktioner och förbättrad prisprestanda för produktionsskalutrullningar. Gemini 3.5 Flash är optimerad för högkapacitetsarbetsbelastningar såsom komplex videoanalys, datautvinning och visuella frågor och svar. Läs mer om Gemini 3.5 Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.5 Flash Lite
Viktig
Se tillämpliga modellvillkor för Gemini 3.5 Flash Lite.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-5-flash-lite
Indata som stöds: text, bild, video, ljud
Gemini 3.5 Flash Lite är den snabbaste och mest kostnadseffektiva modellen i Gemini 3-serien, utvecklad och tränad av Google. Modellen stödjer multimodala indata med bildfunktioner, funktionsanrop och strukturerad utdata. Gemini 3.5 Flash Lite är optimerad för högkapacitets- och kostnadseffektiva installationer.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.1 Pro Preview
Viktig
Se tillämpliga modellvillkor för Gemini 3.1 Pro Preview.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-1-pro
Indata som stöds: text, bild, video, ljud
Gemini 3.1 Pro Preview är en toppmodern hybrid resonemangsmodell utvecklad och tränad av Google. Den levererar starkt resonemang och dokumentintelligens, vilket gör den till en övergripande smart modell för komplexa arbetsflöden och uppgifter. Den utmärker sig i komplext resonemang, djup analys och multimodal förståelse över ett brett spektrum av indata och uppgifter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.1 Flash-bild
Viktig
Se tillämpliga modellvillkor för Gemini 3.1 Flash Image.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Denna modell genererar bilder som utdata, utöver text. Google använder pass-through-prissättning för denna modell, och utdata bildtokens faktureras separat från utdata texttokens. Se Googles priser på Gemini 3.1 Flash Image för detaljer.
Gemini 3.1 Flash Image är endast tillgänglig via Foundation Model API:er pay-per-token. Det stöds inte för provisionerad genomströmning, AI Functions batchinferens ai_query, , eller AI Playground.
Slutpunktsnamn: databricks-gemini-3-1-flash-image
Indata som stöds: text, bild
Gemini 3.1 Flash Image är Googles bildgenererade Gemini-modell. En enda förfrågan kan returnera genererade bilder tillsammans med text. Denna modell stöder inte funktionsanrop.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3.1 Flash Lite
Viktig
Se Tillämpliga modellvillkor för Gemini 3.1 Flash Lite.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-1-flash-lite
Indata som stöds: text, bild, video, ljud
Gemini 3.1 Flash Lite är den snabbaste och mest kostnadseffektiva modellen i Gemini 3-serien, utvecklad och tränad av Google. Modellen är byggd för intelligens i stor skala och stöder multimodala indata med bildfunktioner, funktionsanrop och strukturerade utdata. Gemini 3.1 Flash Lite är optimerat för kostnadseffektiva distributioner med högt dataflöde. Läs mer om Gemini 3.1 Flash Lite.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3 Pro-bild
Viktig
Se tillämpliga modellvillkor för Gemini 3 Pro-bilden.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Denna modell genererar bilder som utdata, utöver text. Google använder pass-through-prissättning för denna modell, och utdata bildtokens faktureras separat från utdata texttokens. Se Googles Gemini 3 Pro Image-priser för detaljer.
Gemini 3 Pro Image är endast tillgänglig via Foundation Model API:er pay-per-token. Det stöds inte för provisionerad genomströmning, AI Functions batchinferens ai_query, , eller AI Playground.
Slutpunktsnamn: databricks-gemini-3-pro-image
Indata som stöds: text, bild
Gemini 3 Pro Image är Googles bildgenerations Gemini-modell. En enda förfrågan kan returnera genererade bilder tillsammans med text. Denna modell stöder inte funktionsanrop.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 3 Flash
Viktig
Se Tillämpliga modellvillkor för Gemini 3 Flash.
Den här modellen finns på en global slutpunkt och kräver att routning mellan geografiska områden aktiveras.
Slutpunktsnamn: databricks-gemini-3-flash
Indata som stöds: text, bild, video, ljud
Gemini 3 Flash är en högpresterande, kostnadseffektiv multimodal AI-modell utvecklad och tränad av Google. Denna modell erbjuder hastighet och skalare utan att kompromissa med kvaliteten, och erbjuder avancerade multimodala funktioner för komplex videoanalys, datautvinning och visuella frågor och svar i nästan realtid. Gemini 3 Flash ger bättre pris, prestanda och snabbare hastigheter, vilket möjliggör produktionsskalande distributioner. Läs mer om Gemini 3 Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 2.5 Pro
Viktig
Se Tillämpliga modellvillkor för Gemini 2.5 Pro.
Google Gemini 2.5 Pro kommer att pensioneras den 2 oktober 2026. Se Inaktuella och tillbakadragna modeller för den rekommenderade ersättningsmodellen och vägledning för hur du migrerar under utfasningen.
Slutpunktsnamn: databricks-gemini-2-5-pro
Indata som stöds: text, bild, video, ljud
Gemini 2.5 Pro är en hybridmodell för resonemang som utvecklats och tränats av Google. Gemini 2.5 Pro:s "Deep Think Mode" och inbyggda ljudutgång gör det till en ledande modell för företag, forskning och kreativa applikationer. Den är utformad för att utmärke sig på komplexa resonemang, djupanalys och multimodal förståelse för en mängd olika indata och uppgifter. Läs mer om Gemini 2.5 Pro.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemini 2.5 Flash
Viktig
Se tillämpliga modellvillkor för Gemini 2.5 Flash.
Google Gemini 2.5 Flash är nedlagd och planeras pensioneras den 2 oktober 2026. Se Inaktuella och tillbakadragna modeller för den rekommenderade ersättningsmodellen och vägledning för hur du migrerar under utfasningen.
Slutpunktsnamn: databricks-gemini-2-5-flash
Indata som stöds: text, bild, video, ljud
Gemini 2.5 Flash är en snabb, kostnadseffektiv, multimodal AI-modell som utvecklats och tränats av Google. Det är Googles första helt hybridbaserade resonemangsmodell, utformad för utvecklare och företag som söker snabba, skalbara och prisvärda AI-lösningar. Gemini 2.5 Flash är optimerad för realtidsprogram och högvolymprogram som chattrobotar, extrahering av data, översättning och dokumentparsing. Läs mer om Gemini 2.5 Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Alibaba Cloud Qwen3.5 122B A10B
Viktig
Qwen3.5 122B A10B-modellen finns i offentlig förhandsversion.
Slutpunktsnamn: databricks-qwen35-122b-a10b
Indata som stöds: text
Qwen3.5 122B A10B är en moe-resonemangsmodell som skapats och tränats av Alibaba Cloud med totalt 122 miljarder parametrar och 10 miljarder aktiva parametrar per slutsatsdragning. Modellen stödjer ett kontextfönster på 256K och upp till 25K utdatatokens, och levererar stark prestanda vid resonemang, kodning och agentiska uppgifter. Som en modell med endast resonemang skälar alltid Qwen3.5 122B A10B innan du svarar, och resonemanget kan inte inaktiveras.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Alibaba Cloud Qwen3-Embedding-0.6B
Viktig
Qwen3-Embedding-0.6B-modellen finns i offentlig förhandsversion.
Slutpunktsnamn: databricks-qwen3-embedding-0-6b
Indata som stöds: text
Qwen3-Embedding-0.6B är en kompakt textinbäddningsmodell med ~600M-parametrar som är utformade för semantiska uppgifter som hämtning, likhetssökning, klustring och klassificering. Den kodar text till kompakta vektorer som representerar betydelse snarare än ytform.
Modellen stöder över 100 språk (inklusive kod) och hanterar långa kontexter upp till ~32 000 token, vilket gör den lämplig för inbäddning av långa dokument. Den skapar inbäddningar med en konfigurerbar dimension upp till 1024 och är instruktionsmedveten, vilket möjliggör aktivitetsspecifik biasing via prompter.
Qwen3-Embedding-0.6B bygger på en transformatorkodare och finjusteras specifikt för inbäddningsgenerering och balanserar inbäddningskvaliteten med effektiv slutsatsdragning.
Inbäddningsmodeller är särskilt effektiva när de används tillsammans med LLM:er för användningsfall med utökad generering baserad på återhämtning (RAG). Qwen3-Embedding-0.6B kan användas för att hitta relevanta textfragment i stora delar av dokument som kan användas i kontexten för en LLM.
Alibaba Cloud Qwen3-Next 80B A3B Instruktion
Viktig
Modellen Qwen3-Next 80B A3B Instruct finns i offentlig förhandsversion.
Slutpunktsnamn: databricks-qwen3-next-80b-a3b-instruct
Indata som stöds: text
Qwen3-Next-80B-A3B-Instruct är en mycket effektiv stor språkmodell som är optimerad för instruktions-följande uppgifter som skapats och tränats av Alibaba Cloud. Den här modellen är utformad för att hantera ultralånga kontexter och excels i arbetsflöden i flera steg, hämtningsförhöjd generering och företagsprogram som kräver deterministiska utdata vid högt dataflöde.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Zhipu AI GLM 5.3 Flash
Slutpunktsnamn: databricks-glm-5-3-flash
Indata som stöds: text, bild
GLM-5.3-Flash är en inbyggt multimodal blandning av experter (MoE)-modell med 320 miljarder totala parametrar och 18 miljarder aktiva parametrar, utvecklad av Zhipu AI. Modellen stöder en kontextlängd på 1 048 576 tokens och är optimerad för resonemang, kodning och användning av agentiska verktyg. Läs mer om GLM-5.3-Flash.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Zhipu AI GLM 5.2
Slutpunktsnamn: databricks-glm-5-2
Indata som stöds: text
GLM-5.2 är en blandning av experters (MoE) språkmodell med totalt 753 miljarder parametrar utvecklade av Zhipu AI. Modellen stöder en kontextlängd på 1 miljon tokens och är optimerad för långsiktig resonemang, kodning och användning av agentiska verktyg.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Moonshot AI Kimi K3
Slutpunktsnamn: databricks-kimi-k3
Indata som stöds: text, bild
Kimi K3 är en modell med 2,8 biljoner parametrar utvecklad av Moonshot AI med inbyggda synfunktioner. Modellen stödjer en kontextlängd på 1 miljon tokens och är utformad för långsiktig kodning, kunskapsarbete och resonemang.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
DeepSeek V4 Flash (0731)
Slutpunktsnamn: databricks-deepseek-v4-flash-0731
Indata som stöds: text
DeepSeek V4 Flash (0731) är en hybridblandning av experters (MoE) språkmodell med totalt 284 miljarder parametrar och 13 miljarder aktiva parametrar, utvecklad av DeepSeek. Modellen är optimerad för snabb och kostnadseffektiv resonemang, kodning och användning av agentiska verktyg.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT OSS 120B
Slutpunktsnamn: databricks-gpt-oss-120b
Indata som stöds: text
GPT OSS 120B är en toppmodern resonemangsmodell med tankekedja och justerbara resonemangsnivåer som skapats och tränats av OpenAI. Det är OpenAI:s flaggskeppsmodell med öppen åtkomst och har ett kontextfönster med 128 000 token. Modellen är byggd för högkvalitativa resonemangsuppgifter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
OpenAI GPT OSS 20B
Slutpunktsnamn: databricks-gpt-oss-20b
Indata som stöds: text
GPT OSS 20B är en toppmodern, lättviktig resonemangsmodell som skapats och tränats av OpenAI. Den här modellen har ett kontextfönster med 128K token och utmärker sig i realtidsapplikationer och batchinferensuppgifter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Googla Gemma 3 12B
Viktig
Se Tillämpliga modellvillkor för gemma 3-villkoren och policyn för godtagbar användning.
Slutpunktsnamn: databricks-gemma-3-12b
Indata som stöds: text, bild
Gemma 3 12B är en multimodal modell med 12 miljarder parametrar och visionsspråk som utvecklats av Google som en del av Gemma 3-familjen. Gemma 3 har upp till 128 000 tokenkontexter och ger flerspråkigt stöd för över 140 språk. Den här modellen är utformad för att hantera både text- och bildindata och generera textutdata, och är optimerad för dialoganvändningsfall, textgenerering och bildtolkningsuppgifter, inklusive frågesvar.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Meta Llama 4 Maverick
Viktig
Se Tillämpliga modellvillkor för llama 4 Community-licensen och principen för godtagbar användning.
Slutpunktsnamn: databricks-llama-4-maverick
Indata som stöds: text, bild
Llama 4 Maverick är en toppmodern stor språkmodell som skapats och tränats av Meta. Det är den första i Llama-modellfamiljen som använder en blandning av experters arkitektur för beräkningseffektivitet. Llama 4 Maverick stöder flera språk och är optimerad för exakta användningsfall för bild- och texttolkning. Läs mer om Llama 4 Maverick.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Meta Llama 3.3 70B Instruktion
Viktig
Från och med den 11 december 2024 ersätter Meta-Llama-3.3-70B-Instruct stödet för Meta-Llama-3.1-70B-Instruct i Foundation Model API:ers betalning per token-slutpunkter.
Se Tillämpliga modellvillkor för LLama 3.3 Community-licens och policy för godtagbar användning.
Slutpunktsnamn: databricks-meta-llama-3-3-70b-instruct
Indata som stöds: text
Meta-Llama-3.3-70B-Instruct är en toppmodern stor språkmodell med en kontext av 128 000 token som har skapats och tränats av Meta. Modellen stöder flera språk och är optimerad för dialoganvändningsfall. Läs mer om Meta Llama 3.3.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Meta Llama 3.1 8B Instruera
Viktig
Se Tillämpliga modellvillkor för communitylicensen för LLama 3.1 och policyn för godtagbar användning.
Slutpunktsnamn: databricks-meta-llama-3-1-8b-instruct
Indata som stöds: text
Meta-Llama-3.1-8B-Instruct är en toppmodern stor språkmodell med en kontext av 128 000 token som har skapats och tränats av Meta. Modellen stöder flera språk och är optimerad för dialoganvändningsfall. Läs mer om Meta Llama 3.1.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Anthropic Claude Haiku 4,5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-haiku-4-5
Indata som stöds: text, bild
Claude Haiku 4.5 är Anthropics snabbaste och mest kostnadseffektiva modell och levererar kodningskvalitet nära gränsen med exceptionell hastighet och effektivitet. Den utmärker sig i realtidsprogram med låg latens, inklusive chattassistenter, kundtjänstagenter, parprogrammering och snabba prototyper. Den här modellen är perfekt för kostnadsmedvetna produktionsdistributioner och agentiska system som kräver dynamisk AI-hjälp.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Sonnet 5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-sonnet-5
Indata som stöds: text, bild
Anmärkning
Claude Sonnet 5 stöder inte parametrarna temperature, top_peller top_k sampling. Begäranden som innehåller dessa parametrar returnerar ett 400-fel.
Claude Sonnet 5 är Anthropic mest kompatibla Sonnet-modell, utformad för kodning, agentiska arbetsflöden och professionellt arbete i stor skala. Den kombinerar intelligens på nära Opus-nivå med Sonnets kostnadseffektivitet och hastighet, vilket gör den väl lämpad för kundinriktade agenter, arbetsflöden för produktionskodning och avancerade uppgifter för innehållsgenerering.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Antropisk Claude Sonnet 4.6
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-sonnet-4-6
Indata som stöds: text, bild
Claude Sonnet 4.6 är Anthropics mest avancerade hybridresonderingsmodell. Det erbjuder två lägen: nästan omedelbara svar och utökat tänkande för djupare resonemang baserat på uppgiftens komplexitet. Claude Sonnet 4.6 är specialiserat på program som kräver en balans mellan praktiskt dataflöde och avancerat tänkande som kundinriktade agenter, arbetsflöden för produktionskodning och innehållsgenerering i stor skala.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Antropisk Claude Sonnet 4.5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-sonnet-4-5
Indata som stöds: text, bild
Claude Sonnet 4.5 är Anthropics mest avancerade hybridskälmodell. Det erbjuder två lägen: nästan omedelbara svar och utökat tänkande för djupare resonemang baserat på uppgiftens komplexitet. Claude Sonnet 4.5 är specialiserat på program som kräver en balans mellan praktiskt dataflöde och avancerat tänkande som kundinriktade agenter, arbetsflöden för produktionskodning och innehållsgenerering i stor skala.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Fable 5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Viktig
För Claude Fable 5 behålls uppmaningar och svar i 30 dagar i förtroende- och säkerhetssyfte. Dessa data bearbetas av automatiserade säkerhetssystem och kan i vissa fall flaggas för mänsklig granskning. Data tas bort automatiskt efter 30 dagar, förutom i händelse av en säkerhetsundersökning, eller juridiska krav för att behålla data efter 30 dagar. Anthropic är en begränsad underprocessor för det här säkerhetskvarhållningssyftet.
Slutpunktsnamn: databricks-claude-fable-5
Indata som stöds: text
Claude Fable 5 är en Mythos-klassmodell från Anthropic utformad för självständigt kunskapsarbete och kodning. Med robusta skydd inbyggda kan den hantera långvariga, komplexa och asynkrona uppgifter med mindre behov av mänskliga incheckningar än tidigare modeller, vilket gör det väl lämpat för agentiska arbetsflöden som kräver varaktigt fokus över utökade kontexter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Opus 5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-5
Indata som stöds: text, bild
Claude Opus 5 är Anthropic mest kompatibla hybridredigerare och bygger vidare på Opus-serien med fokus på agentisk kodning, kodgranskning och autonomt arbete med lång horisont. Den här modellen utmärker sig för komplexa programvaruuppgifter med flera filer, till exempel stora refaktoriseringar och funktionsutveckling från slutpunkt till slutpunkt, felsökning med hög precision, samordning av flera agenter och visionsuppgifter som diagram, dokument och gränssnittsförstämelse. Claude Opus 5 upprätthåller stark instruktionsföljning, verktygsanrop och resonemang över hela kontextfönstret, och levererar nästan högsta kvalitet vid låg och medelhög resonemangsinsats, vilket gör den väl lämpad för långkontexterade, kostnadskänsliga företagsarbetsflöden.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Opus 4.8
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-4-8
Indata som stöds: text, bild
Claude Opus 4.8 bygger vidare på Opus-serien med ytterligare förbättringar av funktionerna för noggrannhet, effektivitet och resonemang. Den här modellen utmärker sig med komplexa extraherings- och agentiska resonemangsuppgifter med bildstöd, vilket gör den idealisk för företagsprogram som kräver djupanalys, dokumenttolkning och avancerade arbetsflöden i flera steg.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Opus 4.7
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-4-7
Indata som stöds: text, bild
Claude Opus 4.7 är Anthropics mest kapabla resoneringsmodell och utvecklar Opus-serien med förbättrad noggrannhet, effektivitet och förbättrade bildbehandlingsfunktioner. Den här modellen ger starkare prestanda för komplexa extraherings- och agentiska resonemangsuppgifter samtidigt som du använder färre utdatatoken än föregående. Claude Opus 4.7 har stöd för ökad bildupplösning, vilket gör det idealiskt för företagsapplikationer som kräver djupanalys, dokumentförståelse och sofistikerade arbetsflöden i flera steg.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Antropisk Claude Opus 4.6
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-4-6
Indata som stöds: text, bild
Claude Opus 4.6 är Anthropics mest kompatibla hybridtänksmodell med anpassningsbara tankefunktioner. Den här modellen introducerar en ny maxinsatsnivå för de mest krävande uppgifterna, med hög ansträngning inställd som standard för optimala prestanda. Claude Opus 4.6 utmärker sig för komplexa resonemang, djupanalys, kodgenerering, forskning och avancerade arbetsflöden i flera steg. Det är idealiskt för företagsapplikationer som kräver både omfattande analys och omfattande resultat.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Anthropic Claude Opus 4.5
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-4-5
Indata som stöds: text, bild
Claude Opus 4.5 är Anthropics mest kompatibla hybridskälmodell, byggd för de mest komplexa uppgifter som kräver djupanalys och utökat tänkande. Den här modellen kombinerar kraftfulla funktioner för generell användning med avancerade resonemang, utmärkt kodgenerering, forskning, skapande av innehåll och avancerade agentiska arbetsflöden i flera steg. Claude Opus 4.5 stödjer text- och bildinmatningar, vilket gör det idealiskt för företagsapplikationer som kräver både bredd och djup i förståelse.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Antropisk Claude Sonnet 4
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Anthropic Claude Sonnet 4 är inaktuellt. Se Inaktuella och inaktuella modeller för dess slutdatum, rekommenderade ersättningsmodell och vägledning för hur du migrerar under utfasningen.
Slutpunktsnamn: databricks-claude-sonnet-4
Indata som stöds: text, bild
Claude Sonnet 4 är en toppmodern hybridmodell som skapats och tränats av Anthropic. Den här modellen erbjuder två lägen: nästan omedelbara svar och utökat tänkande för djupare resonemang baserat på uppgiftens komplexitet. Claude Sonnet 4 är optimerad för olika uppgifter som kodutveckling, storskalig innehållsanalys och utveckling av agentprogram.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Antropisk Claude Opus 4.1
Viktig
Kunderna ansvarar för att säkerställa att de följer villkoren i Anthropics användningsprincip. Se även Databricks Master Cloud Services-avtalet och, i förekommande fall, Databricks Business Associate-avtalet.
Slutpunktsnamn: databricks-claude-opus-4-1
Indata som stöds: text, bild
Claude Opus 4.1 är en toppmodern hybridmodell som skapats och tränats av Anthropic. Den här stora språkmodellen för generell användning är utformad för både komplexa resonemang och verkliga program i företagsskala. Den stödjer text- och bildinmatning. Den här modellen utmärker sig för uppgifter som kodgenerering, skapande av forskning och innehåll och arbetsflöden för flera steg agenter utan konstant mänsklig inblandning.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
Den här slutpunkten hanteras av Databricks inom Databricks säkerhetsperimeter.
Tänkande maskinlaboratorier Inkling
Viktig
Inkling finns i offentlig förhandsvisning.
Slutpunktsnamn: databricks-inkling
Indata som stöds: text, bild
Inkling är en blandning av experters (MoE) språkmodell med 975 miljarder totala parametrar och 41 miljarder aktiva parametrar, utvecklad av Thinking Machine Labs. Modellen stödjer en kontextlängd på 1 miljon tokens och är optimerad för kodning, resonemang och agentiska verktygsanvändningsuppgifter.
AI-modeller kan göra misstag, missförstå avsikt och hallucinera eller ge felaktiga svar. Databricks rekommenderar att kunderna utvärderar sina modeller för att säkerställa att de fungerar som avsett.
GTE Large (En)
Slutpunktsnamn: databricks-gte-large-en
Indata som stöds: text
Allmän textinbäddning (GTE) är en textinbäddningsmodell som kan mappa valfri text till en inbäddningsvektor med 1 024 dimensioner och ett inbäddningsfönster med 8 192 token. Dessa vektorer kan användas i vektorindex för LLM:er och för uppgifter som hämtning, klassificering, frågesvar, klustring eller semantisk sökning. Den här slutpunkten hanterar den engelska versionen av modellen och genererar inte normaliserade inbäddningar.
Inbäddningsmodeller är särskilt effektiva när de används tillsammans med LLM:er för användningsfall med utökad generering baserad på återhämtning (RAG). GTE kan användas för att hitta relevanta textfragment i stora delar av dokument som kan användas i kontexten för en LLM.
Stor BGE (En)
Slutpunktsnamn: databricks-bge-large-en
Indata som stöds: text
BAAI Allmän inbäddning (BGE) är en textinbäddningsmodell som kan mappa valfri text till en inbäddningsvektor med 1 024 dimensioner och ett inbäddningsfönster med 512 token. Dessa vektorer kan användas i vektorindex för LLM:er och för uppgifter som hämtning, klassificering, frågesvar, klustring eller semantisk sökning. Den här slutpunkten hanterar den engelska versionen av modellen och genererar normaliserade inbäddningar.
Inbäddningsmodeller är särskilt effektiva när de används tillsammans med LLM:er för användningsfall med utökad generering baserad på återhämtning (RAG). BGE kan användas för att hitta relevanta textfragment i stora delar av dokument som kan användas i kontexten för en LLM.
I RAG-program kanske du kan förbättra prestandan för ditt hämtningssystem genom att inkludera en instruktionsparameter. BGE-författarna rekommenderar att du provar instruktionen "Represent this sentence for searching relevant passages:" för frågeinbäddningar, även om dess prestandapåverkan är domänberoende.