Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
In dit artikel worden de geavanceerde open modellen beschreven die worden ondersteund door Databricks Foundation-model-API's.
Opmerking
Zie Ondersteunde basismodellen op Model serving voor beschikbaarheid van regio's van deze modellen en de ondersteunde functiegebieden.
Opmerking
Op Azure Databricks, OpenAI- en Google Gemini-modellen, samen met Zhipu AI GLM 5.3, GLM 5.3 Flash en GLM 5.2, Moonshot AI Kimi K3, Thinking Machine Labs Inkling en DeepSeek V4 Flash, zijn beschikbaar via ADI Services, geleverd door Databricks. Voor opstelling en toegang, zie ADI Services.
U kunt queryaanvragen naar deze modellen verzenden met behulp van de eindpunten voor betalen per token die beschikbaar zijn in uw Databricks-werkruimte. Zie Gebruik basismodellen en de tabel met modellen die betaling per token ondersteunen voor de namen van de modeleindpunten om te gebruiken.
Naast het ondersteunen van modellen in de betalen-per-token modus, biedt de Foundation Model-API ook de gereserveerde doorvoermodus aan. Databricks raadt geprovisioneerde doorvoer aan voor productiewerkbelastingen. Deze modus ondersteunt alle modellen van een modelarchitectuurfamilie, waaronder de fijn-afgestemde en op maat vooraf getrainde modellen die worden ondersteund in de betalen per token modus. Zie Provisioned throughput Foundation Model API's voor de lijst met ondersteunde architecturen.
U kunt met deze ondersteunde modellen communiceren met behulp van de AI Playground-.
Voor OpenAI-, Google-, Gemini- en Anthropic-modellen komen het contextvenster en de maximale outputtokens overeen met de waarden die door de respectievelijke modelaanbieder zijn gepubliceerd.
OpenAI GPT-5.6 Sol
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-6-sol
Ondersteunde invoer: tekst, afbeelding
GPT-5.6 Sol, ook wel GPT-5.6 genoemd, is het vlaggenschipmodel van OpenAI in de GPT-5.6-familie, dat state-of-the-art prestaties levert op het gebied van agentisch coderen, lange-horizon redeneren en complex gebruik van tools, met ondersteuning voor een nieuwe maximale redeneerinspanning. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.6 Terra
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-6-terra
Ondersteunde invoer: tekst, afbeelding
GPT-5.6 Terra is het gebalanceerde model in OpenAI's GPT-5.6-familie voor dagelijkse agentische en redeneerwerklasten, en biedt prestaties die concurreren met GPT-5.5 tegen lagere kosten. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.6 Luna
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-6-luna
Ondersteunde invoer: tekst, afbeelding
GPT-5.6 Luna is het snelle, kostenefficiënte model in OpenAI's GPT-5.6-familie, dat sterke redenering en agentische capaciteit biedt tegen de laagste kosten in het gamma. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.5 Pro
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
GPT-5.5 Pro gebruikt uitgebreide promptcaching. Gecachte tensoren worden niet langer dan 24 uur opgeslagen in GPU-lokale opslag.
Opmerking
Dit model wordt niet ondersteund in AI Playground. Gebruik de Responses API om met dit model te communiceren.
Eindpuntnaam: databricks-gpt-5-5-pro
Ondersteunde invoer: tekst, afbeelding
GPT-5.5 Pro is een variant met hogere nauwkeurigheid van GPT-5.5, gericht op de moeilijkste problemen, waaronder diepgaand onderzoek, geavanceerde wiskunde en hooginzet redeneren. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.5
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
GPT-5.5 gebruikt uitgebreide promptcaching. Gecachte tensoren worden niet langer dan 24 uur opgeslagen in GPU-lokale opslag.
Opmerking
Dit model wordt niet ondersteund in AI Playground. Gebruik de Responses API om met dit model te communiceren.
Eindpuntnaam: databricks-gpt-5-5
Ondersteunde invoer: tekst, afbeelding
GPT-5.5 is OpenAI's sterkste frontiermodel voor enterprise agent-workflows, complexe documentredenering en langetermijncodeeragenten. GPT-5.5 voedt ook Codex, de codeeragent van OpenAI. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.4
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-4
Ondersteunde invoer: tekst, afbeelding
GPT-5.4 is een algemeen groottaalmodel met redeneermogelijkheden, ontwikkeld door OpenAI. Het levert verbeterde prestaties bij complexe taken met verhoogde nauwkeurigheid en meer doordachte en gestructureerde redenering. Dit model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.4 mini
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-4-mini
Ondersteunde invoer: tekst, afbeelding
GPT-5.4 mini is een kostengeoptimaliseerd algemeen taalmodel met redeneermogelijkheden, ontwikkeld door OpenAI. Gebouwd op de GPT-5.4-architectuur levert dit model verbeterde prestaties op goed gedefinieerde taken die betrouwbare redenering, nauwkeurige taal en snelle output vereisen. Het ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.4 nano
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-4-nano
Ondersteunde invoer: tekst, afbeelding
GPT-5.4 nano is een algemeen groottaalmodel met redeneermogelijkheden, ontwikkeld door OpenAI. Gebouwd op de GPT-5.4-architectuur, blinkt dit model uit in taken met hoge doorvoersnelheid zoals eenvoudige instructievolging of classificatie voor routinematige bedrijfsprocessen of mobiele applicaties. Het ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.3 Codex
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Opmerking
Dit model wordt niet ondersteund in AI Playground. Gebruik de Responses API om met dit model te communiceren.
Eindpuntnaam: databricks-gpt-5-3-codex
Ondersteunde invoer: tekst, afbeelding
GPT-5.3 Codex is OpenAI's meest geavanceerde agentische coderingsmodel, ontworpen om complexe, langlopende taken aan te kunnen die onderzoek, het gebruik van tools en uitvoering vereisen. Het combineert toonaangevende codeerprestaties met het redeneren en de professionele kennis van GPT-5.2, terwijl het 25% sneller werkt. Het model ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.2
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-2
Ondersteunde invoer: tekst, afbeelding
GPT-5.2 is een algemeen groottaalmodel met redeneermogelijkheden ontwikkeld door OpenAI. Dit model bouwt direct voort op GPT-5.1 en biedt een hogere nauwkeurigheid, verbeterde token-efficiëntie bij middelgrote tot complexe taken en meer doordachte gestructureerde redenering. Dit model blinkt uit in gestructureerde extractie, meerstapsworkflows en multimodale taken. Het ondersteunt multimodale inputs.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5.1
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-1
Ondersteunde invoer: tekst, afbeelding
GPT-5.1 is een algemeen groottaalmodel met redeneermogelijkheden ontwikkeld door OpenAI. Dit model bevat zowel Instant- als Denkmodus voor snelle gesprekken of diep redeneren, waarbij eenvoudige of complexe taken automatisch worden aangepast. Het model blinkt uit in contentcreatie, tutoring, technische ondersteuning en coderen, met minder afhankelijkheid van strikte prompt-engineering dan eerdere versies. Het ondersteunt multimodale inputs. Lees meer over GPT-5.1.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5
Ondersteunde invoer: tekst, afbeelding
GPT-5 is een geavanceerd, algemeen bruikbaar groot taalmodel en redeneermodel, ontwikkeld en getraind door OpenAI. Het ondersteunt multimodale inputs. Het model is gebouwd voor het coderen, chatten, redeneren en agentgestuurde taken.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5 mini
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-mini
Ondersteunde invoer: tekst, afbeelding
GPT-5 mini is een geavanceerd, algemeen toepasbaar groot taalmodel en begripmodel, gebouwd en getraind door OpenAI. Het ondersteunt multimodale inputs. Het model is kostengeoptimeerd voor redenerings- en chatworkloads en excelt op goed gedefinieerde taken waarvoor betrouwbare redenering, nauwkeurige taal en snelle uitvoer voor tekst en afbeeldingen is vereist.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT-5 nano
Belangrijk
Klanten zijn verantwoordelijk voor het waarborgen van hun naleving van toepasselijke modelvoorwaarden.
Eindpuntnaam: databricks-gpt-5-nano
Ondersteunde invoer: tekst, afbeelding
GPT-5 nano is een geavanceerd, algemeen doel groot taalmodel en een redeneringsmodel, gebouwd en getraind door OpenAI. Het ondersteunt multimodale inputs. Het model excelleert bij hoog doorvoertaken, zoals eenvoudig instructie-volgen of classificatie voor routinematige bedrijfsprocessen of voor mobiele toepassingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.7 Flash
Belangrijk
Zie Toepasselijke modelvoorwaarden voor Gemini 3.7 Flash.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-7-flash
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.7 Flash is een multimodaal AI-model ontwikkeld en getraind door Google. Het ondersteunt functie-aanroepen en hybride redeneren voor algemene en multimodale werklasten. De reasoning_effort parameter accepteert waarden van "low", "medium" (standaard), of "high". Gemini 3.7 Flash ondersteunt "minimal"geen .
Lees meer over Gemini 3.7 Flash.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.6 Flash
Belangrijk
Zie Toepasselijke modelvoorwaarden voor Gemini 3.6 Flash.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-6-flash
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.6 Flash is een snel, kostenefficiënt, multimodaal AI-model ontwikkeld en getraind door Google. Als opvolger van Gemini 3.5 Flash biedt dit model sterkere redenering, geavanceerde multimodale mogelijkheden en verbeterde prijsprestaties voor productieschaal-implementaties. Gemini 3.6 Flash is geoptimaliseerd voor high-throughput workloads zoals complexe video-analyse, data-extractie en visuele Q&A's. Lees meer over Gemini 3.6 Flash.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.5 Flash
Belangrijk
Zie Toepasselijke modeltermen voor Gemini 3.5 Flash.
Eindpuntnaam: databricks-gemini-3-5-flash
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.5 Flash is een snel, kostenefficiënt, multimodaal AI-model ontwikkeld en getraind door Google. Als een belangrijke stap vooruit ten opzichte van Gemini 3 Flash biedt dit model sterkere redenering, geavanceerde multimodale mogelijkheden en verbeterde prijsprestaties voor productieschaal-implementaties. Gemini 3.5 Flash is geoptimaliseerd voor high-throughput workloads zoals complexe video-analyse, data-extractie en visuele Q&A's. Lees meer over Gemini 3.5 Flash.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.5 Flash Lite
Belangrijk
Zie Toepasselijke modelvoorwaarden voor Gemini 3.5 Flash Lite.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-5-flash-lite
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.5 Flash Lite is het snelste en meest kostenefficiënte model in de Gemini 3-serie, ontwikkeld en getraind door Google. Het model ondersteunt multimodale invoer met afbeeldingsmogelijkheden, functieaanroep en gestructureerde uitvoer. Gemini 3.5 Flash Lite is geoptimaliseerd voor hoog-doorvoer, kosteneffectieve implementaties.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.1 Pro Preview
Belangrijk
Zie toepasselijke modelvoorwaarden voor Gemini 3.1 Pro Preview.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-1-pro
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.1 Pro Preview is een geavanceerd hybride redeneermodel ontwikkeld en getraind door Google. Het levert sterke redenering en documentintelligentie, waardoor het een overal slim model is voor complexe workflows en taken. Het blinkt uit in complex redeneren, diepgaande analyse en multimodaal begrip over een breed scala aan inputs en taken.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.1 Flash Afbeelding
Belangrijk
Zie Toepasselijke modeltermen voor Gemini 3.1 Flash Image.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Dit model genereert afbeeldingen als output, naast tekst. Google gebruikt pass-through pricing voor dit model, en outputbeeldtokens worden apart gefactureerd van outputteksttokens. Zie de prijzen van Google's Gemini 3.1 Flash Image voor details.
Gemini 3.1 Flash Image is alleen beschikbaar via Foundation Model API's pay-per-token. Het wordt niet ondersteund voor provisioned throughput, AI Functions batchinferentie, ai_query, of AI Playground.
Eindpuntnaam: databricks-gemini-3-1-flash-image
Ondersteunde invoer: tekst, afbeelding
Gemini 3.1 Flash Image is het Gemini-model van Google's beeldgeneratie. Een enkel verzoek kan gegenereerde afbeeldingen samen met tekst teruggeven. Dit model ondersteunt geen functie-aanroepen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3.1 Flash Lite
Belangrijk
Zie Toepasselijke modeltermen voor Gemini 3.1 Flash Lite.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-1-flash-lite
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3.1 Flash Lite is het snelste en meest rendabele model in de Gemini 3-serie, ontwikkeld en getraind door Google. Het model is gebouwd voor intelligentie op schaal en ondersteunt multimodale invoer met mogelijkheden voor afbeeldingen, functie-aanroepen en gestructureerde uitvoer. Gemini 3.1 Flash Lite is geoptimaliseerd voor implementaties met hoge doorvoer en kostenbesparing. Meer informatie over Gemini 3.1 Flash Lite.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3 Pro Afbeelding
Belangrijk
Zie Toepasselijke modeltermen voor Gemini 3 Pro afbeelding.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Dit model genereert afbeeldingen als output, naast tekst. Google gebruikt pass-through pricing voor dit model, en outputbeeldtokens worden apart gefactureerd van outputteksttokens. Zie de prijzen van Google's Gemini 3 Pro Image voor details.
Gemini 3 Pro Image is alleen beschikbaar via Foundation Model API's pay-per-token. Het wordt niet ondersteund voor provisioned throughput, AI Functions batchinferentie, ai_query, of AI Playground.
Eindpuntnaam: databricks-gemini-3-pro-image
Ondersteunde invoer: tekst, afbeelding
Gemini 3 Pro Image is het Gemini-model van Google's beeldgeneratie. Een enkel verzoek kan gegenereerde afbeeldingen samen met tekst teruggeven. Dit model ondersteunt geen functie-aanroepen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 3 Flash
Belangrijk
Zie Toepasselijke modelvoorwaarden voor Gemini 3 Flash.
Dit model wordt gehost op een globaal eindpunt en vereist dat routering tussen geografische regio's is ingeschakeld.
Eindpuntnaam: databricks-gemini-3-flash
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 3 Flash is een snel, kostenefficiënt multimodaal AI-model ontwikkeld en getraind door Google. Dit model biedt snelheid en schaalbaarheid zonder concessies te doen aan de kwaliteit, met geavanceerde multimodale mogelijkheden voor complexe video-analyse, data-extractie en visuele Q&A's in bijna realtime. Gemini 3 Flash levert betere prijs, prestaties en snellere snelheden, waardoor productieschaal-implementaties mogelijk zijn. Lees meer over Gemini 3 Flash.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 2.5 Pro
Belangrijk
Zie Toepasselijke modelvoorwaarden voor de Gemini 2.5 Pro.
Google Gemini 2.5 Pro wordt op 2 oktober 2026 met pensioen gestuurd. Zie Afgeschafte en buiten gebruik gestelde modellen voor het aanbevolen vervangingsmodel en richtlijnen voor het migreren tijdens afschaffing.
Eindpuntnaam: databricks-gemini-2-5-pro
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 2.5 Pro is een hybride redeneermodel ontwikkeld en getraind door Google. Gemini 2.5 Pro's "Deep Think Mode" en ingebouwde audio-uitvoer stellen het op als een toonaangevend model voor bedrijfs-, onderzoeks- en creatieve toepassingen. Het is ontworpen om uit te blinken bij complexe redenering, grondige analyse en multimodale kennis over een breed scala aan invoer en taken. Meer informatie over Gemini 2.5 Pro.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemini 2.5 Flash
Belangrijk
Zie Toepasselijke modeltermen voor de Gemini 2.5 Flash.
Google Gemini 2.5 Flash is buiten gebruik gesteld en staat gepland voor pensioen op 2 oktober 2026. Zie Afgeschafte en buiten gebruik gestelde modellen voor het aanbevolen vervangingsmodel en richtlijnen voor het migreren tijdens afschaffing.
Eindpuntnaam: databricks-gemini-2-5-flash
Ondersteunde invoer: tekst, afbeelding, video, audio
Gemini 2.5 Flash is een snel, kostenefficiënt, multimodale AI-model dat door Google is ontwikkeld en getraind. Het is het eerste volledig hybride redeneringsmodel van Google, ontworpen voor ontwikkelaars en ondernemingen die snelle, schaalbare en betaalbare AI-oplossingen zoeken. Gemini 2.5 Flash is geoptimaliseerd voor realtime en grote volumes zoals chatbots, gegevensextractie, vertaling en documentparsering. Meer informatie over Gemini 2.5 Flash.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Alibaba Cloud Qwen3.5 122B A10B
Belangrijk
Het Qwen3.5 122B A10B-model is in openbare preview.
Eindpuntnaam: databricks-qwen35-122b-a10b
Ondersteunde invoer: tekst
Qwen3.5 122B A10B is een hybride Mix-of-Experts -redeneringsmodel gebouwd en getraind door Alibaba Cloud, met 122 miljard totale parameters en 10 miljard actieve parameters per deductie. Het model ondersteunt een contextvenster van 256K en maximaal 25K outputtokens, en levert sterke prestaties op het gebied van redeneren, programmeren en agentische taken. Als model met alleen redeneren kan Qwen3.5 122B A10B altijd worden gebruikt voordat ze reageren en kan redenering niet worden uitgeschakeld.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Alibaba Cloud Qwen3-Embedding-0.6B
Belangrijk
Het Qwen3-Embedding-0.6B-model bevindt zich in openbare preview.
Eindpuntnaam: databricks-qwen3-embedding-0-6b
Ondersteunde invoer: tekst
Qwen3-Embedding-0.6B is een compact model voor het insluiten van tekst met ~600M-parameters, ontworpen voor semantische taken, zoals ophalen, overeenkomsten zoeken, clusteren en classificatie. Het codeert tekst in dichte vectoren die betekenis vertegenwoordigen in plaats van oppervlaktevorm.
Het model ondersteunt meer dan 100 talen (inclusief code) en verwerkt lange contexten tot ~32K-tokens, waardoor het geschikt is voor het insluiten van lange documenten. Het produceert insluitingen met een configureerbare dimensionaliteit tot 1024 en is instructiebewust, waardoor taakspecifieke vooroordelen via prompts mogelijk zijn.
Qwen3-Embedding-0.6B is gebouwd op een transformer encoder en is specifiek afgestemd op het genereren van embeddings, waarbij het de kwaliteit van de embeddings in balans brengt met efficiënte inferentie.
Inbeddingsmodellen zijn met name effectief wanneer zij samen met LLMs worden gebruikt voor retentie-verrijkte generatie (RAG)-gebruiksscenario's. Qwen3-Embedding-0.6B kan worden gebruikt om relevante tekstfragmenten te vinden in grote stukken documenten die kunnen worden gebruikt in de context van een LLM.
Alibaba Cloud Qwen3-Next 80B A3B Instruct
Belangrijk
Het model Qwen3-Next 80B A3B Instruct is in openbare preview.
Eindpuntnaam: databricks-qwen3-next-80b-a3b-instruct
Ondersteunde invoer: tekst
Qwen3-Next-80B-A3B-Instruct is een zeer efficiënt groot taalmodel dat is geoptimaliseerd voor het uitvoeren van instructietaken en is gebouwd en getraind door Alibaba Cloud. Dit model is ontworpen voor het verwerken van ultra lange contexten en excelleert in werkstromen met meerdere stappen, generatie met behulp van opgehaalde informatie, en ondernemingstoepassingen die deterministische output vereisen bij hoge doorvoer.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Zhipu AI GLM 5.3
Eindpuntnaam: databricks-glm-5-3
Ondersteunde invoer: tekst
GLM-5.3 is een tekstgebaseerd mix van experts (MoE) taalmodel ontwikkeld door Zhipu AI voor codering en het gebruik van agentische tools. Het ondersteunt functie-aanroepen, parallelle tool-aanroepen, gestructureerde output, een contextvenster van maximaal 1.048.576 tokens en tot 65.536 outputtokens. Redeneren is altijd ingeschakeld: reasoning_effort accepteert low, high, en max; weggelaten, minimal, medium, of xhigh waarden gebruiken max, en none wordt afgewezen. Zie Query redeneermodellen en de Z.ai GLM-5.3 documentatie.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Zhipu AI GLM 5.3 Flash
Eindpuntnaam: databricks-glm-5-3-flash
Ondersteunde invoer: tekst, afbeelding
GLM-5.3-Flash is een native multimodale mix van experts (MoE) model met 320 miljard totale parameters en 18 miljard actieve parameters, ontwikkeld door Zhipu AI. Het model ondersteunt een contextlengte van 1.048.576 tokens en is geoptimaliseerd voor redeneren, programmeren en het gebruik van agentische tools. Lees meer over GLM-5.3-Flash.
Dit model redeneert altijd, en redeneren kan niet worden uitgeschakeld. Zie Query-redeneringsmodellen voor ondersteunde reasoning_effort waarden en standaardinstellingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Zhipu AI GLM 5.2
Eindpuntnaam: databricks-glm-5-2
Ondersteunde invoer: tekst
GLM-5.2 is een mix of experts (MoE) taalmodel met 753 miljard totale parameters, ontwikkeld door Zhipu AI. Het model ondersteunt een contextlengte van 1 miljoen tokens en is geoptimaliseerd voor langetermijnredeneren, codering en het gebruik van agentische tools.
Dit model ondersteunt aanpasbare redeneerinspanning. Zie Query-redeneringsmodellen voor ondersteunde reasoning_effort waarden en standaardinstellingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Moonshot AI Kimi K3
Eindpuntnaam: databricks-kimi-k3
Ondersteunde invoer: tekst, afbeelding
Kimi K3 is een model met 2,8 biljoen parameters, ontwikkeld door Moonshot AI met native zichtmogelijkheden. Het model ondersteunt een contextlengte van 1 miljoen tokens en is ontworpen voor langetermijncodering, kenniswerk en redeneren.
Dit model ondersteunt aanpasbare redeneerinspanning. Zie Query-redeneringsmodellen voor ondersteunde reasoning_effort waarden en standaardinstellingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
DeepSeek V4 Flash (0731)
Eindpuntnaam: databricks-deepseek-v4-flash-0731
Ondersteunde invoer: tekst
DeepSeek V4 Flash (0731) is een hybride mix van experts (MoE) taalmodel met 284 miljard totale parameters en 13 miljard actieve parameters, ontwikkeld door DeepSeek. Het model is geoptimaliseerd voor snel, kostenefficiënt redeneren, coderen en agentisch hulpmiddelen.
Dit model ondersteunt aanpasbare redeneerinspanning. Zie Query-redeneringsmodellen voor ondersteunde reasoning_effort waarden en standaardinstellingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT OSS 120B
Eindpuntnaam: databricks-gpt-oss-120b
Ondersteunde invoer: tekst
GPT OSS 120B is een geavanceerd, redenerend model met denkproces en aanpasbare niveaus van redeneerinspanning, gebouwd en getraind door OpenAI. Het is het vlaggenschipmodel van OpenAI met een open model en heeft een contextvenster van 128k tokens. Het model is gebouwd voor redeneringstaken van hoge kwaliteit.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
OpenAI GPT OSS 20B
Eindpuntnaam: databricks-gpt-oss-20b
Ondersteunde invoer: tekst
GPT OSS 20B is een state-of-the-art, lichtgewicht redeneringsmodel gebouwd en getraind door OpenAI. Dit model heeft een contextvenster van 128.000 tokens en blinkt uit in realtime copilots en batch-inferentietaken.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Google Gemma 3 12B
Belangrijk
Zie De toepasselijke modeltermen voor de Gemma 3-voorwaarden en het beleid voor acceptabel gebruik.
Eindpuntnaam: databricks-gemma-3-12b
Ondersteunde invoer: tekst, afbeelding
Gemma 3 12B is een multimodale en visiontaalmodel van 12 miljard parameters dat door Google is ontwikkeld als onderdeel van de Gemma 3-familie. Gemma 3 heeft een token context van 128K en biedt meertalige ondersteuning voor meer dan 140 talen. Dit model is ontworpen om zowel tekst- als afbeeldingsinvoer te verwerken en tekstuitvoer te genereren en is geoptimaliseerd voor gebruiksvoorbeelden voor dialoog, het genereren van tekst en het begrijpen van afbeeldingen, waaronder het beantwoorden van vragen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Meta Llama 4 Maverick
Belangrijk
Zie De toepasselijke modelvoorwaarden voor de Llama 4-communitylicentie en het beleid voor acceptabel gebruik.
Eindpuntnaam: databricks-llama-4-maverick
Ondersteunde invoer: tekst, afbeelding
Llama 4 Maverick is een geavanceerd groot taalmodel gebouwd en getraind door Meta. Het is de eerste van de Llama-modelfamilie dat gebruikmaakt van een combinatie van experts-architectuur voor rekenefficiëntie. Llama 4 Maverick ondersteunt meerdere talen en is geoptimaliseerd voor nauwkeurige gebruiksvoorbeelden voor afbeeldingen en tekstbegrip. Meer informatie over Llama 4 Maverick.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Meta Llama 3.3 70B Instruct
Belangrijk
Vanaf 11 december 2024 vervangt Meta-Llama-3.3-70B-Instruct de ondersteuning van Meta-Llama-3.1-70B-Instruct in de pay-per-token-eindpunten van Foundation Model APIs.
Zie De toepasselijke modelvoorwaarden voor de LLama 3.3-communitylicentie en het beleid voor acceptabel gebruik.
Eindpuntnaam: databricks-meta-llama-3-3-70b-instruct
Ondersteunde invoer: tekst
Meta-Llama-3.3-70B-Instruct is een state-of-the-art groot taalmodel met een context van 128.000 tokens dat is gebouwd en getraind door Meta. Het model ondersteunt meerdere talen en is geoptimaliseerd voor gebruiksscenario's voor dialoog. Meer informatie over de Meta Llama 3.3.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Meta Llama 3.1 8B Instruct
Belangrijk
Zie De toepasselijke modelvoorwaarden voor de LLama 3.1-communitylicentie en het beleid voor acceptabel gebruik.
Eindpuntnaam: databricks-meta-llama-3-1-8b-instruct
Ondersteunde invoer: tekst
Meta-Llama-3.1-8B-Instruct is een state-of-the-art grote taalmodel met een context van 128.000 tokens die door Meta zijn gebouwd en getraind. Het model ondersteunt meerdere talen en is geoptimaliseerd voor gebruiksscenario's voor dialoog. Meer informatie over de Meta Llama 3.1.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Antropische Claude Haiku 4.5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-haiku-4-5
Ondersteunde invoer: tekst, afbeelding
Claude Haiku 4.5 is het snelste en meest rendabele model van Lantropic, dat een coderingskwaliteit in de buurt van de grens levert met uitzonderlijke snelheid en efficiëntie. Het excelleert in realtime toepassingen met lage latentie, waaronder chatassistenten, klantenservicemedewerkers, pair programming, en rapid prototyping. Dit model is ideaal voor kostenbewuste productie-implementaties en agentische systemen waarvoor responsieve AI-hulp is vereist.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Sonnet 5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-sonnet-5
Ondersteunde invoer: tekst, afbeelding
Opmerking
Claude Sonnet 5 biedt geen ondersteuning voor de temperatureparameters , top_pof top_k steekproeven. Aanvragen met deze parameters retourneren een 400-fout.
Claude Sonnet 5 is Anthropic meest geschikt Sonnet-model, ontworpen voor codering, agentische werkstromen en professioneel werk op schaal. Het combineert bijna opus-niveau intelligentie met de kostenefficiëntie en snelheid van Sonnet, waardoor het goed geschikt is voor klantgerichte agents, productiecoderingswerkstromen en geavanceerde taken voor het genereren van inhoud.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Sonnet 4.6
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-sonnet-4-6
Ondersteunde invoer: tekst, afbeelding
Claude Sonnet 4.6 is het meest geavanceerde hybride redeneringsmodel van Tropic. Het biedt twee modi: bijna directe antwoorden en uitgebreid nadenken om dieper te redeneren op basis van de complexiteit van de taak. Claude Sonnet 4.6 is gespecialiseerd in toepassingen die een balans van praktische doorvoer en geavanceerd denken vereisen, zoals klantgerichte agents, productiecoderingswerkstromen en het genereren van inhoud op schaal.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Antropische Claude Sonnet 4.5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-sonnet-4-5
Ondersteunde invoer: tekst, afbeelding
Claude Sonnet 4.5 is het meest geavanceerde hybride redeneringsmodel van Tropic. Het biedt twee modi: bijna directe antwoorden en uitgebreid nadenken om dieper te redeneren op basis van de complexiteit van de taak. Claude Sonnet 4.5 is gespecialiseerd in toepassingen die een balans tussen praktische doorvoer en geavanceerd denken vereisen, zoals klantgerichte agents, werkstromen voor productiecodering en het genereren van inhoud op schaal.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Fable 5.1
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en, indien van toepassing, de Databricks Business Associate-overeenkomst.
Belangrijk
Voor Claude Fable 5.1 worden prompts en antwoorden 30 dagen bewaard voor vertrouwen en veiligheid. Deze gegevens worden verwerkt door geautomatiseerde veiligheidssystemen en kunnen in bepaalde gevallen worden gemarkeerd voor menselijke beoordeling. De gegevens worden na 30 dagen automatisch verwijderd, behalve in het geval van een veiligheidsonderzoek of wettelijke vereisten om de gegevens langer dan 30 dagen te bewaren. Anthropic is een beperkte subprocessor voor dit veiligheidsretentiedoel.
Eindpuntnaam: databricks-claude-fable-5-1
Ondersteunde invoer: tekst, afbeelding
Claude Fable 5.1 is Anthropic's baanbrekende multimodale redeneermodel voor langlopende agentische codering, kenniswerk en wetenschappelijke ontdekkingen. Het gebruikt altijd-actief adaptief denken en ondersteunt per beurt inspanningscontroles en denkupdates tussen toolcalls voor aanhoudende, complexe workflows.
Claude Fable 5.1 accepteert low, medium, high, xhigh, en max inspanningsniveaus. Redeneren kan niet worden uitgeschakeld. Zie Query-redeneermodellen voor details.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Fable 5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en, indien van toepassing, de Databricks Business Associate-overeenkomst.
Belangrijk
Voor Claude Fable 5 worden prompts en antwoorden 30 dagen bewaard voor vertrouwens- en veiligheidsdoeleinden. Deze gegevens worden verwerkt door geautomatiseerde veiligheidssystemen en kunnen in bepaalde gevallen worden gemarkeerd voor menselijke beoordeling. De gegevens worden na 30 dagen automatisch verwijderd, behalve in het geval van een veiligheidsonderzoek of wettelijke vereisten om de gegevens langer dan 30 dagen te bewaren. Anthropic is een beperkte subprocessor voor dit veiligheidsretentiedoel.
Eindpuntnaam: databricks-claude-fable-5
Ondersteunde invoer: tekst
Claude Fable 5 is een Mythos-klassemodel uit Anthropic ontworpen voor autonome kenniswerk en codering. Met robuuste beveiligingen die zijn ingebouwd, kan het langlopende, complexe en asynchrone taken verwerken met minder behoefte aan menselijke check-ins dan eerdere modellen, waardoor het goed geschikt is voor agentische werkstromen waarvoor langdurige aandacht nodig is in uitgebreide contexten.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Opus 5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-5
Ondersteunde invoer: tekst, afbeelding
Claude Opus 5 is Anthropic meest geschikt hybride redeneringsmodel, dat voortbouwt op de Opus-serie met een focus op agentische codering, codebeoordeling en autonoom werken met lange horizon. Dit model excelleert bij complexe softwaretaken met meerdere bestanden, zoals grote herstructureringen en end-to-end functieontwikkeling, het vinden van fouten met hoge precisie, coördinatie van meerdere agents en vision-taken, zoals grafieken, documenten en inzicht in de gebruikersinterface. Claude Opus 5 onderhoudt sterke instructievolging, toolcalling en redeneren over het volledige contextvenster, en levert bijna topkwaliteit bij lage en middelmatige redeneerinspanning, waardoor het zeer geschikt is voor lang-context, kostengevoelige bedrijfsworkflows.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Opus 4.8
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-4-8
Ondersteunde invoer: tekst, afbeelding
Claude Opus 4.8 bouwt voort op de Opus-serie met verdere verbeteringen in nauwkeurigheid, efficiëntie en redeneringsmogelijkheden. Dit model excelleert bij complexe extractie- en agentische redeneringstaken met ondersteuning voor afbeeldingen, waardoor het ideaal is voor bedrijfstoepassingen waarvoor uitgebreide analyse, documentbegrip en geavanceerde werkstromen met meerdere stappen nodig zijn.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Opus 4.7
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-4-7
Ondersteunde invoer: tekst, afbeelding
Claude Opus 4.7 is het meest geschikte hybride redeneringsmodel van Tropic, waarbij de Opus-serie wordt uitgebreid met verbeterde nauwkeurigheid, efficiëntie en verbeterde visuele mogelijkheden. Dit model biedt betere prestaties bij complexe extractie- en agentische redeneringstaken, terwijl er minder uitvoertokens worden gebruikt dan de voorafgaande taak. Claude Opus 4.7 biedt ondersteuning voor verhoogde beeldresolutie, waardoor het ideaal is voor bedrijfsapplicaties die diepgaande analyse, documentbegrip en geavanceerde meerstapsworkflows vereisen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Opus 4.6
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-4-6
Ondersteunde invoer: tekst, afbeelding
Claude Opus 4.6 is het meest geschikte hybride redeneringsmodel van Tropic met adaptieve denkmogelijkheden. Dit model introduceert een nieuw maximale inspanningsniveau voor de meest veeleisende taken, waarbij hoge inspanning is ingesteld als de standaardinstelling voor optimale prestaties. Claude Opus 4.6 excelleert bij complexe redenering, grondige analyse, het genereren van code, onderzoek en geavanceerde werkstromen met meerdere stappen. Het is ideaal voor bedrijfsapplicaties die zowel uitgebreide analyse als uitgebreide output vereisen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Anthropic Claude Opus 4.5
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-4-5
Ondersteunde invoer: tekst, afbeelding
Claude Opus 4.5 is het meest geschikte hybride redeneringsmodel van Antropic, gebouwd voor de meest complexe taken waarvoor diepgaande analyse en uitgebreid denken vereist zijn. Dit model combineert krachtige algemene mogelijkheden met geavanceerde redenering, excellerend bij het genereren van code, onderzoek, het maken van inhoud en geavanceerde agentische werkstromen met meerdere stappen. Claude Opus 4.5 ondersteunt tekst- en beeldinvoer, waardoor het ideaal is voor bedrijfsapplicaties die zowel breedte als diepgang van begrip vereisen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Antropische Claude Sonnet 4
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Anthropic Claude Sonnet 4 is afgeschaft. Zie Afgeschafte en buiten gebruik gestelde modellen voor de buitengebruikstellingsdatum, aanbevolen vervangingsmodel en richtlijnen voor het migreren tijdens afschaffing.
Eindpuntnaam: databricks-claude-sonnet-4
Ondersteunde invoer: tekst, afbeelding
Claude Sonnet 4 is een state-of-the-art, hybride redeneringsmodel gebouwd en getraind door Antropicus. Dit model biedt twee modi: bijna directe antwoorden en uitgebreid nadenken om dieper te redeneren op basis van de complexiteit van de taak. Claude Sonnet 4 is geoptimaliseerd voor verschillende taken, zoals codeontwikkeling, grootschalige inhoudsanalyse en ontwikkeling van agenttoepassingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Antropische Claude Opus 4.1
Belangrijk
Klanten zijn verantwoordelijk voor de naleving van het gebruiksbeleid van Lantropic. Zie ook de Databricks Master Cloud Services-overeenkomst en waar van toepassing de Databricks Business Associate-overeenkomst.
Eindpuntnaam: databricks-claude-opus-4-1
Ondersteunde invoer: tekst, afbeelding
Claude Opus 4.1 is een state-of-the-art, hybride redeneringsmodel gebouwd en getraind door Antropisch. Dit algemene grote taalmodel is ontworpen voor zowel complexe redenering als echte toepassingen op ondernemingsniveau. Het ondersteunt tekst- en afbeeldingsinvoer. Dit model excelleert in taken zoals het genereren van code, onderzoek en het maken van inhoud, en werkstromen voor agents met meerdere stappen zonder constante menselijke tussenkomst.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
Dit eindpunt wordt gehost door Databricks binnen de Databricks-beveiligingsperimeter.
Thinking Machine Labs Inkling
Belangrijk
Inkling is in Public Preview.
Eindpuntnaam: databricks-inkling
Ondersteunde invoer: tekst, afbeelding
Inkling is een mix of experts (MoE) taalmodel met 975 miljard totale parameters en 41 miljard actieve parameters, ontwikkeld door Thinking Machine Labs. Het model ondersteunt een contextlengte van 1 miljoen tokens en is geoptimaliseerd voor codering, redeneren en agentische toolgebruiktaken.
Dit model redeneert altijd. Zie Query-redeneringsmodellen voor ondersteunde reasoning_effort waarden en standaardinstellingen.
AI-modellen kunnen fouten maken, intenties verkeerd begrijpen en hallucineeren of onjuiste antwoorden geven. Databricks raadt klanten aan hun modellen te evalueren om ervoor te zorgen dat ze werken zoals bedoeld.
GTE Large (en)
Eindpuntnaam: databricks-gte-large-en
Ondersteunde invoer: tekst
GTE (General Text Embedding) is een model voor het insluiten van tekst dat elke tekst kan toewijzen aan een insluitingsvector van 1024 dimensies en een insluitvenster van 8192 tokens. Deze vectoren kunnen worden gebruikt in vectorindexen voor LLM's en voor taken zoals ophalen, classificatie, vragen beantwoorden, clusteren of semantische zoekopdrachten. Dit eindpunt dient de Engelse versie van het model en genereert geen genormaliseerde insluitingen.
Inbeddingsmodellen zijn met name effectief wanneer zij samen met LLMs worden gebruikt voor retentie-verrijkte generatie (RAG)-gebruiksscenario's. GTE kan worden gebruikt om relevante tekstfragmenten te vinden in grote stukken documenten die kunnen worden gebruikt in de context van een LLM.
BGE Large (En)
Eindpuntnaam: databricks-bge-large-en
Ondersteunde invoer: tekst
BAAI General Embedding (BGE) is een model voor het insluiten van tekst dat elke tekst kan toewijzen aan een insluitingsvector van 1024 dimensies en een insluitvenster van 512 tokens. Deze vectoren kunnen worden gebruikt in vectorindexen voor LLM's en voor taken zoals ophalen, classificatie, vragen beantwoorden, clusteren of semantische zoekopdrachten. Dit eindpunt dient de Engelse versie van het model en genereert genormaliseerde insluitingen.
Inbeddingsmodellen zijn met name effectief wanneer zij samen met LLMs worden gebruikt voor retentie-verrijkte generatie (RAG)-gebruiksscenario's. BGE kan worden gebruikt om relevante tekstfragmenten te vinden in grote stukken documenten die kunnen worden gebruikt in de context van een LLM.
In RAG-toepassingen kunt u mogelijk de prestaties van uw ophaalsysteem verbeteren door een instructieparameter op te geven. De BGE-auteurs raden aan de instructie "Represent this sentence for searching relevant passages:" te proberen voor het insluiten van query's, hoewel de invloed van de prestaties afhankelijk is van een domein.