Databricks によってホストされている基礎モデルが Foundation Model API で利用可能です

この記事では、 Databricks Foundation Model API でサポートされている最新のオープン モデルについて説明します。

これらの モデルの リージョンの可用性とサポートされている機能領域については、Model Serving でサポートされている基盤モデルを参照してください。

Azure Databricksでは、OpenAIやGoogle Geminiのモデル、Zhipu AI GLM 5.3 FlashおよびGLM 5.2、Moonshot AI Kimi K3、Thinking Machine Labs Inkling、DeepSeek V4 FlashがDatabricksが提供するADIサービスを通じて利用可能です。 設定およびアクセスについては 、ADIサービスをご覧ください。

Databricks ワークスペースで使用可能なトークンごとの支払いエンドポイントを使用して、これらのモデルにクエリ要求を送信できます。 使用するモデル エンドポイントの名前については、基本モデルの使用に関するページとトークン単位の支払いがサポートされているモデルの表を参照してください。

Foundation Model API では、トークンごとの支払いモードでのモデルのサポートに加えて、プロビジョニング済みスループット モードも提供されます。 Databricks では、運用環境のワークロードに対してプロビジョニングされたスループットが推奨されます。 このモードでは、トークンごとの支払いモードでサポートされる微調整済みおよびカスタムの事前トレーニング済みモデルを含む、モデル アーキテクチャ ファミリのすべてのモデルがサポートされます。 サポートされているアーキテクチャの一覧については、プロビジョニング済みスループット基盤モデル API を参照してください。

これらのサポートされているモデルは、AI Playgroundを使用して操作できます。

OpenAI、Google Gemini、Anthropicモデルでは、コンテキストウィンドウと最大出力トークンはそれぞれのモデル提供者が公開した値と一致します。

OpenAI GPT-5.6 ソル

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-6-sol

サポートされている入力: テキスト、画像

GPT-5.6 Sol(GPT-5.6とも呼ばれる)は、GPT-5.6ファミリーにおけるOpenAIの旗艦モデルであり、エージェントコーディング、長期推論、複雑なツールの使用において最先端の性能を提供し、新たな最大推論努力をサポートします。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.6 テラ

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-6-terra

サポートされている入力: テキスト、画像

GPT-5.6 Terraは、日常的なエージェント的および推論ワークロードに適したOpenAIのGPT-5.6ファミリーのバランスモデルであり、GPT-5.5と競合するパフォーマンスを低コストで提供します。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.6 ルナ

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-6-luna

サポートされている入力: テキスト、画像

GPT-5.6 LunaはOpenAIのGPT-5.6ファミリーの中で高速でコスト効率の良いモデルであり、強力な推論力とエージェント能力を最も低コストで提供しています。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.5 Pro

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

GPT-5.5 Proは 拡張プロンプトキャッシュを使用します。 キャッシュされたテンソルはGPUローカルストレージに最大24時間しか保存されません。

このモデルは AI Playgroundではサポートされていません。 このモデルとやり取りするには Responses API を使ってください。

エンドポイント名: databricks-gpt-5-5-pro

サポートされている入力: テキスト、画像

GPT-5.5 Pro は、GPT-5.5の高精度バリアントで、深い研究、高度な数学、そして高リスクの推論など、最も難しい問題に特化しています。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.5

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

GPT-5.5は 拡張プロンプトキャッシュを使用します。 キャッシュされたテンソルはGPUローカルストレージに最大24時間しか保存されません。

このモデルは AI Playgroundではサポートされていません。 このモデルとやり取りするには Responses API を使ってください。

エンドポイント名: databricks-gpt-5-5

サポートされている入力: テキスト、画像

GPT-5.5 は、OpenAIがエンタープライズエージェントのワークフロー、複雑なドキュメント推論、長期コーディングエージェントに向けた最強のフロンティアモデルです。 GPT-5.5はOpenAIのコーディングエージェントであるCodexの動力源でもあります。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.4

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-4

サポートされている入力: テキスト、画像

GPT-5.4 はOpenAIによって開発された、推論能力を備えた汎用大規模言語モデルです。 複雑なタスクにおいて、精度の向上とより意図的なスキャフォールド的な推論でパフォーマンスを向上させます。 このモデルはマルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.4 mini

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-4-mini

サポートされている入力: テキスト、画像

GPT-5.4 miniは、OpenAIによって開発されたコスト最適化された汎用大規模言語モデルで、推論能力を備えています。 GPT-5.4アーキテクチャを基に構築されたこのモデルは、信頼できる推論、正確な言語、迅速な出力を必要とする明確なタスクでパフォーマンスを向上させます。 マルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.4 nano

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-4-nano

サポートされている入力: テキスト、画像

GPT-5.4 nanoは、OpenAIによって開発された推論能力を備えた汎用大規模言語モデルです。 GPT-5.4アーキテクチャを基に構築されたこのモデルは、単純な命令追従や日常業務プロセス、モバイルアプリケーションの分類などの高スループット作業に優れています。 マルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.3 コデックス

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

このモデルは AI Playgroundではサポートされていません。 このモデルとやり取りするには Responses API を使ってください。

エンドポイント名: databricks-gpt-5-3-codex

サポートされている入力: テキスト、画像

GPT-5.3 CodexはOpenAIで最も高度なエージェントコーディングモデルであり、研究、ツール使用、実行に関わる複雑で長期的なタスクを扱うよう設計されています。 最先端のコーディング性能とGPT-5.2の論理・専門知識を組み合わせ、25% の高速動作を実現しています。 モデルはマルチモーダル入力をサポートしています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.2

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-2

サポートされている入力: テキスト、画像

GPT-5.2は、OpenAIによって開発された推論能力を備えた汎用大規模言語モデルです。 このモデルはGPT-5.1を直接基盤とし、より高い精度、中複雑度のタスクにおけるトークン効率の向上、そしてより意図的なスキャフォールド推論を提供します。 このモデルは構造化抽出、多段階ワークフロー、多モーダルタスクに優れています。 マルチモーダル入力に対応しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5.1

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-1

サポートされている入力: テキスト、画像

GPT-5.1は、OpenAIによって開発された推論能力を備えた汎用大規模言語モデルです。 このモデルは、迅速な会話や深い推論のためのインスタントモードとシンキングモードの両方を備え、単純なタスクから複雑なタスクまで自動的に調整します。 このモデルはコンテンツ制作、チュータリング、技術サポート、コーディングに優れており、従来のバージョンよりも厳密なプロンプトエンジニアリングへの依存度が低いです。 マルチモーダル入力に対応しています。 GPT-5.1について詳しくはこちらをご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5

サポートされている入力: テキスト、画像

GPT-5 は、OpenAI によって構築およびトレーニングされた最先端の汎用大規模言語モデルおよび推論モデルです。 マルチモーダル入力に対応しています。 モデルは、コーディング、チャット、推論、エージェント駆動型のタスク用に構築されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5ミニ

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-mini

サポートされている入力: テキスト、画像

GPT-5 mini は、OpenAI によって構築およびトレーニングされた最先端の汎用大規模言語モデルおよび推論モデルです。 マルチモーダル入力に対応しています。 このモデルは、推論とチャットのワークロード用にコスト最適化されており、信頼性の高い推論、正確な言語、テキストと画像の迅速な出力を必要とする明確に定義されたタスクに優れています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT-5 nano

重要

顧客は 適用されるモデル用語への適合を確保する責任があります。

エンドポイント名: databricks-gpt-5-nano

サポートされている入力: テキスト、画像

GPT-5 nano は、OpenAI によって構築およびトレーニングされた最先端の汎用大規模言語モデルおよび推論モデルです。 マルチモーダル入力に対応しています。 このモデルは、単純な命令のフォローや、日常的なビジネス プロセスやモバイル アプリケーションの分類などの高スループットタスクに優れています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3.7 FlashをGoogleで検索してみてください

重要

ジェミニ3.7フラッシュの 適用モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-7-flash

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.7 Flashは、Googleによって開発・訓練されたマルチモーダルAIモデルです。 汎用およびマルチモーダルワークロード向けの関数呼び出しやハイブリッド推論をサポートします。 reasoning_effortパラメータは"low""medium"(デフォルト)、または"high"の値を受け入れます。 Gemini 3.7 Flashは "minimal"をサポートしていません。 Gemini 3.7 Flashについて詳しく学びましょう。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3.6 FlashをGoogleで検索してみてください

重要

ジェミニ3.6フラッシュの 適用モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-6-flash

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.6 Flashは、Googleによって開発・訓練された高速でコスト効率の高いマルチモーダルAIモデルです。 Gemini 3.5 Flashの後継モデルとして、このモデルはより強力な論理性、高度なマルチモーダル機能、そして生産規模での導入に適した価格パフォーマンスの向上を提供します。 Gemini 3.6 Flashは、複雑なビデオ解析、データ抽出、ビジュアルQ&Aなどの高スループットワークロードに最適化されています。 Gemini 3.6 Flashについて詳しく学びましょう。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

GoogleでGemini 3.5 Flashを検索してみてください

重要

ジェミニ3.5フラッシュの 適用モデル用語 を参照してください。

エンドポイント名: databricks-gemini-3-5-flash

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.5 Flashは、Googleによって開発・訓練された高速かつコスト効率の高いマルチモーダルAIモデルです。 Gemini 3 Flashからの大幅な進化として、このモデルはより強力な論理性、高度なマルチモーダル機能、そして生産規模での導入における価格パフォーマンスの向上を提供します。 Gemini 3.5 Flashは、複雑なビデオ解析、データ抽出、ビジュアルQ&Aなどの高スループットワークロードに最適化されています。 Gemini 3.5 Flashについて詳しくはこちらをご覧ください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3.5 Flash LiteをGoogleで検索してみてください

重要

ジェミニ3.5フラッシュライトの 適用モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-5-flash-lite

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.5 Flash Liteは、Gemini 3シリーズの中で最も高速かつコスト効率の良いモデルで、Googleが開発・トレーニングしました。 モデルは画像機能、関数呼び出し、構造化出力を備えたマルチモーダル入力をサポートしています。 Gemini 3.5 Flash Liteは、高スループットでコスト効率の高い展開に最適化されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Google Gemini 3.1 Pro プレビュー

重要

Gemini 3.1 Proプレビューの 該当モデル用語 をご覧ください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-1-pro

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.1 Pro Previewは、Googleによって開発・訓練された最先端のハイブリッド推論モデルです。 強力な推論力とドキュメントインテリジェンスを提供し、複雑なワークフローやタスクに対して全体的にスマートなモデルとなっています。 複雑な推論、深い分析、そして幅広い入力やタスクにわたる多様態理解に優れています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3.1 フラッシュ画像をGoogleで検索してください

重要

Gemini 3.1フラッシュイメージの 適用モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

このモデルはテキストに加えて画像も出力として生成します。 Googleはこのモデルでパススルー料金を採用しており、出力画像トークンは出力テキストトークンとは別に請求されます。 詳細は GoogleのGemini 3.1 Flash Imageの価格 設定をご覧ください。

Gemini 3.1 Flash Imageは、Foundation Model APIsのペイパートークンを通じてのみ利用可能です。 プロビジョニング済みスループット、AI Functionsのバッチ推論、 ai_query、AI Playgroundには対応していません。

エンドポイント名: databricks-gemini-3-1-flash-image

サポートされている入力: テキスト、画像

Gemini 3.1 Flash Imageは、Googleの画像生成モデルであるGeminiです。 単一のリクエストで生成された画像とテキストを同時に返すことができます。 このモデルは関数呼び出しをサポートしていません。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3.1 Flash LiteをGoogleで検索してみてください

重要

Gemini 3.1 Flash Lite の 該当するモデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-1-flash-lite

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3.1フラッシュライトは、Googleによって開発され、訓練されたGeini 3シリーズの中で最速で最もコスト効率の高いモデルです。 大規模なインテリジェンス用に構築されたこのモデルは、画像機能、関数呼び出し、構造化出力を備えたマルチモーダル入力をサポートします。 Gemini 3.1 Flash Lite は、高スループットでコスト効率の高いデプロイ用に最適化されています。 Gemini 3.1 Flash Lite の詳細をご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Google Gemini 3 Pro画像

重要

Gemini 3 Pro Imageの モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

このモデルはテキストに加えて画像も出力として生成します。 Googleはこのモデルでパススルー料金を採用しており、出力画像トークンは出力テキストトークンとは別に請求されます。 詳細は GoogleのGemini 3 Pro Imageの価格 設定をご覧ください。

Gemini 3 Pro Imageは、Foundation Model APIのペイパートークンを通じてのみ利用可能です。 プロビジョニング済みスループット、AI Functionsのバッチ推論、 ai_query、AI Playgroundには対応していません。

エンドポイント名: databricks-gemini-3-pro-image

サポートされている入力: テキスト、画像

Gemini 3 Pro ImageはGoogleのイメージ世代ジェミニモデルです。 単一のリクエストで生成された画像とテキストを同時に返すことができます。 このモデルは関数呼び出しをサポートしていません。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 3 FlashをGoogleで検索してみてください

重要

ジェミニ3フラッシュの 適用モデル用語 を参照してください。

このモデルはグローバル エンドポイントでホストされており、 クロス geography ルーティングを有効にする必要があります

エンドポイント名: databricks-gemini-3-flash

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 3 Flashは、Googleによって開発・訓練された高速かつコスト効率の高いマルチモーダルAIモデルです。 このモデルは品質を損なうことなく速度とスケールを提供し、複雑な動画解析、データ抽出、視覚的なQ&Aをほぼリアルタイムで行う高度なマルチモーダル機能を備えています。 Gemini 3 Flashはより良い価格パフォーマンスと高速化を実現し、生産規模での展開を可能にします。 ジェミニ3フラッシュについて詳しくはこちら。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 2.5 Proで検索してください

重要

ジェミニ2.5 Proの 適用モデル用語 を参照してください。

Google Gemini 2.5 Proは2026年10月2日に廃止されます。 推奨される置換モデルについては、非推奨および廃止されたモデルを参照し、非推奨の間に移行する方法についてはガイダンスを参照してください。

エンドポイント名: databricks-gemini-2-5-pro

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 2.5 Proは、Googleによって開発・訓練されたハイブリッド推論モデルです。 Gemini 2.5 Proの「ディープシンクモード」と組み込みのオーディオ出力は、エンタープライズ、研究、クリエイティブアプリケーションの主要なモデルとして分離しました。 これは、さまざまな入力とタスクにわたって複雑な推論、詳細な分析、マルチモーダルな理解に優れた設計になっています。 Gemini 2.5 Pro の詳細をご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Gemini 2.5 FlashをGoogleで検索してみてください

重要

ジェミニ2.5フラッシュの 適用モデル用語 を参照してください。

Google Gemini 2.5 Flashは推奨終了となり、2026年10月2日に廃止される予定です。 推奨される置換モデルについては、非推奨および廃止されたモデルを参照し、非推奨の間に移行する方法についてはガイダンスを参照してください。

エンドポイント名: databricks-gemini-2-5-flash

サポートされる入力: テキスト、画像、ビデオ、オーディオ

Gemini 2.5 Flash は、Google によって開発およびトレーニングされた、高速でコスト効率の高いマルチモーダル AI モデルです。 これは、迅速でスケーラブルで手頃な価格の AI ソリューションを求める開発者や企業向けに設計された、Google 初の完全ハイブリッド推論モデルです。 Gemini 2.5 Flash は、チャットボット、データ抽出、翻訳、ドキュメント解析などのリアルタイムおよび大量のアプリケーション向けに最適化されています。 Gemini 2.5 Flash の詳細をご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

アリババクラウド Qwen3.5 122B A10B

重要

Qwen3.5 122B A10B モデルは パブリック プレビュー段階です

エンドポイント名: databricks-qwen35-122b-a10b

サポートされている入力: テキスト

Qwen3.5 122B A10B は、アリババ クラウドによって構築およびトレーニングされたハイブリッドエキスパート混合 (MoE) 推論モデルであり、推論ごとに合計 1,220 億個のパラメーターと 100 億個のアクティブ パラメーターを備えています。 このモデルは256Kのコンテキストウィンドウと最大25Kの出力トークンをサポートし、推論、コーディング、エージェントタスクで高い性能を発揮します。 推論のみのモデルとして、Qwen3.5 122B A10B は常に応答する前に理由を示し、推論を無効にすることはできません。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

アリババクラウド Qwen3-Embedding-0.6B

重要

Qwen3-Embedding-0.6B モデルは パブリック プレビュー段階です

エンドポイント名: databricks-qwen3-embedding-0-6b

サポートされている入力: テキスト

Qwen3-Embedding-0.6B は、取得、類似性検索、クラスタリング、分類などのセマンティック タスク用に設計された、約 600M のパラメーターを持つコンパクトなテキスト埋め込みモデルです。 テキストは、サーフェスフォームではなく意味を表す密なベクトルにエンコードされます。

このモデルは 100 以上の言語 (コードを含む) をサポートし、最大 32,000 個のトークンまでの長いコンテキストを処理するため、長いドキュメントを埋め込むのに適しています。 最大 1024 の構成可能な次元を持つ埋め込みを生成し、命令に対応しているため、プロンプトによるタスク固有のバイアスが可能です。

Qwen3-Embedding-0.6Bはトランスエンコーダー上に構築され、埋め込み生成専用に微調整され、埋め込み品質と効率的な推論のバランスを取ります。

埋め込みモデルは、取得拡張生成 (RAG) のユース ケースに LLM と組み合わせて使用する場合に特に効果的です。 Qwen3-Embedding-0.6B は、LLM のコンテキストで使用できるドキュメントの大きなチャンクで関連するテキスト スニペットを検索するために使用できます。

Alibaba Cloud Qwen3-Next 80B A3B の指示

重要

Qwen3-Next 80B A3B Instruct モデルは パブリック プレビュー段階です

エンドポイント名: databricks-qwen3-next-80b-a3b-instruct

サポートされている入力: テキスト

Qwen3-Next-80B-A3B-Instruct は、Alibaba Cloud によって構築およびトレーニングされた命令フォロー タスク用に最適化された、非常に効率的な大規模言語モデルです。 このモデルは、超長のコンテキストと優れたマルチステップ ワークフロー、取得拡張生成、および高スループットで確定的な出力を必要とするエンタープライズ アプリケーションを処理するように設計されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Zhipu AI GLM 5.3 フラッシュ

エンドポイント名: databricks-glm-5-3-flash

サポートされている入力: テキスト、画像

GLM-5.3-Flashは、Zhipu AIによって開発された3200億の総パラメータと180億のアクティブパラメータを持つネイティブなマルチモーダル混合型の専門家(MoE)モデルです。 このモデルは1,048,576トークンのコンテキスト長をサポートし、推論、コーディング、エージェントツールの使用に最適化されています。 GLM-5.3-フラッシュについて詳しく学びましょう。

このモデルは常に推論をし、推論は無効化されません。 サポートされたreasoning_effort値とデフォルトについてはクエリ推論モデルを参照してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

Zhipu AI GLM 5.2

エンドポイント名: databricks-glm-5-2

サポートされている入力: テキスト

GLM-5.2は、Zhipu AIによって開発された7,530億のパラメータを持つ専門家(MoE)言語モデルの混合モデルです。 このモデルは100万トークンのコンテキスト長をサポートし、長期的な推論、コーディング、エージェントツールの使用に最適化されています。

このモデルは調整可能な推論努力をサポートします。 サポートされたreasoning_effort値とデフォルトについてはクエリ推論モデルを参照してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

ムーンショットAI キミK3

エンドポイント名: databricks-kimi-k3

サポートされている入力: テキスト、画像

Kimi K3は、Moonshot AIが開発した2.8兆パラメータのモデルで、ネイティブの視覚機能を備えています。 このモデルは100万トークンのコンテキスト長をサポートし、長期的なコーディング、知識作業、推論のために設計されています。

このモデルは調整可能な推論努力をサポートします。 サポートされたreasoning_effort値とデフォルトについてはクエリ推論モデルを参照してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

DeepSeek V4 フラッシュ(0731)

エンドポイント名: databricks-deepseek-v4-flash-0731

サポートされている入力: テキスト

DeepSeek V4 Flash(0731)は、DeepSeekが開発した2840億の総パラメータと130億のアクティブパラメータを持つ、専門家(MoE)のハイブリッド混合言語モデルです。 このモデルは、迅速かつコスト効率の良い推論、コーディング、エージェントツールの使用に最適化されています。

このモデルは調整可能な推論努力をサポートします。 サポートされたreasoning_effort値とデフォルトについてはクエリ推論モデルを参照してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT OSS 120B

エンドポイント名: databricks-gpt-oss-120b

サポートされている入力: テキスト

GPT OSS 120B は、OpenAI によって構築およびトレーニングされた、思考の連鎖と調整可能な推論作業レベルを備えた最先端の推論モデルです。 OpenAIの主力のオープンウェイトモデルで、128Kトークンコンテキストウィンドウを備えています。 このモデルは、高品質の推論タスク用に構築されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

OpenAI GPT OSS 20B

エンドポイント名: databricks-gpt-oss-20b

サポートされている入力: テキスト

GPT OSS 20B は、OpenAI によって構築およびトレーニングされた最新の軽量推論モデルです。 このモデルには 128K トークン コンテキスト ウィンドウがあり、リアルタイムの副操縦タスクとバッチ推論タスクに優れています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

GoogleでGemma 3 12B

重要

Gemma 3 の用語と許容される使用ポリシーについては、 該当するモデル の用語を参照してください。

エンドポイント名: databricks-gemma-3-12b

サポートされている入力: テキスト、画像

Gemma 3 12Bは、Gemma 3ファミリーの一部としてGoogleによって開発された120億のパラメータマルチモーダルおよびビジョン言語モデルです。 Gemma 3 には最大 128,000 個のトークン コンテキストがあり、140 を超える言語に対して多言語サポートを提供します。 このモデルは、テキスト入力と画像入力の両方を処理し、テキスト出力を生成するように設計されており、質問の回答を含む、ダイアログのユース ケース、テキスト生成、画像理解タスク用に最適化されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

メタ ラマ 4 マーベリック

重要

Llama 4 Community License と Acceptable Use Policy の 該当するモデル条項 を参照してください。

エンドポイント名: databricks-llama-4-maverick

サポートされている入力: テキスト、画像

Llama 4 Maverick は、Meta によって構築およびトレーニングされた最先端の大規模言語モデルです。 Llama モデル ファミリの中で、コンピューティング効率のためにエキスパート アーキテクチャの組み合わせが使用された最初のモデル です。 Llama 4 Maverick は複数の言語をサポートしており、正確な画像とテキストの理解のユース ケース用に最適化されています。 Llama 4 Maverick の詳細をご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

メタラマ3.3 70B指示

重要

2024 年 12 月 11 日より、Meta-Llama-3.3-70B-Instruct は、Foundation Model API のトークンごとの支払いエンドポイントでの Meta-Llama-3.1-70B-Instruct のサポートを置き換えます。

LLama 3.3 コミュニティ ライセンスと受け入れ可能な使用ポリシーについては、 該当するモデルの用語 を参照してください。

エンドポイント名: databricks-meta-llama-3-3-70b-instruct

サポートされている入力: テキスト

Meta-Llama-3.3-70B-Instruct は、Meta によって構築およびトレーニングされた 128,000 個のトークンのコンテキストを持つ最先端の大規模言語モデルです。 このモデルは複数の言語をサポートし、対話のユース ケースに最適化されています。 Meta Llama 3.3の詳細を確認してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

メタラマ3.1 8B指示

重要

LLama 3.1 コミュニティ ライセンスと受け入れ可能な使用ポリシーについては、 該当するモデルの用語 を参照してください。

エンドポイント名: databricks-meta-llama-3-1-8b-instruct

サポートされている入力: テキスト

Meta-Llama-3.1-8B-Instruct は、Meta によって構築およびトレーニングされた 128,000 個のトークンのコンテキストを持つ最先端の大規模言語モデルです。 このモデルは複数の言語をサポートし、対話のユース ケースに最適化されています。 Meta Llama 3.1 の詳細をご覧ください

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

アントロピック・クロード・ハイク 4.5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-haiku-4-5

サポートされている入力: テキスト、画像

Claude Haiku 4.5はアントロピックの最速かつ最も費用対効果の高いモデルであり、卓越した速度と効率でニアフロンティアコーディング品質を提供します。 チャット アシスタント、カスタマー サービス エージェント、ペア プログラミング、迅速なプロトタイプ作成など、リアルタイムで待機時間の短いアプリケーションに優れています。 このモデルは、コスト意識の高い運用デプロイや、応答性の高い AI 支援を必要とするエージェント システムに最適です。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

Anthropic Claude ソネット 5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-sonnet-5

サポートされている入力: テキスト、画像

Claude Sonnet 5 では、 temperaturetop_p、または top_k サンプリング パラメーターはサポートされていません。 これらのパラメーターを含む要求は、400 エラーを返します。

Claude Sonnet 5 はAnthropicの最も能力の高い Sonnet モデルであり、コーディング、エージェントワークフロー、大規模なプロフェッショナルな作業用に設計されています。 ほぼOpusレベルのインテリジェンスとSonnetのコスト効率とスピードを組み合わせ、顧客向けのエージェント、制作コーディングワークフロー、洗練されたコンテンツ生成タスクに適しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

Anthropic Claude ソネット 4.6

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-sonnet-4-6

サポートされている入力: テキスト、画像

Claude Sonnet 4.6 は、Anthropic の最も高度なハイブリッド推論モデルです。 ほぼ瞬時の応答と、タスクの複雑さに基づくより深い推論のための拡張思考の 2 つのモードが用意されています。 Claude Sonnet 4.6 は、実用的なスループットと高度な思考 (顧客向けのエージェント、運用コーディング ワークフロー、大規模なコンテンツ生成など) のバランスを必要とするアプリケーションを専門としています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アンスロピック・クロード・ソネット 4.5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-sonnet-4-5

サポートされている入力: テキスト、画像

Claude Sonnet 4.5 は、アントロピックの最も高度なハイブリッド推論モデルです。 ほぼ瞬時の応答と、タスクの複雑さに基づくより深い推論のための拡張思考の 2 つのモードが用意されています。 Claude Sonnet 4.5 は、顧客向けのエージェント、実稼働コーディング ワークフロー、大規模なコンテンツ生成など、実用的なスループットと高度な思考のバランスを必要とするアプリケーションを専門としています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

Anthropic Claude Fable 5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks マスター クラウド サービス契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

重要

Claude Fable 5 の場合、プロンプトと応答は信頼と安全のために 30 日間保持されます。 このデータは自動化された安全システムによって処理され、特定のインスタンスでは人間によるレビューのフラグが設定される場合があります。 安全調査の場合、または 30 日を超えてデータを保持するための法的要件を除き、データは 30 日後に自動的に削除されます。 Anthropicは、この安全保持の目的で限られたサブプロセッサーです。

エンドポイント名: databricks-claude-fable-5

サポートされている入力: テキスト

Claude Fable 5は、自律的な知識作業とコーディングのために設計されたAnthropicのMythosクラスのモデルです。 堅牢なセーフガードが組み込まれているため、以前のモデルよりも人間によるチェックインの必要性が少なく、実行時間の長い、複雑な、非同期のタスクを処理できるため、拡張コンテキスト全体で持続的なフォーカスを必要とするエージェントワークフローに適しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

Anthropic Claude Opus 5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-5

サポートされている入力: テキスト、画像

Claude Opus 5 はAnthropic最も能力の高いハイブリッド推論モデルであり、エージェントコーディング、コード レビュー、および長期的な自律的な作業に焦点を当てた Opus シリーズに基づいて構築されています。 このモデルは、大規模なリファクタリングやエンドツーエンドの機能開発、高精度のバグ検出、マルチエージェントの調整、グラフ、ドキュメント、UI の理解などのビジョン タスクなどの複雑なマルチファイル ソフトウェア タスクに優れています。 Claude Opus 5は、コンテキストウィンドウ全体を通じて強力な指示追従、ツール呼び出し、推論機能を維持し、低・中程度の推論作業でほぼトップレベルの品質を提供し、長期コンテキストやコストに敏感なエンタープライズワークフローに適しています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

Anthropic Claude Opus 4.8

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-4-8

サポートされている入力: テキスト、画像

Claude Opus 4.8 は、精度、効率、推論機能をさらに改善した Opus シリーズに基づいています。 このモデルは、画像をサポートする複雑な抽出とエージェント的な推論タスクに優れており、詳細な分析、ドキュメントの理解、高度なマルチステップ ワークフローを必要とするエンタープライズ アプリケーションに最適です。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アントロピック・クロード・オプス 4.7

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-4-7

サポートされている入力: テキスト、画像

Claude Opus 4.7は、Anthropicの最も能力の高いハイブリッド推論モデルであり、精度、効率、および強化されたビジョン機能を備えたOpusシリーズを進化させます。 このモデルは、複雑な抽出タスクとエージェント推論タスクに対してより強力なパフォーマンスを提供しながら、前身よりも少ない出力トークンを使用します。 Claude Opus 4.7は画像解像度の向上を特徴とし、詳細な分析、ドキュメント理解、高度な多段階ワークフローを必要とするエンタープライズアプリケーションに最適です。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アントロピック・クロード・オプス 4.6

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-4-6

サポートされている入力: テキスト、画像

Claude Opus 4.6 は、アダプティブ思考機能を備えた Anthropic の最も能力の高いハイブリッド推論モデルです。 このモデルでは、最も要求の厳しいタスクに新しい最大作業量レベルが導入され、最適なパフォーマンスを得るための既定値として高い作業量が設定されます。 Claude Opus 4.6 は、複雑な推論、詳細な分析、コード生成、調査、高度なマルチステップ ワークフローに優れています。 広範な分析と包括的な成果物の両方を必要とする企業向けアプリケーションに最適です。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アントロピック・クロード・オプス 4.5

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-4-5

サポートされている入力: テキスト、画像

Claude Opus 4.5は、深い分析と拡張思考を必要とする最も複雑なタスクのために構築された、アントロピックの最も能力の高いハイブリッド推論モデルです。 このモデルは、強力な汎用機能と高度な推論を組み合わせたものであり、コード生成、研究、コンテンツ作成、高度なマルチステップエージェントワークフローに優れています。 Claude Opus 4.5はテキストと視覚入力をサポートしており、理解の幅と深さの両方を求めるエンタープライズアプリケーションに最適です。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アントロピック クロード ソネット 4

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

Anthropic Claude Sonnet 4 は非推奨です。 廃止日については、 非推奨および廃止されたモデル 、推奨される代替モデル、および非推奨時の移行方法に関するガイダンスを参照してください。

エンドポイント名: databricks-claude-sonnet-4

サポートされている入力: テキスト、画像

Claude Sonnet 4 は、Anthropic によって構築およびトレーニングされた最先端のハイブリッド推論モデルです。 このモデルには、ほぼ瞬時の応答と、タスクの複雑さに基づくより深い推論のための拡張思考の 2 つのモードが用意されています。 Claude Sonnet 4 は、コード開発、大規模なコンテンツ分析、エージェント アプリケーション開発などのさまざまなタスクに最適化されています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

アントロピック・クロード・オプス 4.1

重要

お客様は、Anthropic の 使用ポリシーの条項に準拠していることを確認する責任があります。 Databricks Master Cloud Services 契約 と、該当する場合は Databricks Business Associate Agreement も参照してください。

エンドポイント名: databricks-claude-opus-4-1

サポートされている入力: テキスト、画像

Claude Opus 4.1 は、Anthropic によって構築およびトレーニングされた最先端のハイブリッド推論モデルです。 この汎用の大規模言語モデルは、複雑な推論と、エンタープライズ規模での実際のアプリケーションの両方を対象に設計されています。 テキストと画像の入力に対応しています。 このモデルは、一定の人間の介入なしに、コード生成、研究とコンテンツの作成、マルチステップエージェントワークフローなどのタスクに優れています。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

このエンドポイントは、Databricks セキュリティ境界内の Databricks によってホストされます。

シンキングマシン・ラボ・インクリング

重要

『Inkling』は パブリックプレビュー中です。

エンドポイント名: databricks-inkling

サポートされている入力: テキスト、画像

Inklingは、Thinking Machine Labsによって開発された9750億の総パラメータと410億のアクティブパラメータを持つ専門家(MoE)言語モデルの混合体です。 このモデルは100万トークンのコンテキスト長をサポートし、コーディング、推論、エージェントツール使用タスクに最適化されています。

このモデルは常に理屈を述べます。 サポートされたreasoning_effort値とデフォルトについてはクエリ推論モデルを参照してください。

AI モデルは間違いを犯したり、意図を誤解したり、幻覚を見せたり、間違った答えを出したりする可能性があります。 Databricks では、モデルを評価して、意図したとおりに動作していることを確認することをお勧めします。

GTE Large (英語版)

エンドポイント名: databricks-gte-large-en

サポートされている入力: テキスト

一般テキスト埋め込み (GTE) は、任意のテキストを 1024 次元埋め込みベクターと 8192 トークンの埋め込みウィンドウにマップできるテキスト埋め込みモデルです。 これらのベクターは、LLM のベクター インデックスや、取得、分類、質問への回答、クラスタリング、セマンティック検索などのタスクに使用できます。 このエンドポイントは、モデルの英語版を提供し、正規化された埋め込みを生成しません。

埋め込みモデルは、取得拡張生成 (RAG) のユース ケースに LLM と組み合わせて使用する場合に特に効果的です。 GTE を使用すると、LLM のコンテキストで使用できるドキュメントの大きなチャンクで関連するテキスト スニペットを検索できます。

BGE Large (英語版)

エンドポイント名: databricks-bge-large-en

サポートされている入力: テキスト

BAAI General Embedding (BGE) は、任意のテキストを 1024 次元埋め込みベクターと 512 トークンの埋め込みウィンドウにマップできるテキスト埋め込みモデルです。 これらのベクターは、LLM のベクター インデックスや、取得、分類、質問への回答、クラスタリング、セマンティック検索などのタスクに使用できます。 このエンドポイントは、モデルの英語版を提供し、正規化された埋め込みを生成します。

埋め込みモデルは、取得拡張生成 (RAG) のユース ケースに LLM と組み合わせて使用する場合に特に効果的です。 BGE を使用すると、LLM のコンテキストで使用できるドキュメントの大きなチャンクで関連するテキスト スニペットを検索できます。

RAG アプリケーションでは、命令パラメーターを含めることで、取得システムのパフォーマンスを向上させることができます。 BGE の作成者は、クエリ埋め込みの命令 "Represent this sentence for searching relevant passages:" を試すことをお勧めしますが、パフォーマンスへの影響はドメインに依存します。

その他のリソース