匯入與 OpenAI 相容的 Google Gemini API

適用於:所有API Management層

本文將示範如何將一個與 OpenAI 相容的 Google Gemini API 匯入,以便存取例如 gemini-2.5-flash-lite 這樣的模型。 對於這些模型,Azure API Management可以管理一個相容於 OpenAI 的聊天完成端點。

深入了解如何在 API Management 中管理 AI API:

先決條件

透過入口網站匯入相容 OpenAI 的 Gemini API

  1. 在 Azure portal,前往你的 API 管理實例。

  2. 在左側功能表 的 [API] 底下,選取 [API]>[+ 新增 API]。

  3. 在 [定義新的 API] 下,選取 [ 語言模型 API]。

    在入口網站中建立傳遞語言模型 API 的螢幕快照。

  4. 在 [設定 API] 索引標籤上:

    1. 輸入 API 的 [顯示名稱] 和選擇性 [描述]。

    2. 在 [URL] 中,輸入 Gemini OpenAI 兼容性文件中的下列基底 URL: https://generativelanguage.googleapis.com/v1beta/openai

    3. 在 Path 中,附加一條你的 API Management 實例用來路由請求到 Gemini API 端點的路徑。

    4. 在 [類型] 中,選取 [建立 OpenAI API]。

    5. 在Access鍵中輸入以下內容:

      1. 標頭名稱: 授權。
      2. 標頭值 (key): Bearer 後面接著您的 Gemini API 金鑰。

    在入口網站中匯入 Gemini LLM API 的螢幕快照。

  5. 在其餘索引標籤上,選擇性地設定原則來管理權杖取用、語意快取和 AI 內容安全性。 如需詳細資訊,請參閱 匯入語言模型 API。

  6. 選取 檢閱。

  7. 入口網站驗證設定後,選擇 建立。

API Management 建立 API 並設定以下內容:

  • 將 API 要求導至 Google Gemini 端點的 後端 資源和 set-backend-service 策略。
  • 使用您提供的 Gemini API 金鑰來訪問 LLM 後端。 API Management 將金鑰保護為秘密的 命名值。
  • (選擇性)可協助您監視和管理 API 的原則。

測試雙子座模型

匯入 API 之後,您可以測試 API 的聊天完成端點。

  1. 選取您在上一個步驟中建立的 API。

  2. 選取 [測試] 索引標籤。

  3. 選取 POST Creates a model response for the given chat conversation 作業,這是對 POST 端點的 /chat/completions 要求。

  4. 在 請求主體 區段中,輸入下列 JSON 來指定模型和範例提示。 在此範例中,使用了gemini-2.5-flash-lite模型。

    {
        "model": "gemini-2.5-flash-lite",
        "messages": [
            {
                "role": "system",
                "content": "You are a helpful assistant"
            },
            {
                "role": "user",
                "content": "How are you?"
            }
        ],
        "max_tokens": 50
    }
    

    當測試成功時,後端會回應成功的 HTTP 回應碼和一些資料。 回應包含代幣使用數據,幫助您監控和管理語言模型代幣消費。

    在入口網站中測試 Gemini LLM API 的螢幕快照。