Samouczek: Zarządzaj dostępem do modelu agenta kodującego za pomocą Unity Gateway

W tym samouczku łączysz zewnętrznego agenta programistycznego, takiego jak Codex, Gemini CLI lub Cursor, z dużymi modelami językowymi (LLM) obsługiwanymi przez Unity Gateway. Następnie możesz kontrolować, kto może mieć dostęp do tych modeli oraz ile zasobów agent może zużyć i ile może wydać. Zamiast wklejać klucz API dostawcy do swojego narzędzia, każde żądanie jest kierowane przez usługę modelu Unity Gateway. Unity Catalog kontroluje, kto może używać których modeli, a Unity Gateway egzekwuje limity oraz rejestruje zużycie i koszty.

Po ukończeniu tego samouczka będziesz mieć następujące elementy:

  • Agent programistyczny, który wysyła każde żądanie do modelu przez Unity Gateway z wykorzystaniem poświadczeń Azure Databricks, bez klucza API dostawcy na komputerze dewelopera.
  • Centralne rejestry korzystania z agenta i związanych z tym kosztów, zgodnie z limitami szybkości żądań i uprawnieniami ustawionymi w usłudze modelu.

Prerequisites

Krok 1. Łączenie agenta kodowania

Agenta można połączyć w jeden z dwóch sposobów:

  • Unity Gateway CLI (zalecane): Open-source launcher, który obsługuje OAuth i zapisuje pliki konfiguracyjne każdego agenta, w tym URL i model bazy usług. Nie zarządzasz ręcznie kluczami API ani punktami końcowymi.
  • Konfiguracja ręczna: Ustaw samodzielnie bazowy adres URL usługi modelu oraz model w wbudowanych ustawieniach narzędzia (Cursor, Codex lub Gemini CLI). Zobacz Integracja z agentami kodowania.

Ta sekcja korzysta z CLI Unity Gateway. Zainstaluj go, a następnie uruchom żądanego agenta:

uv tool install git+https://github.com/databricks/unity-gateway

Kodeks

ug codex

Aby uruchomić w trybie nieinteraktywnym, przekaż własny parametr agenta za pośrednictwem interfejsu wiersza poleceń Unity Gateway:

ug codex --full-auto

Gemini CLI

ug gemini

OpenCode

ug opencode

Copilot

ug copilot

Przy pierwszym uruchomieniu interfejs wiersza poleceń Unity Gateway prosi o podanie adresu URL obszaru roboczego i przeprowadza uwierzytelnienie; kolejne uruchomienia przechodzą bezpośrednio do agenta.

Krok 2. Zarządzaj dostępem agenta do modelu

Usługą modelu możesz zarządzać jak każdym innym obiektem podlegającym zabezpieczeniom w Unity Catalog: przyznać EXECUTE, aby kontrolować, kto może z niej korzystać, oraz używać Unity Gateway do limitowania liczby żądań i wydatków. Skonfiguruj dowolną z następujących opcji:

  • Zarządzanie osobami, które mogą uzyskać dostęp do modelu: w Eksploratorze wykazu otwórz usługę modelu i przyznaj EXECUTE użytkownikom lub grupom na karcie Uprawnienia .
  • Ogranicz liczbę żądań: W Eksploratorze katalogu na karcie Przegląd usługi modelu kliknij pozycję Skonfiguruj w sekcji Limity szybkości. Ustaw limit liczby żądań na minutę (QPM) lub limit liczby tokenów na minutę (TPM) dla wszystkich żądań dla punktu końcowego lub dla poszczególnych użytkowników.
  • Ustaw budżet wydatków: Administrator konta może stworzyć budżet dostosowany do wszystkich punktów końcowych Unity Gateway. Budżet obejmuje łączne wydatki na usługi modeli; ustaw próg alertu, aby otrzymywać powiadomienia lub blokować korzystanie, zanim koszty przekroczą ten próg.

Krok 3. Sprawdzanie, czy ruch jest zarządzany

Potwierdź, że żądania agenta przechodzą przez Unity Gateway i są nagrywane:

  • Z poziomu agenta: Wyślij monit. Agent odpowiada, używając skonfigurowanego przez Ciebie modelu, bez klucza API dostawcy na Twoim komputerze.

  • Z tabeli systemu użycia: Wykonywanie zapytań dotyczących śledzenia użycia w celu potwierdzenia, że usługa modelu rejestruje żądania:

    SELECT service_name, requester, status_code, COUNT(*) AS calls
    FROM system.ai_gateway.usage
    WHERE service_type = 'MODEL_SERVICE'
    GROUP BY service_name, requester, status_code
    ORDER BY calls DESC;
    

Aby szczegółowo przeanalizować wydatki, zobacz Analizuj koszt Unity Gateway.

Następne kroki