Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Usługa Databricks rozumie znaczenie Twoich danych i zaufanie, które umieszczasz w nas podczas korzystania z naszej platformy i funkcji pomocniczych sztucznej inteligencji usługi Databricks. Usługa Databricks jest zobowiązana do najwyższych standardów ochrony danych i wdrożyła rygorystyczne środki w celu zapewnienia, że informacje przesyłane do funkcji pomocniczych sztucznej inteligencji usługi Databricks są chronione.
-
Dane pozostają poufne.
- Databricks nie używa danych, promptów ani odpowiedzi przesłanych do tych funkcji lub wygenerowanych przez nie do trenowania bazowych modeli generatywnych, które Databricks udostępnia do użytku stronom trzecim.
- Nasi partnerzy modelu nie zachowują danych przesyłanych za pośrednictwem tych funkcji, nawet w przypadku monitorowania nadużyć. Nasze funkcje pomocnicze sztucznej inteligencji oparte na partnerach korzystają z punktów końcowych zerowego przechowywania danych od naszych partnerów modelowych.
- Ochrona przed szkodliwymi wynikami. W przypadku korzystania z usługi Azure OpenAI usługa Databricks używa również filtrowania zawartości usługi Azure OpenAI w celu ochrony użytkowników przed szkodliwą zawartością. W przypadku korzystania z modeli Anthropic, usługa Databricks opiera się na wbudowanych mechanizmach bezpieczeństwa Anthropic i dodatkowych zabezpieczeniach przed szkodliwymi wynikami zgodnie z opisem w dokumentacji bezpieczeństwa Anthropic. Ponadto usługa Databricks przeprowadziła obszerną ocenę z tysiącami symulowanych interakcji użytkowników, aby zapewnić skuteczne stosowanie ochrony przed szkodliwą zawartością, jailbreakami, niezabezpieczonym generowaniem kodu i korzystaniem z zawartości praw autorskich innych firm.
- Usługa Databricks używa tylko danych niezbędnych do świadczenia usługi. Dane są wysyłane tylko w przypadku interakcji z funkcjami pomocniczymi sztucznej inteligencji usługi Databricks lub w razie potrzeby w celu udostępnienia tych funkcji. Usługa Databricks wysyła monit, odpowiednie metadane i wartości tabeli, błędy, a także kod wejściowy lub zapytania, aby pomóc w zwracaniu bardziej odpowiednich wyników.
- Dane są chronione w trakcie przesyłania i w stanie spoczynku. Cały ruch między usługą Databricks a partnerami modelu jest szyfrowany w trakcie przesyłania zgodnie z branżowym standardem szyfrowania TLS. Wszystkie dane przechowywane w obszarze roboczym usługi Azure Databricks są szyfrowane za pomocą protokołu AES-256-bitowego.
- Databricks oferuje mechanizmy kontroli nad lokalizacją przechowywania danych. Funkcje asystujące sztucznej inteligencji usługi Databricks są usługami wyznaczonymi i przestrzegają granic lokalizacji danych. Aby uzyskać więcej informacji, zobacz Databricks Geos: Data residency i Databricks Designated Services.
Aby uzyskać więcej informacji na temat sposobu obsługi danych przez określone funkcje, zobacz często zadawane pytania dotyczące prywatności i zabezpieczeń.
Dane wysyłane do modeli
Jakie usługi i modele korzystają z funkcji pomocniczych sztucznej inteligencji opartych na partnerach?
Jeśli ustawienie funkcji sztucznej inteligencji wspieranych przez partnerów jest włączone, funkcje pomocnicze AI usługi Databricks wykorzystują modele hostowane przez usługę Azure OpenAI lub Anthropic na platformie Databricks.
Niektóre funkcje, takie jak Autouzupełnianie kodu Genie, używają modelu hostowanego w usłudze Databricks nawet wtedy, gdy ustawienie jest włączone. Jeśli wyłączysz ustawienie funkcji sztucznej inteligencji obsługiwanej przez partnera, niektóre funkcje pomocnicze mogą korzystać z modelu hostowanego przez Databricks. Aby uzyskać więcej informacji, zobacz Funkcje sztucznej inteligencji obsługiwane przez partnerów.
Jakie dane są wysyłane do modeli?
Usługa Databricks wysyła tylko dane potrzebne do świadczenia usługi. Ogólnie rzecz biorąc, obejmuje to monit (na przykład pytanie, kod lub zapytanie) oraz odpowiednie metadane, takie jak nazwy tabel i kolumn i opisy, przykładowe wartości, błędy i poprzednie pytania. Dokładne dane różnią się od funkcji:
- Genie Code wysyła kod i zapytania w bieżącej komórce notesu lub karcie edytora SQL, nazwy tabel i kolumn oraz opisy, poprzednie pytania i ulubione tabele. W trybie agenta kod Genie może również analizować dane wyjściowe komórek i odczytywać przykłady danych z tabel, podobnie jak w przypadku innych agentów kodowania w branży.
- Agenci genie używają wiersza polecenia języka naturalnego, nazw tabel i opisów, odpowiednich wartości, ogólnych instrukcji, przykładowych zapytań SQL i funkcji SQL.
- Genie One wysyła Twoje pytanie w języku naturalnym oraz odpowiednie metadane, takie jak nazwy tabel i kolumn, opisy oraz wartości próbek, gdy rozmawiasz z danymi. Genie One odpowiada, kierując się do Twoich agentów Genie i przeszukując zasoby danych, do których masz uprawnienia. Gdy podłączysz zewnętrzne źródła, takie jak Google Drive, Microsoft 365 czy Slack, Genie One może również wysyłać treści z tych źródeł, aby odpowiedzieć na Twoje pytanie.
- Genie Ontology to zunifikowana warstwa kontekstowa, która daje Genie mapę Twojej organizacji świadomą biznesu, łącząc modelowany kontekst (semantyka Unity Catalog, taka jak widoki metryczne i domeny) oraz kontekst wnioskowany, który Genie automatycznie buduje i utrzymuje na podstawie istniejących zasobów i użytkowania. Wyodrębnione fragmenty ontologii respektują uprawnienia zasobów źródłowych. Aby wygenerować wnioskowany kontekst, Genie wyodrębnia wiedzę ze źródeł, w tym z widoków metryk, pulpitów, zapytań SQL i agentów Genie.
- Komentarze generowane przez sztuczną inteligencję wysyłają metadane dla udokumentowanego obiektu i jego obiektów nadrzędnych, w tym wykazu, schematu, tabeli, funkcji, modelu i nazw woluminów, ich bieżących komentarzy i szczegółów kolumny (nazwa, typ, czy jest to klucz podstawowy i bieżący komentarz kolumny).
Czy dane wysyłane do modeli są zgodne z uprawnieniami użytkownika w Unity Catalog?
Tak, wszystkie dane wysyłane do pomocniczych funkcji sztucznej inteligencji są zgodne z uprawnieniami katalogu Unity, więc żadne dane, do których użytkownicy nie mają dostępu, nie są wysyłane do takich modeli.
Czy dostawcy modelu partnerskiego przechowują moje dane?
Nie. W przypadku korzystania z modeli partnerskich za pośrednictwem usługi Databricks dostawcy modelu partnerskiego nie przechowują monitów ani odpowiedzi.
Przechowywanie i dostęp
Gdzie są przechowywane odpowiedzi z funkcji pomocniczych sztucznej inteligencji?
Odpowiedzi agenta Genie i zatwierdzone komentarze generowane przez sztuczną inteligencję są przechowywane w bazie danych płaszczyzny sterowania usługi Databricks. Baza danych płaszczyzny sterowania jest szyfrowana w formacie AES-256-bitowym.
Historia czatów w usłudze Genie Code jest przechowywana w tym samym miejscu co inna zawartość notesu.
Rozmowy czatowe Genie One są przechowywane w bazie danych Databricks control plane, która jest szyfrowana AES-256-bitowo.
Kto może zobaczyć moją historię czatów z Genie?
Możesz wyświetlić własne czaty z kodem Genie. Administratorzy mogą oglądać czat, jeśli mają bezpośredni link. Gdy udostępniasz czat, odbiorcy mogą go zobaczyć. Zobacz Udostępnianie czatu.
Menedżerowie agentów usługi Genie mogą wyświetlać komunikaty innych użytkowników, ale nie ich wyniki zapytania. Konwersacje z agentami Genie są zgodne z ustawieniami udostępniania konwersacji.
Możesz oglądać własne czaty z Genie One. Gdy udostępniasz czat, odbiorcy mogą go zobaczyć jako tylko do odczytu. Możesz udostępnić czat Genie One z każdym, kto ma swoje konto, albo ponownie ustawić go prywatnym. Zobacz Udostępnianie czatu.
Wykonywanie i dokładność kodu
Czy Genie wykonuje kod?
Genie Agents zostały zaprojektowane z dostępem do danych klientów wyłącznie do odczytu, dzięki czemu mogą jedynie generować i uruchamiać zapytania SQL tylko do odczytu.
Podobnie jak w przypadku Genie Agents, czat Genie One ma dostęp do Twoich danych tylko w trybie odczytu, więc generuje i uruchamia wyłącznie zapytania SQL tylko do odczytu dla danych, do których masz uprawnienia dostępu.
W trybie agenta kod Genie może uruchamiać kod w notesie i edytorze SQL. Na początku kod Genie poprosi Cię o potwierdzenie, aby kontynuować wykonywanie. Możesz wybrać potwierdzenie, zawsze zezwalać na uruchamianie w bieżącym czacie Genie Code lub zawsze zezwalać na uruchamianie. Inne tryby kodu Genie nie uruchamiają automatycznie kodu w Twoim imieniu.
Modele sztucznej inteligencji mogą popełniać błędy, błędnie zrozumieć intencję i halucyzować lub udzielać niepoprawnych odpowiedzi. Przejrzyj i przetestuj kod wygenerowany przez sztuczną inteligencję przed jego uruchomieniem.
Czy usługa Databricks dokonała oceny w celu oceny dokładności i przydatności odpowiedzi z funkcji pomocniczych sztucznej inteligencji?
Tak, usługa Databricks przeprowadziła obszerne testowanie wszystkich naszych funkcji pomocniczych sztucznej inteligencji na podstawie ich oczekiwanych przypadków użycia i używania symulowanych danych wejściowych użytkownika w celu zwiększenia dokładności i odpowiedniości odpowiedzi. Oznacza to, że sztuczna inteligencja jest nową technologią, a funkcje pomocnicze sztucznej inteligencji mogą dostarczać niedokładne lub niewłaściwe odpowiedzi.
Miejsce przechowywania i zgodność danych
W jaki sposób ruch jest kierowany przez Geos?
Funkcje pomocnicze sztucznej inteligencji usługi Databricks to wyznaczone usługi, które używają Databricks Geos do zarządzania rezydencją danych podczas przetwarzania zawartości klienta. Routing ruchu zależy od regionu i tego, czy jest włączone przetwarzanie między obszarami geograficznymi (wymuszanie przetwarzania danych w obszarze roboczym Lokalizacja geograficzna dla wyznaczonych usług jest wyłączone).
Czy mogę używać funkcji pomocniczych sztucznej inteligencji z tabelami, które przetwarzają dane regulowane (PHI, PCI, IRAP, FedRAMP)?
Tak. W tym celu należy spełnić wymagania, takie jak włączenie profilu zabezpieczeń zgodności i dodać odpowiedni standard zgodności w ramach konfiguracji profilu zabezpieczeń zgodności.
Modele hostowane w usłudze Databricks
Jak funkcje pomocnicze sztucznej inteligencji działają z modelami hostowanymi w usłudze Databricks?
Gdy funkcje sztucznej inteligencji oparte na partnerach są wyłączone, funkcje pomocnicze sztucznej inteligencji korzystają z modeli hostowanych w usłudze Databricks, które są całkowicie wybrane przez usługę Databricks i zarządzane przez usługę Databricks. Usługa Databricks używa modeli typu open source dostępnych do użytku komercyjnego, takich jak OpenAI GPT OSS.
Poniższy diagram zawiera omówienie sposobu, w jaki model hostowany w usłudze Databricks obsługuje funkcje oparte na sztucznej inteligencji usługi Databricks, takie jak szybka poprawka.
- Użytkownik wykonuje komórkę notesu, co powoduje wystąpienie błędu.
- Usługa Databricks dołącza metadane do żądania i wysyła je do modelu dużego języka hostowanego w usłudze Databricks (LLM). Wszystkie dane są szyfrowane w stanie spoczynku. Klienci mogą używać klucza zarządzanego przez klienta (CMK).
- Model hostowany w usłudze Databricks reaguje na sugerowane zmiany kodu w celu naprawienia błędu wyświetlanego użytkownikowi.