Información general sobre la API de recuperación de Microsoft 365 Copilot

Las API de Microsoft 365 Copilot proporcionan acceso a los componentes que impulsan las experiencias de Copilot, desbloqueando la capacidad de mejorar los agentes de motor personalizados y las soluciones de IA generativa con las funcionalidades de Microsoft 365 Copilot. La API de recuperación de Microsoft 365 Copilot le permite fundamentar sus soluciones de IA generativa con su conocimiento de Microsoft 365 y de otros usuarios devolviendo fragmentos de texto relevantes del índice híbrido que alimenta a Microsoft 365 Copilot.

La API de recuperación ofrece una solución optimizada para la generación aumentada de recuperación (RAG) sin necesidad de replicar, indexar, fragmentar y proteger los datos en un índice independiente. La API comprende el contexto y la intención del usuario y realiza transformaciones de consulta para obtener los resultados más relevantes, lo que es más difícil de lograr con la búsqueda léxica o incluso con RAG básico de orígenes alternativos.

RAG es esencial cuando se compilan soluciones de IA generativa y se quieren usar los conocimientos de Microsoft 365. Cuando implementa RAG, sus soluciones pueden proporcionar respuestas más precisas y contextualmente relevantes basadas en el vasto repositorio de datos de su organización. La API de recuperación logra RAG extrayendo fragmentos de texto actualizados y relevantes de conectores de SharePoint, OneDrive y Copilot. La API de recuperación mantiene los datos en su lugar y mantiene los controles de acceso y gobernanza. La API de recuperación garantiza que las respuestas sintetizadas se basen en los datos más recientes y relevantes. Este proceso mejora la confiabilidad y la utilidad de las soluciones de IA generativa.

Para explorar la API, pruebe una consulta en la demostración interactiva.

Sugerencia

¿Desea explorar la API de recuperación antes de escribir código? Pruebe la demostración interactiva para ver una solicitud y respuesta en directo con sus datos de Microsoft 365.

¿Por qué usar la API de recuperación?

La API de recuperación ofrece una manera segura y compatible de recuperar fragmentos de texto relevantes de los conectores de SharePoint, OneDrive y Copilot, a la vez que optimiza para la recuperación de contexto. Por lo tanto, no es necesario expulsar datos, romper permisos o comprometer la seguridad y el cumplimiento.

Las aplicaciones de conocimiento personalizado pueden usar la API de recuperación para fundamentar las respuestas en información específica de la organización almacenada en conectores de SharePoint, OneDrive y Copilot. En lugar de crear y mantener índices vectoriales independientes, estas aplicaciones pueden recuperar contexto relevante de los orígenes de datos de Microsoft 365 para fundamentar respuestas de modelo de lenguaje grande (LLM) de la misma manera que lo hace Microsoft 365 Copilot.

Las aplicaciones financieras y legales que requieren alta precisión en la recuperación de información pueden usar las capacidades de filtrado de la API para limitar las búsquedas a bibliotecas de documentos o tipos de contenido específicos, lo que garantiza que las respuestas solo incluyan fuentes aprobadas y respete las barreras de información y los controles de acceso.

Las aplicaciones de múltiples orígenes pueden combinar contenido de SharePoint y OneDrive con información de los conectores de Microsoft 365 Copilot, creando una knowledge base unificada que abarque tanto Microsoft 365 como repositorios de terceros, a la vez que mantiene controles de seguridad y cumplimiento coherentes.

Imagine una empresa de consultoría que se especializa en proporcionar soluciones personalizadas para sus clientes, con una parte significativa de su trabajo centrado en los datos almacenados en SharePoint. La firma está desarrollando un agente de motor personalizado para ayudar a sus consultores a prepararse para reuniones importantes con los clientes. Este agente debe acceder y recuperar información precisa y actualizada de SharePoint. La firma trabaja con dos clientes importantes que son competidores directos en el mercado. Por lo tanto, la empresa tiene una necesidad crítica de mantener rigurosos estándares de seguridad y cumplimiento para garantizar que los documentos y datos de un cliente nunca sean accesibles para el otro. La API de recuperación ayuda a la empresa a administrar los riesgos de cumplimiento y seguridad y garantizar la relevancia y la actualización de los datos y, a su vez, simplifica el esfuerzo general de desarrollo.

Administrar riesgos de cumplimiento y seguridad

La API de recuperación usa las características de seguridad y cumplimiento integradas en Microsoft 365 para garantizar que se conserven los permisos de origen de datos y la configuración de cumplimiento. Al recuperar los datos en el lugar, evita fugas de datos y garantiza que la información confidencial de un cliente nunca sea accesible para otro, lo cual es esencial para mantener estrictos estándares de seguridad y cumplimiento. Dentro de una organización, el modelo de permisos de Microsoft 365 garantiza que los usuarios solo puedan obtener resultados del contenido al que tienen permiso para acceder.

Solucionar la relevancia y la frescura

Debido a que la API de recuperación recupera el contexto relevante sin duplicación de datos, sus resultados se mantienen actualizados y relevantes, y elimina la necesidad de mantener canalizaciones de datos independientes y costosas.

Menor costo de propiedad y esfuerzo de desarrollo

La API de recuperación elimina la necesidad de crear una canalización de indexación y exportación de datos segura que puede incurrir en costos significativos para las organizaciones. La API admite las siguientes funcionalidades requeridas:

  • Administración de proveedores de búsquedas
  • Rastreadores
  • Conectores de datos
  • Almacenamiento de datos
  • Analizadores de contenido
  • Indización
  • Seguridad

Las organizaciones pueden usar estas características integradas para evitar gastos y complejidades, y mantener estrictos controles de acceso y cumplimiento dentro de Microsoft 365.

Funcionalidades de la API de recuperación

La API de recuperación permite recuperar datos de los siguientes orígenes de datos:

  • SharePoint
  • OneDrive
  • Conectores de Copilot

La API admite consultas de lenguaje natural y usa la pila de Microsoft 365 Copilot para recuperar el contexto de conexión a tierra relevante dentro del límite de confianza de Microsoft 365. Puede usar la API para definir el ámbito de la recuperación mediante el lenguaje de consulta por palabra clave (KQL) para recuperar el contenido más importante de su caso de uso. Con KQL, puede filtrar por direcciones URL, intervalos de fechas, tipos de archivo y mucho más.

Licencias

La API de recuperación está disponible sin coste adicional para los usuarios con una licencia de complemento de Microsoft 365 Copilot. Al obtener acceso o usar la API de recuperación de Microsoft 365 Copilot, acepta los Términos de uso de las API de Microsoft 365 Copilot (versión preliminar).

Para los usuarios que no dispongan de una licencia de complemento de Microsoft 365 Copilot, la API de recuperación estará disponible a través del consumo de pago por uso (versión preliminar) para orígenes de datos de nivel de inquilino, como conectores de SharePoint y Copilot. Los orígenes de datos de nivel de usuario, como OneDrive, no están disponibles.

Nota:

El consumo de pago por uso de la API de recuperación es actualmente una característica en versión preliminar. Cuando accede o usa el consumo de pago por uso de la API de recuperación de Microsoft 365 Copilot, acepta los Términos de uso de pago por uso de la API de recuperación de Microsoft 365 Copilot (versión preliminar).

Los usuarios con licencia que no son de Copilot y que tienen habilitado el pago por uso para la API de recuperación pueden usar la herramienta SharePoint en Microsoft Foundry a través del consumo de pago por uso.

Para obtener más información sobre cómo habilitar y deshabilitar el consumo de pago por uso de la API de recuperación, así como los precios, vea Información general sobre el pago por uso de la API de recuperación.

Procedimientos recomendados

Las siguientes prácticas recomendadas se aplican tanto a las consultas sin filtrar (consultas sin filterExpression) como a las consultas filtradas (consultas con filterExpression):

  • Los resultados y las extracciones devueltos por la API de recuperación no están ordenados. Por este motivo, se recomienda no limitar el valor maximumNumberOfResults a menos que tenga requisitos estrictos sobre la cantidad de tokens que puede consumir el LLM.
  • Envíe todas las extracciones devueltas por la API de recuperación a su LLM/orchestrator para la generación de respuestas.
  • Evite consultas genéricas que podrían aplicarse a una amplia variedad de contenido.
  • Proporcione el mayor contexto posible en la consulta.
  • queryString debe ser una sola oración.
  • Evite errores ortográficos en palabras clave con mucho contexto al construir el elemento queryString.

Aplique la siguiente práctica recomendada a las consultas filtradas (consultas con filterExpression):

  • Si desea filtrar mediante el parámetro de ruta en SharePoint o OneDrive, no use un vínculo para compartir ni copie la dirección URL de la barra de direcciones. En su lugar, vaya a la ubicación de la carpeta o archivo en SharePoint o OneDrive online y elija los tres puntos para abrir Más acciones. Desplácese hacia abajo en el panel y elija Detalles. Desde allí, puede desplazarse hacia abajo en el panel de navegación izquierdo para buscar y copiar la ruta de acceso.

Limitaciones conocidas

A continuación se muestran las limitaciones actuales y otras limitaciones de la API de recuperación:

  • Necesita los Files. permisos Read.All y Sites.Read.All para recuperar contenido de SharePoint mediante la API de recuperación.
  • Necesita los Files. permisos Read.All y Sites.Read.All para recuperar contenido de OneDrive mediante la API de recuperación.
  • Necesita el permiso ExternalItem.Read.All para recuperar el contenido de los conectores de Copilot mediante la API de recuperación.
  • La API de recuperación está optimizada para la recuperación del contexto.
  • El parámetro de solicitud queryString tiene un límite de 1.500 caracteres.
  • Debe recuperar de un origen de datos a la vez mediante el parámetro de solicitud dataSource . No se admiten los resultados intercalados.
  • Si el parámetro de solicitud filterExpression tiene una sintaxis de KQL incorrecta, la consulta se ejecuta correctamente sin ámbito.
  • No todas las propiedades de SharePoint y OneDrive son compatibles con filterExpression. Para obtener una lista de las propiedades admitidas, consulte la referencia de la API.
  • El parámetro de solicitud maximumNumberOfResults tiene un valor máximo de 25.
  • El relevanceScore en la carga de respuesta mide la similitud de coseno entre queryString y el extract, normalizado al rango de 0 a 1.
  • Es posible que se devuelva una extracción sin un relevanceScore al recuperarla de los conectores de Copilot.
  • Se admiten hasta 200 solicitudes por usuario por hora.
  • La recuperación de texto en tablas se limita a archivos de.doc, .docx y .pptx en OneDrive y SharePoint.
  • No se admite la recuperación de contenido no textual, incluidas imágenes y gráficos.
  • No se admiten los resultados de archivos con extensiones de .docx, .pptx y .pdf mayores que 512 MB. No se admiten los resultados de archivos con cualquier otra extensión de más de 150 MB.
  • Si recupera desde SharePoint o OneDrive, la recuperación semántica y la recuperación híbrida solo se admiten para las extensiones de archivo .doc, .docx, .pptx, .pdf, .aspx y .one . Todas las demás extensiones de archivo solo admiten la recuperación léxica.
  • La API de recuperación está sujeta a todas las limitaciones del índice semántico de Microsoft 365 Copilot.
  • Si retrievalHits en la carga de respuesta está vacía, no se encontraron resultados relevantes.

Paso siguiente