Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
La limitación se produce cuando las operaciones consumen más segundos de unidades de capacidad (CU) de los que permite la SKU de capacidad. Las unidades de capacidad miden la potencia de cálculo disponible para cada SKU. Un exceso de limitación puede dar lugar a una experiencia degradada para el usuario final. Un tenant de Microsoft Fabric puede crear varias capacidades y asignar espacios de trabajo a una capacidad específica para la facturación y el dimensionamiento.
Fabric aplica limitación a nivel de capacidad. Mientras que una capacidad, o conjunto de espacios de trabajo, puede experimentar un rendimiento reducido por sobrecarga, otras pueden seguir funcionando con normalidad. Cuando una capacidad genera funcionalidades como los elementos de OneLake y otra capacidad las consume, el estado de limitación de recursos de la capacidad consumidora determina si limita las llamadas al elemento.
Cómo Fabric equilibra rendimiento y fiabilidad
Fabric ofrece un rendimiento rápido a sus clientes. Las tareas que pueden tardar varios minutos en completarse en otras plataformas pueden finalizar en cuestión de segundos en Fabric. Las operaciones grandes pueden ejecutarse en cualquier momento del día sin necesidad de una planificación cuidadosa, ya que Fabric distribuye el cálculo de esas operaciones durante un periodo de tiempo más largo, sin ralentizar la operación. Fabric permite este comportamiento mediante las funciones integradas de ráfaga y suavizado. Estas características permiten que las capacidades se autogestionen y se autorrecuperen ante picos temporales de uso que, de otro modo, provocarían que otros sistemas fallen o se ralenticen.
Bursting: Utiliza más capacidad de cálculo de la que proporciona el SKU
Para garantizar un rendimiento rápido, Fabric utiliza el bursting para ejecutar operaciones lo más rápido posible. Con el bursting, las operaciones pueden consumir temporalmente más computación que el computo provisionado para el SKU de capacidad. Gracias al procesamiento en ráfaga, obtienes resultados sin tener que esperar. Una capacidad menor también puede utilizar el bursting para operar operaciones más grandes que normalmente requerirían una capacidad más costosa.
Suavización: Distribuir el uso de la CU entre futuros puntos temporales
Para evitar penalizarte cuando las operaciones se benefician de la explosión, Fabric suaviza, o promedia, el uso de CU de una operación durante un periodo de tiempo más largo. Este comportamiento garantiza que puedas disfrutar de un rendimiento consistentemente rápido sin limitaciones.
Suavizado distribuye el uso de CU consumido a través de puntos de tiempo futuros. Los puntos de tiempo de Fabric tienen 30 segundos de duración. Las siguientes 24 horas contienen 2.880 puntos de tiempo. Fabric gestiona automáticamente la cantidad de CUs consumidas en cada punto de tiempo.
El tipo de utilización de una operación determina el número de puntos de tiempo que Fabric utiliza para el suavizado. Obtenga información sobre las operaciones de Fabric.
- Fabric suaviza las operaciones interactivas durante un mínimo de cinco minutos, y hasta 64 minutos dependiendo de cuánto consumo de CU consuman.
- Fabric suaviza las operaciones en segundo plano durante un periodo de 24 horas porque normalmente tienen largos tiempos de funcionamiento y un gran consumo de CU.
Debido al suavizado, solo se aplica una parte del uso de CU para una operación a cualquier punto de tiempo individual, lo que reduce la limitación general. El uso de CU suavizado se acumula a medida que se ejecutan las operaciones. La capacidad futura, que son las CUs disponibles en futuros puntos temporales, paga por un uso fluido porque la capacidad funciona de forma continua.
El estallido y el suavizado funcionan juntos para facilitarte tu trabajo. Por ejemplo, normalmente dedicas tiempo a programar tareas y repartirlas a lo largo del día. Con el suavizado, Fabric reparte el coste de cálculo para trabajos en segundo plano durante 24 horas. Como resultado, los trabajos programados pueden ejecutarse todos simultáneamente sin causar picos que de otro modo bloquearían el inicio de los trabajos. Al mismo tiempo, puedes disfrutar de un rendimiento consistentemente rápido sin esperar a que se completen los trabajos lentos ni perder tiempo gestionando horarios de trabajo.
Nota:
Fabric no admite ráfagas ni suavización cuando un administrador de capacidad habilita la facturación de escalado automático para Spark. En este escenario, el uso de Spark funciona en modo de pago por uso, y los conceptos de bursting y suavizado no se aplican.
Disparadores y etapas de aceleración
Aunque las capacidades tienen un suavizado integrado que reduce el impacto de los picos de uso, todavía es posible sobrecargar una capacidad mediante la ejecución de demasiadas operaciones.
La capacidad limita automáticamente las nuevas operaciones cuando está sobrecargada. La limitación se produce en pasos progresivos para minimizar el impacto en tareas importantes, como las actualizaciones de datos.
Incluso cuando una capacidad funciona por encima del 100 % de uso, Fabric no aplica inmediatamente la limitación. En cambio, la capacidad proporciona protección contra excesos de consumo, que te permite consumir 10 minutos de capacidad futura sin limitación. Este comportamiento ofrece una protección limitada incorporada contra sobretensiones, al tiempo que ofrece a los usuarios un rendimiento siempre rápido y sin interrupciones.
La limitación se inicia cuando una capacidad usa todos sus recursos de CU durante los próximos 10 minutos. La primera fase de la limitación impone retrasos de 20 segundos a las nuevas operaciones interactivas. La segunda fase de la limitación rechaza nuevas operaciones interactivas cuando una capacidad agota todos sus recursos de CU para la próxima hora. Durante esta fase, las operaciones en segundo plano pueden comenzar y ejecutarse. La tercera fase de limitación rechaza todas las solicitudes nuevas, tanto interactivas como en segundo plano, cuando la capacidad agota todos los recursos de CU disponibles para las próximas 24 horas. La capacidad sigue limitando las solicitudes hasta que pagas las CUs consumidas.
Nota:
Microsoft intenta mejorar la flexibilidad del cliente en el uso del servicio, a la vez que equilibra la necesidad de administrar el uso de la capacidad del cliente. Por este motivo, Microsoft puede cambiar o actualizar la directiva de limitación de Fabric.
La siguiente tabla resume los factores desencadenantes y las etapas de limitación de velocidad.
| Uso | Límite de la póliza | Impacto en la experiencia |
|---|---|---|
| Uso <= 10 minutos | Protección contra uso por encima del límite | Los trabajos pueden consumir 10 minutos de uso de capacidad futura sin restricciones. |
| 10 minutos < Uso <= 60 minutos | Retraso interactivo | Fabric retrasa los trabajos interactivos solicitados por el usuario en 20 segundos tras la entrega. |
| 60 minutos < Uso <= 24 horas | Rechazo interactivo | Fabric rechaza los trabajos interactivos solicitados por el usuario. |
| Uso > 24 horas | Rechazo en segundo plano | Fabric rechaza todas las solicitudes. |
Ejemplo: Cómo la suavización reduce la regulación para una operación en segundo plano
A continuación se muestra un ejemplo ilustrativo de cómo funciona la suavización para una operación en segundo plano que consumió 1 hora de CU (su uso equivalía a 1 CU durante 1 hora). Fabric suaviza las operaciones en segundo plano durante 24 horas. La contribución de una operación en segundo plano a cualquier punto temporal es las horas de CU de la operación divididas entre las horas de CU del SKU durante el período de suavizado. Un F2 proporciona 2 CUs, es decir, 48 horas de CU al día (2 CUs multiplicados por 24 horas). Este trabajo contribuye con 1 hora de CU / 48 horas de CU = ~2,1 % en cada instante temporal. El impacto en los límites de limitación de 10 y 60 minutos también es de ~2,1%.
Aquí está el detalle que apoya el ejemplo.
1 hora CU = 3.600 segundos CU (1 CU multiplicado por 60 minutos por hora y 60 segundos por minuto).
Cada punto temporal dura 30 segundos. En 24 horas, hay 2880 puntos de tiempo (24 horas * 60 minutos * 2 puntos de tiempo por minuto).
Como el suavizado distribuye los 3.600 segundos de CU a lo largo de 24 horas, la tarea aporta 3.600 segundos de CU / 2.880 intervalos de tiempo a cada intervalo de 30 segundos. Por lo tanto, aporta 1,25 segundos de CU por punto temporal.
El porcentaje de limitación de 10 minutos se basa en el total de CUs disponibles en los siguientes 10 minutos de capacidad operativa.
Una capacidad F2 proporciona 2 CU. En cada punto temporal, un F2 tiene 2 CUs multiplicados por 30 segundos = 60 CU segundos de cálculo.
La contribución de la tarea en segundo plano a cada punto temporal es de 1,25 segundos de CU / 60 segundos de CU = ~2,1 % de un punto temporal individual.
En 10 minutos, el F2 tiene 2 CU multiplicadas por 600 segundos = 1.200 segundos de cálculo.
La parte de la tarea en segundo plano que el suavizado distribuye en los siguientes 10 minutos de capacidad es 1,25 segundos de CU multiplicados por 20 puntos temporales = 25 segundos de CU.
Así, el porcentaje de limitación de 10 minutos es 25 segundos de CU / 1.200 segundos de CU = ~2,1 %.
Del mismo modo, el impacto porcentual de limitación de 60 minutos del trabajo en segundo plano también es de ~2,1%.
Aunque la operación en segundo plano consumió más CUs de las disponibles en el siguiente intervalo de 10 minutos (consumió seis veces más), la capacidad F2 no se ve limitada porque el suavizado distribuye el total de CUs a lo largo de 24 horas. Debido al suavizado, solo se aplica una pequeña parte de las UNIDADES de proceso consumidas a cualquier punto de tiempo individual.
Sobrepagos, transporte y agotamiento
Cuando las operaciones utilizan más capacidad de la que soporta el SKU en un único punto temporal, el sistema calcula un excedente. El sistema calcula los excesos después del suavizado. Si los excedentes superan la ventana de limitación permitida de 10 minutos, se convierten en CUs de arrastre .
La protección por uso por encima del límitegarantiza que la capacidad no se reduzca hasta que se complete la ventana de limitación de 10 minutos. Reduce la frecuencia de retrasos interactivos que provocan picos temporales de utilización.
Fabric aplica las CUs de reenvío a cada punto temporal posterior. Si un intervalo temporal no se completa, las CU no utilizadas reducen la cantidad de CU arrastradas. Esta reducción es el burndown.
La aplicación de la limitación continúa hasta que la capacidad sin usar paga todas las CU de transporte.
Capacidades de supervisión para la limitación
Los administradores de capacidad pueden configurar alertas por correo electrónico para los umbrales de capacidad utilizando Eventos de Resumen de Capacidad. Los administradores también pueden usar la aplicación de métricas de capacidad para revisar los niveles de restricción de su capacidad.
Dimensionamiento adecuado y optimización de una capacidad
Los niveles de limitación constantemente altos indican la necesidad de equilibrar la carga entre varias capacidades o aumentar el tamaño de la SKU de la capacidad. Para los SKUs F, puedes escalar la capacidad. Escalar entre SKUs en lados opuestos del límite F256 y F512 podría resultar en una experiencia más lenta.
Cómo indicar que se está produciendo una limitación de capacidad
Cuando una capacidad rechaza solicitudes, ves códigos de error específicos y texto de error:
- Código de estado
CapacityLimitExceeded - Mensaje de error
Your organization's Fabric compute capacity has exceeded its limits. Try again later. - Mensaje de error
Cannot load model due to reaching capacity limits
Nota:
El bajo rendimiento suele deberse al diseño de un objeto. Solo a veces el rendimiento es lento debido a la limitación de capacidad.
Cuando se sobrecarga una capacidad, un administrador de capacidad puede usar la aplicación de métricas de capacidad de Fabric para confirmar la limitación.
- La tabla Eventos del sistema de la página Cómputo muestra el historial de eventos de regulación.
- Los gráficos de limitación de la página Proceso se muestran cuando el uso suavizado supera uno de los límites.
Cómo detener la limitación cuando se produce
Las capacidades son auto-reparables, por lo que siempre puede esperar hasta que termine el estado de sobrecarga antes de enviar nuevas solicitudes.
Sin embargo, para dejar de sufrir esta limitación más rápidamente, puedes usar las siguientes estrategias.
Al usar capacidades de SKU de F, para detener la limitación:
- Aumente temporalmente la SKU. Al aumentar la SKU, se agota el transporte más rápido, ya que cada punto de tiempo tiene más capacidad de inactividad.
- Haz una pausa y luego retoma tu capacidad. La pausa de una capacidad da como resultado un evento de facturación para el uso acumulado de la capacidad futura. Cuando se inicia o reanuda una capacidad, tiene un uso de capacidad futuro cero para que pueda aceptar nuevas operaciones inmediatamente. Pausar puede hacer que el contenido asignado a la capacidad no esté disponible, así que primero asegúrate de que la capacidad no esté en uso.
- La facturación por exceso de capacidad también puede evitar que se produzca la limitación; sin embargo, cuesta tres veces la tarifa normal de capacidad. Para más información, consulte Habilitar exceso de capacidad.
Al usar capacidades de SKU de P, para detener la limitación:
- Habilite la escalabilidad automática para la capacidad P.
Las operaciones en vuelo no se restringen
La limitación solo afecta a las operaciones solicitadas después de que la capacidad inicie la limitación. Todas las operaciones, incluidas las de larga duración que entregaste antes de que comenzara el throttling, pueden completarse. Este comportamiento te asegura que las operaciones se completen, incluso durante picos de uso de CU.
Protección de limitación compuesta
En Fabric, una operación suele desencadenar otros elementos o cargas de trabajo para completarse. Hay muchos ejemplos, pero uno típico es ver un informe. Cada objeto visual del informe ejecuta una consulta en un modelo semántico subyacente. El modelo semántico también podría leer datos de OneLake para proporcionar el resultado de la consulta. Cada una de estas solicitudes forma una cadena.
Cuando hay una cadena de llamadas, existe el riesgo de limitación acumulada, que se produce cuando Fabric aplica la limitación más de una vez a la misma petición. Fabric cuenta con protección integrada contra el estrangulamiento compuesto, lo que reduce la probabilidad de que se produzca estrangulamiento compuesto. Las cargas de trabajo pueden optar por esta protección.
Cuando las cargas de trabajo soportan protección contra la limitación compuesta, Fabric limita una solicitud solo una vez por cada capacidad que participa en la cadena. La decisión de limitación se produce cuando la solicitud se inicia y se aplica a todas las operaciones de la cadena.
Si una cadena se basa en más de una capacidad, cada capacidad aplica su limitación de velocidad una sola vez, a la primera solicitud que recibe en la cadena.
Las siguientes experiencias de carga de trabajo admiten la limitación compuesta:
- Modelos semánticos que se conectan con otros modelos semánticos usando DirectQuery.
- Consultas DAX desde informes paginados a modelos semánticos.
El comportamiento de limitación es específico de las cargas de trabajo de Fabric
Aunque la mayoría de los productos Fabric siguen las reglas de limitación mencionadas anteriormente, existen algunas excepciones.
Por ejemplo, los flujos de eventos de Fabric tienen muchas operaciones que pueden funcionar durante años después de iniciarse. Limitar las nuevas operaciones de flujo de eventos no tendría sentido, por lo que Fabric reduce la cantidad de recursos de CU asignados a mantener abierto el flujo hasta que la capacidad vuelva a estar en condiciones normales.
Otra excepción es la Inteligencia en tiempo real, que no sería en tiempo real si retrasara las operaciones 20 segundos. Como resultado, la inteligencia en tiempo real no aplica la primera fase de limitación con retrasos de 20 segundos a 10 minutos de capacidad futura. La inteligencia en tiempo real espera hasta la fase de rechazo en 60 minutos de capacidad futura para comenzar la limitación. Este comportamiento garantiza que puedas seguir disfrutando de un rendimiento en tiempo real incluso en periodos de alta demanda.
De manera similar, Fabric notifica casi todas las operaciones de la categoría Warehouse como actividad en segundo plano para aprovechar la distribución uniforme de la actividad a lo largo de 24 horas y permitir los patrones de uso más flexibles posibles. La clasificación de todo el almacenamiento de datos como en segundo plano impide que los picos de utilización de CU desencadenen la aceleración con demasiada rapidez. Algunas peticiones pueden desencadenar una cadena de operaciones a la que Fabric aplica una limitación de manera distinta. Cuando una operación interactiva inicia una cadena que incluye una operación en segundo plano, Fabric puede restringir la operación en segundo plano igual que si fuera una operación interactiva.
Clasificaciones interactivas y en segundo plano para la limitación y el suavizado
Quizá notes que Fabric a veces clasifica las operaciones como interactivas y las suaviza como fondo, o viceversa. Esta distinción se debe a que los sistemas de limitación de velocidad de Fabric deben aplicar las reglas de limitación de velocidad antes de que una solicitud comience a ejecutarse.
El sistema de limitación intenta clasificar con precisión las operaciones tras el envío. A veces, cuando una operación comienza a ejecutarse, hay información más detallada disponible que cambia la categorización. En escenarios ambiguos, el sistema de limitación de frecuencia opta por clasificar las operaciones como en segundo plano, lo que más te conviene.
Realizar un seguimiento de los usos por encima del límite y las operaciones rechazadas
Para ver si tu capacidad está sobrecargada, revisa el gráfico de Utilización en la aplicación Microsoft Fabric Capacity Metrics. Un pico que pasa por la línea indica un uso por encima del límite. Para investigar aún más el uso por encima del límite, explore en profundidad la página del punto de tiempo. Luego revisa tanto tus operaciones interactivas como las de segundo plano para ver cuáles causaron los excesos.
Dado que un uso superior al 100 % no significa automáticamente una limitación de velocidad, usa el gráfico de limitación de velocidad cuando evalúes los excesos. A partir de ahí, abre una tabla con los minutos hasta la reducción, un gráfico con adiciones, reducción y porcentaje acumulado, entre otros datos. Minutos para quemar estima cuánto tiempo tardaría el agotamiento si no se producen más operaciones en la capacidad.
Para ver un historial visual de cualquier sobreuso de la capacidad, incluidos el arrastre, los datos acumulados y el consumo de los datos de utilización, ve a la pestaña Excesos. Cambia la escala visual de excesos para mostrar 10 minutos, 60 minutos y 24 horas.
La vista detallada de la aplicación Microsoft Fabric Capacity Metrics muestra las operaciones que Fabric rechazó durante un evento de limitación de capacidad. Hay poca información sobre estas operaciones porque nunca comenzaron. Puedes ver el producto, el usuario, el ID de operación y la hora de la solicitud. Cuando Fabric rechaza una solicitud, los usuarios finales reciben un mensaje de error que les pide que lo intenten de nuevo más adelante.
Capacidad de cómputo facturable y no facturable en los cálculos de limitación
Al revisar el uso de la capacidad en la aplicación de métricas de capacidad, algunas operaciones son facturables y otras no son facturables. Los cálculos de limitación solo incluyen operaciones facturables. Algunas capacidades de vista previa pueden generar operaciones no facturables. Utiliza operaciones no facturables para planificar con antelación y así dimensionar correctamente tu capacidad para cuando estas funciones de vista previa se vuelvan facturables.