人工智慧代理的持久任務

那些能連續運作數小時、呼叫外部工具、並在基礎設施故障中生存的 AI 代理,需要 持久執行 的能力——能夠自動檢查進度並從中斷處繼續。 Durable Task Scheduler 與 Durable Task 程式設計模型提供這樣的基礎設施,處理狀態管理、檢查點與分散式協調,讓您的代理程式碼不必負擔這些。

透過這個程式設計模型,你可以利用標準程式結構(迴圈、條件句、錯誤處理)在 .NET、Python、Java 和 JavaScript/TypeScript 中建立韌性且具狀態的代理式工作流程。 執行時會持續維持狀態,並自動從故障中恢復。

Durable Task 不是代理框架——它可以與任何 AI 代理框架運作,包括 Microsoft 代理框架、LangChain 或直接的 LLM API 呼叫。 你專注於代理人的邏輯;Durable Task 處理大規模的可靠執行。

在本文中,您將瞭解:

  • 持久執行可解決 AI 代理程式的生產挑戰
  • 持久任務程式設計模型所支援的代理工作流程模式
  • Durable Task 技術堆疊與其他 Azure 代理式工作流程選項的比較

小提示

準備好開始建造了嗎? 跳到 Agentic Application Patterns 查看程式碼範例,或嘗試 Microsoft Agent Framework 的 Durable Task 擴充功能,實現交鑰匙整合。

持久執行解決生產挑戰

生產環境中的 AI Agent 會面臨持久執行可解決的數項挑戰:

  • 長時間執行且具狀態的工作階段 — Human-in-the-loop 互動、多步驟推理和工具增強工作流程,可讓 Agent 保持作用中數小時、數天或數週。 代理人會累積狀態(對話歷史、中間結果、待處理決策),這些狀態必須在每個步驟中被保留。
  • 昂貴的代幣消耗 — 處理大量 LLM 代幣既昂貴又耗時。 速率限制可能會在工作流程中途節流您的 Agent。 若在過程中發生失敗,已消耗的代幣與已花費的時間將被損失。
  • 基礎設施中斷 — 運算重啟、部署、擴展事件及暫時性故障都可能導致代理會話當機。 若無法恢復,代理人必須從頭開始,重新消耗所有先前已花費的代幣並重複完成所有工作。

持久執行解決了以下挑戰:

  • 自動檢查點 — Durable Task 執行階段會將每個狀態轉換 (LLM 回應、工具呼叫結果、控制流程決策) 設定檢查點至持久儲存體。
  • 從上次檢查點繼續 — 當發生故障時,執行會 自動 在健康的虛擬機上恢復。 完成的 LLM 呼叫不會重複,因此保留權杖費用和時鐘時間。
  • 內建重試 — 可配置的重試策略搭配回溯功能,能處理來自 LLM API、外部工具及下游服務的暫時性失敗,無需額外程式碼。

代理式工作流程模式

Durable Task 支援多種代理型工作流程模式,主要分為兩大類:

  • 確定性工作流程:你的程式碼定義了控制流程。 你用標準程式設計結構來撰寫步驟序列——包括分支、平行處理和錯誤處理。 LLM 是工作流程中的一個步驟,但不控制整體流程。
  • 代理導向工作流程(代理迴圈):LLM 驅動控制流程。 代理人決定呼叫哪些工具、順序,以及任務何時完成。 你提供工具和指令,但執行程式在執行時決定執行路徑。

這兩類都受益於耐用執行,且可在同一應用中結合使用。 欲詳細了解支援模式及程式碼範例,請參閱代理應用模式。

比較 Azure 上的代理式工作流程選項

除了 Durable Task 技術堆疊外,還有多種選擇可以在 Azure 上建立代理式工作流程。 每種選項都有不同的優勢與取捨,取決於你對控制流程、程式語言支援、AI 框架整合、主機、狀態管理及目標受眾的需求。 以下表格將協助你決定哪一種最適合你的需求。

能力 Durable Task 代理框架工作流程 Logic Apps 代理迴圈
控制流程 命令式(代碼定義) 圖形基礎(由程式碼定義) 宣告式 (設計工具 / JSON)
語言 .NET、Python、Java、TypeScript/JS .NET,Python 視覺設計器 / JSON
AI 框架支援 任何(語意核心、LangChain、AutoGen、直接 API) 針對代理框架優化 內建 AI 連接器
裝載 Azure Functions 或任何主機 任何;一等 Foundry Hosted Agents Logic Apps 管理服務
狀態儲存 耐用任務排程器(管理式) 自備 (檢查點管理員) Logic Apps 服務執行時(管理式)
代理導向工作流程 你可以自己做,或用 Durable Task 擴充功能 內建 代理迴圈動作
目標對象 後端開發者 應用程式開發人員 整合 / Low-code 使用者
長時間執行的任務 一等 (數小時到永久) 透過開發人員控制的檢查點 僅限具狀態工作流程 (最長 90 天)
故障復原 自動 說明書 自動
可檢視性 Scheduler dashboard、OpenTelemetry OpenTelemetry,自訂視覺化 Azure 監視器、Logic Apps 診斷

下一步