總結
小提示
有關更多詳細信息,請參閱 文本和圖像 選項卡!
在本單元中,我們探討了 Microsoft Foundry 中的視覺模型,以及如何利用它們分析影像並產生原創影像與影片。
該模組涵蓋多模態模型,支援影像分析。 我們也涵蓋了像 GPT-Image 家族中的圖片生成模型,用於使用 Foundry 工具和 API 從提示中創建和編輯圖片。 最後,我們引入了使用 Sora 模型的影片生成技術,透過互動遊樂場與程式化、非同步的 REST 工作流程,實現文字轉影片及影像對影片的創作。
整體而言,Microsoft Foundry 中的視覺 AI 模型有助於彌合視覺資料與語言型 AI 之間的差距。 它們支援文件與影像分析、視覺助理、無障礙工具及多模態 AI 代理等情境,使影像理解成為現代 AI 應用的自然延伸。
想了解更多,請參考以下連結:
- 請查看文件中的圖像分析快速入門。
- 了解更多關於 視覺輔助聊天模式的資訊。
- 了解更多關於 Azure OpenAI 影像生成模型的資訊。
- 了解更多 關於 Sora 影片生成的資訊。