總結

已完成

小提示

有關更多詳細信息,請參閱 文本和圖像 選項卡!

本模組介紹語音辨識(語音轉文字)作為語音應用與代理的基礎。 學習者將探索如何從麥克風或音訊檔案擷取語音,並利用 Azure Speech 轉換成書面文字。 該模組說明語音轉文字在應用程式中的角色——無論是客戶端應用程式還是後端服務——並強調常見情境,如即時轉錄、字幕、語音信箱處理,以及向 AI 代理提供文字輸入。

接著,模組涵蓋語音合成(文字轉語音),使應用程式能從文字產生自然聽起來的語音。 學習者可以看到 Azure Speech 如何利用神經語音來控制發音、語調、速度和音高,以及合成音訊如何立即播放或保存以備後用。 本節強調文字轉語音如何讓應用程式與代理能以聲音回應,提升無障礙性、免持互動及整體使用者體驗。

最後,該模組結合了這些功能,並結合了語音轉語音(Voice Live)技術。 學習者將發現 Voice Live 如何將語音轉文字、AI 推理與文字轉語音整合成一個完整的即時對話服務。 開發者不必再拼湊多個元件,而是能利用 Voice Live 打造反應迅速、自然的語音代理,能聆聽、思考與說話——讓使用 Azure Speech 與 Microsoft Foundry 創造生產環境即時的對話體驗變得更容易。

請使用以下連結了解更多資訊。