Azure Text to Speech

Azure Text to Speech を使用すると、140 の言語と方言で 400 を超える音声で自然に話すアプリとサービスを構築できます。

このコネクタは、次の製品とリージョンで使用できます。

サービス クラス リージョン
コピロット スタジオ Premium 次を除くすべての Power Automate リージョン :
     - 21Vianet が運営する China Cloud
ロジック アプリ Standard 次を除くすべての Logic Apps リージョン :
     - Azure China リージョン
Power Apps Premium 次を除くすべての Power Apps リージョン :
     - 21Vianet が運営する China Cloud
Power Automate(パワーオートメート) Premium 次を除くすべての Power Automate リージョン :
     - 21Vianet が運営する China Cloud
お問い合わせ
名前 Speech Service Power Platform チーム
URL https://docs.microsoft.com/azure/cognitive-services/speech-service/support
Email speechpowerplatform@microsoft.com
コネクタ メタデータ
Publisher Microsoft
Website https://docs.microsoft.com/azure/cognitive-services/speech-service/
プライバシー ポリシー https://privacy.microsoft.com
カテゴリ 人工知能;ウェブサイト

Speech サービスを使用すると、REST API を使用してテキストを合成音声に変換し、リージョンでサポートされている音声の一覧を取得できます。

前提条件

続行するには、次のものが必要です。

接続を作成する

コネクタでは、次の認証の種類がサポートされています。

[variables('oauthDefaultDisplayName')] [variables('oauthDefaultDescription')] Azure Government と US Government (GCC) と米国政府機関 (GCC-High) の Azure Government および国防総省 (DoD) を除くすべてのリージョン 共有不可
API キー APIキー すべてのリージョン 共有可能
Microsoft Entra ID 統合 Microsoft Entra ID を使用して音声サービスにアクセスします。 米国政府 (GCC) のみ 共有不可
統合Microsoft Entra ID (Azure Government) Microsoft Entra ID を使用して音声サービスにアクセスします。 Azure Government および米国政府機関の Azure Government および国防総省 (DoD) (GCC-High) のみ 共有不可
既定 [非推奨] このオプションは、明示的な認証の種類がない古い接続に対してのみ行われ、下位互換性のためにのみ提供されます。 すべてのリージョン 共有不可

[variables('oauthDefaultDisplayName')]

認証 ID: tokenBasedAuth

適用: Azure Government および米国政府 (GCC) および米国政府 (GCC-High) の Azure Government および国防総省 (DoD) を除くすべてのリージョン

[variables('oauthDefaultDescription')]

これは共有可能な接続ではありません。 電源アプリが別のユーザーと共有されている場合、別のユーザーは新しい接続を明示的に作成するように求められます。

名前 タイプ Description 必須
リソースID 文字列 Cognitive Services リソース ID (例: /subscriptions/<Subscription ID>/resourceGroups/<ResourceGroup Name>/providers/Microsoft.CognitiveServices/accounts/<CognitiveServices リソース名>) 正しい
カスタム サブドメイン 文字列 カスタム サブドメイン エンドポイント URL (例: contoso) 正しい

API キー

認証 ID: keyBasedAuth

適用対象: すべてのリージョン

APIキー

これは共有可能な接続です。 電源アプリが別のユーザーと共有されている場合は、接続も共有されます。 詳細については、 キャンバス アプリのコネクタの概要 - Power Apps |Microsoft Docs

名前 タイプ Description 必須
アカウント キー securestring Speech Service キー 正しい
リージョン 文字列 Speech Service リージョン (例: eastus) 正しい

Microsoft Entra ID 統合

認証 ID: tokenBasedAuth

適用: 米国政府 (GCC) のみ

Microsoft Entra ID を使用して音声サービスにアクセスします。

これは共有可能な接続ではありません。 電源アプリが別のユーザーと共有されている場合、別のユーザーは新しい接続を明示的に作成するように求められます。

名前 タイプ Description 必須
リソースID 文字列 Cognitive Services リソース ID (例: /subscriptions/<Subscription ID>/resourceGroups/<ResourceGroup Name>/providers/Microsoft.CognitiveServices/accounts/<CognitiveServices リソース名>) 正しい
カスタム サブドメイン 文字列 カスタム サブドメイン エンドポイント URL (例: contoso) 正しい

統合Microsoft Entra ID (Azure Government)

認証 ID: tokenBasedAuth

適用: Azure Government および米国政府の Azure Government および国防総省 (DoD) (GCC-High) のみ

Microsoft Entra ID を使用して音声サービスにアクセスします。

これは共有可能な接続ではありません。 電源アプリが別のユーザーと共有されている場合、別のユーザーは新しい接続を明示的に作成するように求められます。

名前 タイプ Description 必須
リソースID 文字列 Cognitive Services リソース ID (例: /subscriptions/<Subscription ID>/resourceGroups/<ResourceGroup Name>/providers/Microsoft.CognitiveServices/accounts/<CognitiveServices リソース名>) 正しい
カスタム サブドメイン 文字列 カスタム サブドメイン エンドポイント URL (例: contoso) 正しい

既定 [非推奨]

適用対象: すべてのリージョン

このオプションは、明示的な認証の種類がない古い接続に対してのみ行われ、下位互換性のためにのみ提供されます。

これは共有可能な接続ではありません。 電源アプリが別のユーザーと共有されている場合、別のユーザーは新しい接続を明示的に作成するように求められます。

名前 タイプ Description 必須
アカウント キー securestring ニューラル テキスト読み上げアカウント キー用の Azure Cognitive Services 正しい
リージョン 文字列 Speech Service リージョン (例: eastus) 正しい

調整制限

名前 呼び出し 更新期間
接続ごとの API 呼び出し 100 60 秒

アクション

SSML を使用してテキストを音声に変換する

音声合成マークアップ言語 (SSML) を使用してテキストを音声に変換する

テキストを音声に変換する

1 つのテキストを音声に変換します。

音声の一覧を取得する

特定のリージョンまたはエンドポイントの音声の完全な一覧を取得します。

SSML を使用してテキストを音声に変換する

音声合成マークアップ言語 (SSML) を使用してテキストを音声に変換する

パラメーター

名前 キー 必須 説明
SSML テキスト
ssmlText True string

SSML 形式のテキスト (例: <speak xmlns='http://www.w3.org/2001/10/synthesis' xmlns:mstts='http://www.w3.org/2001/mstts' xmlns:emo='http://www.w3.org/2009/10/emotionml' version='1.0' xml:lang='en-US'><voice name='en-US-ChristopherNeural'>power connector</voice></speak>)

出力オーディオ形式
outputFormat string

ストリーミング以外のオーディオ形式。 既定値: riff-24khz-16bit-mono-pcm。

テキストを音声に変換する

1 つのテキストを音声に変換します。

パラメーター

名前 キー 必須 説明
音声名
voiceName True string

テキスト読み上げ用の音声名の出力。 たとえば、en-US-JennyNeural です。

ロケール
locale True string

格納されているデータのロケール。 例: en-US.

合成されたテキスト
synthesizedText True string

音声に変換する必要がある合成テキスト。

出力オーディオ形式
outputFormat string

ストリーミング以外のオーディオ形式。 既定値: riff-24khz-16bit-mono-pcm。

Style
style string

音声の高速スタイル。 例: 明るい。

読み上げ速度
speakingRate string

音声の速度。 例: -40.00%。

音声の一覧を取得する

特定のリージョンまたはエンドポイントの音声の完全な一覧を取得します。

返品

名前 パス 説明
array of object
items
object

アレイ