什么是语音翻译?

在本文中,你将了解使用 Azure 语音进行翻译的优点和功能。 语音服务支持音频流的实时多语言语音转语音和语音转文本翻译。

使用语音 SDK 或语音 CLI,可以为应用程序、工具和设备授予对提供音频的源听录和翻译输出的访问权限。 检测到语音时,会返回过渡性的听录和翻译结果,最终结果可以转换为合成语音。

有关语音翻译支持的语言列表,请参阅语言和语音支持

提示

前往 Speech Studio,以低延迟快速测试语音并将语音翻译为所选的其他语言。

核心功能

语音翻译的核心功能包括:

实时语音翻译(标准)

语音翻译使用一个标准 API 通过文本输出、音频输出或两者进行实时翻译。

如果要发送指定源语言的输入音频流,并以指定目标语言返回翻译文本、合成语音或两者,请使用标准语音翻译 API。

多个目标语言翻译

在需要多种语言的输出时,语音服务可以直接提供将输入语言翻译成两种目标语言的功能。 这样,便可以在单个 API 调用中接收两个输出并将这些翻译共享给更广泛的受众。 如果需要更多输出语言,可以创建多服务资源或使用单独的翻译服务。

如果需要翻译成两种以上的目标语言,需要创建 Azure AI 服务资源或针对第二种以外的更多语言使用单独的翻译服务。 如果选择使用多服务资源调用语音翻译服务,请注意,翻译费用适用于除第二种语言以外的每种语言,具体取决于翻译的字符计数。

若要计算应用的翻译费用,请参阅 Azure 翻译器定价

多个目标语言翻译定价

请务必注意,语音翻译服务实时运行,在中间过程中,系统会翻译语音结果以生成翻译结果。 因此,实际翻译量大于输入音频的标记量。 需要支付每种目标语言的语音转文本听录和文本翻译费用。

例如,假设你需要将一小时音频文件的文本翻译为三种目标语言。 如果初始语音转文本听录包含 10,000 个字符,则你可能需支付 2.80 美元的费用。

警告

此示例中的价格仅用于说明目的。 有关最新定价信息,请参阅 Azure 语音定价翻译器定价

开始

首先,请尝试使用语音翻译快速入门。 语音翻译服务通过语音 SDK语音 CLI 提供。

可以在 GitHub 上找到 Speech SDK 语音转文本和翻译示例。 这些示例涵盖了常见方案,例如,从文件或流中读取音频、连续和单发识别和翻译,以及使用自定义模型。

后续步骤