1创建语音识别模型
- 1登录 Azure 门户
- 2选择 AI 服务 -> Azure Speech
- 3点击创建资源 -> 语音识别模型
- 4配置参数并保存
2将文本转换为语音
- 1安装 Azure SDK 或使用 REST API
- 2编写代码或脚本调用文本转语音接口
- 3指定输出格式和语言
- 4生成并下载语音文件
正在加载工具详情...

语音识别、文本转语音和翻译服务
快速了解工具核心信息
核心功能包括语音识别、文本转语音及翻译;亮点是可定制的多语言模型;适用于开发多语言AI应用。
关于本工具的常见疑问解答
概述 用例 安全性 定价 相关产品 客户案例 资源 常见问题 开始使用 Azure
Azure OpenAI 通过结合多种数据类型(如文本、图像、视频和音频)的模型,融入多模态并增强应用。了解详情 Microsoft Foundry 在一个平台上获取开发生成式 AI 应用和自定义代理所需的一切。了解详情 Foundry Control Plane 中的 Content Safety 利用内置工具将负责任 AI 原则付诸实践,提供安全可信的解决方案。了解详情 Azure Content Understanding 加速将多模态数据转化为洞察。了解详情 Azure Translator 实时或批量翻译超过100种语言的文档和文本,实现全球覆盖。了解详情 Azure Language 使用预构建的 AI 功能构建对话界面、总结文档和分析文本。了解详情
Azure OpenAI 通过结合多种数据类型(如文本、图像、视频和音频)的模型,融入多模态并增强应用。了解详情 Microsoft Foundry 在一个平台上获取开发生成式 AI 应用和自定义代理所需的一切。了解详情 Foundry Control Plane 中的 Content Safety 利用内置工具将负责任 AI 原则付诸实践,提供安全可信的解决方案。了解详情 Azure Content Understanding 加速将多模态数据转化为洞察。了解详情 Azure Translator 实时或批量翻译超过100种语言的文档和文本,实现全球覆盖。了解详情 Azure Language 使用预构建的 AI 功能构建对话界面、总结文档和分析文本。了解详情
Azure Speech 是 Foundry Tools(原 Azure AI 服务)的一部分,提供语音转文本、文本转语音、翻译和说话人识别 API。它以前称为 Azure AI Speech。
是的,我们正在将许多以前的 Azure AI 服务重新品牌化为 Foundry Tools。这一转变反映了 Foundry 下的更广泛平台统一,并表明这些服务现在被定位为构建代理型 AI 应用的核心工具。Foundry Tools 中的 Azure Speech 仍然提供相同的强大功能——如语音识别、文本转语音和翻译——但现在是为构建智能代理的开发者设计的统一工具包的一部分。重新品牌有助于阐明这些 API 如何融入 Foundry 生态系统,并使它们更容易被发现、编排和集成到现代 AI 工作流中。
Azure Speech 提供多种功能和能力,包括语音转文本、文本转语音和语音翻译。这些功能通过多种编程语言的 SDK 提供,包括 C#、C++ 和 Java。了解详情
语音支持不断增长的语言集。有关支持的语言,请参阅当前列表。
客户正在使用 Foundry Tools 构建有趣的应用程序。开始使用 Azure Speech,应用于会话式 AI、呼叫后分析和视频摘要等场景。
Azure Speech 支持多种语言的语音识别,包括但不限于英语、中文、西班牙语和法语等。具体支持的语言范围可参考 Azure 官方文档。
通过调用 Azure Speech SDK 或 REST API,并提供要转换的文本内容,可以生成相应的语音文件或直接播放语音。具体实现方法请参考官方文档提供的示例代码。
Azure Speech 提供了可定制的语音模型功能,允许用户根据特定需求训练模型以提高识别准确率和适应特定口音或方言。这有助于在不同场景下提供更精确的服务。
真实用户评价