SenseAudio 简介
SenseAudio 定位为 AI 语音与智能音频创作平台,以 AI 语音大模型为基础,为用户提供自然语音生成、多情绪表达、音色克隆及语音识别等能力。
平台同时提供创作台、开放平台及多种 AI 音视频创作工具,覆盖从文本、声音到音视频内容生成的不同创作环节。官网还提供 S-Design、S-Agent、商汤输入法 SoWork 等相关 AI 工具。

SenseAudio 核心功能
文本转语音
输入文本并选择对应音色,即可生成 AI 语音。平台提供多种精品音色,并支持不同情绪和表达风格,适用于短视频配音、有声内容、广告旁白等场景。
音色克隆
支持通过语音素材捕捉声音特征,对原始音色进行 AI 复刻,并支持多种语言及粤语的音色克隆。
AI 音频生成
用户可以通过自然语言描述角色、台词和情绪,生成多角色对白、背景音乐及环境音,适合故事、播客及沉浸式音频内容制作。
语音识别
将语音内容快速转换为文字,可用于语音转写、语音交互及音频内容处理。
同声传译
提供 AI 同声传译能力,支持多语种之间的实时语音转换与翻译,适用于跨语言沟通和会议交流。
人声提取
支持从音频和视频中提取人物声音,并提供中文、英文人声提取能力,可用于音频后期处理及内容再创作。
AI 音视频创作
平台提供 AI 音视频创作工具,覆盖 AI 视频生成及音视频编辑等环节,为内容创作者提供从灵感构思到作品制作的辅助能力。
SenseAudio 产品优势
- AI 语音大模型驱动:围绕语音生成、识别及交互构建 AI 能力。
- 自然语音表现:强调自然、动听及多情绪语音表达。
- 音色资源丰富:提供多种精品音色,覆盖不同配音需求。
- 多种音频能力集成:覆盖 TTS、ASR、音色克隆、人声提取和音频生成。
- 创作工具丰富:同时提供音频、视频及设计类 AI 创作能力。
- 支持开放平台:提供 API 开放平台及模型调用能力,便于开发者将 AI 音频能力集成到业务系统。
SenseAudio 应用场景
SenseAudio 可用于以下场景:
- 短视频配音:生成短视频、宣传视频等内容所需的 AI 配音。
- 有声内容制作:用于有声书、故事及音频节目制作。
- 广告与营销:生成广告旁白、宣传内容及品牌音频。
- 影视与内容创作:辅助角色对白、音效及音频内容制作。
- AI 音频创作:生成多角色对白、背景音乐和环境音。
- 跨语言交流:利用同声传译能力辅助跨语言沟通。
- 语音交互:用于语音识别、语音交互及智能应用。
- 开发者应用:通过开放平台将语音、文本和多媒体生成能力集成到应用中。
SenseAudio 使用教程
文本转语音
- 进入 SenseAudio 创作台。
- 输入需要转换的文本。
- 选择合适的 AI 音色。
- 根据需求调整语速、声调及音量。
- 生成并试听语音。
- 满意后导出音频。
音色克隆
- 准备符合要求的清晰语音素材。
- 上传语音素材。
- 根据平台要求完成音色创建。
- 选择生成的音色进行语音合成。
- 根据实际效果调整文本和表达。
开放平台 API
开发者可以进入 SenseAudio 开放平台,获取 API Key,并根据官方 API 文档调用文本生成、语音合成、语音识别、图片生成、视频生成及音乐生成等相关能力。
SenseAudio 收费标准
SenseAudio 的创作台与 API 使用同一套餐和积分池,官方当前说明 1 元可兑换 5000 积分,不同模型按照不同计费单位扣除积分。
开放平台目前公开的主要模型价格包括:
| 能力 | 模型 | 官方价格 |
|---|---|---|
| 文本生成 | SenseAudio-S2 | 输入 5 元/百万 Tokens,输出 30 元/百万 Tokens |
| 文本生成 | SenseAudio-S2-Flash | 输入 2 元/百万 Tokens,输出 12 元/百万 Tokens |
| 文本生成 | SenseAudio-S2-Lite | 输入 1 元/百万 Tokens,输出 12 元/百万 Tokens |
| 语音合成 | SenseAudio-TTS-1.5 | 3.5 元/万字符 |
| 语音识别 | SenseAudio-ASR-Lite-1.5 | 0.9 元/小时 |
| 语音识别 | SenseAudio-ASR-1.5 | 1.8 元/小时 |
| 语音识别 | SenseAudio-ASR-Pro-1.5 | 3.6 元/小时 |
| 语音识别 | SenseAudio-ASR-DeepThink-1.5 | 3.6 元/小时 |
| 语音识别 | SenseAudio-ASR-Check-1.5 | 3.6 元/小时 |
| 音乐生成 | SenseAudio-Music-1.0 | 原价 1 元/首,优惠后 0.5 元/首 |
| 图片生成 | SenseAudio-Image-2.0 | 原价 1 元/张,优惠后 0.5 元/张 |
| 图片生成 | SenseAudio-Image-1.0 | 0.2 元/张 |
视频生成等能力按照生成时长、分辨率等维度计费,具体价格以 SenseAudio 开放平台当前模型列表及计费规则为准。
SenseAudio 常见问题(FAQ)
SenseAudio 是什么?
SenseAudio 是一款基于 AI 语音大模型的智能音频创作平台,提供文本转语音、语音识别、音色克隆、音频生成等能力。
SenseAudio 可以进行 AI 配音吗?
可以。平台提供文本转语音功能,并提供多种精品音色及情绪表达能力,可用于短视频、有声内容和广告旁白等场景。
SenseAudio 支持音色克隆吗?
支持。平台提供音色克隆功能,可以根据语音素材提取声音特征并生成对应 AI 音色。
SenseAudio 支持语音识别吗?
支持。平台提供语音识别能力,可以将语音内容转换为文字。
SenseAudio 是否提供 API?
提供。SenseAudio 建立了开放平台,并提供模型列表、API Key 和相关开发文档。
SenseAudio 支持哪些 AI 能力?
目前官方公开能力包括文本生成、语音合成、语音识别、音乐生成、图片生成及视频生成等。

















皖公网安备34010202602243号