SenseAudio 简介

SenseAudio 定位为 AI 语音与智能音频创作平台,以 AI 语音大模型为基础,为用户提供自然语音生成、多情绪表达、音色克隆及语音识别等能力。

平台同时提供创作台、开放平台及多种 AI 音视频创作工具,覆盖从文本、声音到音视频内容生成的不同创作环节。官网还提供 S-Design、S-Agent、商汤输入法 SoWork 等相关 AI 工具。

SenseAudio

SenseAudio 核心功能

文本转语音

输入文本并选择对应音色,即可生成 AI 语音。平台提供多种精品音色,并支持不同情绪和表达风格,适用于短视频配音、有声内容、广告旁白等场景。

音色克隆

支持通过语音素材捕捉声音特征,对原始音色进行 AI 复刻,并支持多种语言及粤语的音色克隆。

AI 音频生成

用户可以通过自然语言描述角色、台词和情绪,生成多角色对白、背景音乐及环境音,适合故事、播客及沉浸式音频内容制作。

语音识别

将语音内容快速转换为文字,可用于语音转写、语音交互及音频内容处理。

同声传译

提供 AI 同声传译能力,支持多语种之间的实时语音转换与翻译,适用于跨语言沟通和会议交流。

人声提取

支持从音频和视频中提取人物声音,并提供中文、英文人声提取能力,可用于音频后期处理及内容再创作。

AI 音视频创作

平台提供 AI 音视频创作工具,覆盖 AI 视频生成及音视频编辑等环节,为内容创作者提供从灵感构思到作品制作的辅助能力。

SenseAudio 产品优势

  • AI 语音大模型驱动:围绕语音生成、识别及交互构建 AI 能力。
  • 自然语音表现:强调自然、动听及多情绪语音表达。
  • 音色资源丰富:提供多种精品音色,覆盖不同配音需求。
  • 多种音频能力集成:覆盖 TTS、ASR、音色克隆、人声提取和音频生成。
  • 创作工具丰富:同时提供音频、视频及设计类 AI 创作能力。
  • 支持开放平台:提供 API 开放平台及模型调用能力,便于开发者将 AI 音频能力集成到业务系统。

SenseAudio 应用场景

SenseAudio 可用于以下场景:

  • 短视频配音:生成短视频、宣传视频等内容所需的 AI 配音。
  • 有声内容制作:用于有声书、故事及音频节目制作。
  • 广告与营销:生成广告旁白、宣传内容及品牌音频。
  • 影视与内容创作:辅助角色对白、音效及音频内容制作。
  • AI 音频创作:生成多角色对白、背景音乐和环境音。
  • 跨语言交流:利用同声传译能力辅助跨语言沟通。
  • 语音交互:用于语音识别、语音交互及智能应用。
  • 开发者应用:通过开放平台将语音、文本和多媒体生成能力集成到应用中。

SenseAudio 使用教程

文本转语音

  • 进入 SenseAudio 创作台。
  • 输入需要转换的文本。
  • 选择合适的 AI 音色。
  • 根据需求调整语速、声调及音量。
  • 生成并试听语音。
  • 满意后导出音频。

音色克隆

  • 准备符合要求的清晰语音素材。
  • 上传语音素材。
  • 根据平台要求完成音色创建。
  • 选择生成的音色进行语音合成。
  • 根据实际效果调整文本和表达。

开放平台 API

开发者可以进入 SenseAudio 开放平台,获取 API Key,并根据官方 API 文档调用文本生成、语音合成、语音识别、图片生成、视频生成及音乐生成等相关能力。

SenseAudio 收费标准

SenseAudio 的创作台与 API 使用同一套餐和积分池,官方当前说明 1 元可兑换 5000 积分,不同模型按照不同计费单位扣除积分。

开放平台目前公开的主要模型价格包括:

能力模型官方价格
文本生成SenseAudio-S2输入 5 元/百万 Tokens,输出 30 元/百万 Tokens
文本生成SenseAudio-S2-Flash输入 2 元/百万 Tokens,输出 12 元/百万 Tokens
文本生成SenseAudio-S2-Lite输入 1 元/百万 Tokens,输出 12 元/百万 Tokens
语音合成SenseAudio-TTS-1.53.5 元/万字符
语音识别SenseAudio-ASR-Lite-1.50.9 元/小时
语音识别SenseAudio-ASR-1.51.8 元/小时
语音识别SenseAudio-ASR-Pro-1.53.6 元/小时
语音识别SenseAudio-ASR-DeepThink-1.53.6 元/小时
语音识别SenseAudio-ASR-Check-1.53.6 元/小时
音乐生成SenseAudio-Music-1.0原价 1 元/首,优惠后 0.5 元/首
图片生成SenseAudio-Image-2.0原价 1 元/张,优惠后 0.5 元/张
图片生成SenseAudio-Image-1.00.2 元/张

视频生成等能力按照生成时长、分辨率等维度计费,具体价格以 SenseAudio 开放平台当前模型列表及计费规则为准。

SenseAudio 常见问题(FAQ)

SenseAudio 是什么?

SenseAudio 是一款基于 AI 语音大模型的智能音频创作平台,提供文本转语音、语音识别、音色克隆、音频生成等能力。

SenseAudio 可以进行 AI 配音吗?

可以。平台提供文本转语音功能,并提供多种精品音色及情绪表达能力,可用于短视频、有声内容和广告旁白等场景。

SenseAudio 支持音色克隆吗?

支持。平台提供音色克隆功能,可以根据语音素材提取声音特征并生成对应 AI 音色。

SenseAudio 支持语音识别吗?

支持。平台提供语音识别能力,可以将语音内容转换为文字。

SenseAudio 是否提供 API?

提供。SenseAudio 建立了开放平台,并提供模型列表、API Key 和相关开发文档。

SenseAudio 支持哪些 AI 能力?

目前官方公开能力包括文本生成、语音合成、语音识别、音乐生成、图片生成及视频生成等。

相关导航