Skip to content

API 参考

推荐从 Convbased 调用高层接口:

ts
import { Convbased } from "@convbased/sdk";

const session = await Convbased.startVoiceChange(options);
const converted = await Convbased.convertFile(options);
const speech = await Convbased.textToSpeech(options);

三项函数也支持具名导入。

高层函数

函数签名返回
startVoiceChangestartVoiceChange(opts: StartVoiceChangeOptions)Promise<VoiceSession>
convertFileconvertFile(opts: ConvertFileOptions)Promise<ConvertedFile>
textToSpeechtextToSpeech(opts: TextToSpeechOptions)Promise<TtsResult>

完整参数语义见实时变声文件变声文本转语音

VoiceSession

startVoiceChange() resolve 后返回会话句柄:

成员签名说明
streamMediaStream | null转换后的音频流。
setPitchsetPitch(semitones: number)按半音调整音高。
updateupdate(preferences: VoicePreferences)更新传入的调音字段。
setMutedsetMuted(muted: boolean)设置麦克风静音状态。
mute / unmutemute() / unmute()静音或取消静音。
stopstop(): Promise<void>结束会话并释放 SDK 获取的麦克风流。

文本转语音类型

TextToSpeechOptions 支持:

  • modegeneralexpressiveadvanced
  • voicevoices:单参考或有序多参考,两者不能同时使用。
  • emotionVoice:独立情感参考。
  • promptText:参考音频转写。
  • paramsGeneralTtsParamsExpressiveTtsParamsAdvancedTtsParams

TtsResult 包含 modebillingQuantitybillingUnitaudioDurationSecamountChargedbalanceAfter 和可选 subtitle

需要构建动态模式选择器时,使用 new TtsClient({ auth }).getModes() 获取 TtsModeInfo[]

主要导出类型

分组类型
鉴权SdkAuthenticationSdkAuthOptionsSdkTokenRequestSdkAuthError
实时变声StartVoiceChangeOptionsVoiceSessionVoiceStatusVoiceOutputVoicePreferences
文件变声ConvertFileOptionsConvertedFileFileInferencePreferences
文本转语音TextToSpeechOptionsTtsResultTtsGenerationModeTtsModeInfoTtsBillingUnitTtsReferenceTtsParams

其余低层客户端和辅助类型以软件包随附的 .d.ts 为准。