返回音频创作

🎧 语音合成(音色复刻)

上传10秒音频样本即可精准克隆任意声音,用克隆的音色合成任意文本

🎧

合成设置

预计消耗5 积分
🎵

生成结果

🎧

上传音频样本后点击生成

✨ 使用指南

上传音频样本,精准克隆任意声音

💡

什么是音色复刻?

音色复刻是通过上传一段音频样本,让 AI 精准克隆该声音。上传 10 秒清晰语音即可获得良好效果。克隆后的音色可以用于合成任意文本的语音。

✓ 适用场景:克隆亲友声线、复现经典角色配音、打造专属语音分身、多语言语音合成

📤
音频样本要求

上传格式的限制

格式:MP3 或 WAV

大小:Base64 编码后不超过 10MB

时长:10 秒以上即可获得良好效果

音质:使用清晰录音,避免背景噪音

🎬
风格控制

合成时可调整语气

自然语言控制:在风格指令中描述语气情绪

音频标签:在合成文本中嵌入 (风格) 标签

支持:情绪、方言、角色扮演等

示例:(激动)太好了!我们终于成功了!
⚠️

注意事项与使用技巧

📋 音频样本要求

• 音频样本需为 MP3 或 WAV 格式
• 文件大小不超过 10MB
• 10 秒以上清晰语音即可获得良好效果
• 音频样本需转为 Base64 编码后上传(平台自动处理)

💡 效果提升技巧

• 使用单人独白的音频,避免多人混杂
• 选择安静环境录制,减少背景噪音
• 语速适中,吐字清晰
• 合成文本的语言应与样本语言一致
• 可以在风格指令中用自然语言或音频标签调整语气
• 此模式不支持唱歌模式