返回音频创作
🎧 语音合成(音色复刻)
上传10秒音频样本即可精准克隆任意声音,用克隆的音色合成任意文本
🎧
合成设置
预计消耗5 积分
🎵
生成结果
🎧
上传音频样本后点击生成
✨ 使用指南
上传音频样本,精准克隆任意声音
💡
什么是音色复刻?
音色复刻是通过上传一段音频样本,让 AI 精准克隆该声音。上传 10 秒清晰语音即可获得良好效果。克隆后的音色可以用于合成任意文本的语音。
✓ 适用场景:克隆亲友声线、复现经典角色配音、打造专属语音分身、多语言语音合成
📤
音频样本要求
上传格式的限制
格式:MP3 或 WAV
大小:Base64 编码后不超过 10MB
时长:10 秒以上即可获得良好效果
音质:使用清晰录音,避免背景噪音
🎬
风格控制
合成时可调整语气
自然语言控制:在风格指令中描述语气情绪
音频标签:在合成文本中嵌入 (风格) 标签
支持:情绪、方言、角色扮演等
示例:(激动)太好了!我们终于成功了!
⚠️
注意事项与使用技巧
📋 音频样本要求
• 音频样本需为 MP3 或 WAV 格式
• 文件大小不超过 10MB
• 10 秒以上清晰语音即可获得良好效果
• 音频样本需转为 Base64 编码后上传(平台自动处理)
💡 效果提升技巧
• 使用单人独白的音频,避免多人混杂
• 选择安静环境录制,减少背景噪音
• 语速适中,吐字清晰
• 合成文本的语言应与样本语言一致
• 可以在风格指令中用自然语言或音频标签调整语气
• 此模式不支持唱歌模式