AI 声音设计

最多 150 个字符。留空时由模型生成试听内容。

每次可生成 1–4 个试听候选。

最近任务

你生成的声音候选会显示在这里。

你生成的声音候选会显示在这里。

用一段描述,探索你想要的声音

声音设计适合从创意开始的配音尝试:你已经知道角色大概应该怎样说话,却还没有参考录音,也不确定现成音色是否合适。在 Voicv 中,你可以描述声音的高低、质感、语速、情绪和表达方式,再通过返回的音频判断方向。比如,纪录片开场可能需要低沉、克制而清晰的旁白,动画角色可能更适合明亮、轻快、带有好奇心的说话方式。把用途转成能听出来的特征,比只写“好听的声音”更便于评估。

这里的描述用于引导生成,并不是对每个特征的精确承诺。“温暖”“有颗粒感”“从容”等词可能得到不同的声音解释,因此试听是工作流的一部分。如果候选的音色合适但语速不理想,可以保留音色描述,只调整节奏;如果表达显得过于夸张,就减少情绪指令,再生成一次。每次只改变一个关键条件,更容易分辨是哪部分描述影响了结果,也能避免反复使用含糊的提示词。

每次请求可以返回一到四个候选,它们保存在同一个任务里,便于比较、播放和下载。这个页面生成的是试听音频,不会自动把候选加入永久声音库。声音克隆需要参考录音,文本转语音通常使用已有声音朗读脚本,声音设计则用于探索文字描述对应的声音方向。先区分这三种目的,再选择工具,能避免把短试听误当成长篇配音任务或可反复调用的声音模型。

如何在 Voicv 设计声音

先准备清楚的声音要求,再用一小段有代表性的文字检验候选效果。

1

写出可听见的声音特征

在声音描述中说明角色或旁白的定位,接着补充音域、音色质感、说话节奏和表达方式。描述最多支持两千个字符,但不需要为了填满输入框而增加无关背景。可以写“温暖的低音旁白,吐字清楚,语速从容,情绪克制”,让每个条件都能在试听时检查。避免同时要求极快和极慢、强烈兴奋和完全平静等相互冲突的效果。

2

填写试听文本

试听文本是可选项,最多一百五十个字符。建议选用接近实际用途的短句,例如包含重要人名、疑问句或专业词语的一句旁白。留空时,模型会提供试听内容。

3

选择候选数量并提交

每次可以选择一到四个候选,默认两个。第一个候选消耗 5,000 Credits,每增加一个候选加收 2,000 Credits。 登录后确认按钮展示的费用,再提交生成。请求受理后,任务会出现在右侧结果区;此时可以继续修改表单。再次点击生成会创建另一个独立计费请求,即使描述和试听文字没有改变,也不是免费重播。

4

逐个试听,再决定如何调整

比较候选时,尽量使用相同的播放音量,重点听清晰度、节奏、声音质感和语句表达。每个候选都可以单独下载。历史记录保留任务输入,点击复用描述可以重新填入表单,但不会自动发起生成。如果一个方向已经接近目标,就只修改仍不满意的特征,再用相同试听句比较下一次结果。

把声音探索变成可比较的过程

候选的意义是帮助你做出创作判断;先明确评价标准,再选择值得继续发展的声音方向。

从零开始,不依赖参考录音

当角色还停留在文字设定或脚本阶段时,可以直接描述它应该怎样说话。人物的身份和场景有助于确定语气,但描述最终应落到可听见的特点上。与其只写某个真实人物的名字,不如说明音域、清晰度和节奏。如果目标是复现一段你有权使用的录音中的声音,应选择接受参考音频的声音克隆流程。

在同一个任务中比较多个候选

同一段描述可能产生不同解释。一次请求返回多个候选,便于在相同输入下听出细微差异。不要只比较第一秒的音色,还应听句尾是否自然、停顿是否合适,以及关键字是否清楚。候选是供你选择的方案,并不保证每个都满足要求;如果都不合适,先修改描述再提交会更有针对性。

提交前就知道请求费用

第一个候选消耗 5,000 Credits,每增加一个候选加收 2,000 Credits。 任务执行失败时,会按该任务保存的报价退还已扣积分。已经成功返回音频但创作效果不符合偏好,与任务失败是不同情况,因此每次重新生成前都应检查描述和费用。

保留思路,回看试听结果

最近任务显示在表单旁边,完整历史页方便翻页查看先前请求。每条任务中的候选均可播放和下载,原始描述帮助你回想当时的设计目标。对需要长期保留的音频,建议及时下载到自己的文件库,不要把任务历史理解为永久存储承诺。删除记录后,应以你已保存的文件继续整理项目素材。

声音设计常见问题

了解输入要求、计费方式和输出边界,再开始第一次声音实验。

必须上传自己的录音吗?

不需要。这里唯一必填的创作输入是声音描述,试听文本可以留空。如果你已经有录音,希望复现其中的说话人,应使用声音克隆工具。两种流程的输入和目标不同,声音设计不会要求你先训练一个模型再开始试听。

描述写得越长越好吗?

不一定。清楚、协调的要求比冗长背景更有帮助。先写用途,再写三到五个能听见的特征,例如低音、明亮音色、自然停顿或平稳语速。听完候选后,保留有效部分,只修改明显偏离目标的条件。不要用大量互相矛盾的形容词试图覆盖所有可能性。

试听文本应该怎么选?

选择一段接近真实使用场景的短句,并控制在一百五十个字符内。如果最终内容包含人名、数字或专业术语,可以在试听中加入代表性的词。标点也能帮助你评估停顿和句式表达。这里用于短试听,不适合粘贴整篇文章;长脚本应使用对应的文本转语音流程。

一次生成四个候选会扣四次积分吗?

第一个候选消耗 5,000 Credits,每增加一个候选加收 2,000 Credits。 一到四个候选的总费用依次为 5,000、7,000、9,000、11,000 Credits;默认两个候选为 7,000 Credits。 再次提交才会创建新的计费请求。可以先在一次请求里比较多个方向,再决定是否需要继续修改,避免把候选数量误认为独立任务数量。

候选会自动加入我的声音库吗?

不会。声音设计返回的是试听音频和候选信息,候选标识不等于永久声音模型标识。你可以下载结果、比较效果或复用原始描述,但不能把候选标识直接当作后续文本转语音的声音选择。如果需要持续使用同一个声音,应查看独立的声音库与模型流程。

能指定普通话、其他语言或地方口音吗?

可以在声音描述中说明希望的语言、口音和表达习惯。这些条件会引导模型,但不代表对发音、地域真实性或跨语言一致性的保证。对重要内容,应让熟悉目标语言的人检查试听,尤其注意专有名词、轻重音以及在特定语境下容易产生歧义的词。

生成失败后会怎样处理积分?

失败任务会展示错误,已扣积分通过任务退款流程返还;同一失败回调重复到达不会再次退款。如果只是浏览器暂时无法读取状态,应先刷新页面或到历史记录核对原任务,而不是立即连续提交。原任务仍在执行时重新提交,会创建额外请求。

相同描述能保证每次声音一致吗?

不能。重新提交会执行新的生成,模型可能给出不同的声音解释。页面没有用于保证一致性的种子控制,也不会自动建立永久声音身份。需要做对照时,可以保持试听句不变,每次只修改一个特征,并以实际音频为准决定下一步。

让声音设想成为可以试听的候选

写下清楚的声音方向,选择候选数量,再从真实听感判断下一步。

设计声音