浏览器里的AI声音克隆,30秒样本就能克隆一整段话

有个东西能把一个人说过的话,变成他能说任何新内容的声音。奶奶能给你讲睡前故事,走了的人能留一句交代,都是那个人的声音。

Vocalove就是干这个的,浏览器里跑,录一段3到30秒的样本,输句话,出来的就是那个声音。

一只白色AI机器人在发光的电路板上,胸口亮着AI两个字母,四周是模糊的键盘和芯片

Vocalove 是什么

一个声音克隆工具,全流程在浏览器里完成。它和普通TTS的区别在于,普通TTS是拿一套系统预设的声音念稿子,谁用都是那几个播音腔;声音克隆是学某个具体的人怎么说话,然后用他的声音念新的内容。

流程三步:

  • 选声音:要么用内置预设,要么现场录一段
  • 写内容:输入想让这段声音说的话
  • 生成并分享:一键下载或分享

克隆模式大概要1到3分钟,内置预设的声音快得多。样本支持mp3、wav、m4a,或者直接在浏览器里录。官方说安静房间里一段清晰的话就够了。

它内置了三个声音模型可选:F5-TTS、Qwen3 TTS Clone Voice、Chatterbox Turbo。

配照片做成会说话的视频

这是它跟别的克隆工具不太一样的地方:声音克隆完可以顺带加一张正面照片,生成会说话的肖像视频。

照片要求正脸、自然光效果好。它把这条线叫memorial和keepsake,站内做了一整套相关页面——追思视频、宠物纪念视频、葬礼幻灯片之类的流程,官网的说法是让家属不用自己拿编辑器去对音轨。

这个功能默认带水印,想去掉要消耗积分。

免费额度怎么算

这块说得清楚,免责就少。

试听完全免费,不用绑卡,也不用先充钱。 注册新账号送5个永久有效的积分,另外每天还有免费额度。

要花钱的地方在下载:去掉水印的高清导出才消耗积分,按一次性积分包购买,不搞订阅,官网特意强调这点。

已经抓到的价目:

  • Starter:1.9美元,190积分,额外送19(多10%)
  • Creator:5.9美元,590积分,额外送59(多10%)
  • Pro:19.9美元,1990积分,额外送298(多15%)
  • 更高一档:69美元,6900积分,额外送1725(多25%),带可重复使用的克隆音色

页面上生成时有实时显示当前消耗,比如某模型标着9积分/1000字符,可以拿来估算。

隐私和合规

网站自己把两条规矩写在明处,我转述一下。

第一,只克隆你拥有或者有权使用的声音,界面上有确认勾选项,选音色时要求勾「我确认有权使用这个声音」。第二,上传的内容用于生成你的作品,不会被卖去做无关的模型训练,这条是官网原话。想删的时候可以删,积分是一次性购买包,不绑定订阅周期。

这两条写得明确不代表技术风险不存在。声音克隆的争议历来集中在冒充和诈骗上,用在逝者身上和用在陌生人身上是完全不同的性质。国内读者的实际使用场景——比如给孩子录一段、给家人做纪念——基本落在授权使用这一侧,这就没问题。

国内用要注意

这个站是英文站,没有中文界面,注册和支付都得靠信用卡或者海外支付方式,付起来不如国内顺手。

用之前先把三条确认清楚:

  • 只克隆自己或获得授权的声音,别拿真人没同意的声音去用
  • 免费额度够先试听,觉得效果不行就不用花钱
  • 需要存档的作品记得下载,积分是买断的但平台上的记录别指望一直留着

技术上没有门槛,它自己强调的是runs entirely in your browser。不过这种站点真正的成本在服务器端的模型推理,浏览器只是界面,生成那1到3分钟大概率是在等云端算完。

想给家里的老人做一段,或者想听听自己孩子的声音念一段课文,这个工具确实比录真人方便。