其它·via @mubei
语音克隆的门槛,终于降到了你的本地显卡上。 开源工具 Voice Clone Lab,直接把声音克隆变成了一条傻瓜式的本…
语音克隆的门槛,终于降到了你的本地显卡上。
开源工具 Voice Clone Lab,直接把声音克隆变成了一条傻瓜式的本地工作流。 只需要 5 到 15 分钟的音频素材,它能包揽后续的所有脏活累活。 从音频降噪、人声提取、切片到文字转录,全在你的电脑上本地跑完。
你可以像改表格一样,手动校对它转录出的台词,接着直接微调模型。 也可以选定一段参考音频,直接进行零样本生成。 挑好微调好的模型,敲下你想让它说的台词,一段足以乱真的 WAV 音频就出来了。 那些极其自然的声音,原说话者根本没有录过。
音频数据一行都不会传回云端,隐私彻底留在本地。 工具开源免费,但底线非常明确:只能用来克隆明确拿到授权的声音,切勿越界。
翻译视频 / X
相关 / RELATED
JSON- M语音模型的门槛,彻底塌了。 现在的竞争早就不在“能不能克隆声音”了。 而是怎么用5秒的样本、极低的成本,直接生成带情绪的…
- M如今,声音已经不再是你的身份凭证了。 给所有人提个醒: 以后在电话里听到熟悉的声音,哪怕是你的父母、子女或老板,也千万别…
- M把声音转成字,早就不稀奇了。 但转录一小时的长音频,最难的根本不是认字。 是认人。 你要在60分钟的多人对话里,精准追踪…
- M有人把 Claude Code 的最大痛点给平了。 一个直接砍掉使用限制的开源工具。 GitHub 上已经狂揽 4.7…
- M华尔街最贵的安全系统,可能被一通听起来像同事的电话直接绕开。 黑客正利用AI语音克隆技术,对华尔街大型对冲基金发起一波定…
- MLisa Su手里那台巴掌大的小机器,能跑2000亿参数的大模型。 但它最吓人的地方,是悄悄把AI的“产权关系”给改了。…
导出 / EXPORT
订阅 · SUBSCRIBE
每周一封信号简报,重大进展可选即时推送。