VOICE WORKBENCH / REFERENCE EXPLORATION

同一段轻唱,
探索不同音色条件。

听本人原声,再比较清唱参考、讲话参考与不同 α 的实际输出。所有输出来自同一段本人录音,使用 OpenVoice V2 进行音色条件转换。

AI 音色探索,使用 Adele 来源参考;尚未验收,不是真人演唱。这是一组实验结果。Adele 来源访谈与清唱未声明开放授权;本页仅提供原发布者链接,不提供其原始录音。
本人 8 秒轻唱→参考音色条件 / α→模型转换输出

电脑没有话筒?用手机打开录音入口 →录音后下载原文件,传到电脑工作台上传转换。手机网页负责录音与试听,AI 转换在电脑执行。

逐条试听

6 / 6 条可播放 · 切换播放会暂停上一条
建议戴耳机,先听原声,再用相近音量比较。
01原声

本人原声

输入:8 秒轻唱

8.00 秒40 kHz
下载 WAV ↓

未经过模型转换;与其他条目使用同一段轻唱。

02α = 0.50

清唱参考 · α 0.50

Vogue 现场清唱参考

8.00 秒22.05 kHz
下载 WAV ↓

实际 α 来自推理收据;lerp 条件插值。参考片段 6.32 秒。

查看本次运行记录
设备
cpu
本次总耗时
7.52 秒
其中模型推理
7.28 秒
本次模型加载
0.00 秒

缓存、预热与输入长度影响耗时;这些记录不是实时性能基准。

输出 SHA256
6fffdd2de9a82d1311c773749d3020fed9e6e948cf04336bf8d5f593fd8f07b2

03α = 1.00

清唱参考 · α 1.00

Vogue 现场清唱参考

8.00 秒22.05 kHz
下载 WAV ↓

实际 α 来自推理收据;lerp 条件插值。参考片段 6.32 秒。

查看本次运行记录
设备
cpu
本次总耗时
74.93 秒
其中模型推理
16.30 秒
本次模型加载
6.44 秒

缓存、预热与输入长度影响耗时;这些记录不是实时性能基准。

输出 SHA256
1199e1dc5e0ab7793b015ee494cccfdda20337a15e264eaee873862fbefc9ffa

04α = 1.00

讲话参考 · α 1.00

Vogue 连续讲话参考

8.00 秒22.05 kHz
下载 WAV ↓

实际 α 来自推理收据;lerp 条件插值。参考片段 8.24 秒。

查看本次运行记录
设备
cpu
本次总耗时
7.44 秒
其中模型推理
7.18 秒
本次模型加载
0.00 秒

缓存、预热与输入长度影响耗时;这些记录不是实时性能基准。

输出 SHA256
6f3fde46019f1c733e25f54bb054257aaea554cf8cc11589fcdfa4fb8ecefc35

05α = 0.50

讲话参考 · α 0.50

NPR 连续访谈参考

8.00 秒22.05 kHz
下载 WAV ↓

实际 α 来自推理收据;lerp 条件插值。参考片段 20.00 秒。

查看本次运行记录
设备
cpu
本次总耗时
7.72 秒
其中模型推理
7.50 秒
本次模型加载
0.00 秒

缓存、预热与输入长度影响耗时;这些记录不是实时性能基准。

输出 SHA256
d02d2f2a4e87d8127bcdce18550ad7a6c2a7951cb38e72fe1a60b86383ee9ed3

06α = 1.00

讲话参考 · α 1.00

NPR 连续访谈参考

8.00 秒22.05 kHz
下载 WAV ↓

实际 α 来自推理收据;lerp 条件插值。参考片段 20.00 秒。

查看本次运行记录
设备
cpu
本次总耗时
7.55 秒
其中模型推理
7.18 秒
本次模型加载
0.00 秒

缓存、预热与输入长度影响耗时;这些记录不是实时性能基准。

输出 SHA256
71a5f5c611dbc4956f0979a7cab45ce6d11d558fe469e77f06991d9d7361d368

这次试听能说明什么