← 实验档案
EXP-002 Stopped 立项 2026-08-05 发布 2026-08-12 复盘 2026-08-15 ▶ 视频版

音色克隆本地版

对声音素材敏感的创作者和企业,是否需要一个样音不出本机的音色克隆工具?

本实验已停止。档案完整保留——停止的原因,和成功的原因一样值得记录。

本页目录
01 · WHY

为什么做

在线音色克隆需要上传样音、按条计费,敏感声音素材没有本地选项。7 月的 VoxKit 初测显示本地方案接近可用边界,新版本发布后,我决定用一个限时 2 天的实验直接验证。

02 · DEMO

最小 Demo

  • 10 秒样音克隆
  • 本地合成 20 秒语音
  • 样音不出本机
实验视频 · 已发布 2026-08-12
03 · THINKING

判断与取舍

  • 只做单音色、单段合成。沿用 EXP-001 的验证框架:先验证价值,再扩能力。
  • 直接对照商用在线服务。观众听得出差距,就让差距出现在视频里。
04 · LIMITS

已知限制

  • 中文长句韵律不稳定,与 VoxKit 初测结论一致;
  • 部署门槛高于扣像实验,环境配置约 40 分钟。
05 · TESTING

验证过的假设

  1. H1"样音不上传"是一部分用户的购买理由。被证伪
  2. H2存在重复发生的克隆需求(配音、有声内容)。成立
  3. H3本地合成音质达到"可用"线。被证伪
  4. H4部署门槛可被目标用户接受。未验证到——在 H3 处已经停下。
06 · FEEDBACK

反馈摘要

0h · 发布 08-1224h48h72h · 复盘 KILL

计时结束 · 23 条有效反馈(A 3 · B 9 · C 11)

72 小时内共 23 条有效反馈:A 级 3 条 · B 级 9 条 · C 级 11 条。

  • 用户在意的是音质与韵律,不是"本地运行"——多位 B 级反馈直接说"哪个像用哪个";
  • 最高频请求是"更像",不是"更私密";
  • 3 条 A 级反馈全部来自配音工作室,需求真实,但现有音质达不到他们的交付线。
07 · DECISION

决定

DECISION · 2026-08-15

停止。H1 与 H3 同时被证伪:本地不是购买理由,当前开源模型的音质没有过可用线。

需求存在(H2 成立),但价值主张选错了。方向转入观察清单,等模型质量过线再回来。

KILL停止,写复盘
LEARN调整方向再验证
TEST交给真实用户
PROMOTE升级为项目

停止不是失败。不再投入一个缺乏证据的方向,是一次有效的验证。

08 · REVIEW

学到什么

  • "本地"是特性,不是价值。在扣像场景它踩中隐私痛点,在克隆场景用户只关心像不像——同一个卖点换个场景就失效;
  • 质量型需求要先测质量线。下次遇到"效果决定一切"的方向,第一天先做对照盲听/盲评,不合格直接停;
  • Radar 的观察结论是对的。7 月初测就说"暂不迁移",实验只是把这个判断用真实用户再确认了一次——这个学费本可以更便宜。
09 · TIMELINE

时间线

  • 2026-08-05 立项DONE

    Brief 完成,技术依据来自 VoxKit 初测。

  • 2026-08-12 视频发布 + 网站同步DONE

    对照演示如实保留了差距明显的样例。

  • 2026-08-15 72 小时复盘:停止STOP

    数据、反馈与决定更新至本页,档案关闭。

← 返回实验档案

※ 内容增长模拟稿:本实验为虚构示例,用于评审 Stopped 状态的档案版式。