上个月录第三条课程视频,我嗓子又哑了
我做知识付费小课,每周要录两段口播。那天晚上录第三条时嗓子就哑了,对着镜头想:不能再硬扛了。
你是不是也这样 — 不想出镜但需要声音,想做课程但没时间精修录音棚?AI 配音这两年变化挺大,2025 年的版本真的能"听不出是机器"。
这三个工具,我挨个用了两个月
先说结论:做课程录音最划算是 ElevenLabs(每月 5 美元起,约 36 元人民币);短视频日更、要求不高,剪映自带的 AI 配音就够用,0 元;接商业配音单、对细节要求高的,往 ElevenLabs 克隆档或微软 Azure 走。
我朋友老周在杭州做财经短视频,团队就他和剪辑师两人。2025 年 3 月起他用 ElevenLabs 的"克隆自己声音"功能 — 先录 30 分钟样本喂给系统,之后每条视频输入文字就行,他本人只需偶尔校对几个读错的词。他说省下来的嗓子让他每周能多发两条视频。
另一个朋友陈姐在成都做儿童有声书,试过剪映、魔音工坊,最后停在 ElevenLabs 标准付费版 — 一个月大概 22 美元。她说最关键的不是"像不像人",而是"念错人名时能不能手动改",这点免费工具做不好。
今天想试,复刻成本是这样
钱:剪映 0 元;ElevenLabs 起步 5 美元/月;微软 Azure 按字符算,新用户前 12 个月每月有免费额度。
时间:第一次玩 2-3 小时上手;克隆自己声音再录 20-30 分钟样本。
技术门槛:不需要懂代码,全程点鼠标、输文字、下载音频文件。如果你用过剪映就能用这些。
第一步:打开 ElevenLabs 官网,用 Google 账号登录,首页就能看到"Text to Speech",输入一段中文试听。不用注册就能听 Demo。
这里说一下我也卡过的地方:ElevenLabs 的中文声音里,方言和儿化音偶尔读错,特别是人名。第一次别直接拿去做课程,先拿一段旧稿件试。
你属于哪一类?
如果你刚起步、还没开始做视频:别急。现在不试也没事,先用手机自己录两条看反馈。等你真觉得"嗓子不够用"或"出镜怕尴尬",再考虑 AI 配音。这工具不是所有人都需要。
如果你已经有 1-2 个客户、开始做内容交付:从剪映 AI 配音起步,0 成本试一周。如果一周后你觉得"还能再专业点",再升级 ElevenLabs 的 5 美元档。
如果你已经在扩规模、接商业配音或课程订单:直接上 ElevenLabs 22 美元档或克隆自己声音,把"录音—校对—导出"流程固定下来,每条省下的 1 小时会很明显。
最后一句掏心窝:AI 配音能解决"嗓子不够"和"不想出镜",但解决不了"内容本身值不值得听"。工具是放大器,不是发动机。