最近连着审了好几档社教类节目的样片,发现一个挺普遍的现象——制作方开始大量使用AI合成声音来做知识科普,有的甚至把配音演员的活儿全盘外包给了算法。这事儿在台里内部讨论了好几轮,有人觉得效率高省钱,也有人担心会出问题。我今天就从一个普通编辑的角度,聊聊我对这个问题的真实看法。

先说说好的方面。咱们做社教节目的人都知道,知识科普类内容往往需要反复打磨文稿,尤其像历史、科技、医学这些专业领域,每个字儿都得较真。传统配音流程里,你约棚、约老师、等后期修音,一来二去两三天就过去了,要是中途文稿改了,还得重新约。AI声音最直接的好处就是快,你这边改完文本,那边马上就能合成,而且成本几乎可以忽略不计。对于一些预算紧张的小型制作团队,或者需要快速出短片的应急项目,这个诱惑力确实挺大。而且现在很多AI模型已经能做到自然度很高,不仔细听你甚至分不清是真人还是机器,语气停顿重音都能模拟得像模像样。
但问题也恰恰出在这里。社教节目的核心是什么?是“教育”和“传递可信知识”。观众打开这个节目的时候,潜意识里是带着一种信任感的。我举个例子,你让孩子听一个AI讲恐龙灭绝,和听一个专业解说员用温和沉稳的嗓音讲,他吸收信息的心理状态是完全不同的。真人声音里蕴含着情绪、温度、甚至某种权威感——哪怕播音员只是老老实实照着稿子念,那种呼吸的节奏、偶尔的细微停顿、一句话结束时的语气变化,都是人味儿,而人味儿恰恰是教育场景里最需要的润滑剂。AI声音再像真人,它本质上是没有“在场感”的。你听久了会隐隐觉得别扭,就像面对一张永远微笑的假脸,你说不上哪里不对,但就是不太舒服。
更要命的是,社教类节目涉及的知识往往需要反复核实、避免误导。万一AI在合成时因为语速、断句或者多音字识别错误,念出了歧义,或者把一些敏感数据念错了,观众可不会算你技术失误的账——他们会直接质疑整个节目的专业度。去年我们台有一档文物科普节目,用AI代替了原来的配音老师,结果把“青铜器”的“青”字重音放错了位置,听起来像“轻铜器”,被网友截图吐槽了一晚上。虽然事后出个道歉声明就能翻篇,但那种信任感的损伤是长期的。
还有一个绕不开的点是伦理。坦白说,用AI声音会不会导致配音演员失业?我们这行本来就不算宽裕,很多优秀的配音老师是靠接社教节目养家糊口的。如果全行业都去用AI,那这些老师怎么办?更微妙的是,有些AI模型未经授权就使用了特定配音演员的声音数据进行训练,这已经涉及肖像权和声音权的问题。作为编辑,我们既要对节目质量负责,也要对产业链上的每一个劳动者负责。不是所有能省的钱都值得省。
当然,我也不是完全反对使用AI。我自己的实践下来,觉得可以分场景来看。比如一些纯功能性的板块——像天气预报、股票指数播报、简单的操作指南——这些内容本身不带情感色彩,受众只想知道结果,这时候用AI完全没问题,甚至比真人更稳定。但如果是讲历史文化、科学原理、艺术鉴赏,或者面对儿童、老年人这类特殊受众,我还是倾向于保留真人配音。儿童对声音的辨识度尤其敏感,他们需要从语气里感受到“被讲述”的亲密感,机器声容易让他们产生距离。老年观众更不用说,很多老人本来就不太适应电子设备,你再让一个数字声音对着他们念养生知识,效果肯定打折。
再说说政策导向。前段时间总局出的文件虽然没明说禁止AI,但强调过“广播电视节目要维护真实性和可信度”。社教节目作为主流文化传播阵地,如果大面积使用合成声音而不加标注,其实是有违导向精神的。我觉得未来大概率会出台细化规定,比如要求使用AI时必须在片尾注明,或者限制某些重要栏目不能完全依赖AI。长远来看,技术肯定还会进步,但“人”作为传播主体这层底色不该丢掉。
回到最初的问题:社教类节目知识科普到底能不能用AI声音?我的答案是“能用,但得慎用”。如果把AI当成一个辅助工具,比如先拿它生成一个速读草稿,让编辑检查内容逻辑,或者给后期剪辑做临时参考,这是聪明的用法。但如果直接拿合成声音当最终成品去播,尤其是那些需要建立长期口碑和公信力的系列节目,我个人觉得风险大于收益。做编辑这些年,我最大的感受是,观众最后记住的从来不是哪个声音特别标准,而是哪个声音让他们觉得“这人真的在讲给我听”。
所以我会建议我的团队,在动辄几十万一集的纪录片里,在需要反复推敲的专题片里,该花在配音上的钱一分也别省。而那些日常小科普、碎片化知识短视频,如果你实在预算紧张,用AI也不是不行,但请务必做好校对和标注。技术是给人用的,不是反过来替人做决定。我们这些做内容的,说到底是在跟人心打交道,声音只是工具,而信任才是永远买不来的底牌。


















