随着人工智能技术的飞速迭代,语音合成、声音克隆等应用已渐渐融入日常生活。然而,技术在带来便捷的同时也存在隐忧:未经许可擅自采集他人声音投喂训练AI、合成语音并商业化牟利,该如何界定法律责任?
今天(9月29日),上海市第一中级人民法院依法审结上海首例人工智能合成语音引发的自然人声音权益保护纠纷案件,判决平台运营方构成声音侵权,赔偿权利人经济损失5万元。该案裁判思路也精准契合了2026年9月7日出台的《最高人民法院关于依法审理涉人工智能纠纷案件的意见》第四条相关规定。
案情回顾
王女士是某APP上实名认证的配音演员,平时在该APP上进行配音、发布作品,以此获得报酬。
2025年1月,王女士从好友处了解到,A公司在其互联网推广拉新活动中疑似使用了王女士的声音。王女士经核实认为,该活动使用的自己声音疑似AI合成,于是对相关音频进行了公证以固定证据,并向人民法院提出起诉。
王女士认为,其从未与A公司进行过合作和任何授权,A公司擅自使用其声音构成侵权,遂要求A公司停止侵权并赔偿经济损失30万元。
A公司辩称,案涉音频确为该公司开发的AI生成,但具体的来源和投喂的素材因前员工离职无法确认。该公司此前从不知晓王女士配音演员的身份,不存在采集、使用其声音的情况,现有证据也无法直接证明其推广活动中使用了王女士的声音。

图片源自网络
案件审理中,为证明侵权事实,王女士通过司法鉴定对公证的案涉音频与当场采集的本人声音进行了语音分析比对。鉴定意见显示,案涉音频与王女士本人音频在28个共振峰声学指标中,有24个偏离度小于10%,其中16个小于5.36%,两者较为相似及高度相似的部分达到90%。
一审法院审理后认为,A公司的行为构成人工智能生成声音侵权且对王女士造成经济损失,遂依法判决A公司向王女士赔偿5万元。
双方均不服一审判决,提起上诉。
人民法院裁判
上海市第一中级人民法院经审理认为,未经自然人同意,使用自然人的声音作为训练语料,模仿该自然人的音色、语调和发音风格等生成能够识别该自然人的合成人声,应当认定侵害自然人声音权益。本案中,王女士作为配音演员已举证证明其配音作品发布于公开网络平台上,A公司存在获取其声音来源的信息渠道及可能性。同时,经鉴定报告分析,合成语音与人声音频偏离度较小,两者高度相似,足以使普通社会公众进行特定身份关联,具有可识别性。A公司虽予以否认,但其作为掌握原始训练数据的控制方,未能就投喂素材来源合法性、未利用自然人声音特征、未造成公众混淆误认等待证事实充分举证,应承担举证不能的不利后果。据此,可认定A公司未经王女士同意,将能够识别个人身份的合成语音面向社会公众商业化使用,已构成声音侵权。
同时,关于声音侵权损害赔偿的数额认定,应优先参照权利人同类许可使用费标准予以确定;若权利人举证不足、许可使用费难以查实的,可结合侵权持续时间、传播范围、使用方式、过错程度、损害结果、人格要素在商业化利用中的贡献比例等因素综合确定损失金额。本案中,涉案语音上架持续时间较短,属流程播报提示音效,并非活动核心卖点、引流载体,加之王女士的网络关注度、公众活跃度不高,声音单独商业化市场价值有限,故认为一审法院酌情确定赔偿5万元公平合理。
综上,上海市第一中级人民法院依法判决:驳回上诉,维持原判。
法官说法

吴 丹
上海市第一中级人民法院立案庭(诉讼服务中心、诉调对接中心、信访办公室)法官
本案是一起因人工智能合成语音引发的自然人声音权益保护纠纷案件。平台运营方在未取得配音演员授权的情况下,利用AI技术合成与其声音高度相似的语音并用于商业推广活动,最终被认定构成声音侵权。案件聚焦人工智能语音合成技术的商业化应用这一新型侵权场景,兼具法律适用的典型性与社会警示的代表性。
一、AI模仿人声并非“原创”,未经授权可能构成侵权
当前不少AI语音产品的开发者存在一种认知误区:认为AI生成的声音是对声纹特征的算法重构,属于技术模拟产物而非对原始录音的直接复制,因此不涉及侵权。这一认识混淆了“技术生成方式”与“法律评价对象”的区别。法律保护的不是声音的物理载体,而是声音所承载的人格标识利益。只要AI合成声音能够识别到特定自然人,无论其通过何种算法路径生成,未经许可的使用都可能构成对声音权益的侵害。
本案的典型意义在于,它明确了AI语音合成场景下侵权认定的核心标准——可识别性,而非技术来源。这意味着,即使平台无法说明训练素材的具体来源,只要合成声音与特定自然人的声音高度相似,且普通社会公众足以将两种声音进行关联,那么平台就可能被推定使用了权利人声音。这一规则实质上将AI语音侵权的认定从“素材来源证明”转向“结果可识别性判断”,为大量同类纠纷提供了可操作的裁判思路。
二、训练数据由平台单方控制,举证责任应相应倾斜
AI语音合成模型的核心训练数据、算法日志、素材来源记录均由平台单方掌握,权利人客观上难以获取。若坚持“谁主张、谁举证”的一般规则,要求权利人证明平台使用了其声音进行训练,则极大抬高了维权门槛。本案在裁判中明确的规则是:权利人只需证明其声音具有被获取的合理渠道、合成语音与其声音高度相似,即完成初步举证;此后举证责任转移至平台,由其证明训练数据的合法来源或合成语音与权利人声音无关。
这一举证责任分配规则具有普遍的司法意义。它回应了AI侵权案件中证据偏在的结构性难题,防止平台以“技术黑箱”或“员工离职无法确认”为由逃避责任。对AI产业而言,这一规则也传递了明确信号:谁掌控数据,谁就应当承担相应的合规举证义务。
三、声音的商业化利用须以授权为前提,技术中立不免除审查责任
声音权益兼具人格属性与财产属性。对专业配音演员等以声音为核心职业资源的群体而言,声音的商业价值尤为突出。AI语音合成技术本身是中立的,但技术中立不等于使用中立。经营主体在将AI合成语音投入商业场景前,负有对声音素材来源合法性进行审查的义务。不能以“不知晓权利人身份”或“系AI自动生成”为由,免除其取得授权、合规使用的基本责任。

图片源自网络
本案也警示广大经营主体,AI语音商业化应用不能以牺牲自然人声音权益为代价。平台应当建立声音素材来源审查机制,对训练数据和生成内容进行合规管理。唯有在技术创新与权利保护之间划定清晰边界,才能推动人工智能产业在法治轨道上健康、规范、有序发展。
法条链接
一、《中华人民共和国民法典》
第九百九十条 人格权是民事主体享有的生命权、身体权、健康权、姓名权、名称权、肖像权、名誉权、荣誉权、隐私权等权利。
除前款规定的人格权外,自然人享有基于人身自由、人格尊严产生的其他人格权益。
第九百九十一条 民事主体的人格权受法律保护,任何组织或者个人不得侵害。
第九百九十五条 人格权受到侵害的,受害人有权依照本法和其他法律的规定请求行为人承担民事责任。受害人的停止侵害、排除妨碍、消除危险、消除影响、恢复名誉、赔礼道歉请求权,不适用诉讼时效的规定。
第一千零一十八条 自然人享有肖像权,有权依法制作、使用、公开或者许可他人使用自己的肖像。
……
第一千零一十九条 任何组织或者个人不得以丑化、污损,或者利用信息技术手段伪造等方式侵害他人的肖像权。未经肖像权人同意,不得制作、使用、公开肖像权人的肖像,但是法律另有规定的除外。
……
第一千零二十三条 ……
对自然人声音的保护,参照适用肖像权保护的有关规定。
第一千一百八十二条 侵害他人人身权益造成财产损失的,按照被侵权人因此受到的损失或者侵权人因此获得的利益赔偿;被侵权人因此受到的损失以及侵权人因此获得的利益难以确定,被侵权人和侵权人就赔偿数额协商不一致,向人民法院提起诉讼的,由人民法院根据实际情况确定赔偿数额。
二、《最高人民法院关于审理利用信息网络侵害人身权益民事纠纷案件适用法律若干问题的规定》
第十二条 被侵权人为制止侵权行为所支付的合理开支,可以认定为民法典第一千一百八十二条规定的财产损失。
……
来源丨上海市第一中级人民法院
责任编辑:王英鸽
声明丨转载请注明来自“上海高院”
