一句话定义:声音与肖像权(Voice & Likeness Rights),指每个人对自己可被识别的声音和外在形象享有"我说了算"的人格权,他人未经同意不得复制、合成、公开或商用。
原理:声音拿的是"跟脸同款的门禁卡"
《民法典》里有一句关键表述:对自然人声音的保护,参照适用肖像权保护的有关规定。而肖像权条款又写明,不得以利用信息技术手段伪造等方式侵害他人肖像权。翻译成人话——你的脸怎么被保护,你的声音就怎么被保护。所以没经过同意,拿几段录音训练出"AI 版你",再用来配音、带货、发短视频,原则上就是侵权。
打个比方:声音像你家的门禁卡。别人捡到卡(录到你的声音)不等于拥有了你家;想"住进去"(做商业使用),得你签字出租。租期多久、用来干什么、能不能转租(再授权给第三方),都得写清楚。授权是租房,不是卖房。
和相邻概念的区别
| 概念 | 保护什么 | 关键点 |
|---|---|---|
| 肖像权 | 可被识别的面部形象 | 明确禁止用技术手段伪造 |
| 声音权 | 可被识别的声音 | 参照肖像权规则处理 |
| 个人信息权益 | 声纹等生物识别信息 | 属敏感个人信息,需单独同意 |
| 著作权 | 录音制品、作品的表达 | 版权归制作方,不等于能克隆声音 |
最后一行最容易踩坑:买了正版有声书或配音素材,你拿到的是"听和播"的许可,不是"克隆这个人声音"的许可。
算不算侵权,看三件事
1. 可识别性:普通人一听就知道是谁。
2. 有没有同意:有授权就是合法来源。
3. 有没有免责事由:新闻报道、公共利益、个人学习研究等情形,边界很窄,别当万能挡箭牌。
监管侧还有两道硬要求:提供人脸、声音编辑功能的,要提示并取得单独同意;生成内容要做显著标识。具体细则以官方页面为准。海外方面,美国部分州已有针对"数字复制品"的专门立法,联邦层面仍在提案阶段,尚未成法。
授权怎么签才不掉坑
写清用途(是否用于训练模型、能否生成全新内容)、期限、地域、渠道、是否独家、能否转授权、撤回与删除机制、报酬方式、违约责任。涉及敏感个人信息,还要"一次一签"的单独同意,不能塞进一份长长的用户协议里蒙混过去。
对从业者的实际意义
做语音合成、虚拟人、数字员工的团队,采购数据时要问清来源与授权链条;签配音、代言合同时把"AI 使用"条款写进去;产品上线后保留标识和投诉下架通道。
普通人被克隆了怎么办:先截图存证,通知平台下架,必要时走投诉和诉讼。这项权利不是抽象概念,它从合同第一页就开始了。
