technology 11 分钟阅读

日本首例AI声音裁决划定界线——却未能拯救一位配音演员

东京地方法院成为日本首个承认声音属于可保护公开权范畴的法院——但仍驳回了配音演员津田健次郎对TikTok的诉讼。这一限缩性推理为平台、语音克隆初创公司与创作者在全亚洲乃至全球范围内的运营模式,建立了一个全新的法律框架。

  • GitHub下架
  • 生成式AI
  • 集体诉讼
  • 语音合成
  • 东京地方法院
  • TikTok

这项判决并非看上去那样简单

东京地方法院刚刚作出了首个关于在生成式AI时代,个人声音是否构成受保护的公开权的裁决。这本身就是一项里程碑式的判决。但此案同时也驳回了著名声优津田健次郎针对TikTok运营公司提起的具体诉讼——这一细节将在未来几个月里被各方反复解读甚至曲解。

关键在于其中的微妙之处。法院裁定声音可以受到保护。然后它又指出,津田在这起特定案件中未能满足维权标准。正是“承认权利”与“提供救济”之间的这一差距——正在起草AI时代的真正法律架构,其影响将远超日本国界。

津田健次郎是谁,以及此案为何降临

津田是日本最具知名度的声优之一。他的职业生涯横跨数十年的动画、电子游戏和旁白工作。他的声音本质上就是一个品牌——受众通过音色、节奏和质感来识别角色和产品,正如西方受众通过歌手嗓音来识别一样。当你询问法律是否应当保护这种声音时,这种文化现实至关重要。

他在发现有人未经授权使用生成式AI复制其声音制作视频后,起诉了TikTok的日本运营公司。这些视频出现在一个短视频内容传播迅速、归属标注薄弱的平台上。津田请求法院下令删除这些视频。

TikTok作为平台运营商,提出了标准的抗辩理由:它只是通道,而非出版者;并且日本法律此前没有明确判例将声音视为独立的知识产权。法院不得不回答一个日本法庭此前从未正式面对过的问题。

法院实际作出了何种裁决

东京地方法院裁定,声音属于公开权的保护范围——这是日本的一个法律概念,用于保护个人身份(包括姓名、肖像和人格)的商业价值。法院的推理并未将声音仅仅视为一段音频记录,而是将其视为个人公众人格的一种可识别属性,当未经同意被商业使用时,它承载着经济价值。

这部分内容将被法律学者援引多年。日本法院长期以来已在更广泛的公开权原则下保护形象和姓名。将这一逻辑延伸至声音是一个有意义的进展,特别是在一个版权法历史上主要围绕固定表达而非个人属性构建的法域。

但法院随后认定,基于事实,津田的诉求证据不足。判决并非基于对“声音”这一概念过于狭窄的、认为其不受保护的理解;而是基于涉案涉嫌侵权内容的具体呈现方式、可识别程度,以及津田能否证明合理观众会将这些AI生成片段与他自己个人联系起来。这些都是证据性问题,而非理论问题——这对未来的事态发展至关重要。

为何驳回起诉比承认权利更为重要

一则标题为“法院承认声音为公开权”的新闻看似具有决定性。但事实并非如此。驳回起诉意味着此案未颁发禁令、未判赔损失,也未为此案创设任何平台义务。平台方可以阅读该判决并得出结论:只要能在可识别性清晰时响应下架请求,它们在运营上仍有回旋余地。

对于创作者而言,相反的风险同样真实存在。一直在等待法律明确性的声音克隆初创公司现在收到了一个信号:大门已开,但门槛比许多人假设的要高。单纯复制一种声音可能不足以触发法律责任。内容必须使原始人格对合理观众而言具有足够的可识别性。

这种“可识别性”标准既是该判决最大的贡献,也是其最大的模糊之处。它与其它司法管辖区的做法相吻合——欧盟强调人格权,美国不断发展的公开权案例——但它的应用背景是,生成式AI能够产生技术上准确却在感知上模棱两可的声音输出。法院将在未来几年内厘清何谓“足够可识别”。

这对TikTok及其他平台意味着什么

TikTok在此案中的立场 straightforward:它是一个托管平台,而非创作工具。法院并未对此种定位作出否定裁决。然而,它间接承认声音属于受保护属性之列。这一转变改变了所有在日本托管用户生成内容的平台的计算方式。

实际影响很可能通过执法行动而非判决本身来实现。如果权利持有人能援引此判决,主张声音应与形象和姓名享有同等的保护地位,平台将面临更多的下架请求,并最终迎来更多检验“可识别性”界限的诉讼。预计未来18个月内,针对声音的内容识别系统将从实验性工具转变为必需品。

在该平台上使用声音克隆工具的创作者也应预期会面临更多阻力。该判决并未禁止声音复制。它明确指出,具有足够可识别风险性的复制行为可能受到挑战。这一区分将驱动创作者经济中的产品设计和法律策略。

全球涟漪效应

日本不像某些司法管辖区那样确立全球先例,但其大陆法传统和其市场规模,使其判决在亚洲具有超出其本身的影响力。韩国、台湾和新加坡都面临同样的根本问题:一个人的声音是否应获得与其形象同等的法律保护?一家日本地方法院说“是”——同时谨慎地限缩了救济范围——这为其他亚洲法庭提供了一个可借鉴的模板,而无需采纳外国普通法原则。

在美国,公开权案例已沿着州界线四分五裂。德克萨斯州和加利福尼亚州的立场各不相同,联邦层面的提案也陷入僵局。日本的推理提供了一条中间道路,一些美国倡导者可能认为其颇具参考价值:保护该属性,但在触发责任前要求证明可识别性。这一框架可能在数月内出现在美国的法律文件中。

欧盟正通过《人工智能法案》及其 ongoing 的人格权讨论走向不同方向,强调同意和透明度,而非本案采用的“可识别性”标准。欧盟的预防性方法与日本的补救性方法之间的对比,已经在塑造跨国公司为亚洲市场构建合规策略的方式。

更长的弧线

这项判决并非日本声音保护辩论的终结。它是开始。地方法院的判决可以被上诉,其采用的“可识别性”标准将在上级法院接受检验。全国各地的低级法庭现在将在声音相关纠纷时引用该判决。权利持有人将带着更扎实的证据记录提起新诉讼。平台将提前调整其政策。

此刻值得关注的并非津田健次郎个人的胜败结果。而是法院为他构建的框架——一个承认声音为受保护权益,但同时要求证明公众确实会将AI输出与真人联系起来的框架。这一标准比一概禁止更难满足,但也更持久。一刀切的禁令难以抵御技术变革。而可识别性标准会随技术演进而演进。

在日本,AI声音问题已不再是理论探讨。法院已经发声,且发声十分审慎。所有在AI时代构建、托管或使用声音进行表演的人,都应仔细倾听这种“审慎”意味着什么。

要点总结

日本东京地方法院划定了一条界线。声音受保护。但保护要求具备可识别性。驳回津田的诉求并非对这一原则的矛盾;而是其具体应用。真正的故事在于法院选择的标准——一个优先考虑受众如何感知AI生成输出,而非输出技术上多么精确的标准。这一标准将在未来几年影响诉讼、产品设计和平台政策。它也将被全球法院和政策制定者深入研究,因为他们都在观望日本如何应对这个其他司法管辖区也在努力定义的难题。