El tribunal de Tokio reconoce la voz como símbolo de la personalidad, al igual que la imagen
El Tribunal de Distrito de Tokio, el 30 de septiembre de 2026, declaró por primera vez que el uso comercial no autorizado de la voz del actor de voz Kenjirō Tsuda por parte de la empresa operadora de TikTok constituye una violación del derecho a la imagen.

Resumen del fallo y contexto
Según informó INSIDE, el 30 de septiembre de 2026 el Tribunal de Distrito de Tokio emitió una sentencia en la que se determinó que la utilización comercial sin autorización de la voz de una personalidad pública, en este caso el reconocido actor de voz Kenjirō Tsuda, puede constituir una infracción del derecho a la imagen. El actor Tsuda había señalado que su voz había sido reproducida mediante tecnología de inteligencia artificial y que dicha reproducción había sido empleada en numerosos videos alojados en la plataforma gestionada por la empresa operadora de TikTok. La parte demandante argumentó que la voz constituye un atributo personal de la identidad, comparable a la imagen facial, y que, por tanto, debe recibir la misma protección jurídica. El tribunal aceptó esta argumentación y estableció, mediante su fallo, un nuevo precedente en la protección de los derechos sobre la voz.
Métodos y escala de la clonación de voz IA
La cuenta anónima de TikTok que fue objeto del litigio había publicado, entre julio de 2024 y septiembre de 2025, un total de 188 videos en los que se imitaba la voz del señor Tsuda mediante el uso de tecnología de inteligencia artificial. Según los informes, los videos fueron creados entrenando un software de síntesis de voz con datos de audio previamente grabados del actor, de modo que el programa pudiera generar automáticamente la voz a partir de entradas de texto. Esta técnica de clonación de voz permitió la producción masiva de contenido que reproducía de forma muy parecida la entonación y el timbre característicos del actor.
- Publicación de 188 videos
- Promedio de 1,47 millones de reproducciones por video
- Ingresos publicitarios mensuales de entre 500.000 y 750.000 yenes
Fundamentos de la decisión judicial
El tribunal explicó que la voz funciona como información de identificación personal y que su uso está directamente vinculado a la valoración social y a los beneficios económicos del individuo, por lo que debe considerarse un objeto de protección equiparable al de la imagen facial. En la sentencia se señaló que reconocer la voz como un "símbolo de la personalidad" implica una ampliación significativa del concepto tradicional de derecho a la imagen, estableciendo un precedente importante para la jurisprudencia futura.
En cuanto a la solicitud de la parte demandante de ordenar la eliminación de los videos, el tribunal la desestimó porque, al momento de dictar la sentencia, la cuenta involucrada ya había sido cerrada, lo que hacía imposible ejecutar la medida. El juzgador aceptó formalmente la petición de orden de eliminación, pero justificó su rechazo al considerar que la ejecución práctica no era factible.
Relación con las directrices del Ministerio de Justicia
Se ha señalado que la presente sentencia está alineada con las directrices sobre el uso de voces generadas por IA que el Ministerio de Justicia publicó en agosto de 2024. Dichas directrices sugieren que la utilización comercial o la falsificación de voces creadas mediante inteligencia artificial deben tratarse como cuestiones relacionadas con el derecho a la imagen.
No obstante, esas directrices son únicamente orientaciones administrativas y no poseen fuerza vinculante como una reforma legislativa formal. Por consiguiente, la decisión judicial se considera un caso individual y no se extiende automáticamente a situaciones similares sin una evaluación judicial específica.
Limitaciones del fallo y desafíos futuros
Aunque el fallo reconoce la protección jurídica de la voz, también pone de manifiesto que el rápido avance de la tecnología de IA y la diversidad de sus aplicaciones superan la capacidad actual del marco legal para adaptarse. En particular, persisten dudas sobre cómo actuar cuando la fuente de generación de la voz es opaca o cuando el contenido se difunde simultáneamente en múltiples plataformas.
Se espera que el poder legislativo y las autoridades administrativas trabajen para clarificar la protección de los derechos vinculados a la voz generada por IA. Entre los temas que se consideran prioritarios están la estandarización de los procedimientos de autorización para el uso de datos de voz y la definición de criterios para calcular la indemnización por infracciones.
Cambios esperados a futuro
A raíz de esta sentencia, es probable que los operadores de plataformas consideren la adopción de políticas que obliguen a los creadores de contenido a obtener una autorización previa antes de emplear la voz de una personalidad conocida. El hecho de que los ingresos publicitarios asociados a los videos clonados alcancen cifras de varios cientos de miles de yenes refuerza la posición negociadora de los titulares de derechos.
Sin embargo, la aplicación de la sentencia sigue estando limitada a este caso concreto, y hasta que no se produzca una reforma legislativa a nivel nacional, las empresas y los creadores deberán gestionar los riesgos de forma autónoma, adoptando medidas de prevención y cumplimiento por cuenta propia.
En conjunto, la determinación del tribunal de Tokio de incluir la voz dentro del ámbito del derecho a la imagen constituye un indicador relevante sobre la dirección que tomará la protección de los derechos de personalidad en la era de la inteligencia artificial. La atención ahora se centra en cómo la legislación y las prácticas de la industria evolucionarán para limitar efectivamente el uso comercial no autorizado de voces.
Fuentes
- AI 偷聲月賺 75 萬日圓,日本首判聲音受肖像權保護INSIDE · 4 de octubre de 2026
- 東京地方裁判所裁判所 · 30 de septiembre de 2026



