Ir al contenido

UTAU

De Wikipedia, la enciclopedia libre
(Redirigido desde «Utau»)
UTAU
Información general
Tipo de programa Sintetizador de software
Modelo de desarrollo Código cerrado
Lanzamiento inicial marzo de 2008
Archivos legibles
Enlaces

UTAU (歌う? tdl.‘cantar’) es un editor de partituras para bancos de voz japonés creado por Ameya/Ayame (飴屋/菖蒲?). Este programa es similar al software Vocaloid, con la diferencia de que es shareware en lugar de estar bajo una licencia de terceros.

Descripción general

[editar]

En marzo de 2008, Ameya/Ayame lanzó Utau, un software shareware gratuito de soporte avanzado que se podía descargar desde su sitio web principal. Utau (歌う), que literalmente significa 'cantar' en japonés, tiene su origen en la actividad de "Jinriki Bōkaroido" (人力ボーカロイド? Manual Vocaloid), donde las personas editan una pista vocal existente, extraen fonemas, ajustan el tono y los vuelven a ensamblar para crear una voz de canto al estilo Vocaloid. Utau se creó originalmente para ayudar en este proceso mediante síntesis concatenativa. Utau puede utilizar archivos WAV proporcionados por el usuario, de modo que se puede sintetizar una voz cantada introduciendo la letra y la melodía de la canción. Utau venía con el sintetizador de voz de AQUEST "AquesTalk" [1] para sintetizar las muestras de voz del banco de voz predeterminado, Utane Uta (también apodado Defoko, que significa 'Chica predeterminada' en japonés) en su lanzamiento inicial, después de lo cual el generador se elimina a sí mismo. Las voces creadas para el programa Utau también se denominan oficialmente "Utau", aunque coloquialmente se las conoce como "Utauloids", en referencia a VOCALOID. En Japón también se les conoce como "bancos de voz" (término más común en zonas de habla inglesa) y "bibliotecas (de voz)". Usuarios independientes han desarrollado una infinidad de bancos de voz. Estos bancos de voz normalmente se distribuyen directamente desde sus creadores mediante descarga por internet, pero algunos se venden como parte de proyectos comerciales.

Utau es principalmente un programa japonés, por lo que muchas de sus voces están creadas específicamente para el idioma japonés. Sin embargo, dado que los usuarios pueden crear sus propios bancos de voz, la comunidad de usuarios ha ideado métodos para permitir que estos bancos de voz canten en idiomas distintos del japonés. El formato X-SAMPA se usa a menudo para bancos de voz italianos u otros idiomas distintos del japonés; sin embargo, a veces se utilizan otros sistemas fonéticos, como ARPABET y diversos sistemas fonéticos personalizados.[2]

Los archivos de proyecto de Utau se guardan con la extensión .ust (Utau Sequence Text). Estos archivos pueden distribuirse libremente, lo que permite que diferentes Utau canten la misma pieza. Los productores han desarrollado varios métodos para producir sus bancos de sonido y los resultados de los bancos de voz varían debido a esto.[3] Utau no admite el formato MIDI ni el formato .vsq.

Según las capturas de pantalla publicadas en Twitter, Ameya/Ayame añadió compatibilidad con Unicode en una versión más reciente de Utau que aún no se ha publicado. Ya se ha publicado la compatibilidad con la región fija de la cola del backend correspondiente, así como con varias otras codificaciones de audio, mientras que la compatibilidad con el frontend aún no se ha publicado a fecha de septiembre de 2022. Ameya también actualizó Utau para que fuera compatible con sistemas de 64 bits.

Configuración

[editar]

El editor es capaz de colocar notas, introducir fonemas y cambiar el tono y el volumen en un rollo de piano. En Utau solo se puede crear una pista, y las notas no se pueden superponer. Dado que un ser humano no puede decir dos cosas diferentes al mismo tiempo, esto también es cierto para un Utauloide. Por defecto, solo se muestran las notas en el editor de piano, pero se pueden cambiar los ajustes de visualización para mostrar la curva de tono, la intensidad del volumen, la envolvente y los indicadores. Utau utiliza indicadores para modificar aspectos de la voz, como filtros de paso bajo y paso alto, y para reducir o aumentar la respiración. Estas banderas varían según el remuestreador utilizado. La información y los datos de la partitura en el banco de voz se procesan con un remuestreador y una herramienta de audio (wavtool) basándose en la partitura creada con el editor. Solo se puede utilizar un remuestreador en un único archivo .ust . Se utiliza un filtro de formantes para controlar los cambios en la calidad de la voz, el cual puede desactivarse.

El archivo de audio que se va a cargar se encuentra haciendo coincidir los símbolos de la nota con el nombre del archivo de audio en la biblioteca de voces. Sin embargo, un archivo prefix.map puede cambiar la subcarpeta de la que se toma la muestra. El tono de la voz sintetizada se ajusta según la diferencia entre el archivo de sonido original y el tono de la nota en el editor. Utau utiliza filtros de formantes para evitar cambios extremos en la calidad de la voz, los cuales pueden desactivarse. El procesamiento por lotes se utiliza para generar varias notas a la vez. Durante este proceso se crean archivos de caché. Dependiendo del remuestreador, la cantidad de archivos de caché puede aumentar. En el menú hay opciones para eliminar los archivos de caché cuando se cierra el programa o después de un cierto período de tiempo.

Existen complementos integrados que pueden fusionar automáticamente las vocales, y la configuración "Omakase/A la carta" que puede agregar tono y vibrato automáticos a un archivo completo. También se pueden añadir al software otros complementos creados por los usuarios. Los colores del editor también se pueden cambiar en el archivo setting.ini.

Voces

[editar]

Como se mencionó anteriormente, los archivos WAV se pueden importar a Utau. Un solo banco de voces puede contener cientos, o en algunos casos miles, de estos archivos. Las voces se instalan colocándolas en la carpeta "voces" o arrastrándolas y soltándolas sobre el icono de Utau. Estas bibliotecas también incluyen un archivo oto.ini que determina la temporización y la configuración de cada muestra. Al generar audio a partir de los datos de la partitura en el editor, el programa utiliza el oto.ini para configurar la sincronización y la pronunciación. Los archivos oto.ini se pueden crear utilizando la interfaz gráfica de usuario de Utau o con software de terceros creado por los usuarios, siendo SetParam el más destacado de estos programas de terceros. Las tablas de frecuencia (archivos .frq) se utilizan para procesar la forma de onda al cambiar el tono en el editor. Algunos remuestreadores utilizan otros tipos de archivo en lugar de .frq. Las voces también pueden venir acompañadas de archivos de imagen, generalmente en formato .bmp, y diálogos de voz independientes, como ocurre con algunos Vocaloids. También suelen incluir archivos readme que contienen información sobre el software y las condiciones de uso. También se suelen incluir archivos de información de personajes, comúnmente llamados character.txt, que contienen información que se puede ver en la sección "Vista previa de voz" de la interfaz gráfica de usuario, donde se indica el autor del banco de voz, el nombre, un archivo de muestra que se reproducirá al hacer clic en el botón "muestra" y la imagen del banco de voz. También puede contener otros parámetros especificados por el creador, como el "género".

Algunos bancos de voz son monosilábicos, denominados colectivamente "CV" (consonante-vocal), mientras que otros utilizan trifonos para producir un sonido más suave.[3] Estos bancos de voces trifonéticas se conocen colectivamente como "VCV" (vocal-consonante-vocal). Su creación requiere mucho más tiempo y esfuerzo (ya que ocupan aproximadamente siete veces el tamaño de un banco de voces CV, en términos de líneas en el archivo oto.ini ), pero producen un resultado más natural.

Posteriormente, las voces de Utau incluirían fonemas compuestos de vocales y consonantes (VC) para adaptarse a idiomas distintos del japonés. Entre los métodos que emplean esto se incluyen "CVVC" (en el que un fonema VC se coloca entre dos fonemas CV), o un método similar, "VCCV", que se basa en CVVC, pero contiene algunas diferencias (diferenciación entre VC aspirados y no aspirados, soporte para grupos consonánticos, etc.). "VCCV" se llama así para diferenciarse de las listas CVVC anteriores de su creador. Dos métodos de grabación de voz menos comunes son CVC, donde un fonema consta de una consonante-vocal-consonante y se divide en el programa mediante el uso del oto.ini, y un método llamado rentan-jutsu (れんたんじゅつ?), en la que se graba una serie de sílabas CV en varios archivos wav para crear un resultado más suave sin recurrir al VCV completo.

Dado que los archivos de audio son independientes, pueden utilizarse en otros programas, como por ejemplo un DAW (estación de trabajo de audio digital).

Desarrollo

[editar]

El desarrollo de Utau comenzó cuando Ameya empezó a usar Audacity para recombinar muestras de otros cantantes y Melodyne para corregir el tono de las muestras y ponerles música. A este acto se le denominaba "VOCALOID impulsado por energía humana". LOLI. COM, un músico que publicó su propia música rap en Nico Nico Douga, utilizó su propia voz para crear un Vocaloid impulsado por humanos y lanzó un software de edición de audio que podría ayudar a los usuarios a hacer lo mismo. Dado que el proceso de crear "VOCALOID de forma manual" requería una cantidad considerable de tiempo y esfuerzo, Ameya comenzó a desarrollar una nueva herramienta que facilitaría el proceso.

La herramienta fue anunciada en Nico Nico Douga el 11 de enero de 2008. En aquel entonces, era posible ajustar la duración del sonido, cambiar la envolvente de una nota y generar archivos por lotes. El 5 de febrero de 2008 se publicó un vídeo que mostraba la interfaz gráfica de usuario (GUI). Aquí era posible estirar el tiempo de las muestras, crear archivos oto.ini y ajustar las inflexiones de tono de las notas.[4] El 5 de marzo de 2008, se publicó en Nico Nico Douga un vídeo que explicaba las especificaciones del programa,[5] y el 15 de marzo de 2008, la herramienta pasó a llamarse Utau.

El creador era programador de profesión y no especialista en síntesis vocal, pero utilizó sus conocimientos previos para crear Utau. Tras su lanzamiento, Ameya continuó mejorando Utau y comenzó a desarrollarlo en colaboración con otros desarrolladores de conversión de texto a voz.[6]

En junio de 2008, Ameya rechazó la etiqueta de "Jinriki Bōkaroido" (人力ボーカロイド? Manual Vocaloid) para Utau, llamándolo software de síntesis de voz para cantar.[7]

En 2011 se lanzó una versión para Mac llamada Utau-Synth.

Archivos de audio y derechos de autor

[editar]

Dado que Utau puede crear una voz cantada a partir de cualquier archivo WAV, es posible tomar la voz de una persona existente y usarla como datos. Con frecuencia, se reutilizan fragmentos de las voces de actores, cantantes y celebridades para su uso en Utau. El creador, Ameya, creó en una ocasión una voz utilizando datos del CD de un actor de doblaje.

En mayo de 2008, Ameya decidió dejar de usar datos de audio sin permiso por el momento, a menos que el actor de voz lo autorizara.[8]

Impacto cultural

[editar]
Vídeo musical de "Dance Delightful" de Jamie Paige, que muestra el banco de voces Utau Adachi Rei, creado mediante la combinación de ondas sinusoidales a través de síntesis aditiva.

Aunque el software es muy popular en Japón, sus orígenes e impacto cultural se deben a la popularidad ya consolidada del software Vocaloid. Utau se hizo famoso por primera vez cuando el creador de Kasane Teto lanzó el personaje, haciéndose pasar por un Vocaloid real como parte de una broma del Día de los Inocentes en 2008. La influencia del software Vocaloid también propició que ambos programas se utilizaran habitualmente de forma conjunta. Con frecuencia, las mascotas populares de Utau, como Kasane Teto, aparecen en medios basados en VOCALOID, como Maker Hikōshiki Hatsune Mix o Hatsune Miku: Project DIVA.

Posteriormente, el software Utau tendría su propio impacto en Vocaloid y otros sintetizadores vocales, y varias voces harían referencia a Utau o se producirían originalmente para dicho motor. Por ejemplo, Megurine Luka V4x fue influenciada por la vocalista de Utau Gahata Meiji.[9] Wataru Sasaki, productor de planificación y desarrollo de Crypton Future Media, también habló con alguien muy familiarizado con Utau y dijo que la conversación fue "muy interesante".[10] Macne Nana, de la serie Macne, se convertiría más tarde en una voz tanto para Utau como para Vocaloid. El proveedor de voz de Vocaloid Ruby en inglés, Misha, había producido previamente un Utau en idioma japonés llamado Makune Hachi Makune Hachi (MAKU音ハチ?). Además, el vocalista de Dex, Kenji-B, creó a Kenji Baionoto (倍音音ケンジ?) para Utau, y AkiGlancy, la vocalista detrás de la compañera de Dex, Daina, le dio su voz a Utau Namida (ナミダ?). Kikuko Inoue, la actriz de voz de Macne Coco White and Black (Mac音ココ白・黒) (ver serie Macne) pasó a expresar un producto Vocaloid5 con el nombre de Haruno Sora (桜乃そら). El producto venía con dos bancos de voz, Natural y Frío.[11] Tras el lanzamiento de la voz de Vocaloid 3 Tohoku Zunko, sus dos hermanas Tohoku Itako y Tohoku Kiritan entregaron sus voces a Utau.[12] Más tarde, Kiritan organizaría una campaña de financiación colectiva para que ella se convirtiera en una Voiceroid.[13] Además de su influencia en Vocaloid, Utau ha servido como plataforma de lanzamiento para el desarrollo de otros sintetizadores de voz cantada comerciales. El más notable de ellos es el Synthesizer V de Dreamtonics, que surgió del desarrollo del remuestreador Utau conocido como Moresampler, ambos desarrollados por Kanru Hua.[14][15][16]

Su principal atractivo no reside únicamente en su distribución gratuita a través de Internet, sino en que permitía al usuario insertar su propia voz en la base de datos para su uso en la creación musical, abriendo así las puertas a que los usuarios desarrollaran aún más su propia música. Utau debe su creciente popularidad a su capacidad para proporcionar un método gratuito de creación de voces para uso musical y ha logrado que numerosos productores musicales trabajen con el software en sitios como Niconico y YouTube. Los usuarios también lo ven como una alternativa al software Vocaloid, que ofrece una selección más limitada de voces a un precio elevado y puede que no ofrezca los tipos de voz que buscan para su música, ya que la gran base de datos de voces suele tener muchas más probabilidades de ofrecer la voz que buscan. Sin embargo, a pesar de la cantidad de bancos de voz que ofrece, el software tiene en general muchos menos productores trabajando con él que Vocaloid.[17]

Una emisora de radio programó un programa de 1 hora que contenía únicamente música basada en Vocaloid y Utau.[18]

Además, a partir del 19 de julio de 2012 se celebró regularmente un evento llamado The Utau M@STER. El evento fue la principal reunión de grupos o círculos y se llevó a cabo de manera similar al evento relacionado con Vocaloid, THE VOC@LOID M@STER, que existía desde 2007.[19]

Software relacionado

[editar]

A diferencia de Vocaloid, los archivos Utau no son restrictivos, ya que no se basan en una licencia propietaria. Por lo tanto, es posible utilizar productos con licencia de código abierto con el software Utau, como los producidos para la Macne series (Mac音シリーズ?) , lanzados para los programas Reason 4 y GarageBand. Estos productos fueron vendidos por Act2 y, al convertir su formato de archivo, también pudieron funcionar con el programa Utau.[20] Posteriormente, los paquetes Macne Whisper☆Angel Sasayaki, Macne Nana 2S y Macne Petit 2S venían con bancos de voces Utau preconstruidos.

El banco de voces predeterminado "Defoko" (Utane Uta) toma prestada su voz del software AquesTalk, específicamente de la voz "AquesTalk Female-1" producida por A-quest. Se le había concedido permiso para su distribución gratuita junto con el software.[21] Utane Koe, la hermana de Uta, también toma prestada su voz del software AquesTalk. Namine Ritsu (波音リツ), un banco de voces creado originalmente para Utau, también se agregó más tarde a otro programa llamado Sinsy como "Namine Ritsu S". Otro banco de voz desarrollado originalmente para el software Utau, Yamine Renri (闇音レンリ), también se agregó posteriormente a Synthesizer V. El popular personaje de Utau, Kasane Teto, se lanzó como una base de datos de voz de IA de Synthesizer V el 27 de abril de 2023.[22]

Debido al acuerdo de derechos de autor del propio software, no está permitido importar software con licencia no abierta, como VOCALOID, al software Utau.[23] Los usuarios del software también han desarrollado varios complementos que añaden y mejoran las voces del programa. El programa de software Sugarcape, basado en la misma intención de software libre que Utau, ya ha entrado en fase beta.[24] Hubo una versión oficial de Utau para Mac lanzada el 27 de mayo de 2011, llamada Utau-Synth.[25] Tiene prácticamente las mismas características que la versión de Windows. La versión Utau-Synth puede importar tanto voces como canciones creadas con la versión de Windows, pero sus archivos de proyecto y configuraciones de bancos de voces no son totalmente compatibles con la versión de Windows. A finales de 2017 se mencionó que Plogue Art et Technologie, Inc. tenía una adaptación de redirección funcional que haría que las voces de Utau aparecieran en su motor Alter/Ego.[26]

OpenUtau es una implementación moderna, no oficial y de código abierto de la mayoría de las funciones presentes en Utau, desarrollada por el productor de Vocaloid StAkira, con una versión beta lanzada en noviembre de 2021. El software fue diseñado para ser compatible con Utau, pero con una experiencia de usuario moderna, y con el tiempo se le fueron añadiendo más funciones. A diferencia de Utau, no requiere una configuración regional del sistema en japonés para funcionar correctamente.[27]

Uso en la música

[editar]

La primera canción original de Utau que se lanzó fue "Kenka Wakare" (けんか別れ?  ; en inglés: Fighting and Breaking up) de nwp8861,[28] quien también fue responsable de "Song of the Eared Robot"[29] cantada por Kasane Teto. La canción Kenka Wakare fue lanzada en Nico Nico Douga el 10 de mayo de 2008 con el banco de voz Utane Uta;[30] una versión revisada fue lanzada tres días después, el 13 de mayo de 2008.

Las canciones con licencia del álbum Graduation from Lie, en el que participa Kasane Teto, fueron lanzadas para su descarga digital por Karen-T, bajo el sello Crypton Future Media, como un lanzamiento especial. Esta es la primera versión con licencia de cualquier Utau.[31]

La biblioteca de voces Momo Momone se utiliza en el vídeo viral de YouTube "Nyan Cat". Es una versión de "Nyanyanyanyanyanyanya!" , una canción compuesta originalmente por daniwellP y que utiliza la VOCALOID Hatsune Miku.[32]

Véase también

[editar]

Referencias

[editar]
  1. «Aquestalk Official Website». A-quest products website (en jP). 30 January 2007.
  2. «Phoneme Chart». ARPAsing (en inglés estadounidense). Consultado el 6 April 2024.
  3. 1 2 «"Continuous Sound" Recording: UTAU Upgrades Realism – Vocaloidism». Vocaloidism. Archivado desde el original el 27 March 2012. Consultado el 27 April 2016.
  4. «自作ツールを使ってテキスト読み上げソフトに「片道キャッチボール」を». Niconico. 5 February 2008. Consultado el 29 June 2021.
  5. «人力ボーカロイド支援ツールらしきものを作ってみた その1 導入編». Niconico. 6 March 2008.
  6. «あなたの声で歌うソフト「UTAU」の奇妙な世界». ASCII.jp. Consultado el 29 June 2021.
  7. «"真の人力Vocaloid"とは». UTΑUについて. Consultado el 29 June 2021.
  8. Ameya. «テト声の調整に本腰が入った理由 (Why I got serious about adjusting the Teto voice)». Consultado el 31 July 2021.
  9. «crypton_wat». Twitter. Consultado el 27 April 2016.
  10. «crypton_wat». Twitter. Consultado el 29 April 2016.
  11. «井上喜久子のVOCALOID、VOICEROIDがついに登場! 新VOCALOID5に対応! 「VOCALOID 桜乃そら」「VOICEROID2 桜乃そら」 2018年7月26日発売». ahsoft.com. AH-Software. Consultado el 29 June 2021.
  12. «東北イタコ、きりたんのUTAU音源». Archivado desde el original el 24 June 2020. Consultado el 27 April 2016.
  13. «クラウド出版». Consultado el 27 April 2016.
  14. Hua, Kanru (23 September 2022), libllsm2, consultado el 3 October 2022.
  15. «libllsm2 Release – Kanru Hua's Website». 8 October 2018. Archivado desde el original el 8 October 2018. Consultado el 3 October 2022.
  16. «Moresampler – Kanru Hua's Website». 8 October 2018. Archivado desde el original el 8 October 2018. Consultado el 3 October 2022.
  17. «How Big Is The Japanese Vocaloid Community?». Archivado desde el original el 13 December 2010.
  18. «NHK の本気!ボカロラジオ「エレうた」の高き志» [NHK's Determination! High Aspirations with Vocaloid Radio "Ere Uta"] (en japonés). ASCII Media Works. 5 February 2011. Consultado el 25 February 2011.
  19. «「THE UTAU M@STER」UTAU only event». Consultado el 27 April 2016.
  20. «Mac音ナナ シリーズ» [Macne Nana Series] (en japonés). Act2. Archivado desde el original el 11 de mayo de 2011. Consultado el 9 July 2010.
  21. «音声合成ライブラリ製品の紹介 - 株式会社アクエスト». Consultado el 27 April 2016.
  22. «Synthesizer V AI 重音テト». 2 April 2023. Archivado desde el original el 3 April 2023. Consultado el 4 April 2023.
  23. «Controversy Concerns/POCALOID and illegal modifications». Vocaloid Wiki (en inglés). Consultado el 1 September 2019.
  24. «Macで動くボーカルシンセを作る». Archivado desde el original el 20 February 2020. Consultado el 27 April 2016.
  25. «UTAU for Mac: UTAU-Synth». Vocaloidism. Archivado desde el original el 27 March 2012. Consultado el 27 April 2016.
  26. «@chipspeech 5:19 p.m.—Nov 10, 2017 Tweet». Twitter. Consultado el 1 December 2017.
  27. «What is OpenUTAU?». STUDIO OGIEN. 16 November 2021. Archivado desde el original el 16 November 2021. Consultado el 25 February 2022.
  28. «【UTAU】Tried to sing an original song【Kenka Wakare (Fighting and Breaking Up)】». 13 de mayo de 2008.
  29. «【UTAU】Song of the Eared Robot (Original)【Kasane Teto】». 10 June 2008.
  30. «Utane Uta/Defoko UTAU Wiki page».
  31. «Kasane Teto "Graduation from Lie"» (en japonés). Crypton Future Media. Consultado el 2 October 2010.
  32. «[Miku Hatsune] Nyanyanyanyanyanyanya! [Original Loop] (the name of the nico nico vid) you can see that in the title stands "Miku Hatsune", which is referring to miku». 25 July 2010.

Enlaces externos

[editar]