Activadades de Junio y Julio ’17

Han habido pocas. La verdad es que estoy preparando por ahí un nuevo ensamble musical, lo único que en éste momento diré es que en el repertorio se incluye éste arreglo a Luis Arcaráz de Bonita:

Por otro lado les comparto éste otro arreglo a guitarra y voz de la rola de Van Morrison Brown Eyed Girl. Un tema muy conocido pero que se llega a escuchar poco en vivo.

Hasta aquí es lo que dejamos, el verano está siendo invertido en ensayos para éste proyecto que pronto verá la luz.

Actividades musicales de marzo, abril y mayo

No podía dejar sin documentar mis actividades musicales de este último bimestre. Mi chamba de académico me tuvo absorto 

pero aún así me di el tiempo para grabar y publicar en redes la rola de Leap Up. De hecho hay también una versión previa en acústico que aquí les dejo:

Fue un gozo el haber escrito y grabado ese tema. Aparte de él, tenemos en reserva un tema instrumental titulado A Random Thankfulness y lo publicaremos en redes en julio. La composición de ese tema como su nombre lo dice fue con base en un proceso aleatorio que ya describiremos en su momento.

La segunda actividad musical fue mi participación al bajo en el proyecto Hidra, de Ugon Alverde. En esta ocasión, se le encargó a Hidra la tarea de proveer un acompañamiento de Rock a un ensamble de Gaitas del Parque España, Puebla.

La experiencia fue interesante, lástima que el sistema de monitoreo no fuera óptimo. Afortunadamente destacó la buena voluntad de los músicos sobre el escenario del Teatro de la Ciudad aquí en Puebla, Pue.

Procesamiento de Voz Usando TD-PSOLA y MBROLA

Se ha visto que modificar duración y tono en una señal de voz (prosodia) no son operaciones triviales.  De manera intuitiva, el lector podría pensar que, modificaciones a tono y duración se consiguen interpolando muestras y re-muestreando la señal. Los resultados de realizar tal proceso equivalen a aquellos observados cuando se modifica la velocidad de reproducción de una cinta de audio analógica, es decir: el tono sube o baja de manera exagerada. Se han buscado alternativas para resolver éste problema, uno de los más eficientes ha sido el procesamiento de la señal mediante un algoritmo conocido como TD-PSOLA (Stylianou, 2008).

Time Domain Pitch Synchronous Overlap Add (Fragmentación y traslape de la señal sincronizada en tono en dominio del tiempo). Tal cual su nombre lo indica, el algoritmo tiene la siguiente estructura:

  1. Se analizan los distintos periodos en la señal de voz y se colocan indicadores (pitch marks)
  2. Hacer un ventaneo (fragmentación de la señal) con una cierta duración.
  3. Identificación de la frecuencia fundamental F0 en cada uno de los segmentos contenidos en las ventanas.
  4. Si se desea aumentar la duración, se repiten ciertos segmentos para aumentar el periodo. Si por el contrario la intención es volverla más corta, se eliminan algunos segmentos.
  5. Si se desea cambiar el tono se reacomodan las ventanas con modificaciones de la duración entre una y otra, dependiendo si se quiere aumentar o disminuir la frecuencia.
  6. Finalmente se suman las ventanas resultantes para realizar la síntesis

En el enlace abajo se muestran ejemplos de síntesis usando TD-PSOLA, la primera y segunda frase muestran sonido sintetizado a partir de texto. La diferencia entre ambas es la entonación que fue modificada de forma artificial. El tercer audio muestra una señal de voz grabada sin modificaciones y la cuarta es ésta misma señal con modificaciones en tono y duración.

 

A continuación, presentamos los detalles del algoritmo arriba mencionado:

Se tiene una señal de voz como se ve en la figura 1.

Figura 1 “Señal de voz”

En esta señal es necesario hacer una detección de las partes periódicas de la misma, para ello hay varios métodos. Aquí describimos el procedimiento propuesto por Goncharoff  (Goncharoff & Gries, 1998). En primer lugar, se buscan secuencias numéricas que se incrementen y decrementen con cierta regularidad. Una vez hallados estos periodos se identifican mediante marcas de tono o pitch marks. Posteriormente se separa la señal en tramas o frames, cada frame tiene una duración de dos periodos. La ventaja de tener éstas ventanas como unidades aisladas es que podemos combinarlas teniendo sus puntos centrales en la frecuencia principal. Luego se traslapan unas con otras y se tiene una reconstrucción de la señal original. La figura 2 muestra un diagrama de la misma.

Figura 2 “(1) Detección de pitch marks. (2) Aplicación de ventanas Hanning. (3) Separación en frames. (4) Reconstrucción de la señal original.

Se recomienda la ventana de dos periodos para facilitar la reconstrucción de la onda en el momento del traslape, así como se ilustra en la figura 3.

Figura 3 “Traslape de segmentos”

  2. Modificaciones de tono y duración.

Precisamente la ventaja de hacer ésta separación de la señal en tramas es lo que nos permite hacer modificaciones en duración y tono. Para modificar la duración es necesario duplicar algunas de las tramas. Por su parte si se busca un acortamiento de la duración de la señal, algunas de las tramas deben ser eliminadas. La figura 4 ilustra éste concepto.

La modificación del tono se logra mediante la recombinación de las tramas. En éste caso es necesario modificar la duración de las pitch marks. Vale la pena mencionar un ejemplo para ilustrar éste concepto:

  • Se tiene un segmento de voz con un tono de 100 Hz (10 ms entre cada pitch mark)
  • Se realiza el ventaneo de Hanning
  • Sí se colocan las ventanas a una distancia de 9 ms y luego se hace la suma-traslape, se obtendrá ahora un tono de 111 Hz.

Figura 4 “Traslape para modificar tono”

Para el caso de la modificación del tono, es necesario alterar la duración de los periodos entre las pitch marks. La consecuencia de esto puede ser la obtención de una señal más corta en el tiempo. Por ésta razón, a veces es necesario duplicar algunos frames en afán de preservar la duración original de la señal.

Detallaremos ésta explicación con un ejemplo:

  • Se tiene un tono de 100Hz ventaneado con 5 frames cada uno con una separación de 10 ms. Es decir, hay una duración total de (5-1) *10 ms= 40ms entre la primera y la última pitch mark.
  • Si deseamos cambiar el tono a 150 Hz es necesario poner la distancia de las pitch marks a 6.6 ms, el probema es que ahora nuestra duración total es de (5-1) *6.6ms= 26 ms.
  • Para preservar la duración original, tenemos que duplicar dos frames, de ésta forma volvemos a nuestra duración de 40 ms (7-1) * 6.6 ms =40 ms.
  1. Detalle de la manipulación de las pitch marks

Como se puede apreciar en las secciones anteriores la base del método TD PSOLA, el elemento crítico son las pitch marks . Se ha dicho que es necesario modificarlas para ejecutar los cambios de duración y tono.

Se mencionó que las pitch marks se hallan mediante un algoritmo de detección. Dichas marcas se pueden representar como una secuencia de análisis Ta= {ta1, ta2,…,taM}, el periodo local entre dos de éstas marcas se define como:

Que no es más que un valor medio entre la pitch mark inicial y la pitch mark final. De éste punto, se hace un ventaneo de la señal para separar en frames, éste se define como:

De aquí es necesario crear una secuencia de síntesis de las pitch marks que depende de la duración y cambio en el tono deseados Ts= {tS1, tS2,…,tSM}, la relación de ésta secuencia de síntesis con la de análisis está relacionada por una función M[i] que especifica cuáles frames de análisis deberán corresponder en la síntesis. Ésta función es una suerte de línea de tiempo virtual entre sínteis y análisis, tal como se ve en la figura 5.

Figura 5 “línea de virtual tiempo de pitch marks entre análisis y síntesis”

Multi-Band Resynthesis Overlap Add (MBROLA)

Se habló en párrafos anteriores acerca de dos tareas principales a resolver en la síntesis concatenativa, la primera tiene que ver con la modificación de la prosodia y la segunda con hacer una transición sutil entre fonemas.

El que la transición no sea sutil tiene que ver con una unión incorrecta entre fonemas, la cual puede ser de tres tipos:

Mala unión de Fase (Phase Mismatch): Este tipo de problemas ocurren cuando las formas de onda no están centradas en las mismas posiciones relativas dentro del periodo de tiempo en que se encuentran.

Mala unión de Tono (Pitch Mismatch): Sucede cuando ambos segmentos tienen la misma envolvente espectral pero fueron pronunciados con diferentes tonos.

Mala unión de Envolvente de Espectro (Spectral Envelope Mismatch): Esta falla resulta cuando las unidades fonéticas fueron extraídas de contextos diferentes entre sí. La discontinuidad ocurre sólo en un período.

Ante estos problemas de unión, Dutoit y Leich (Dutoit & Leich, 1993)proponen una solución conocida como MBROLA. Este algoritmo deriva directamente del TD-PSOLA, de hecho es muy semejante. La diferencia radica en que no se hace un análisis individual de las ventanas. Ni son necesarias las pitch marks.

Como lo muestra el diagrama, el sistema toma como referencia un difonema procedente de un corpus. El primer paso es diferenciar si es vocal o sordo. Si se trata de un sonido vocal, entonces se separa y se hace un análisis de bandas del mismo. El análisis se lleva a cabo mediante un sintetizador armónico que se encarga de calcular nuevas amplitudes y fases con características regulares. Estos difonemas resintetizados son después concatenados utilizando el método Overlap Add OLA.

Figura 6 “Esquema de MBROLA”

Dado que objetivo de MBROLA es hacer las formas de onda lo más semejantes entre sí. Es esencial el reajuste de fases del que se habló anteriormente y se explicará a continuación con mayor detalle. El ajuste de las ondas se hace en los bordes de la última parte del primer segmento y de la primera parte del segundo segmento. El último borde y el subsiguiente se denotan como SlN  y Sr0 respectivamente y los ajustes a los mismos se definen como ML y MR los cuales se obtienen de las siguientes fórmulas:

Para i=0…ML-1 y j=0…MR-1

Para la solución de la mala unión de la envolvente de espectro se usa el algoritmo propuesto por Charpentier y Moulines (Moulines & Charpentier, 1990) el cual consiste en la interpolación de los periodos vocales de tono regular (voiced pitch periods).

Referencias

Dutoit, T., & Leich, H. (1993). MBR-PSOLA: Text-to-speech synthesis based on an MBE re-synthesis of the segments database. Speech Communication. Retrieved from http://www.sciencedirect.com/science/article/pii/016763939390042J

Goncharoff, V., & Gries, P. (1998). An algorithm for accurately marking pitch pulses in speech signals. Proc. of the SIP’98. Retrieved from

Moulines, E., & Charpentier, F. (1990). Pitch-synchronous waveform processing techniques for text-to-speech synthesis using diphones. Speech Communication. Retrieved from http://www.sciencedirect.com/science/article/pii/016763939090021Z

Stylianou, Y. (2008). Voice Transformation. In Springer Handbook of Speech Processing (pp. 489–504). Berlin, Heidelberg: Springer Berlin Heidelberg. https://doi.org/10.1007/978-3-540-49127-9_24

 

Síntesis de Voz, Resumen de los métodos más representativos

Desde principios del siglo XX se han realizado distintos esfuerzos para generar “máquinas parlantes”, o de manera más correcta: Realizar Síntesis de Voz. Sin embargo, a casi un siglo de que apareció el primer sintetizador de voz eléctrico de Homer Dudley que se tiene documentado (“Homer Dudley’s Speech Synthesisers,” n.d.) llamado VODER (ver figura).  No se ha terminado de lograr el sueño de tener un sistema de síntesis de voz que resulte indistinguible de la voz humana. Si bien las voces sintéticas de la actualidad cumplen casi cabalmente el requisito de inteligibilidad, aún no es así con el de la expresión. La combinación de estos dos es lo que dota de naturalidad a los sistemas de voz artificial.

Existen tres sistemas de síntesis vocal: síntesis de formantes, síntesis articulatoria y síntesis concatenativa. A continuación, se explica con detalle en que consiste cada uno.

 

  1. Síntesis de Formantes

Se define como frecuencias formantes a aquellas frecuencias características de un fonema. Tales sonidos permanecen constantes en cada emisión de frase, independientemente de la entonación o intensidad con la que la frase haya sido producida. Gracias a ésta característica sabemos que los fonemas pueden ser identificados en todo momento por estas frecuencias.

Fisiológicamente hablando, las formantes son resultado de las resonancias producidas a lo largo del tracto vocal de la onda sonora proveniente de la glotis que tuvo su origen en la vibración de las cuerdas vocales producida por una corriente de aire en los pulmones.

En la voz humana existen dos tipos de sonidos: vocales y sordos o no-vocales, los primeros son resultado de la vibración de las cuerdas vocales y los segundos resultan del flujo de aire que pasa directamente de los pulmones al tracto vocal.

Este proceso de generación artificial de formantes se puede lograr en un sistema de procesamiento de señales electrónicas. La señal proveniente de las cuerdas vocales se simula con una fuente sinusoidal. Los sonidos no-vocales, por su parte, se emulan a través de una fuente de ruido blanco. Las frecuencias formantes se logran pasando dicha fuente a través de un conjunto de filtros pasa banda. Un modelo que ha sido referente en este tipo de sistemas de fuente-filtros es el sintetizador de Klatt (Klatt, 1982) el cual fue de los primeros sistemas de síntesis en software cuyo algoritmo y código fuente se publicaron a detalle.

  1. Síntesis Articulatoria

La síntesis articulatoria está basada principalmente en el trabajo de Fant (Fant, 1970) que comenzó desde principios de los 60. Este tipo de síntesis pretende modelar las características físicas haciendo un estudio de la geometría del tracto vocal, principalmente de su largo y su área transversal. Posteriormente mediante ecuaciones de movimiento de fluidos se hace un modelo matemático de los fenómenos acústicos que tienen lugar adentro del tracto.

El concepto físico de la presión que el aire ejerce sobre el tracto vocal, así como el chorro de aire que viaja dentro de él se simplifica observando el tracto vocal como una serie de tubos interconectados. Así como el tejido del tracto vocal cambia su grosor de acuerdo con el sonido que se emite, cada uno de estos tubos tiene un diámetro distinto correspondiente a un fonema determinado.

Este modelo tubular es referente en dos tipos de síntesis: la de circuitos acústicos y la de Linear Predictive Coding o LPC. Se hablará de LPC y cómo utiliza el modelo tubular más adelante en este documento, en lo referente a circuitos acústicos podemos mencionar que el modelo tracto vocal-tubular fue muy popular a mediados del siglo veinte ya que constituyó el principio para la elaboración de una familia de sintetizadores de voz eléctricos.

Muchos de ellos fueron llevados a la práctica utilizando analogías acústicas-eléctricas. Destaca el trabajo de Stevens, Kasowski con Fant (Stevens, Kasowski, & Fant, 1953). La síntesis articulatoria perdió un poco de popularidad durante los 60 y 70, no fue sino hasta 1982 con el trabajo de Maeda que se reutilizó la analogía electro-acústica y sin duda al día de hoy el trabajo más relevante donde se emplea síntesis articulatoria es Vocal Tract Lab (Birkholz & Jackel, 2003; Birkholz, Jackèl, & Kroger, 2006), el cual continúa vigente en su interesante proyecto en el sitio vocaltractlab.

  1. Síntesis Concatenativa

Sin importar cómo fueron generados los fonemas, ya fuera grabadas por una persona o mediante una parametrización de la que se hablará más adelante. Para hacer síntesis es necesario es necesario enlazar los fonemas uno con otro luego de ser producidos. A este tipo de síntesis de voz se le conoce como síntesis concatenativa.

La síntesis concatenativa es la más eficiente en sistemas de síntesis al día de hoy. En la síntesis concatenativa se pueden modificar más detalladamente las unidades mínimas de lenguaje logrando una mayor naturalidad cuando éstos se producen.

Como consecuencia de lo anterior, la inteligibilidad y entonación de una voz artificial de síntesis concatenativa superan a aquellas logradas con síntesis articulatoria o con síntesis de formantes.

Los métodos para emular la prosodia (tono y duración) en la concatenación de las palabras son principalmente los basados en el principio de Suma-Traslape (Overlap-Add), en estos métodos destacan PSOLA, MBROLA y selección de unidades.

Se dice que (Dutoit, 2008) para producir lenguaje hablado de manera inteligible, se requiere de la habilidad de generar lenguaje continuo coarticulado. Lo cual nos conduce a pensar que los puntos de transición entre fonemas son mucho más importantes para la inteligibilidad de lo que son los segmentos estables. Incluso los fonemas vocales largos y sostenidos varían en amplitud y frecuencia, además de que contienen elementos inarmónicos.

Con base en éste argumento, la síntesis de voz concatenativa busca inteligibilidad “pegando” trozos de habla en lugar de fonemas aislados. Esto conlleva a una mejor coarticulación.

 

  1. Síntesis Concatenativa basada en Difonemas

Un primer intento de lograr una concatenación más precisa es mediante el uso de difonemas como unidades mínimas para producir lenguaje hablado.

Normalmente, el difonema comienza y termina con una parte estable como se muestra en la figura

El problema es que la cantidad de difonemas presentes en un idioma es enorme. Típicamente una base de datos de difonemas es de al menos 1500 unidades.  En términos prácticos, tres minutos de habla muestreados a 16 KHz con resolución de 16 bit suman alrededor de 5 MB.

Para resolver este problema, se busca una lista de palabras donde aparezca al menos dos veces cada difonema. El texto se lee por un locutor profesional para evitar mucha variación en tono y articulación. Posteriormente, los elementos elegidos son marcados mediante herramientas de visualización o algoritmos de segmentación. Finalmente se recolectan en una base de datos.

A groso modo, la manera en cómo se lleva a cabo la síntesis es la siguiente:

  1. El sintetizador recibe la entrada fonética y se realiza un procesamiento previo de lenguaje (se hablará más delante de dicho proceso).
  2. Se establece duración, tono y tipo de fonema.
  3. Se recolecta de la base de datos una serie de fonemas candidatos para llevar a cabo la síntesis.

Normalmente los fonemas elegidos difícilmente reúnen de manera natural los requerimientos para darle a la frase producida la suficiente inteligibilidad por lo que hay que realizar dos tareas adicionales. La primera tarea consiste en hacer modificaciones en la prosodia. La segunda tarea tiene que ver con la “suavización” de las transiciones de los difonemas ya que son muy notorias debido a las ya mencionadas variaciones de amplitud y frecuencia.

Algunos ejemplos de síntesis por difonemas se encuentran en los audios a continuación:

Todas las voces son originales de FESTIVAL y se pueden encontrar detalles del sistema en su sitio oficial. La primera frase es inglés americano, la segunda inglés británico y la cuarta español europeo.

Bilbliografía

Birkholz, P., & Jackel, D. (2003). A three-dimensional model of the vocal tract for speech synthesis. Of the 15th International Congress of  …. Retrieved from http://rickvanderzwet.nl/trac/personal/export/360/liacs/API2010/workshop1/birkholz-2003-icphs.pdf

Birkholz, P., Jackèl, D., & Kroger, B. (2006). Construction and control of a three-dimensional vocal tract model. Acoustics, Speech and Signal. Retrieved from http://ieeexplore.ieee.org/abstract/document/1660160/

Dutoit, T. (2008). Corpus-Based Speech Synthesis. In Springer Handbook of Speech Processing (pp. 437–456). Berlin, Heidelberg: Springer Berlin Heidelberg. https://doi.org/10.1007/978-3-540-49127-9_21

Fant, G. (n.d.). Acoustic theory of speech production : with calculations based on X-ray studies of Russian articulations. Retrieved from https://books.google.com.mx/books/about/Acoustic_Theory_of_Speech_Production.html?id=qa-AUPdWg6sC&redir_esc=y

Homer Dudley’s Speech Synthesisers. (n.d.). Retrieved from http://users.polytech.unice.fr/~strombon/SSI/z.Supplements/vocoder/http___www.obsolete.pdf

Klatt, D. H. (n.d.). Software for a cascade/parallel formant synthesizer. Retrieved from http://www.fon.hum.uva.nl/david/ba_shs/2009/klatt-1980.pdf

Stevens, K., Kasowski, S., & Fant, C. (1953). An electrical analog of the vocal tract. The Journal of the Acoustical. Retrieved from http://asa.scitation.org/doi/abs/10.1121/1.1907169

Leap Up

This tune was created as a gift, but as sometimes magically happens, the song started to live by itself. Previous versions can be found in video format in youtube. The song has clear influence from a 70s pop song, particularly towards the end with the lead synth. The lyrics are about courage: “Leap up without fear, challenge time and space”.

The cover was chosen by the friend the song was given to. It is a painting that she saw at a market in St. John (Virgin Islands), the image is full of color with a jungle theme. Goes well with a live spirit song like this one.

Instruments: Drums, Fender Precision Bass, Fender Stratocaster, Yamaha PSR 630 and Vocals.

Performer: Carlos Franco

April 2017

Enero y Febrero 2017, silenciosos

Una tardía entrada en mi bitácora de actividades musicales. No pasó desapercibida ésta primera etapa del año en cuanto  a música, sin embargo no hubo shows en vivo ni grabaciones nuevas.

Fueron dos vídeos, una interpretación de “Oh Darling” a bajo y voz. Con la necedad del epiphone zurdo. Hubo también una composición reciente “Leap Up” dedicada a la persona con quien comienza una nueva aventura. En el caso de ésta última se hizo un ejercicio diferente en el programa de Beatles en el Microscopio.

Se estreno la canción en vivo, tipo Agustin Lara en la XEW.

Diciembre 2016 Cerrando con tres actividades diversas

Seguimos aquí  metiendo información a éste diario de actividades musicales que nos ayuda a mantener la cordura. Empecemos por lo primero:

15400466_1210749485627166_1168794439493864851_n-1Martes 13 de Diciembre.

Una comida de fin de año con los profes de la Facultad de Artes de la BUAP significó una nueva tocada con el trío de jazz Illarramendi-Guevara-Franco. Donde dimos rienda suelta al impulso jazzero con estandars como: The Chicken, Night Birds, Take the A Train, Equinox y hasta una versión de Noche de Paz con arreglo de Guevara.

Lunes 19 de Diciembre

El último programa de 2016 de Beatles en el Microcopio. Donde invitamo a Marcelino Cólex igual que hace un año para revivir ese dueto de country-blues llamado “La última Milla”. La verdad es que considerando que decidí ocupar como arma especial una Les Paul en lugar de mi  habitual bajo, se logró una sensación agradable haciendo temas de Tommy Flint, el famoso Blue Bossa y hasta una composición Colex/Franco que desde hoy se titula “Alcaline”.

 img_3383

He aquí el link del programa

Finalmente me dí el gusto de participar en una red social de colaboraciones musicales llamada Bandhub es una idea muy atractiva donde un usuario propone un tema con un sólo track, por ejemplo: voz, guitarra. A partir de ahí invita a otros músicos a colaborar con las partes restantes como bajo, batería, coros, etc. Se pueden hacer covers o composiciones originales. En éste caso dimos notas graves a éste hermoso tema Pop de los Beatles llamado “Hold Me Tight”

https://bandhub.com/s/57816435ae166055d58a1d87

Interesante último mes con tras actividades nada despreciables: Dos tocadas: Una en radio y otra en vivo y una colaboración a distancia.

Noviembre de 16 y la producción de un álbum solista.

Noviembre no fue de presentaciones en directo, sin embargo, lo que empezó como un single para compartir en éste mes, terminó en un nuevo LP. Siempre es importante considerar que: Un nuevo álbum, un nuevo aprendizaje
Sin duda es importante buscar que se quede algo nuevo como músicos en cada nueva grabación. En este caso, quiero listar lo que considero fue un reciente aprendizaje :
1. La batería es un instrumento musical muy chingón. Sin embargo y como en toda actividad en la que se empieza a conocer algo nuevo, aún requiero más práctica antes de hacer una línea lo suficientemente profesional. El trabajo quedó digno pero hubo temas como “the last rock and roll” y “sobretodo amor” en donde se nota falta de dominio en los redobles de tarola/caja/snare.

2. Al buscar que el volumen final de un track iguale a los volúmenes de las grandes producciones termina en afectar negativamente el rango dinámico de la pieza musical. Por ésta razón decidí dejar los tracks de forma tal que sus picos máximos quedaran en -3 dB. Este enfoque se utilizó a inicios de los 90 en producciones comerciales como Dangerous de Michael Jackson. Evidentemente los tracks sonarán con menos volumen que un track de gran producción comercial pero se conservará su dinámica y por lo tanto la calidad en los sonidos.
Respecto a éste segundo punto quiero remarcar que lo relevante de los sonidos del track ocurre en el momento de la captura y edición de los mismos. No en la masterización. Queda como aprendizaje el procesar las señales de manera que sean más rica acústicamente en timbre.

Una última actividad que tuvo lugar y para no cerrar el mes en ceros fue la siguiente rendición en guitarra al estándar de jazz Blue Bossa.

https://youtu.be/QNv8Ca5r5jc

Espíritu Vencedor

Notas del Album

Ve sin miedo
Sin duda hay dos elementos clave, por un lado el blues y por otro ese tipo de canciones Rock Pop donde existe un coro de notas largas en la voz sobre un acompañamiento de octavos un poco sobrepasado de agudos. Por ejemplo “Save me” de Remy Zero o “Creep” de Radiohead. La letra desde el principio quería que fuera de aliento: “Ve sin miedo”, no renuncies a ti.

Espíritu Vencedor
La canción que da título al disco, que fue pensada para una mujer muy esforzada en su trabajo.
Aquí tenía ganas de hacer guitarras casi atmosféricas y que la batería y el bajo estuvieran únicamente sugeridos en el fondo. La voz fue pasada por un amplificador de bajo y eso le da esa sensación de estar sonando a través de un radio AM. Sólo en la parte media ocurre una voz con proceso tradicional de micrófono y reverb. Para los más clavados en la teoría les comento que la progresión armónica surgió antes que la melodía y fue generada completamente al azar. Por ésta razón la melodía se adaptó después.

Crear
Ésta canción tiene una letra que describe una situación que, según he visto, es común entre los colegas: “Creer que la música es sólo para conseguir fama y fortuna”. Luego de unos años de ejercer esta hermosa profesión se da uno cuenta de que va mucho más allá de todo eso.
Musicalmente quería una influencia tipo Creedence, con guitarras acústicas en cada lado de la estereofonía, llevando la armonía de manera casi percusiva. Hay también un piano de fondo y un bajo casi hermanado con el bombo.

D es de Dinosaurio 
Es una composición de Alonso Arreola que aparece en su álbum “Música para ser niño”. El tema siempre me gustó mucho y lo trabajé con el músico poblano Gil Gallardo para que me obsequiara ese lindo sonido de Sax soprano.

The Last Rock and Roll
Este tema empezó como una improvisación de batería en 4/4 pensando en términos rocanrroleros. De ahí la melodía surgió una vez terminado el ritmo, de entrada se ideó la frase This is the last rock and Roll, se sabía que la letra tenía que llevar temática tipo “Closing Time” de Semisonic.
La guitarra principal tiene un riff que seguramente tuvo que ver con “I Saw her Standing There”, la guitarra segunda hace ritmo a contratiempo. Con un rasgueo de sonido muy Stratocaster.
El bajo por su parte surgió de una clase de bajo con Alonso Arreola, en donde me sugería seguir con el bajo diferentes elementos de la batería en una misma frase musical. Es por eso que el bajo empieza con un aire muy desenfadado siguiendo al bombo, en el verso sin embargo empieza a ir a tiempo con la tarola y hace el remate haciendo octavos con los contratiempos. La voz la imaginé como ciertos temas de Lennon, mucho reverb y delay, la interpretación también tiene cierta influencia suya. La letra hace referencia a aquellos días con Eslabón cuando tocando en algún bar de Puebla me daba cuenta de que no estaba ya contento en ese entorno.

Lazo Cerrado
Usamos el término en ingeniería para denotar a un sistema cuya salida se retroalimenta a la entrada, como una caja de WC  por ejemplo, se vacía y se vuelve a llenar automáticamente. Siempre me gustaron esas palabras y quise usarlas para nombrar éste tema instrumental.
La base percusiva es claramente electrónica, encima de ella va el bajo desarrollando el tema melódico acompañado de una guitarra stratocaster con acordes de séptima mayor que siempre me han parecido relajantes. Aunque el tema B tarta de evocar una momento lúdico para nuevamente caer al tema A. Finalmente aparece un alegre tema C para cerrar la pieza. Esta canción es una suerte de intermedio para seguir la línea de las canciones con letra.

Octafono Markov
Recibe su nombre de dos conceptos, el primero porque está escrita sobre una escala octáfona, es una escala cuyo orden va tono y semitono.
El nombre Markov viene del sintetizador de voz Hidden Markov Models as Text to Speech Synthesis. Es un sistema de cómputo que genera voz artificial en español sobre el que hemos estado trabajando en la UNAM desde hace algunos años.
Las voces que ahí suenan, a excepción de la de un servidor, fueron producto de dicho programa. El resto de los sonidos son bajo, Batería y batería virtual.

Take me Home
La melodía salió mientras caminaba de la tienda a mi casa, no estaba muy seguro de su destino final hasta que a manera de ejercicio decidí pasar a partitura la melodía. Una vez en el papel hubo chance de pensar en una composición a varias voces.
De ahí me acordé de esos himnos religiosos de Palestrina, la letra es una especie de salmo, que si bien no soy religioso, quise ser fiel al género.

Sobretodo Amor
Una canción tanatológica según me dijeron. El mensaje del tema es que, independientemente de cómo quieras morir, de poco vale una vida sin amor por otros y de otros a uno. Disfruté mucho el solo de guitarra, sin duda me ayudó a sacar mi lado blusero en la guitarra. Oculto hace tiempo.

Love for Granted
Este tema tiene mucha influencia de Badfinger, Fleetwood Mac o Wings. Melodía muy accesible con un coro fácil de seguir. Imaginé una lírica más desde un punto de vista femenino que masculino, en un mundo ideal ésta rola la imagino cantada por Suzy Quatro o Sheryl Crow de ahí que fuera en inglés.
La base rítmica es simple, batería marcando los tiempos y bajo haciendo octavos rítmicamente mientras melódicamente soporta la armonía de la canción. Las guitarras van contestando a la voz con frases melódicas a veces y marcando el acorde otras tantas.
Siempre hay lugar para una canción pop, éste fue el postre del disco.

Esto es a groso modo “Espíritu Vencedor”, el segundo álbum de un servidor en donde está a cargo de todo. Es desgastante trabajar así y hasta cierto punto me pierdo de las contribuciones de otros músicos, sin duda la siguiente entrega será con una banda completa. Por otro lado debo decir que me divirtió mucho tocar instrumentos como guitarras o batería que normalmente no toco, en ese sentido fue muy ilustrativo.

 

Octubre y el rollo musical mensual

El mes sólo tuvo una presentación que fue el día 4. En un homenaje a los rockeros poblanos de antaño. Eslabón participó invitado por Raúl Núñez, tocando cuatro rolas de rock and roll de los 60 en las versiones cómo se conocieron en México. Popotitos por ejemplo, grabada por Enrique Guzmán (con los Teen Tops) es una adaptación del tema Bonnie Moroni, que al día de hoy indentifico más por John Lennon que por sus intérpretes originales.

Nunca he sido entusiasta del rock de los 60 en sus versiones al español, sin embargo fue bueno el pretexto para agarrar mi Epiphone Viola y juntarme a hacer ruido con Víctor Illarramendi y Marco Quintana. Se sumó al palomazo mi amigo el saxofonista Orlando Flores y por supuesto que estaba Ramón Durañona, en ésta ocasión haciendo la función de ingeniero de sonido. Considerando el PA con el que tocamos fue como hacer cirugía con cuchillos de cocina, triste situación. En la guitarra solista fue de invitado Rogelio Rodríguez, un experimentado requinto de trio romántico que se animó a tocar guitarra eléctrica en esta ocasión. Aparece a la izquierda de Marco en la foto, una sentida disculpa pero no recuerdo los nombres de los otros señores.


El secreto de mantener musical éste mes fue jugando al ermitaño en el estudio de grabación. Lo que iba a ser simplemente un single en el mes de noviembre se amplió con algunos temas más a un álbum completo con temas diversos entre sí. Ya lo compartiré en su debido momento, mientras tanto dejamos aquí uno de los temas que ya había grabado en julio pero no había llevado al YouTube.

De Alonso Arreola: D es de Dinosaurio. Presentando a Gil Gallardo en el saxo: