Enjoy A New Student Discount All 55,000 Courses on sale for Only $12.99

Ends in 05h 23m 49s

Presentamos Open Music Repository

La música está en todas partes. También lo están las partituras, los catálogos, las grabaciones, las ediciones digitales y las distintas formas de describir una misma obra.

Pero cuando intentamos reunir toda esa información, descubrimos algo bastante curioso:

encontrar una obra musical no siempre es tan sencillo como parece.

Por eso estamos construyendo Open Music Repository.

Un proyecto que empieza por una pregunta sencilla

¿Qué pasaría si pudiéramos reunir información procedente de distintas fuentes musicales y hacer que todas esas referencias pudieran relacionarse entre sí?

Imaginemos una obra de Mozart.

En una fuente puede aparecer como:

Ave verum corpus, K. 618

En otra:

Ave verum corpus, K.618 (Mozart, Wolfgang Amadeus)

Y en otra:

Ave, verum corpus

Para una persona, probablemente resulta evidente que estamos hablando de la misma obra.

Para un ordenador, no necesariamente.

Y este es solamente uno de los problemas que aparecen cuando intentamos trabajar con grandes cantidades de información musical.

Una misma obra puede tener muchas identidades

Los títulos pueden cambiar.

Los nombres de los compositores pueden aparecer de muchas maneras. Una misma persona puede figurar como:

Mozart
Mozart, W. A.
Wolfgang A. Mozart
Wolfgang Amadeus Mozart
Wolfgang Amadé Mozart

También pueden existir diferentes catálogos, ediciones, movimientos y representaciones digitales de una misma obra.

Y, además, las distintas fuentes no siempre contienen exactamente la misma información.

Nuestro objetivo es empezar a construir una infraestructura que permita relacionar toda esa información sin perder su procedencia.

No queremos simplemente cambiar un título por otro o decidir que dos registros son iguales porque «se parecen».

Queremos poder decir:

Estas referencias probablemente corresponden a la misma obra.

Y también:

Estas referencias podrían corresponder a la misma obra, pero no tenemos suficiente información para asegurarlo.

O incluso:

No hemos encontrado evidencia suficiente para establecer la relación.

Esta última posibilidad es importante.

No queremos inventar certezas

Cuando se trabaja con información procedente de diferentes fuentes, es muy tentador elegir siempre una respuesta.

Pero una respuesta incorrecta puede ser mucho peor que reconocer que existe una duda.

Por eso uno de los principios que estamos incorporando al proyecto es que las decisiones deben conservar su evidencia.

  • Si varias fuentes coinciden, queremos saberlo.
  • Si una fuente proporciona un identificador externo, queremos conservarlo.
  • Si existen varias posibilidades, queremos poder mostrarlas.
  • Y si no sabemos la respuesta, el sistema debe ser capaz de decirlo.

Construir antes que correr

Open Music Repository está todavía en construcción.

En esta primera etapa estamos trabajando especialmente en los cimientos: cómo recoger información de diferentes fuentes, cómo normalizarla, cómo relacionar las distintas representaciones de una obra y cómo separar los datos originales de las conclusiones que obtiene el sistema.

Es un trabajo menos visible que una aplicación terminada, pero creemos que es fundamental.

Antes de construir herramientas que permitan buscar, consultar o trabajar con miles de obras, necesitamos conseguir que esas obras estén bien identificadas y relacionadas.

Y esto nos está llevando a descubrir que la parte más difícil no siempre es encontrar información.

A veces, lo difícil es saber qué significa realmente esa información y cómo se relaciona con todo lo demás.

Un proyecto que iremos contando

No queremos presentar Open Music Repository como un producto terminado.

Estamos empezando.

Durante el desarrollo iremos encontrando problemas, probando soluciones y aprendiendo de los resultados. Algunos funcionarán y otros no.

Y queremos compartir parte de ese proceso.

En próximas publicaciones hablaremos de algunos de esos problemas con más detalle: cómo identificar una obra cuando las fuentes utilizan títulos diferentes, cómo reconocer a un compositor cuando su nombre llega mal formado, cómo determinar cuándo dos representaciones pertenecen a la misma obra y qué hacer cuando las fuentes no están de acuerdo.

Porque detrás de una búsqueda que parece sencilla como:

Mozart → Ave Verum Corpus

hay bastante más trabajo del que parece.

Open Music Repository nace para explorar precisamente ese problema.

Y este es solo el principio.


Descubre más desde Recursos para formacion

Suscríbete y recibe las últimas entradas en tu correo electrónico.

Deja un comentario

/*Si te ha gustado el artículo
no dudes en compartirlo*/

Facebook
Twitter
LinkedIn

Ver mi IP

Añade aquí tu texto de cabecera