El formato MARC

MARC es el formato con el que las bibliotecas guardan sus registros desde 1968. Quién lo creó, cómo se lee un registro y por qué se intenta sustituir.

5 min
Editar

MARC (del inglés MAchine-Readable Cataloging, catalogación legible por máquina) es el formato con el que las bibliotecas guardan y se intercambian los datos de su catálogo desde finales de los años sesenta. Un registro MARC es la versión informática de la vieja ficha de cartulina: contiene el autor, el título, la edición, el pie de imprenta, la descripción física y las materias de un libro, pero cada dato va en una casilla numerada que un programa puede reconocer. Gracias a él, una biblioteca de Bilbao puede copiar el registro que otra hizo en Toronto sin volver a describir el libro.

El problema que resolvió era de escala. A principios del siglo XX, la Biblioteca del Congreso de Estados Unidos empezó a imprimir sus fichas de catálogo y a vendérselas a otras bibliotecas, que así se ahorraban el trabajo de catalogar los libros más comunes. En 1901 abrió un servicio de distribución de fichas que acabó enviando millones de ellas cada año por correo. Pero una ficha impresa servía solo para una cosa: archivarla en un cajón. Si una biblioteca quería un listado de novedades, una bibliografía o un catálogo por materias, había que copiar a mano otra vez los mismos datos.

Fotografía antigua de una nave con máquinas de imprenta alineadas y operarios en mangas de camisa trabajando junto a mesas de madera con cajones
Fig. 1 Impresión de fichas de catálogo en la Biblioteca del Congreso hacia 1920. La biblioteca vendía copias de sus fichas a cualquier otra biblioteca desde 1901; MARC nació en buena parte para automatizar esta producción.Autor desconocido (Biblioteca del Congreso de EE. UU.) · 1920 · Dominio público · Wikimedia Commons

En 1965 la Biblioteca del Congreso contrató a Henriette Avram, una programadora que había aprendido el oficio en la Agencia de Seguridad Nacional y que no sabía nada de bibliotecas. Su encargo era estudiar cómo poner en cinta magnética los datos del catálogo. Avram pasó meses aprendiendo catalogación y llegó a una conclusión: no bastaba con copiar la ficha tal cual, había que desmontarla en elementos y etiquetar cada uno para que la máquina supiera qué era un apellido, qué un título y qué una fecha. Entre 1966 y 1968 dirigió el proyecto piloto MARC, en el que dieciséis bibliotecas recibieron semanalmente cintas con los registros nuevos de la Biblioteca del Congreso.

Fotografía en blanco y negro de una mujer de pelo corto y gafas, sonriente, con abrigo oscuro, junto a un hombre trajeado que sonríe, en un despacho con banderas al fondo
Fig. 2 Henriette Avram con el presidente Richard Nixon en 1974, al recibir el Federal Woman’s Award por el desarrollo de MARC. Siguió en la Biblioteca del Congreso hasta 1992 y murió en 2006.Autor desconocido · 1974 · Dominio público · Wikimedia Commons

La versión definitiva, MARC II, apareció en 1968, y su estructura se convirtió en norma nacional en 1971 y en norma internacional, la ISO 2709, en 1973. Desde 1971 la cooperativa OCLC, fundada en Ohio, ofrecía catalogación compartida en línea con registros MARC: cuando una biblioteca catalogaba un libro, las demás podían descargarlo. Hoy su base de datos, WorldCat, reúne cientos de millones de registros. Cada país desarrolló durante años su propia variante, como la española IBERMARC o la británica UKMARC, hasta que en 1999 la estadounidense y la canadiense se fusionaron en MARC 21, que ha acabado imponiéndose en casi todas partes, también en las bibliotecas españolas.

Un registro MARC se compone de una cabecera de longitud fija, que describe el tipo de registro, y de una serie de campos. Cada campo se identifica con una etiqueta de tres cifras que dice qué contiene. Las etiquetas se agrupan por centenas con cierta lógica: las 0XX son números y códigos, las 1XX el autor principal, las 2XX el título y la edición, las 3XX la descripción física, las 5XX las notas, las 6XX las materias y las 7XX los autores secundarios. Detrás de la etiqueta vienen dos indicadores, dos posiciones que matizan cómo tratar el campo, y luego el contenido dividido en subcampos, cada uno precedido por un código de una letra.

Así se vería, simplificado, el registro de la primera edición del Quijote:

100 1# $a Cervantes Saavedra, Miguel de, $d 1547-1616.
245 13 $a El ingenioso hidalgo don Qvixote de la Mancha / $c compuesto por Miguel de Ceruantes Saauedra.
264 #1 $a En Madrid : $b Por Iuan de la Cuesta, $c 1605.
650 #4 $a Novela española $y Siglo XVII.

La etiqueta 100 indica el autor principal; su primer indicador, 1, dice que el nombre empieza por el apellido, y el subcampo $d guarda las fechas de vida. En el 245, el título, el segundo indicador vale 3: le dice al ordenador que se salte los tres primeros caracteres, «El » con su espacio, al ordenar alfabéticamente, de modo que el libro aparezca en la I de Ingenioso y no en la E. El 264 recoge el lugar, el editor y la fecha, y el 650, una materia. Una almohadilla significa que ese indicador no se usa. Los datos se copian como aparecen en la portada, con la ortografía de 1605, y la normalización queda para los puntos de acceso.

Anatomía de un campo MARC

MARC funcionó tan bien que se volvió difícil de cambiar. Se diseñó para cintas magnéticas y para producir fichas, y eso se nota: los campos mezclan datos con signos de puntuación de la ficha impresa, como la barra antes del autor o los dos puntos antes del editor, y muchos datos importantes se guardan como texto libre que una máquina no puede interpretar. En 2002, el bibliotecario Roy Tennant publicó un artículo con un título que se hizo famoso, «MARC debe morir», en el que defendía sustituirlo por formatos basados en XML y compatibles con el resto de la web.

La Biblioteca del Congreso anunció en 2011 una iniciativa para reemplazarlo, que desembocó en BIBFRAME, un modelo basado en datos enlazados: en lugar de registros cerrados, afirmaciones sobre obras, personas y ediciones que se conectan entre sí y con otras fuentes de la web, como Wikidata. La transición avanza despacio, porque hay miles de millones de registros MARC en los catálogos del mundo y casi todos los programas de gestión bibliotecaria dependen de él. Mientras tanto, cada búsqueda en el catálogo de una biblioteca sigue leyendo, por debajo, las etiquetas que Avram diseñó hace más de medio siglo.

Registro bibliográfico – Catálogo de biblioteca – Catálogo colectivo – Metadatos – Encabezamiento del registro bibliográfico – El ISBN

§

Fuentes

  1. Henriette D. AvramMARC: Its History and ImplicationsLibrary of Congress, Washington1975
  2. Henriette D. AvramThe MARC Pilot Project: Final ReportLibrary of Congress, Washington1968
  3. Biblioteca del Congreso de EE. UU.Understanding MARC Bibliographic: Machine-Readable CatalogingLibrary of Congress, Washington2003enlace
  4. Roy TennantMARC Must DieLibrary Journal 127 (17)2002
  5. Biblioteca del Congreso de EE. UU.Bibliographic Framework as a Web of Data: Linked Data Model and Supporting ServicesLibrary of Congress, Washington2012
  6. Organización Internacional de NormalizaciónISO 2709:2008. Information and documentation. Format for information exchangeISO, Ginebra2008
Sarasola, Josemari (2025). "El formato MARC". Ikusmira. Recuperado de https://ikusmira.org/p/el-formato-marc/

Una errata, un dato desfasado, un párrafo que falta: edítalo y la redacción revisa tu propuesta.

Sugerir una mejora →
Ciencias de la documentación El formato MARC