Dublin Core

Dublin Core ist ein Standard zur Beschreibung von Ressourcen — Dokumenten, Bildern, Datensätzen, Webseiten — mit einem kleinen, festgelegten Satz von Metadatenfeldern. Die Idee dahinter ist simpel: Wenn alle Beteiligten dieselben Felder mit derselben Bedeutung verwenden, lassen sich Bestände unterschiedlicher Herkunft durchsuchen und zusammenführen, ohne dass jede Sammlung ihr eigenes Schema erklären muss.

Für die Suchmaschinenoptimierung hat der Standard heute kaum noch praktische Bedeutung. Als Metadaten-Vokabular in Bibliotheken, Archiven, Repositorien und offenen Datenportalen ist er dagegen unverändert im Einsatz — und diese Doppelrolle ist der Grund, warum der Begriff im Online-Marketing gelegentlich auftaucht und dort für Verwirrung sorgt.

Herkunft

Der Ausgangspunkt war eine Diskussion auf der zweiten internationalen WWW-Konferenz 1994 in Chicago: Wie lassen sich Webdokumente so beschreiben, dass Suchsysteme etwas damit anfangen können? Daraus entstand im März 1995 ein Workshop im Ohio, im Ort Dublin, dem Sitz des Bibliotheksverbunds OCLC. Der Name des Standards bezieht sich auf diesen Ort und nicht auf die irische Hauptstadt.

Aus dem Workshop ging ein Kernsatz von Beschreibungsfeldern hervor, der später auf fünfzehn Elemente festgelegt und als Dublin Core Metadata Element Set standardisiert wurde — unter anderem als ISO 15836. Getragen wird die Weiterentwicklung von der Dublin Core Metadata Initiative (DCMI), die auch die erweiterten DCMI Metadata Terms pflegt.

Die fünfzehn Kernelemente

Alle Elemente sind optional, in beliebiger Reihenfolge verwendbar und dürfen mehrfach vorkommen. Sie lauten:

Title, Creator, Subject, Description, Publisher, Contributor, Date, Type, Format, Identifier, Source, Language, Relation, Coverage und Rights.

Auf Deutsch also: Titel, Urheber, Thema, Beschreibung, Herausgeber, weitere Beteiligte, Datum, Ressourcentyp, Format, eindeutige Kennung, Quelle, Sprache, Beziehung zu anderen Ressourcen, räumliche oder zeitliche Abdeckung und Rechteangaben.

Die DCMI Metadata Terms erweitern diesen Satz um präzisere Eigenschaften — etwa dcterms:created, dcterms:modified und dcterms:license statt eines pauschalen Datums- oder Rechtefelds.

Wie Dublin Core notiert wird

In HTML werden die Angaben als Meta-Elemente im <head> hinterlegt, gekennzeichnet mit dem Präfix DC. beziehungsweise DCTERMS., dazu eine Profilangabe, die auf das verwendete Vokabular verweist:

<link rel="schema.DC" href="http://purl.org/dc/elements/1.1/">
<meta name="DC.title" content="Dublin Core">
<meta name="DC.creator" content="Intent GmbH">
<meta name="DC.language" content="de">
<meta name="DC.date" content="2018-05-24">

Außerhalb von HTML wird Dublin Core meist in XML- oder RDF-Strukturen ausgedrückt — dieselbe Semantik, andere Notation. Wie solche Auszeichnungen im Quellcode einer Seite eingebettet werden und welche Rolle XML als Transportformat dabei spielt, ist in den jeweiligen Einträgen beschrieben. Die Angaben stören die Darstellung der Seite nicht; sie sind für Menschen unsichtbar und ausschließlich für auswertende Systeme gedacht.

Warum Google damit nichts anfängt

Hier liegt der Punkt, an dem ältere SEO-Ratgeber in die Irre führen. Um 2010 war die Erwartung verbreitet, Suchmaschinen würden zunehmend alle verfügbaren Metadaten auslesen, und Dublin Core sei deshalb eine Investition in die Zukunft. Diese Erwartung hat sich nicht erfüllt.

Durchgesetzt hat sich stattdessen schema.org, ein gemeinsam von Google, Microsoft, Yahoo und Yandex getragenes Vokabular, das 2011 vorgestellt wurde. Es ist deutlich umfangreicher und beschreibt konkrete Entitäten — Produkt, Rezept, Veranstaltung, Organisation, Stellenanzeige, FAQ — statt nur allgemeiner Dokumenteigenschaften. Google dokumentiert ausdrücklich, welche schema.org-Typen zu Rich Results führen, und empfiehlt als Notation JSON-LD.

Dublin-Core-Angaben taucht in dieser Dokumentation nicht auf. Sie werden weder für das Ranking ausgewertet noch für die Darstellung in den Ergebnissen. Wer möchte, dass Zusatzinformationen im Snippet erscheinen, kommt an schema.org nicht vorbei.

Das entwertet den Standard nicht — es verschiebt nur seinen Einsatzbereich. Was Suchmaschinen von einer Seite an Metadaten tatsächlich verwerten, ist im Eintrag zu Metadaten zusammengefasst, und wie Titel und Beschreibung in der Ergebnisliste wirken, behandelt der Beitrag zur Meta-Description.

Wo der Standard heute eingesetzt wird

Sein eigentliches Terrain hat Dublin Core nie verlassen: den Bereich, für den er entwickelt wurde.

Bibliothekskataloge und wissenschaftliche Repositorien beschreiben ihre Bestände damit. Beim Protokoll OAI-PMH, über das Repositorien ihre Metadaten zum Abruf bereitstellen, ist unqualifiziertes Dublin Core das verpflichtende Austauschformat — jedes teilnehmende System muss es liefern können. Museen, Archive und Digitalisierungsprojekte nutzen es als kleinsten gemeinsamen Nenner zwischen sonst inkompatiblen Erschließungssystemen. Und in offenen Verwaltungsdaten lebt es indirekt weiter: Der europäische Metadatenstandard DCAT-AP für Datenportale greift auf DCMI-Terms zurück.

Für eine Unternehmenswebsite heißt das in der Praxis: Dublin Core einzubauen schadet nicht, bringt aber für die Sichtbarkeit in Suchmaschinen nichts. Sinnvoll wird es dort, wo Inhalte an Fachsysteme übergeben werden — an einen Bibliotheksverbund, ein Forschungsdatenrepositorium oder ein Datenportal, das dieses Format erwartet.