Webarchivierung
Webinhalte sind heute ein wesentlicher Bestandteil unseres Alltags und der Kommunikation. Sie sind überall zu finden, haben für alle Bereiche Relevanz.
Ende des Seitenheaders.
Unter Webarchivierung verstehen Archivar*innen sowohl die Archivierung von Webseiten als auch die von Social-Media-Inhalten.
Das WWW hat sich nach seiner öffentlichen Bereitstellung sehr schnell zum wichtigsten Kommunikationsmedium entwickelt. Dabei ist die einzelne Information – etwa eine Homepage oder auch Social-Media-Inhalte – leicht veränderbar, vielgestaltig und vor allem flüchtig. Gleichzeitig werden immer größere Datenmengen ins Netz gestellt. Die zentrale Frage ist also, wie diese teils archivwürdigen Informationen dauerhaft gesichert werden könnten.
Neben rechtlichen Fragen, die sich aus dem (Kunst-)Urheberrecht ergeben können, treten für Sie als Archivar*innen weitere Herausforderungen auf. Eine Homepage kann sehr komplex aufgebaut sein und sehr heterogene Informationen oder Dateitypen umfassen. Dies erschwert die Auswahl und Archivierung. Um Datenmengen zu reduzieren, können unterschiedliche Maßnahmen ergriffen werden: Zum Beispiel kann nur ein Teil einer Webseite oder eines Social-Media-Auftritss statt der gesamten Präsenz übernommen werden. Schnitte, die in regelmäßigen festgelegten Intervallen sowie anlassbezogen vorgenommen werden, dokumentieren die Entwicklung zumindest in groben Zügen.
Technisch wird meist entweder ein sogenannter Harvester oder ein sogenannter Crawler eingesetzt, der alle ausgewählten Seiten oder Inhalte nacheinander ansteuert, um die dort vorgehaltenen Informationen abzurufen und zu speichern.
Hierzu stehen derzeit mehrere Software-Alternativen und von verschiedenen Herstellern zur Verfügung. Sogenannte Harvester ermöglichen es, punktuell einen definierten Webcontent in geeigneten Formaten zu sichern, ebenso in festgelegten Zyklen. Crawler unterstützen mit automatisierten Prozessen (Sicherungsturnus, festgelegte Seiten und Unterseiten oder Inhalte). Da sich die technischen Möglichkeiten rasant weiterentwickeln, müssen auch die technischen Lösungen ständig nachgerüstet werden.
Synergien durch vom Land gefördertes Projekt "Webarchiv.NRW"
Angeregt durch das Pflichtexemplargesetz NRW, haben sich die Landesbibliotheken in NRW seit 2017 zunehmend intensiver mit der Frage der Webarchivierung auseinandergesetzt. Mit verschiedenen Entwicklungs-, Test- und Finanzierungsphasen (seit 2024 durch das Ministerium für Kultur und Wissenschaft MKW des Landes gefördert), hat sich das Projekt inzwischen als tragfähiges erwiesen.
Im Fokus stehen neben vor allem öffentlichen Webseiten auch landeskundlich relevante Inhalte und Webseiten.
Durch die Überschneidungen mit den Interessen der staatlichen und nichtstaatlichen Archive in NRW, wird zurzeit sukzessive die Zusammenarbeit vertieft, die Archivierung bestimmter Inhalte nicht zuletzt zunehmend mit den Interessen der nichtstaatlichen Archive abgestimmt.
Archivwürdige Webinhalte, die die Landesbibliotheken nicht abgreifen (zum Beispiel Social-Media-Inhalte oder Intranetseiten), müssen gleichwohl weiterhin von den Archiven selbst dauerhaft gesichert werden.