Hoe werkt social media archivering in de praktijk?
Van gekoppeld account tot doorzoekbaar archief: dit artikel legt uit hoe social media archivering in de praktijk werkt, van API-koppeling tot overbrenging naar een e-Depot.
Bij websites gebeurt het vastleggen via crawling: een harvester doorloopt de website zoals een bezoeker dat zou doen. Social media werkt anders. Platforms zijn niet vrij crawlbaar, dus verloopt archivering via officiële API-koppelingen met het platform zelf.
Van account naar archief
1. Accounts in kaart brengen en koppelen
Eerst worden de social media-kanalen van de organisatie geïnventariseerd: welke accounts in aanmerking komen voor archivering, wie eigenaar is, en welk besluit daarover is genomen. Elk account wordt vervolgens gekoppeld via een beveiligde connect-link, geen wachtwoorden delen, maar een officiële autorisatie via het platform zelf.
2. Archiveren: eenmalig of dagelijks
Zodra een account gekoppeld is, start de archivering. Net als bij websites is er een keuze tussen eenmalig archiveren (voor een account dat stopt of niet meer wijzigt) en dagelijks archiveren (voor actieve kanalen). Bij dagelijkse archivering detecteert de software automatisch nieuwe berichten en legt die vast, zonder dat daar handmatig werk voor nodig is.
3. Vastleggen in WARC
Het resultaat van elke archivering wordt, net als bij websites, opgeslagen in het ISO 28500 WARC-formaat. Zie het artikel over WARC-bestanden voor waarom dat formaat de standaard is. Social media-archieven worden zo op dezelfde open, leverancier-onafhankelijke manier bewaard als webarchieven.
Welke platforms
De gangbare platforms voor overheidscommunicatie worden ondersteund via officiële API-koppelingen: LinkedIn, Instagram, X, Facebook, YouTube, Bluesky, Mastodon en Threads. Doordat de koppeling via de officiële API loopt, is de archivering zowel technisch als juridisch correct: er wordt geen content "gescraped" buiten de spelregels van het platform om.
Reacties archiveren
Naast de berichten zelf archiveert dip ook reacties op social media-posts. Dat gebeurt nog niet voor alle platforms; welke reacties meegenomen worden, hangt af van wat een platform daarvoor zelf aanbiedt via de officiële koppeling.
Persoonsgegevens van mensen die reageren, worden gepseudonimiseerd of geanonimiseerd. Zo blijft de inhoud van een reactie, en daarmee vaak de context van een discussie, zichtbaar zonder dat er persoonsgegevens van reagerende inwoners in het archief terechtkomen.
Ontsluiting: raadplegen als tijdlijn
Een verzameling WARC-bestanden is nog geen bruikbaar archief. Ontsluiting maakt het archief raadpleegbaar via een portal: berichten van alle gekoppelde accounts staan op een tijdlijn, doorzoekbaar en filterbaar per account of periode. Elk bericht heeft een unieke, deelbare link naar de staat op dat moment, bruikbaar als bewijsmateriaal bij bijvoorbeeld een Woo-verzoek.
Overbrenging naar een e-Depot
Voor blijvende bewaring kunnen social media-archieven, net als webarchieven, worden overgebracht naar een e-Depot. Omdat WARC een open standaard is, verloopt die overdracht zonder dat de organisatie afhankelijk blijft van één leverancier.
Bij de overbrenging wordt gebruikgemaakt van de metadatastandaard MDTO. Net als bij webarchieven wordt zo vastgelegd welke technische en organisatiespecifieke metadata bij het archief horen, zodat een ontvangende archiefinstelling de content op een gestandaardiseerde manier kan inpassen.
Het proces in het kort
- Social media-accounts worden geïnventariseerd en het besluit over archivering wordt vastgelegd.
- Het account wordt gekoppeld via een beveiligde connect-link met het platform.
- De archivering start, eenmalig of dagelijks, en legt automatisch nieuwe berichten vast.
- Elke archivering levert WARC-bestanden op, opgeslagen conform ISO 28500.
- Het archief wordt ontsloten via een portal, doorzoekbaar en met deelbare links.
- Op enig moment wordt het archief overgebracht naar een e-Depot voor blijvende bewaring.
Net als bij websitearchivering bouwt elke stap voort op de vorige: zonder een besluit over welke accounts gearchiveerd moeten worden, is er niets om te koppelen, en zonder koppeling is er niets om te archiveren of te ontsluiten.
Verwante artikelen
Webarchief in dip Insights
Overheden zijn op grond van de Archiefwet verplicht om informatie die zij publiceren bij het uitvoeren van hun taken te archiveren.
Wat is de selectielijst, en wat betekent die voor je websites?
De selectielijst is geen intern document dat je zelf verzint, maar een wettelijk instrument onder de Archiefwet. Dit artikel legt uit wat een selectielijst inhoudt, en hoe je die vertaalt naar concrete archiveringskeuzes per website.