Skip to main content
Tilbage

Næsten 1,2 milliarder ord fra Folketingets arkiv er nu tilgængelige

19. august 2026


Rigsarkivet og Folketinget har i samarbejde med Digitaliseringsstyrelsen netop frigivet næsten 1,2 milliarder ord fra Folketingets arkiv.

Datasættet består af lovtekster, referater fra Folketingstidende og § 20-spørgsmål og indeholder materiale fra perioden 1849–2026.

Frigivelsen er et resultat af et samarbejde mellem Digitaliseringsstyrelsen, Rigsarkivet og Det Kgl. Bibliotek om at gøre flere danske tekstdata tilgængelige. Samarbejdet blev igangsat i 2024 med henblik på at understøtte udviklingen dansksproget kunstig intelligens. Det nye datasæt er den største samling af tekstdata, der hidtil er blevet udgivet som en del af indsatsen.

Adgang til gode og omfattende tekstdata er afgørende for kvaliteten af fremtidens AI-løsninger. Derfor arbejder Digitaliseringsstyrelsen, Rigsarkivet og Det Kgl. Bibliotek løbende på at afklare juridiske spørgsmål om blandt andet ophavsret og persondata. Formålet er at skabe grundlag for, at endnu flere danske tekstdata kan gøres tilgængelige.

I forbindelse med udgivelsen er dokumenter, der indeholder følsomme personoplysninger, blevet frasorteret. Derudover er direkte personidentifikatorer blevet pseudonymiseret.

Du kan tilgå datasættet via sprogteknologi.dk her