Privat fritidsprojekt · startet juni 2026

Om Lovsamling.dk

Lovsamling.dk er en samling af juridiske skrifter fra perioden 1683 til 1900. Siden samler historiske lovtekster, forordninger, reskripter og beslægtede retskilder i søgbar fuldtekst.

Periode: 1683–1900 122 bind 72.237 bogsider 68.695 dokumenter
Indhold

Indledende omfang

Projektet indeholder indledningsvis følgende samlinger:

122 bind i alt
72.237 bogsider
68.808 dokumenter
Samling Bind Bogsider Dokumenter
Schous Forordninger 26 13.542 11.716
Fogtmans Rescripter 37 24.958 34.405
Love og Anordninger 35 24.101 11.322
Ekspeditioner og Love 23 8.622 11.252
Danske Lov 1 1.014 113
I alt 122 72.237 68.808
Afgrænsning

Udeladelser og manglende bind

Udeladelser

Dele af de originale værker er ikke transskriberet:

  • Titelblad
  • Forord
  • Indholdsfortegnelse
  • Fortegnelser over de i udgivelsesåret ophævede bestemmelser
  • Alfabetiske registre
  • Rettelser til tidligere udgivelser

Disse dele vil derimod alle være at finde under Fuld Faksimile.

Mangler

I serien Love og Anordninger mangler på nuværende tidspunkt bind IX – bind XV (1865–1870).

Metode

Metode og kendte begrænsninger

Indtil for nylig var massetransskribering af frakturskrift ikke en realistisk mulighed for hobbyfolk. Resultatet af ABBYY FineReader Fraktur OCR er lige så dårligt, som det er dyrt. Transkribus’ Metagrapho-API er en lukket fest for arkiver, biblioteker og andre med organisationsabonnement. Tesseract OCR for gotisk skrift er gratis, men kvaliteten er ringe.

Derfor kom det som en gave sendt fra himlen til private entusiaster, da Gemini 2.5 i juni 2025 pludselig gjorde massetransskribering af frakturskrift tilgængelig med forbavsende god kvalitet og særdeles overkommelig prissætning.

Teksterne her på siden er derfor transskriberet fra PDF under anvendelse af Gemini API, bortset fra den digitale tekst til Danske Lov, der er baseret på Bjørn Andersens transskription (bjoerna.dk). Teksterne er programmatisk efterbehandlet og kontrolleret for systemiske fejl. Både Gemini API og OpenAI API er anvendt ved den efterfølgende strukturering af materialet.

Selv om Gemini leverer transskriptioner af pæn kvalitet, er resultatet langt fra fejlfrit. Det skyldes ikke kun mangler i Geminis transskription, men også, at de tilgængelige PDF-filer er af meget svingende kvalitet. Nogle bogsider er overlæsset med håndskrevne tilføjelser, understregninger og i værste fald overstregninger. Andre bogsider har så svag skrift, at indholdet selv for det menneskelige øje er svært at læse. Hvor tydning har vist sig helt umulig, vil der være indsat [Uklart].

Der er nogle områder, hvor der i øjeblikket er særlig risiko for at støde på fejl:

  1. Lange og komplekse tabeller

    Lange tabeller kan være en meget stor udfordring. De længste strækker sig over mere end 120 bogsider og kan rumme skiftende layout, krøllede parenteser med forskellig betydning, indskudte noter og midlertidige tabelafbrydelser. En del tabeller er to-siders, hvor venstre del af kolonnerne står på lige bogsider og højre del på ulige. For at gengive komplekse tabelstrukturer i simpel HTML har det været nødvendigt at give AI frihed til at omstrukturere tabeller, under forudsætning af at den originale tabels faktuelle indhold og intention bevares. Der kan derfor være layoutforskelle mellem originalens tabeller og de viste.

  2. Fangord og sideskift

    Ved sideskift i originalen kan der i enkelte tilfælde fejlagtigt være medtaget fangord, også kaldet kustoder. Der kan også fejlagtigt være begyndt på nyt afsnit. Den dokumentdatering i margin, som altid optræder på ny originalsides første linje, kan i nogle tilfælde fejlagtigt være læst som del af brødteksten. Disse typer fejl vil i næsten alle tilfælde blive rettet øjeblikkeligt, hvis du gør opmærksom på dem (se øjeblikkelige rettelser).

  3. Fodnoter

    Fodnoter er en anden stor udfordring, fordi en enkelt note kan strække sig over adskillige bogsider. Vær særlig opmærksom på lange fodnoter og kontrollér med originalen.

  4. Sammensmeltede dokumenter

    Der kan forekomme tilfælde, hvor der ikke er korrekt adskillelse mellem to dokumenter, så nyt dokument fortsætter i forlængelsen af det viste dokument. Gør du opmærksom på det med "Ret Fejl", vil dokumenterne blive adskilt efter manuel kontrol

  5. Fejltolkede bogstaver og tegn

    Der kan forekomme almindelige fejltolkninger af bogstaver, hvor især æ, ø og tysk umlaut er i risikozonen. Der er også risiko for, at ſ, langt s, forveksles med f, ligesom k også er i øget risiko for at blive forvekslet med f. Der er desuden noteret problemer med at kende forskel på ₻ (mark) og ß (skilling).

  6. Malplacerede ord

    Der er risiko for, at AI ved problemer med tydning tyr til at vælge et malplaceret ord. Med en skarp prompt kan problemet minimeres ganske meget, men ikke helt udelukkes.

  7. Orddelingsstreg

    I nogle tilfælde er orddelingsstreger, der i originalen markerer orddeling ved linjeafslutning, fejlagtigt medtaget, så f.eks. "antage" står som "an-tage". Bruger du "Ret fejl" på denne fejltype, bliver den rettet øjeblikkeligt.

  8. Efterbehandling

    Endelig er der en risiko for, at der ved efterbehandlingen utilsigtet er forårsaget nye fejl. Karakteren af dem er i sagens natur ukendt, for ellers var de blevet rettet.

Den overordnede morale

Kontrollér altid med originalen, hvis nøjagtighed er påkrævet.

Bemærk om tekstombrydning

Selv om en bogstavtro gengivelse er tilstræbt, er der bevidst foretaget ombrydning af meget lange tekststykker og indsat afsnitsdeling på passende steder. Det er gjort for at forbedre læsbarheden af tekstpassager, der i originalen kan strække sig over flere sider uden afsnitsdeling og ved skærmbrug bliver næsten ulæselige. Da siden blot er en gengivelse af tekster, som i sig selv er samlinger af gengivelser af andre tekster, er det ikke fundet upassende her at lade den filologiske nidkærhed vige for bedre læsbarhed.

Kvalitetssikring

Kompenserende foranstaltninger

De 72.000 bogsiders tekst er på ingen måde korrekturlæste, og bliver det heller aldrig. Tekstomfanget er så stort, at det heller ikke har været muligt med et særligt grundigt overordnet gennemsyn. Til gengæld er der iværksat kompenserende foranstaltninger:

  1. Direkte adgang til faksimile

    Ved alle tekstdokumenter er der en ”Faksimile”-knap, der bringer dig direkte til de relevante sider i originalen, så du hele tiden let kan tjekke og kontrollere.

  2. Automatiske fejlsøgningsrutiner

    Der køres løbende automatiske fejlsøgningsrutiner med afgrænsede fokusområder. Det vil forhåbentlig med tiden fange en del resterende fejl. Efterhånden som der dukker bedre PDF-kopier op, der kan erstatte dårligere kopier, vil det også hjælpe, ligesom kommende AI-modeller måske kan gøre det hele et lille nøk bedre.

  3. AI-assisterede, øjeblikkelige rettelser

    Støder du på en stavefejl eller ordfejl, kan du markere tekststykket med fejl, hvorefter der dukker en knap frem: ”Ret fejl”. Klik og skriv evt. i bemærkninger, hvad der er galt, eller hvad der burde stå. AI vil med det samme lave en ekstra grundig analyse af originalteksten for den pågældende side, og hvis AI når frem til samme konklusion som dig, vil fejlrettelsen træde i kraft med det samme. Du bestemmer selv, om du ønsker tilbagemelding under processen (ca. 30-45 sekunder). Ved mere komplicerede rettelser end stavefejl og simple formateringsfejl er det nødvendigt manuelt at efterkontrollere AI’s rettelser, før de effektueres. 95 % af simple rettelser vil ske med det samme. Selv om dit fejlfund ikke bliver rettet øjeblikkeligt, går det ikke tabt, men ryger i puljen til senere kontrolleret rettelse.

Kontakt

Kontakt

Har du forslag til forbedringer eller udvidelser af siden, er du velkommen til at sende mig en mail:

kontakt@lovsamling.dk Per Lindsø Larsen