Slik fjerner du metadata fra en PDF
For å fjerne metadata fra en PDF holder det ikke å slette forfatternavnet i dokumentegenskapene. Filen bærer med seg to metadatalag, ofte et usynlig tekstlag, avslåtte lag og hele lagringshistorikken. Den sikreste måten er å eksportere dokumentet på nytt med metadatafjerning og rasterisering – i SladdPDF gjør du begge deler gratis i nettleseren, uten at filen lastes opp noe sted.
Kort oppsummert
- En PDF lagrer metadata to steder: Info-ordboken (Title, Author, Creator, Producer, datoer) og en XMP-pakke i XML. Begge må tømmes.
- Metadata er ikke bare navn og datoer – skjulte lag, vedlegg, OCR-tekst under skannede sider og tidligere versjoner av dokumentet ligger i samme fil.
- FN-rapporten om Hariri-drapet (2005) ble sendt ut som Word-fil med sporede endringer intakt. Navnene som var tatt ut av teksten, sto fortsatt i revisjonshistorikken.
- ExifTool advarer selv om at slettede PDF-tagger kan gjenopprettes, fordi endringene skrives som en inkrementell oppdatering bakerst i filen.
- Rasterisering ved eksport er den eneste metoden som fjerner metadata, tekstlag, OCR-lag og skjulte objekter i én operasjon.
Hva er metadata i en PDF?
Metadata i en PDF er informasjon om dokumentet som ikke vises på siden: hvem som lagde det, med hvilket program, når det ble opprettet og sist endret, og hvilke nøkkelord eller tagger som er lagt inn. Opplysningene står ikke i teksten, men de følger med filen overalt hvor den sendes.
PDF-formatet lagrer dette to steder. Info-ordboken – det du ser som «dokumentegenskaper» i PDF-leseren – er en enkel liste med felt som Title, Author, Subject, Keywords, Creator, Producer, CreationDate og ModDate. I tillegg kan filen inneholde en XMP-pakke: en XML-strøm med en rikere og mer strukturert versjon av de samme opplysningene, pluss felt Info-ordboken ikke har plass til. De fleste verktøy skriver begge deler. Et program som bare tømmer det ene, etterlater det andre.
Creator forteller hvilket program dokumentet ble laget i, mens Producer forteller hvilket bibliotek som skrev selve PDF-filen – et Word-dokument eksportert til PDF røper dermed både Word og Microsofts PDF-motor.
Feltene fylles som regel ut automatisk. Author hentes fra brukernavnet i Office eller operativsystemet, Title fra dokumentets første overskrift eller filnavn. Ingen trenger å skrive dem inn – de er der allerede i det øyeblikket du trykker «Lagre som PDF». At dette er en reell risiko og ikke en teoretisk en, ser du på at norske universiteter har egne veiledninger for problemet: Universitetet i Agder ber studentene fjerne forfatterinformasjonen i Word før oppgaven lagres som PDF, nettopp fordi innleveringen skal være anonym.
Hva røper metadataene – og hva mer ligger skjult?
Metadata er bare det første av flere skjulte lag i en PDF. En fil som ser ren ut på skjermen, kan i tillegg inneholde et tekstlag under bildene, lag som er slått av, vedlegg, skript, kommentarer og hele historikken over lagringer. Tabellen viser hva som ligger hvor, og hva som faktisk får det bort.
| Skjult element | Hva det kan røpe | Hva som fjerner det |
|---|---|---|
| Info-ordbok (dokumentegenskaper) | Tittel, forfatter, firma, program, opprettet- og endret-dato | Metadatafjerning ved eksport |
| XMP-pakke | De samme feltene i XML-form, pluss verktøykjeder og redigeringsspor | Metadatafjerning ved eksport |
| Tekstlag under en svart boks | Selve teksten som skulle vært sladdet – kan markeres og kopieres ut | Rasterisering, eller ekte sladding som sletter tekstobjektene |
| OCR-lag i skannede dokumenter | Den maskinleste teksten som ligger usynlig under sidebildet | Rasterisering |
| Skjulte lag (optional content) | Utkastversjoner, stempler og kommentarlag som er slått av | Rasterisering eller sanering |
| Vedlegg, skript og skjemadata | Kildefiler, JavaScript, utfylte skjemafelt | Sanering i Adobe Acrobat Pro |
| Tidligere versjoner (inkrementelle oppdateringer) | Dokumentet slik det var før forrige lagring | Full omskriving av filen («Lagre som» eller ny eksport) |
I et skannet dokument ligger OCR-teksten usynlig under sidebildet. En svart boks tegnet oppå bildet skjuler ingenting for et søk: teksten under kan fortsatt markeres, kopieres og finnes med Ctrl+F.
Da metadataene felte FN-rapporten om Hariri-drapet
Det mest kjente eksempelet på at metadata lekker, er FN-rapporten om drapet på Libanons tidligere statsminister Rafik Hariri i 2005. Granskingskommisjonen ledet av den tyske aktoren Detlev Mehlis leverte rapporten som en Word-fil – med sporede endringer intakt.
I den publiserte teksten sto det «senior Lebanese and Syrian officials». Revisjonshistorikken viste hvem som hadde stått der i et tidligere utkast: blant andre Maher al-Assad, den syriske presidentens bror, og etterretningssjefen Assef Shawkat. Mehlis bekreftet senere at han selv hadde tatt navnene ut av den endelige rapporten, og begrunnet det med uskyldspresumsjonen. Redigeringssporene viste til og med når endringene ble gjort.
Poenget er at ingenting var galt med den synlige teksten. Feilen lå i et lag ingen hadde tenkt på – og den utløste en diplomatisk krise.
Samme mekanisme finnes i PDF. Når en PDF lagres med «Lagre» i stedet for «Lagre som», legges endringene bakerst i filen mens den opprinnelige versjonen blir liggende. Det kalles en inkrementell oppdatering, og den som leser filen baklengs, kan i mange tilfeller finne igjen tidligere tilstander av dokumentet.
En PDF som er lagret flere ganger med «Lagre», kan inneholde en logg over hver eneste endring siden forrige fullstendige lagring. «Lagre som» skriver filen om fra bunnen og fjerner historikken.
Hvordan ser du hvilke metadata en PDF inneholder?
Du ser metadataene i en PDF ved å åpne dokumentegenskapene i PDF-leseren – Fil → Egenskaper, eller Ctrl+D i Adobe Acrobat. Der finner du Tittel, Forfatter, Emne, Nøkkelord, Program og PDF-produsent.
Men dokumentegenskapene viser bare Info-ordboken. Vil du se hele bildet – XMP-pakken, vedlegg og revisjonsspor – trenger du et verktøy som leser filstrukturen. ExifTool er gratis, åpen kildekode og kjører på Windows, macOS og Linux. Kommandoen exiftool dokument.pdf lister alt verktøyet finner: Author, Creator, Producer, datoer og hele XMP-pakken. Legger du til -xmp:all, ser du bare XMP-feltene.
Før du sender et dokument fra deg, tar en kontroll under et minutt: åpne dokumentegenskapene, marker alt med Ctrl+A og lim inn i et tomt tekstdokument, og søk med Ctrl+F etter et ord som skal være borte. Finner du noe, er filen ikke ren. Den samme testen avslører også svarte bokser som bare ligger oppå teksten.
Slik fjerner du metadata fra en PDF i nettleseren
Slik fjerner du metadata fra en PDF gratis, uten å installere noe og uten å laste filen opp:
- Åpne PDF-en i SladdPDF. Gå til sladdeverktøyet og dra filen inn i vinduet. Alt behandles i nettleseren med JavaScript og WebAssembly – PDF-en lastes aldri opp til noen server, og verktøyet virker også uten nettforbindelse når siden først er lastet.
- Sladd det som eventuelt skal bort. Skal du bare vaske metadata, hopper du over dette steget. Skal dokumentet også renses for synlige opplysninger, tegner du bokser over dem først. Angrer du, er Ctrl+Z rett ved.
- Huk av for «Fjern metadata». Valget ligger i eksportdialogen og fjerner tittel, forfatter, spor etter programmet som lagde filen, og skjulte tagger.
- Velg Sikker modus. Da rastreres hver side til et flatt bilde før den nye PDF-en bygges. Tekstlaget, OCR-laget og skjulte objekter ødelegges permanent, sammen med metadataene. Hurtigmodus finnes også, men den tegner bare vektorbokser over innholdet og advarer selv om at underliggende tekst i noen tilfeller fortsatt kan hentes ut – bruk den aldri på sensitive opplysninger.
- Juster oppløsning og eksporter. Sett DPI etter behov: høyere gir skarpere tekst og større fil. Last ned resultatet, og kontroller dokumentegenskapene i den nye filen før du sender den videre.
Vær klar over begrensningen: gratisversjonen eksporterer i standardoppløsning, mens eksport i utskriftskvalitet (300 DPI) krever Pro-versjonen med lisensnøkkel. Sidegrense finnes ikke. Trenger du automatisk søk-og-sladd eller batch-kjøring gjennom en tykk saksmappe, er et skrivebordsverktøy som Adobe Acrobat Pro et bedre valg.
Hvorfor rasterisering fjerner mer enn en metadatavask
Rasterisering fjerner mer enn en ren metadatavask fordi den bygger siden opp på nytt: alt som ikke er synlige piksler, forsvinner. En metadatavask tømmer feltene i Info-ordboken og XMP-pakken – men den rører verken tekstlaget, OCR-laget under et skannet sidebilde eller lag som er slått av.
Rasterisering gjør hver side om til ett bilde. Det som ikke synes, finnes ikke lenger i filen. Derfor er de to operasjonene komplementære, ikke alternativer: metadatafjerningen tar dokumentegenskapene, rasteriseringen tar alt det andre. I SladdPDF gjør du begge deler i samme eksport.
Prisen er at teksten ikke lenger kan søkes i eller markeres, og at filen som regel blir større. For dokumenter som skal ut av huset – innsynskrav, anbud, rettsdokumenter, personalsaker – er det som oftest en pris verdt å betale.
Slik fjerner du metadata i Adobe Acrobat Pro
I Adobe Acrobat Pro fjerner du metadata med «Fjern skjult informasjon» eller «Saner dokument» (Remove Hidden Information / Sanitize Document). Begge ligger under sladdeverktøyene.
«Fjern skjult informasjon» skanner dokumentet og viser en liste over det den finner: metadata, kommentarer og merknader, skjulte lag, innebygd søkeindeks, vedlegg og innebygd innhold, skript, lagrede skjemadata, skjult og tildekket tekst, overlappende objekter, lenker og handlinger – og data fra tidligere lagringer. Du huker av for det du vil bli kvitt, og trykker Fjern. «Saner dokument» gjør det samme i én operasjon: den fjerner alt som ikke er synlig, uten at du velger. Forskjellen mellom dem er nettopp at saneringen ikke lar deg velge.
To ting er verdt å merke seg. Endringene trer først i kraft når du lagrer filen – og bruk «Lagre som», ikke «Lagre», slik at filen skrives om fra bunnen. Og funksjonene finnes bare i Acrobat Pro, ikke i gratisversjonen Acrobat Reader.
Hvilken metode bør du velge?
Valget avhenger av hvor mye som må bort og hvor langt dokumentet er. Denne oversikten sammenligner de vanligste måtene å fjerne metadata fra PDF på.
| Metode | Dokumentegenskaper og XMP | Tekstlag, OCR-lag og skjulte lag | Pris |
|---|---|---|---|
| SladdPDF: Sikker modus + «Fjern metadata» | Ja | Ja – sidene rastreres | Gratis uten sidegrense; Pro for 300 DPI-eksport |
| SladdPDF: Hurtigmodus + «Fjern metadata» | Ja | Nei – bare vektorbokser over innholdet | Gratis uten sidegrense |
| Adobe Acrobat Pro: «Saner dokument» | Ja | Ja – fjerner blant annet skjult og tildekket tekst og skjulte lag | Abonnement |
| ExifTool | Ja, men reversibelt uten etterbehandling | Nei | Gratis |
| Skriv ut på papir og skann på nytt | Ja – helt ny fil | Ja | Gratis, men dårligere kvalitet og krever fysisk utstyr |
ExifTool skriver PDF-endringer som en inkrementell oppdatering og gir selv advarselen «ExifTool PDF edits are reversible. Deleted tags may be recovered!». Skal slettingen være permanent, må filen skrives om etterpå – for eksempel med qpdf.
Tre fallgruver når du fjerner metadata
De vanligste feilene handler ikke om at folk glemmer metadataene, men om at metadataene bare ser ut til å være borte.
1. Du tømmer bare det ene metadatalaget
Et verktøy som nullstiller Info-ordboken, men lar XMP-pakken stå, etterlater forfatternavnet i XML-strømmen. Dokumentegenskapene viser tomme felt, og filen ser ren ut – helt til noen kjører ExifTool på den. Kontroller alltid begge lagene.
2. Du lagrer i stedet for å lagre som
Lagrer du med «Lagre», legges endringen bakerst i filen og den gamle versjonen blir liggende foran. Da er både de gamle metadataene og det gamle innholdet fortsatt til stede. Bruk «Lagre som», eller la et verktøy bygge filen på nytt.
3. Du glemmer alt som ikke er metadata
Tekstlaget under en svart boks, OCR-laget i et skannet dokument og lag som er slått av, forsvinner ikke av en metadatavask. Dette er blant de hyppigste årsakene til at sladding svikter – se de vanligste feilene ved sladding av dokumenter.
For offentlige virksomheter er dette mer enn god skikk. Datatilsynet minner om at når et offentlig organ publiserer opplysninger om enkeltpersoner på nett, må hensynet til personvern veies mot hensynene som taler for publisering. Et dokument som lekker navn gjennom metadata, er publisert enten det var meningen eller ikke.
Denne artikkelen er generell veiledning, ikke juridisk rådgivning.
Fjern metadata og sladd i én operasjon
SladdPDF kjører i nettleseren din. Filen lastes aldri opp – verken til oss eller til noen andre. Gratis uten sidegrense – ingen konto, ingen opplasting.
Sladd en PDF nåOfte stilte spørsmål
Hva er metadata i en PDF?
Metadata er informasjon om dokumentet som ikke vises på siden: tittel, forfatter, emne, nøkkelord, hvilket program filen ble laget i, og når den ble opprettet og sist endret. PDF lagrer dette i en Info-ordbok, og som regel i tillegg i en XMP-pakke i XML-format. Begge deler følger med filen når du sender den videre.
Hvordan fjerner jeg metadata fra en PDF gratis?
Åpne PDF-en i SladdPDF, huk av for «Fjern metadata» i eksportdialogen og velg Sikker modus. Da forsvinner tittel, forfatter og verktøyspor, samtidig som sidene rastreres slik at tekstlag og skjulte objekter ødelegges. Alt skjer lokalt i nettleseren, uten opplasting. Gratisversjonen har ingen sidegrense.
Fjerner en svart boks metadataene i PDF-en?
Nei. En svart boks er grafikk som legges oppå innholdet. Den rører verken dokumentegenskapene, XMP-pakken eller tekstlaget under. Metadata må fjernes som en egen operasjon, og teksten under boksen må slettes eller rastreres bort.
Kan slettede metadata gjenopprettes?
Ja, hvis verktøyet skriver endringen som en inkrementell oppdatering. Da fjernes bare pekeren til dataene, mens selve dataene blir liggende bakerst i filen. ExifTool advarer eksplisitt om at slettede PDF-tagger kan gjenopprettes. Du unngår problemet ved å la et verktøy bygge PDF-en på nytt, for eksempel ved rasterisering eller «Lagre som».
Hvordan sjekker jeg om metadataene faktisk er borte?
Åpne den nye filen og se på dokumentegenskapene, Ctrl+D i Adobe Acrobat. Kjør deretter kommandoen exiftool fil.pdf i et terminalvindu – den viser både Info-ordboken og XMP-pakken. Er feltene tomme, og du ikke finner spor av forfatter eller opprinnelig program, er filen ren.
- Adobe: Sanitize PDFs and remove hidden content in Acrobat Pro (Acrobat-brukerhåndbok)
- Wikipedia: Mehlis report – om sporede endringer i den publiserte Word-filen (2005)
- GlobalSecurity.org: Mehlis om navnene som ble tatt ut av Hariri-rapporten (2005)
- Meridian Discovery: PDF Forensic Analysis and XMP Metadata Streams
- KHKonsulting: The PDF Time Machine – om inkrementelle oppdateringer og tidligere versjoner
- ExifTool-forumet: PDF-redigeringer er reversible og slettede tagger kan gjenopprettes
- PDF Tools AG: The Hidden Layers of PDF Redaction – om OCR-lag og skjulte lag
- Advokat Jan Sandtrø: Sjekk og fjern dokumentmetadata
- Universitetet i Agder: Fjerne forfatterinformasjon
- Datatilsynet: Offentlige opplysninger på nett