Hoe je tekst kopieert uit een PDF - 6 manieren, zelfs als het niet mag

Om tekst uit een PDF te kopiëren, open je het bestand in een browser of PDF-lezer, sleep je jouw cursor over de gewenste tekst en druk je op Ctrl+C op Windows of Cmd+C op een Mac. Bij een normale PDF is dat het hele artikel.

Dan is er nog het andere soort. De scan waarbij je cursor een blauw vak over de pagina sleept en niets anders pakt dan lucht. Het bestand waarvan de auteur het kopiëren heeft uitgeschakeld, waardoor Ctrl+C jou een beleefde weigering geeft. Zes methodes hieronder, plus het punt waarop kopiëren überhaupt niet meer de juiste tool is.

Hoe je tekst kopieert en plakt uit een PDF

Zes methodes, grofweg in de volgorde waarin je ze zou gebruiken. Normale PDF, begin bij methode 1. Scan, ga naar methode 3. Bestand dat kopiëren blokkeert, methode 6.

Methode 1: Adobe Acrobat Reader

Adobe Reader is Adobe's desktop-app voor het lezen en markeren van PDF's, en het gaat goed om met eenvoudig kopiëren.

  1. Gebruik je muis om te klikken en te slepen over de tekst die je wilt kopiëren.
  2. Klik met de rechtermuisknop en selecteer "Kopiëren" of gebruik CTRL + C (Windows) of Command + C (Mac).
  3. Klik met de rechtermuisknop en kies "Plakken", of druk op Ctrl+V (Windows) of Cmd+V (Mac) om de tekst te plakken.

Tekst selecteren en kopiëren in Adobe Reader via rechtermuisknop
Klik met de rechtermuisknop en selecteer kopiëren

Sla de installatie over als je daar geen zin in hebt. Sleep de PDF in een tabblad van Chrome, Edge of Safari en selecteer daar de tekst met dezelfde sneltoetsen.

Ideaal om een of twee alinea's mee te pakken. Complexe lay-outs bereiken het klembord met een door elkaar gegooide opmaak, en gescande PDF's leveren helemaal niets op.

Methode 2: Microsoft Word

Word kopieert niet de tekst, het bouwt het document opnieuw op. Daarom behoudt het de opmaak die door plakken vanaf een klembord verloren zou gaan. Dit is de methode die je kiest als je tekst uit een PDF naar Word wilt kopiëren.

  1. Open Word, klik op "Bestand" en vervolgens op "Openen", en kies jouw PDF.
  2. Klik op "Openen." Word waarschuwt dat het op het punt staat het bestand te converteren. Laat dit gebeuren.
  3. Kopieer de tekst die je nodig hebt uit het geconverteerde document.

Microsoft Word dat een PDF bestand converteert
Wacht tot Word de PDF converteert

Simpele documenten komen erdoorheen met het grootste deel van hun opmaak intact.

Een geconverteerde PDF geopend als een bewerkbaar document in Microsoft Word
PDF-document in MS Word

Pagina's met meerdere kolommen en zwaar opgemaakte rapporten zijn de plekken waar de conversie creatief wordt. Controleer deze voordat je erop vertrouwt.

Methode 3: Google Docs

Google Docs voert OCR uit tijdens de import, wat het de kortste route maakt naar de tekst in een gescande PDF. Upload het bestand eerst naar Google Drive.

Een PDF bestand geüpload naar Google Drive
Upload de PDF naar Google Drive

  1. Klik met de rechtermuisknop op het document, kies "Openen met" en selecteer vervolgens "Google Docs".
  2. Selecteer de tekst die je nodig hebt en plak deze waar je hem nodig hebt.

Een PDF openen met Google Docs vanuit het Google Drive menu
Openen met Google docs

Docs leest de pagina en geeft een bewerkbaar document terug. De woorden komen over. Het ontwerp niet, zoals de onderstaande screenshot pijnlijk duidelijk maakt.

Een PDF geconverteerd naar een bewerkbaar Google Docs document
Selecteer de tekst die je nodig hebt

Methode 4: Online PDF naar tekst converters

Converters veranderen een heel document in één stap in platte tekst, precies wat je wilt wanneer de lay-out er niet toe doet. PDF to Text en PDF2Go klaren beide de klus. Met PDF2Go:

  1. Upload het bestand door middel van slepen en neerzetten, of vanuit Google Drive of Dropbox.

Een PDF die wordt geüpload naar de PDF2Go converter
PDF uploaden naar PDF2go

  1. Kies jouw instellingen, klik op "Start" en wacht op de conversie.
  2. Download het tekstbestand en kopieer en plak wat je nodig hebt.

Twee dingen om te overwegen voordat je iets uploadt. Deze tools maken gebruik van traditionele OCR (optische tekenherkenning), dat tekens leest zonder te begrijpen wat ze betekenen, waardoor je eerder tekst krijgt dan bruikbare data. En je geeft jouw document over aan de server van een onbekende, wat wel even het nadenken waard is wanneer het bestand een salaris, een diagnose of een contract bevat.

Methode 5: Python-bibliotheken

Als je goed overweg kunt met code, zullen pypdf of de Adobe PDF Services API dit programmatisch voor je oplossen. pypdf is een open-source Python-bibliotheek voor het lezen, splitsen, samenvoegen en transformeren van PDF-pagina's, en het is de onderhouden opvolger van PyPDF2. Adobe's API dekt soortgelijke gebieden maar dan als een betaalde dienst.

Eén addertje onder het gras. pypdf leest de tekstlaag, dus een scan komt terug als een lege string en een kleine vertrouwenscrisis. Koppel het aan een OCR-stap voor deze bestanden.

Methode 6: Schermtekst vastleggen

Elk groot besturingssysteem kan nu direct tekst van het scherm halen, wat de ultieme reddingsboei is wanneer een PDF weigert mee te werken.

Op Windows 11 open je het Knipprogramma (Snipping Tool), leg je het gewenste deel van de pagina vast en gebruik je Tekstacties om de woorden eruit te halen. Op een Mac doet Livetekst hetzelfde vanuit een screenshot in Voorvertoning. Op iPhone en Android houd je de tekst in een screenshot lang ingedrukt.

Dit werkt op scans en op bestanden waarbij selecteren is geblokkeerd, wat meer is dan de meeste methodes voor elkaar krijgen. Het is wel beperkt tot wat er op één scherm past. Een noodoplossing, geen workflow.

Waarom kan ik geen tekst kopiëren uit deze PDF?

Als je helemaal geen tekst kunt selecteren in een PDF, zijn er slechts twee waarschijnlijke oorzaken. Het verschil ontdekken duurt hooguit een seconde.

Jouw cursor trekt een vak over de hele pagina. De PDF is een scan of een afbeelding. Er is geen tekstlaag, alleen een afbeelding van tekst, dus geen enkele hoeveelheid klikken zal op een woord landen. Je hebt OCR nodig, wat het verandert in een doorzoekbare PDF. Google Docs (Methode 3 hierboven) is de snelste manier om dit eenmalig te doen.

Jouw cursor markeert woorden, maar Ctrl+C doet niets. Kopiëren is uitgeschakeld in de rechten van het bestand. In Acrobat Reader klik je met de rechtermuisknop op de pagina, kies je Documenteigenschappen en controleer je het tabblad Beveiliging om te zien wat de auteur exact heeft toegestaan. Als kopiëren is uitgeschakeld, is de juiste stap om de afzender te vragen om een onbeperkte versie of het wachtwoord. Als het document van jou is, verwijder je de beperking via datzelfde paneel.

Waar kopiëren en plakken tekortschiet

Alle zes methodes delen hetzelfde plafond, en je bereikt het sneller dan je verwacht.

  • Opmaak overleeft het klembord zelden. Lettertypen, groottes en kolommen komen hooguit als suggesties over.
  • Tabellen worden een warboel, omdat een klembord geen benul heeft van rijen en kolommen.
  • Traditionele OCR is accuraat, totdat de scan scheef, vaag of vol is.
  • Online converters sturen jouw document heen en weer via de server van iemand anders.
  • Kopieer één cijfer verkeerd in het totaal van een factuur en je bent slechter af dan helemaal geen data.
  • En wat je ook hebt gekopieerd, moet alsnog worden getypt of geïmporteerd in het systeem dat het daadwerkelijk nodig had.

Dat maakt allemaal niets uit voor één document. Het maakt enorm veel uit voor het vijftigste document deze maand.

Wat AI leest dat een klembord niet kan

AI-gestuurde teksterextractie leest een document zoals een mens dat doet, en beredeneert wat de lay-out betekent in plaats van alleen maar te kijken waar de inkt zit. Dat is het verschil tussen het herstellen van tekst en het verkrijgen van data die je daadwerkelijk kunt gebruiken.

Traditionele OCR geeft je een pagina met tekens en laat jou zoeken naar het factuurnummer. Een AI-engine retourneert direct het factuurnummer.

Waarom een AI-parser dit beter aanpakt

Parseur kan specifieke tekst uit PDF-documenten halen, ongeacht wat de lay-out is.

Maak een gratis account aan
Bespaar tijd en moeite met Parseur. Automatiseer je documenten.
  • Elke leverancier maakt zijn papierwerk anders op. Jij geeft één keer de velden op en niemand bouwt een template per afzender.
  • Tabellen blijven tabellen. Parseur kan tabellen uit PDF's extraheren als rijen en kolommen in plaats van losse tekst.
  • Scans worden bij binnenkomst gelezen, door Zonale OCR wanneer de lay-out hetzelfde blijft en Dynamische OCR wanneer dat niet zo is.
  • Jouw documenten blijven van jou. Parseur is GDPR-compliant, en de SOC 2 Type II certificering is in behandeling.

Parseur levert het resultaat vervolgens af in de tools die je al gebruikt, zodat niemand het nog een keer hoeft te kopiëren en plakken. Dat is PDF-parsing in plaats van kopiëren, en het is een compleet ander proces.

Hoe je tekst kopieert uit een gescande PDF met Parseur

Het instellen duurt een paar minuten en er is geen creditcard voor nodig.

  1. Maak een mailbox aan en kies de AI-engine. De Vision AI-engine leest PDF's, scans en afbeeldingen. De Text AI-engine leest e-mails en tekstdocumenten.

Een Parseur mailbox aanmaken voor inkomende documenten
Maak een full text content mailbox aan

  1. Geef de velden op die je wilt extraheren. De AI vindt ze in alle lay-outs, zonder dat je een template hoeft te bouwen.

De te extraheren velden opgeven in Parseur
Selecteer de metadata-velden

  1. Stuur de gescande PDF in via e-mail, upload of API.
  2. Bekijk wat er terugkomt.

Tekst geëxtraheerd uit een gescande PDF in Parseur
Tekst extract uit gescande PDF

Werk je met één type document? Start dan vanuit de bijbehorende mailbox en de velden komen al benoemd terug. Facturen beginnen met de "Facturen" mailbox.

Een factuur mailbox aanmaken in Parseur
Maak een AI factuur-mailbox aan

Waar de data vervolgens naartoe gaat

  1. Download de tekst in CSV of JSON.
  2. Stuur de data naar een Google Spreadsheet.
  3. Exporteer het naar elke applicatie met Zapier, Make of Power Automate.

Het kopiëren van tekst uit één PDF duurt twee seconden. Het kopiëren uit de volgende vijfhonderd is een taak die niemand zou moeten krijgen. Probeer Parseur eens op de stapel documenten die je al die tijd hebt vermeden.

Een review van een Parseur klant
Review door een blije klant

Laatst bijgewerkt op

Aan de slag

Klaar om je data-extractie
uit documenten te automatiseren?

Start gratis in een paar minuten en ontdek hoe Parseur in jouw workflow past.

Geen modeltraining nodig
Automatiseert data-invoer uit elk document
Schaalbaar van point-and-click tot API

Veelgestelde Vragen

De vragen die mensen daadwerkelijk stellen wanneer een PDF weigert mee te werken.

Open de PDF in een browser of een PDF-lezer, sleep je cursor over de tekst die je wilt kopiëren en druk vervolgens op Ctrl+C in Windows of Cmd+C op een Mac. Plak het met Ctrl+V of Cmd+V. Als je de tekst wilt zonder de originele lettertypen en spatiëring, plak dan met Ctrl+Shift+V, of plak het eerst in een teksteditor (zoals Kladblok) en kopieer het van daaruit opnieuw.

Een gescande PDF heeft geen selecteerbare tekst, dus deze moet worden gelezen door OCR voordat je iets kunt kopiëren. Het bestand uploaden naar Google Drive en openen met Google Docs voert OCR automatisch uit en is de kortste route voor een enkel document. Voor regelmatige of grote hoeveelheden leest een AI-parser de scan en geeft deze gestructureerde velden terug in plaats van een muur aan herstelde tekst.

Ga niet kopiëren en plakken. Open de PDF direct in Microsoft Word via Bestand en dan Openen, en laat Word het converteren. Word bouwt koppen, lijsten en de meeste tabellen opnieuw op, iets wat plakken via het klembord niet kan. De conversie is niet perfect bij lay-outs met meerdere kolommen of zwaar ontworpen pagina's, dus controleer alles met kolommen voordat je het vertrouwt.

Stop met kopiëren en laat de documenten voor jou lezen. Handmatig kopiëren en plakken heeft ergens rond het tiende bestand geen zin meer, en het is nooit haalbaar als een terugkerend proces. Laat de PDF's in plaats daarvan binnenkomen via e-mail, upload of API en automatisch uitlezen, waarbij de velden die je belangrijk vindt in een spreadsheet of jouw eigen systeem landen. Dat is PDF-parsing in plaats van kopiëren, en dat is waar tools zoals Parseur voor zijn gebouwd.

Er zijn twee veelvoorkomende redenen. Of de PDF is een scan of een afbeelding, waardoor er geen tekstlaag is om te selecteren, of het bestand heeft de kopieerrechten uitgeschakeld door degene die het heeft gemaakt. Je kunt het verschil in een seconde zien: als je cursor individuele woorden markeert, bestaat de tekstlaag en is het probleem de rechten. Als je cursor in plaats daarvan een vak over de hele pagina trekt, is het een afbeelding en heb je OCR nodig.

Controleer eerst of kopiëren daadwerkelijk is geblokkeerd. Klik in Acrobat Reader met de rechtermuisknop op het document, kies Documenteigenschappen en kijk op het tabblad Beveiliging om te zien welke rechten de auteur heeft toegestaan. Als het kopiëren van inhoud niet is toegestaan, is de juiste weg om degene die jou het bestand heeft gestuurd te vragen om een onbeperkte kopie of om het wachtwoord. Als het document van jou is en je het wachtwoord hebt, kun je het openen in Acrobat en de beveiliging verwijderen via datzelfde Documenteigenschappen-paneel.

Ja, op zowel iOS als Android, zolang de PDF een echte tekstlaag heeft. Open het in Bestanden, Boeken of Drive, druk lang op een woord om een selectie te starten, versleep de handgrepen en tik vervolgens op Kopiëren. Als lang indrukken niets selecteert, is de pagina een afbeelding en heb je OCR nodig. Op iOS kun je ook de camera op een geprinte pagina richten en Livetekst gebruiken om de woorden direct te kopiëren.

Parseur doet meer dan alleen tekst eruit kopiëren. De Vision AI-engine leest PDF's, scans en afbeeldingen, en de Text AI-engine leest e-mails en tekstdocumenten. Dit geeft benoemde velden terug zoals factuurnummer, datum en totaalbedrag in plaats van een blok ruwe tekst. Jij geeft de velden op die je wilt en de AI vindt ze in alle lay-outs, zonder dat je een template per afzender hoeft te bouwen. Parseur is GDPR-compliant, en de SOC 2 Type II certificering is in behandeling.