Gescande PDF naar Word omzetten

Maak van een scan online een bewerkbaar Word-document met OCR

Stuur resultaat naar:

Maak van een gescande PDF met OCR een bewerkbaar Word-document

Een scan is een foto van een pagina. De meeste hulpmiddelen laten dat zo: ze herkennen de woorden en verbergen die in een onzichtbare laag onder de afbeelding, zodat het bestand wel doorzoekbaar is maar niet te wijzigen. Deze app bouwt het document juist opnieuw op. De woorden en hun posities komen uit de tekstherkenning, de structuur van de pagina — koppen, kolommen, tabellen, bijschriften — wordt apart bepaald, en de pagina wordt opnieuw geschreven als echte tekst, echte tabellen en echte afbeeldingen in een Word-bestand (.docx).

Doordat de structuur wordt gevonden voordat de tekst wordt geplaatst, komt een tabel uit de scan terug als tabel met eigen kolommen en niet als een muur van losse regels. Een formulier komt terug met zijn labels en waarden paarsgewijs uitgelijnd, zoals ze gedrukt stonden. Koppen blijven koppen en elke pagina van de scan blijft een pagina van het document.

De taal van het document wordt uit de pagina’s zelf afgeleid, dus een Duitse of Italiaanse scan vraagt geen handmatige instelling. Woorden waarover de herkenning twijfelt, worden opnieuw uit de scan gelezen in plaats van geraden, en getallen en kenmerken worden nooit herschreven. Is het bestand klaar, dan vertelt één regel hoeveel pagina’s zijn herbouwd, hoeveel woorden zijn gecorrigeerd en hoeveel onzeker zijn gebleven.

U krijgt een .docx dat opent in Word, Google Docs of Pages en dat u bewerkt als elk ander document. Afbeeldingen uit de scan gaan mee met alt-tekst en koppen zijn als koppen gemarkeerd, zodat een schermlezer het document kan volgen — wat een scan met onzichtbare tekstlaag nooit toestaat.

Er zijn grenzen die het waard zijn te kennen. De tekst wordt in één standaardlettertype herschreven, dus de herbouwde pagina komt niet letter voor letter overeen met de scan: de opmaak blijft, de typografie niet. Handschrift is niet waarvoor de herkenning is gemaakt, en handgeschreven notities kunnen als verhaspelde woorden terugkomen. Een vage, scheve of laagopgeloste scan kost bij elke stap nauwkeurigheid. Controleer het resultaat voordat u erop vertrouwt, en bewaar het origineel.

Hoeft u niets te bewerken en moet de pagina er tot op de pixel hetzelfde uitzien, dan is «PDF doorzoekbaar maken» het juiste hulpmiddel: het houdt de afbeelding en legt er een onzichtbare tekstlaag overheen. Dit hulpmiddel ruilt het exacte uiterlijk in voor een document dat u kunt wijzigen.

Alles draait in de browser, op onze servers: zonder installatie, zonder registratie, zonder CAPTCHA. Tot 10 bestanden tegelijk, elk 10 MB. Geüploade bestanden en downloadlinks worden na 24 uur verwijderd.

Een gescande PDF online naar Word omzetten

De tekstherkenning (OCR) leest de woorden en hun plaats, de paginastructuur wordt apart bepaald, en het document wordt opnieuw geschreven als echte tekst, tabellen en afbeeldingen in een .docx.

  1. Upload de gescande PDF — sleep hem naar het uploadvak of klik erin om het bestand op uw computer te kiezen.
  2. Controleer of de pagina’s rechtop en leesbaar zijn: een scheve, vage of laagopgeloste scan kost in elke volgende stap nauwkeurigheid.
  3. Klik op OMZETTEN. Elke pagina wordt herkend, de structuur wordt bepaald en twijfelachtige woorden worden opnieuw uit de scan gelezen.
  4. Lees de samenvattingsregel: hoeveel pagina’s zijn herbouwd, hoeveel woorden gecorrigeerd en hoeveel onzeker gebleven.
  5. Download de .docx en bewerk die in Word, Google Docs of Pages, waarbij u de onzeker gebleven woorden nakijkt.

Bestanden worden na 24 uur van onze servers verwijderd; daarna werken de downloadlinks niet meer.

Vragen en antwoorden