Stuur resultaat naar:
Een scan is een foto van een pagina. De meeste hulpmiddelen laten dat zo: ze herkennen de woorden en verbergen die in een onzichtbare laag onder de afbeelding, zodat het bestand wel doorzoekbaar is maar niet te wijzigen. Deze app bouwt het document juist opnieuw op. De woorden en hun posities komen uit de tekstherkenning, de structuur van de pagina — koppen, kolommen, tabellen, bijschriften — wordt apart bepaald, en de pagina wordt opnieuw geschreven als echte tekst, echte tabellen en echte afbeeldingen in een Word-bestand (.docx).
Doordat de structuur wordt gevonden voordat de tekst wordt geplaatst, komt een tabel uit de scan terug als tabel met eigen kolommen en niet als een muur van losse regels. Een formulier komt terug met zijn labels en waarden paarsgewijs uitgelijnd, zoals ze gedrukt stonden. Koppen blijven koppen en elke pagina van de scan blijft een pagina van het document.
De taal van het document wordt uit de pagina’s zelf afgeleid, dus een Duitse of Italiaanse scan vraagt geen handmatige instelling. Woorden waarover de herkenning twijfelt, worden opnieuw uit de scan gelezen in plaats van geraden, en getallen en kenmerken worden nooit herschreven. Is het bestand klaar, dan vertelt één regel hoeveel pagina’s zijn herbouwd, hoeveel woorden zijn gecorrigeerd en hoeveel onzeker zijn gebleven.
U krijgt een .docx dat opent in Word, Google Docs of Pages en dat u bewerkt als elk ander document. Afbeeldingen uit de scan gaan mee met alt-tekst en koppen zijn als koppen gemarkeerd, zodat een schermlezer het document kan volgen — wat een scan met onzichtbare tekstlaag nooit toestaat.
Er zijn grenzen die het waard zijn te kennen. De tekst wordt in één standaardlettertype herschreven, dus de herbouwde pagina komt niet letter voor letter overeen met de scan: de opmaak blijft, de typografie niet. Handschrift is niet waarvoor de herkenning is gemaakt, en handgeschreven notities kunnen als verhaspelde woorden terugkomen. Een vage, scheve of laagopgeloste scan kost bij elke stap nauwkeurigheid. Controleer het resultaat voordat u erop vertrouwt, en bewaar het origineel.
Hoeft u niets te bewerken en moet de pagina er tot op de pixel hetzelfde uitzien, dan is «PDF doorzoekbaar maken» het juiste hulpmiddel: het houdt de afbeelding en legt er een onzichtbare tekstlaag overheen. Dit hulpmiddel ruilt het exacte uiterlijk in voor een document dat u kunt wijzigen.
Alles draait in de browser, op onze servers: zonder installatie, zonder registratie, zonder CAPTCHA. Tot 10 bestanden tegelijk, elk 10 MB. Geüploade bestanden en downloadlinks worden na 24 uur verwijderd.
De tekstherkenning (OCR) leest de woorden en hun plaats, de paginastructuur wordt apart bepaald, en het document wordt opnieuw geschreven als echte tekst, tabellen en afbeeldingen in een .docx.
Bestanden worden na 24 uur van onze servers verwijderd; daarna werken de downloadlinks niet meer.
Sleep de gescande PDF naar het witte vlak, of klik erin om het bestand te kiezen, en druk op OMZETTEN. Zijn de pagina’s herbouwd, download dan de .docx. Tot 10 bestanden tegelijk, elk 10 MB.
De opmaak blijft — koppen, kolommen, tabellen en afbeeldingen blijven op hun plaats — maar de tekst wordt in één standaardlettertype herschreven en komt dus niet letter voor letter met de scan overeen. Moet de pagina er tot op de pixel gelijk uitzien, gebruik dan «PDF doorzoekbaar maken»: dat houdt de afbeelding en voegt een onzichtbare tekstlaag toe.
OCR is gemaakt voor gedrukte tekst. Handgeschreven notities en handtekeningen kunnen als verhaspelde woorden terugkomen; controleer ze voordat u op het document vertrouwt.
Eén Word-document (.docx) per geüpload bestand, met de tekst, tabellen en afbeeldingen van de scan herbouwd als echte objecten.
Bestanden worden na 24 uur van onze servers verwijderd en de downloadlinks werken daarna niet meer. Niemand anders heeft er toegang toe.
Ja. Alles wordt op onze servers verwerkt, dus elke moderne browser volstaat — Chrome, Firefox, Safari of Opera, op elk besturingssysteem.