Stuur resultaat naar:
Een afbeelding van een pagina – een foto van de telefoon, een screenshot, een bestand van een scanner – bevat geen tekst, alleen pixels. Plak ze in Word en u hebt dezelfde afbeelding in een document: niets erin kan worden geselecteerd, verbeterd of gekopieerd. Deze app bouwt de pagina in plaats daarvan opnieuw op. De woorden en hun posities komen uit de herkenning, de structuur van de pagina – koppen, kolommen, tabellen, bijschriften – wordt apart bepaald, en de pagina wordt opnieuw geschreven als echte tekst, echte tabellen en echte afbeeldingen in een Word-bestand (.docx).
De app neemt de formaten aan waarin afbeeldingen van pagina’s meestal binnenkomen: JPG en JPEG, PNG, BMP, WEBP en TIFF. Een TIFF met meerdere pagina’s, zoals documentscanners die opslaan, wordt frame voor frame gelezen. Upload meerdere afbeeldingen tegelijk en ze worden de pagina’s van één document, in de volgorde waarin u ze toevoegde: een contract dat pagina voor pagina is gefotografeerd, komt terug als één contract, niet als een stapel bestanden.
Een afbeelding heeft geen eigen papierformaat, dus u kiest het vel. Op A4 of Letter wordt elke afbeelding in zijn geheel midden op de pagina gelegd, met het vel staand of liggend naar de afbeelding; ‘Zoals in de afbeelding’ behoudt de verhoudingen van de afbeelding zelf. Foto’s worden rechtgezet volgens de stand die de camera heeft vastgelegd, zodat een zijwaarts gefotografeerde pagina niet zijwaarts terugkomt.
Omdat de structuur wordt gevonden voordat de tekst wordt geplaatst, komt een tabel in de afbeelding terug als tabel met eigen kolommen, niet als een muur van losse regels, en een formulier als paren van labels en waarden. De taal wordt uit de pagina zelf bepaald. Woorden waarover de herkenning twijfelt, worden opnieuw uit de afbeelding gelezen in plaats van geraden, en getallen en kenmerken worden nooit herschreven. Is het bestand klaar, dan vertelt één regel hoeveel pagina’s zijn herbouwd, hoeveel woorden zijn verbeterd en hoeveel twijfelachtig zijn gebleven.
Er zijn grenzen die u moet kennen. De tekst wordt in één standaardlettertype opnieuw geschreven, dus de pagina komt niet letter voor letter overeen met de afbeelding: de opmaak blijft, de typografie niet. Handschrift is niet waarvoor de herkenning is gemaakt. Een wazige, donkere of laag opgeloste afbeelding, of een pagina die onder een scherpe hoek is gefotografeerd, kost bij elke stap nauwkeurigheid. Lees het resultaat voordat u erop vertrouwt, en bewaar het origineel.
Niets te installeren: het werk gebeurt op onze servers, zonder registratie en zonder CAPTCHA. Tot 10 bestanden tegelijk, elk 10 MB. Geüploade bestanden en downloadlinks worden na 24 uur verwijderd.
De tekstherkenning (OCR) leest de woorden in de afbeelding en hun plaats, de paginastructuur wordt apart bepaald, en de pagina wordt opnieuw geschreven als echte tekst, tabellen en afbeeldingen in een .docx.
Bestanden worden na 24 uur van onze servers verwijderd; daarna werken de downloadlinks niet meer.
Sleep de afbeeldingen naar het witte vlak, of klik erin om ze te kiezen, kies het paginaformaat en druk op OMZETTEN. Zijn de pagina’s herbouwd, download dan de .docx. Tot 10 bestanden tegelijk, elk 10 MB.
JPG en JPEG, PNG, BMP, WEBP en TIFF. Een TIFF met meerdere pagina’s, zoals documentscanners die opslaan, wordt frame voor frame gelezen, en elk frame wordt een pagina van het document.
Nee, één. De afbeeldingen worden de pagina’s van één document, in de volgorde waarin u ze uploadde, dus een contract dat pagina voor pagina is gefotografeerd, komt terug als één contract.
De opmaak blijft behouden – koppen, kolommen, tabellen en afbeeldingen blijven waar ze stonden – maar de tekst wordt in één standaardlettertype opnieuw geschreven en komt dus niet letter voor letter overeen met de afbeelding. U krijgt het document, geen kopie van de afbeelding.
Bestanden worden na 24 uur van onze servers verwijderd en de downloadlinks werken daarna niet meer. Niemand anders heeft er toegang toe.
Ja. Alles draait op onze servers, dus elke moderne browser volstaat – Chrome, Firefox, Safari of Opera, op Android, iOS, Windows, macOS of Linux.
OCR is gemaakt voor gedrukte tekst. Handgeschreven notities en handtekeningen kunnen als verhaspelde woorden terugkomen; controleer ze voordat u op het document vertrouwt.