Envoyer le résultat à:
L’image d’une page – une photo prise au téléphone, une capture d’écran, un fichier issu d’un scanner – ne contient pas de texte, seulement des pixels. Collez-la dans Word et vous obtenez la même image dans un document : rien ne peut y être sélectionné, corrigé ni copié. Cette application reconstruit la page. Les mots et leurs positions viennent de la reconnaissance, la structure de la page – titres, colonnes, tableaux, légendes – est déterminée séparément, et la page est réécrite en vrai texte, vrais tableaux et vraies images dans un fichier Word (.docx).
Elle accepte les formats dans lesquels arrivent d’ordinaire les images de pages : JPG et JPEG, PNG, BMP, WEBP et TIFF. Un TIFF multipage, tel que l’enregistrent les scanners de documents, est lu image par image. Envoyez plusieurs images à la fois et elles deviennent les pages d’un seul document, dans l’ordre où vous les avez ajoutées : un contrat photographié page par page revient en un seul contrat, pas en une pile de fichiers.
Une image n’a pas de format papier, c’est donc vous qui choisissez la feuille. En A4 ou en Lettre US, chaque image est posée entière au centre de la page, la feuille orientée en portrait ou en paysage selon l’image ; « Comme sur l’image » garde les proportions de l’image elle-même. Les photos sont redressées d’après l’orientation enregistrée par l’appareil, une page photographiée de côté ne revient donc pas de côté.
Comme la structure est trouvée avant que le texte soit placé, un tableau de l’image revient en tableau avec ses propres colonnes, et non en mur de lignes éparses, et un formulaire revient en libellés et valeurs appariés. La langue est déterminée à partir de la page elle-même. Les mots dont la reconnaissance n’est pas sûre sont relus depuis l’image plutôt que devinés, et les nombres et identifiants ne sont jamais réécrits. Quand le fichier est prêt, une ligne indique combien de pages ont été reconstruites, combien de mots corrigés et combien sont restés douteux.
Il y a des limites à connaître. Le texte est réécrit dans une police standard, la page ne correspondra donc pas lettre pour lettre à l’image : la mise en page est conservée, la typographie non. L’écriture manuscrite n’est pas ce pour quoi la reconnaissance est faite. Une image floue, sombre ou de faible résolution, ou une page photographiée sous un angle prononcé, coûte en précision à chaque étape. Relisez le résultat avant de vous y fier et gardez l’original.
Rien à installer : le travail est fait sur nos serveurs, sans inscription et sans CAPTCHA. Jusqu’à 10 fichiers à la fois, 10 Mo chacun. Les fichiers envoyés et les liens de téléchargement sont supprimés au bout de 24 heures.
L’OCR lit les mots de l’image et leur emplacement, la structure de la page est déterminée séparément, et la page est réécrite en vrai texte, vrais tableaux et vraies images dans un .docx.
Les fichiers sont supprimés de nos serveurs au bout de 24 heures, après quoi les liens de téléchargement cessent de fonctionner.
Glissez les images dans la zone blanche, ou cliquez dedans pour les choisir, choisissez le format de page et appuyez sur CONVERTIR. Une fois les pages reconstruites, téléchargez le .docx. Jusqu’à 10 fichiers à la fois, 10 Mo chacun.
JPG et JPEG, PNG, BMP, WEBP et TIFF. Un TIFF multipage, tel que l’enregistrent les scanners de documents, est lu image par image, et chaque image devient une page du document.
Non, un seul. Les images deviennent les pages d’un même document, dans l’ordre d’envoi : un contrat photographié page par page revient donc en un seul contrat.
La mise en page est conservée – titres, colonnes, tableaux et images restent à leur place – mais le texte est réécrit dans une police standard, il ne correspondra donc pas lettre pour lettre à l’image. Vous recevez le document, pas une copie de l’image.
Les fichiers sont supprimés de nos serveurs au bout de 24 heures et les liens de téléchargement cessent de fonctionner. Personne d’autre n’y a accès.
Oui. Tout s’exécute sur nos serveurs, n’importe quel navigateur récent suffit donc – Chrome, Firefox, Safari ou Opera, sous Android, iOS, Windows, macOS ou Linux.
L’OCR est fait pour le texte imprimé. Les notes manuscrites et les signatures peuvent revenir en mots déformés : vérifiez-les avant de vous fier au document.