שלח תוצאה אל:
תמונה של עמוד – צילום מהטלפון, צילום מסך, קובץ מסורק – אינה מכילה טקסט, רק פיקסלים. הדביקו אותה ב‑Word ותקבלו את אותה תמונה בתוך מסמך: אי אפשר לסמן בה דבר, לתקן או להעתיק. האפליקציה הזו בונה את העמוד מחדש. המילים ומיקומן מגיעים מהזיהוי, מבנה העמוד – כותרות, עמודות, טבלאות, כיתובים – נקבע בנפרד, והעמוד נכתב מחדש כטקסט אמיתי, טבלאות אמיתיות ותמונות אמיתיות בקובץ Word (.docx).
היא מקבלת את הפורמטים שבהם תמונות עמודים מגיעות בדרך כלל: JPG ו‑JPEG, PNG, BMP, WEBP ו‑TIFF. קובץ TIFF רב‑עמודי, כפי שסורקי מסמכים שומרים אותו, נקרא מסגרת אחר מסגרת. העלו כמה תמונות יחד והן יהפכו לעמודים של מסמך אחד לפי הסדר שבו הוספתם אותן: חוזה שצולם עמוד אחר עמוד חוזר כחוזה אחד, ולא כערמת קבצים.
לתמונה אין גודל נייר משלה, ולכן אתם בוחרים את הגיליון. ב‑A4 או ב‑Letter כל תמונה מונחת בשלמותה במרכז העמוד, והגיליון מסתובב לרוחב או לאורך בהתאם לה; «כמו בתמונה» שומר על הפרופורציות של התמונה עצמה. צילומים מיושרים לפי הכיוון שהמצלמה רשמה, כך שעמוד שצולם על הצד לא חוזר על הצד.
מכיוון שהמבנה נמצא לפני שהטקסט ממוקם, טבלה שבתמונה חוזרת כטבלה עם עמודות משלה ולא כגוש שורות מפוזרות, וטופס חוזר כזוגות של תוויות וערכים. השפה נקבעת מתוך העמוד עצמו. מילים שהזיהוי אינו בטוח בהן נקראות שוב מהתמונה במקום להיות מנוחשות, ומספרים ומזהים לעולם אינם נכתבים מחדש. כשהקובץ מוכן, שורה אחת מספרת כמה עמודים נבנו מחדש, כמה מילים תוקנו וכמה נשארו בספק.
יש מגבלות שכדאי להכיר. הטקסט נכתב מחדש בגופן רגיל אחד, ולכן העמוד לא יתאים לתמונה אות באות: הפריסה נשמרת, הטיפוגרפיה לא. כתב יד אינו מה שהזיהוי נבנה בשבילו. תמונה מטושטשת, כהה או ברזולוציה נמוכה, או עמוד שצולם בזווית חדה, פוגעים בדיוק בכל שלב. קראו את התוצאה לפני שאתם סומכים עליה, ושמרו את המקור.
אין מה להתקין: העבודה נעשית על השרתים שלנו, בלי הרשמה ובלי CAPTCHA. עד 10 קבצים בכל פעם, 10 MB כל אחד. קבצים שהועלו וקישורי הורדה נמחקים אחרי 24 שעות.
ה‑OCR קורא את המילים שבתמונה ואת מיקומן, מבנה העמוד נקבע בנפרד, והעמוד נכתב מחדש כטקסט, טבלאות ותמונות אמיתיים בקובץ .docx.
הקבצים נמחקים מהשרתים שלנו לאחר 24 שעות, ולאחר מכן קישורי ההורדה מפסיקים לפעול.
גררו את התמונות לאזור הלבן, או לחצו עליו כדי לבחור אותן, בחרו גודל עמוד ולחצו «המר». כשהעמודים ייבנו, הורידו את קובץ ה‑.docx. עד 10 קבצים בכל פעם, 10 MB כל אחד.
JPG ו‑JPEG, PNG, BMP, WEBP ו‑TIFF. קובץ TIFF רב‑עמודי, כמו שסורקי מסמכים שומרים, נקרא מסגרת אחר מסגרת, וכל מסגרת הופכת לעמוד במסמך.
לא, קובץ אחד. התמונות הופכות לעמודים של מסמך אחד לפי סדר ההעלאה, כך שחוזה שצולם עמוד אחר עמוד חוזר כחוזה אחד.
הפריסה נשמרת – כותרות, עמודות, טבלאות ותמונות נשארים במקומם – אבל הטקסט נכתב מחדש בגופן רגיל אחד, ולכן לא יתאים לתמונה אות באות. מה שמקבלים הוא המסמך, לא עותק של התמונה.
הקבצים נמחקים מהשרתים שלנו לאחר 24 שעות וקישורי ההורדה מפסיקים לפעול. לאף אחד אחר אין גישה אליהם.
כן. הכול רץ על השרתים שלנו, כך שכל דפדפן עדכני מתאים – Chrome, Firefox, Safari או Opera, ב‑Android, iOS, Windows, macOS או Linux.
OCR נבנה עבור טקסט מודפס. הערות בכתב יד וחתימות עלולות לחזור כמילים משובשות, לכן בדקו אותן לפני שתסתמכו על המסמך.