ارسال نتیجه به:
تصویر یک صفحه – عکسی از گوشی، یک اسکرینشات، فایلی از اسکنر – متن ندارد، فقط پیکسل دارد. آن را در ورد بچسبانید و همان عکس را درون یک سند خواهید داشت: هیچ چیزش را نمیشود انتخاب، اصلاح یا کپی کرد. این برنامه بهجای آن صفحه را بازسازی میکند. کلمهها و جای آنها از تشخیص متن میآیند، ساختار صفحه – سرتیترها، ستونها، جدولها، زیرنویسها – جداگانه به دست میآید و صفحه دوباره با متن واقعی، جدول واقعی و تصویر واقعی در یک فایل ورد (.docx) نوشته میشود.
قالبهایی را میپذیرد که تصویر صفحهها معمولاً با آنها میآیند: JPG و JPEG، PNG، BMP، WEBP و TIFF. TIFF چندصفحهای، همانطور که اسکنرهای اسناد ذخیره میکنند، فریمبهفریم خوانده میشود. چند تصویر را با هم بارگذاری کنید تا به همان ترتیبی که اضافه کردهاید صفحههای یک سند شوند؛ قراردادی که صفحهبهصفحه از آن عکس گرفتهاید یک قرارداد برمیگردد، نه انبوهی فایل.
تصویر اندازه کاغذ ندارد، پس برگه را خودتان انتخاب میکنید. روی A4 یا Letter هر تصویر کامل وسط صفحه گذاشته میشود و برگه بهتناسب آن عمودی یا افقی میشود؛ «مانند تصویر» تناسب خود تصویر را نگه میدارد. عکسها بر اساس جهتی که دوربین ثبت کرده صاف میشوند، پس صفحهای که کج یا به پهلو گرفته شده، به پهلو برنمیگردد.
چون ساختار پیش از جایگذاری متن پیدا میشود، جدول تصویر با ستونهای خودش جدول برمیگردد، نه دیواری از خطهای پراکنده، و فرم با برچسبها و مقدارهایش جفتجفت برمیگردد. زبان از روی خود صفحه تشخیص داده میشود. کلمههایی که تشخیص متن دربارهشان مطمئن نیست دوباره از روی تصویر خوانده میشوند، نه حدس زده، و عددها و شناسهها هرگز بازنویسی نمیشوند. وقتی فایل آماده شد، یک خط میگوید چند صفحه بازسازی شد، چند کلمه اصلاح شد و چند کلمه محل تردید ماند.
محدودیتهایی هم هست که بهتر است بدانید. متن با یک فونت استاندارد دوباره نوشته میشود، پس صفحه حرفبهحرف با تصویر یکی نیست: چیدمان حفظ میشود، تایپوگرافی نه. تشخیص متن برای دستخط ساخته نشده است. تصویر تار، تاریک یا کموضوح، یا صفحهای که با زاویه تند عکاسی شده، در هر مرحله از دقت کم میکند. پیش از تکیه بر نتیجه آن را بخوانید و نسخه اصلی را نگه دارید.
چیزی برای نصب نیست: کار روی سرورهای ما انجام میشود، بدون ثبتنام و بدون CAPTCHA. تا ۱۰ فایل در هر بار، هر کدام تا ۱۰ مگابایت. فایلهای بارگذاریشده و لینکهای دانلود پس از ۲۴ ساعت حذف میشوند.
تشخیص متن (OCR) کلمههای تصویر و جای آنها را میخواند، ساختار صفحه جداگانه به دست میآید و صفحه دوباره با متن، جدول و تصویر واقعی در یک فایل .docx نوشته میشود.
فایلها پس از ۲۴ ساعت از سرورهای ما حذف میشوند و پس از آن لینکهای دانلود کار نمیکنند.
تصویرها را به ناحیه سفید بکشید یا روی آن کلیک کنید و انتخابشان کنید، اندازه صفحه را انتخاب کنید و «تبدیل» را بزنید. وقتی صفحهها بازسازی شدند، فایل .docx را دانلود کنید. تا ۱۰ فایل در هر بار، هر کدام تا ۱۰ مگابایت.
JPG و JPEG، PNG، BMP، WEBP و TIFF. TIFF چندصفحهای – همان که اسکنرهای اسناد ذخیره میکنند – فریمبهفریم خوانده میشود و هر فریم یک صفحه از سند میشود.
نه، یکی. تصویرها به همان ترتیبی که بارگذاری کردهاید صفحههای یک سند میشوند؛ پس قراردادی که صفحهبهصفحه از آن عکس گرفتهاید، یک قرارداد برمیگردد.
چیدمان حفظ میشود – سرتیترها، ستونها، جدولها و تصویرها سر جایشان میمانند – اما متن با یک فونت استاندارد دوباره نوشته میشود، پس حرفبهحرف با تصویر یکی نخواهد بود. آنچه برمیگردد خود سند است، نه کپی عکس.
فایلها پس از ۲۴ ساعت از سرورهای ما حذف میشوند و لینکهای دانلود از کار میافتند. هیچکس دیگری به آنها دسترسی ندارد.
بله. همه کارها روی سرورهای ما انجام میشود، پس هر مرورگر امروزی کافی است – Chrome، Firefox، Safari یا Opera، روی Android، iOS، Windows، macOS یا Linux.
OCR برای نوشتهٔ چاپی ساخته شده است. یادداشتهای دستنویس و امضاها ممکن است بهصورت کلمههای درهم برگردند، پس پیش از اتکا به سند آنها را بررسی کنید.