ارسال نتیجه به:
اسکن، عکسِ یک صفحه است. بیشتر ابزارها آن را همانطور رها میکنند: کلمهها را تشخیص میدهند و در لایهای نامرئی زیر تصویر پنهان میکنند، بنابراین میتوان در فایل جستوجو کرد اما نمیتوان چیزی را تغییر داد. این برنامه بهجای آن، سند را از نو میسازد. کلمهها و جای آنها از تشخیص متن میآید، ساختار صفحه — عنوانها، ستونها، جدولها، زیرنویسها — جداگانه به دست میآید، و صفحه دوباره با متن واقعی، جدول واقعی و تصویر واقعی در یک فایل ورد (.docx) نوشته میشود.
چون ساختار پیش از چیدن متن پیدا میشود، جدولِ روی اسکن بهصورت جدول با ستونهای خودش برمیگردد، نه دیواری از سطرهای پراکنده. فرم با عنوانها و مقدارهایش، جفتبهجفت و همتراز، همانگونه که چاپ شده بود برمیگردد. عنوانها عنوان میمانند و هر صفحه از اسکن، یک صفحه از سند باقی میماند.
زبان سند از خود صفحهها تشخیص داده میشود، بنابراین اسکن آلمانی یا ایتالیایی به هیچ تنظیم دستی نیاز ندارد. کلمههایی که تشخیص متن به آنها مطمئن نیست، بهجای حدس زدن، دوباره از روی خود اسکن خوانده میشوند و عددها و شناسهها هرگز بازنویسی نمیشوند. وقتی فایل آماده شد، یک خط میگوید چند صفحه بازسازی شده، چند کلمه اصلاح شده و چند کلمه مشکوک مانده است.
آنچه میگیرید یک .docx است که در ورد، Google Docs یا Pages باز میشود و مثل هر سند دیگری ویرایش میشود. تصویرهای اسکن همراه با متن جایگزین منتقل میشوند و عنوانها بهعنوان عنوان نشانهگذاری میشوند، بنابراین صفحهخوان میتواند سند را دنبال کند — کاری که اسکن با لایهٔ متن نامرئی هرگز اجازه نمیدهد.
محدودیتهایی هست که بهتر است بدانید. متن با یک قلم استاندارد بازنویسی میشود، پس صفحهٔ بازسازیشده حرفبهحرف مثل اسکن نخواهد بود: چیدمان حفظ میشود، تایپوگرافی نه. دستنوشته چیزی نیست که تشخیص متن برای آن ساخته شده باشد و یادداشتهای دستنویس ممکن است بهصورت کلمههای درهم برگردند. اسکن کمرنگ، کج یا کموضوح در هر مرحله از دقت کم میکند. پیش از اتکا به نتیجه آن را بررسی کنید و نسخهٔ اصلی را نگه دارید.
اگر نیازی به ویرایش ندارید و میخواهید صفحه پیکسلبهپیکسل همان شکل بماند، ابزار درست «قابل سرچ کردن PDF» است: تصویر را نگه میدارد و لایهٔ متن نامرئی روی آن میگذارد. این یکی، ظاهر دقیق را با سندی که میتوان تغییرش داد عوض میکند.
همهچیز در مرورگر و روی سرورهای ما اجرا میشود: بدون نصب، بدون ثبتنام، بدون CAPTCHA. تا ۱۰ فایل در هر بار، هرکدام ۱۰ مگابایت. فایلهای بارگذاریشده و لینکهای دانلود پس از ۲۴ ساعت حذف میشوند.
تشخیص نوری متن (OCR)، کلمهها و جای آنها را میخواند، ساختار صفحه جداگانه به دست میآید و سند دوباره با متن، جدول و تصویر واقعی در یک .docx نوشته میشود.
فایلها پس از ۲۴ ساعت از سرورهای ما حذف میشوند و پس از آن لینکهای دانلود کار نمیکنند.
PDF اسکنشده را به ناحیهٔ سفید بکشید یا روی آن کلیک کنید و فایل را انتخاب کنید، سپس «تبدیل» را بزنید. وقتی صفحهها بازسازی شد، فایل .docx را دانلود کنید. تا ۱۰ فایل در هر بار، هرکدام ۱۰ مگابایت.
چیدمان حفظ میشود — عنوانها، ستونها، جدولها و تصویرها سر جای خود میمانند — اما متن با یک قلم استاندارد بازنویسی میشود، پس حرفبهحرف مثل اسکن نخواهد بود. اگر ظاهر پیکسلبهپیکسل میخواهید، از «قابل سرچ کردن PDF» استفاده کنید: تصویر را نگه میدارد و لایهٔ متن نامرئی اضافه میکند.
OCR برای نوشتهٔ چاپی ساخته شده است. یادداشتهای دستنویس و امضاها ممکن است بهصورت کلمههای درهم برگردند، پس پیش از اتکا به سند آنها را بررسی کنید.
برای هر فایلی که بارگذاری میکنید یک سند ورد (.docx) که متن، جدولها و تصویرهای اسکن در آن بهصورت شیء واقعی بازسازی شدهاند.
فایلها پس از ۲۴ ساعت از سرورهای ما حذف میشوند و لینکهای دانلود از کار میافتند. هیچکس دیگری به آنها دسترسی ندارد.
بله. همهچیز روی سرورهای ما پردازش میشود، پس هر مرورگر امروزی کافی است — Chrome، Firefox، Safari یا Opera، روی هر سیستمعاملی.