با OCR و مزیتهای آن آشنا شوید
شاید برای شما هم پیش آمده باشد که نوشته ای را به صورت یک عکس یا فایل پی دی اف در اختیار دارید. اما می خواهید تغییری در این نوشته انجام دهید. یا گاهی اوقات ممکن است به یک دست نوشته یا سند تایپی بر بخورید که بخواهید یک نسخه دیجیتالی از آن را در اختیار داشته باشید، اولین راهی که به ذهنتان میرسد تایپ آن، توسط اپراتور است که کار زمانبری است، اما فناوری OCR به شما این امکان را میدهد که صفحات حاوی متنی که اسکن کردهاید را از فرمت عکس به متن تبدیل کنید.OCR چیست؟
OCR مخفف عبارت Optical Character Reader است. یعنی بازشناسی و تشخیص خودکار متون موجود در تصاویر. OCR نرم افزاری است که اسناد حاوی متون را اسکن میکند و آنها را به متونی تبدیل میکند که قابل ویرایش هستند. بدیهی است، یک اسکنر برای تهیه این اطلاعات برای ویرایش کافی نیست، برای استخراج و تغییر مجدد دادهها از اسناد اسکن شده، تصاویر دوربین یا PDF تصویری، به یک نرم افزار OCR نیاز دارید که حروف را از روی تصویر جدا کرده، آنها را به کلمات و سپس کلمات را به جملات تبدیل کند، بنابراین امکان دسترسی برای ویرایش محتوای اصلی سند را به شما میدهد.
چگونه OCR کار میکند؟
اولین قدم استفاده از یک اسکنر، برای پردازش فرم فیزیکی یک سند است. پس از کپی کردن تمام صفحات، نرم افزار سند را به نسخه ای دو رنگ یا سیاه و سفید تبدیل میکند. تصویر اسکن شده یا bitmap برای مناطق کم نور و تاریک تجزیه و تحلیل میشود، جایی که مناطق تاریک به عنوان کاراکترهایی که باید شناسایی شوند و مناطق نوری به عنوان زمینه شناسایی میشوند، مورد تجزیه و تحلیل قرار میگیرند.
سپس برای یافتن حروف الفبایی یا رقم های عددی مناطق تاریک بیشتر پردازش میشوند. برنامههای OCR میتوانند در تکنیکهای خود متفاوت باشند، اما به طور معمول شامل هدف قرار دادن یک کاراکتر، کلمه یا متن در یک زمان هستند. سپس کاراکترها با استفاده از یکی از این دو الگوریتم مشخص میشوند:
تشخیص الگویی: برنامههای OCR نمونههایی از متن را در فونتها و قالبهای مختلفی ارائه میدهند که برای مقایسه و تشخیص کاراکترهای موجود در فایل اسکن شده استفاده میشوند.
تشخیص ویژگی: برنامههای OCR قوانینی را در رابطه با ویژگیهای یک حرف یا شماره خاص برای تشخیص کاراکترهای موجود در فایل اسکن شده اعمال میکنند. این ویژگیها می توانند شامل تعداد خطوط زاویه دار، خطوط متقاطع یا منحنیهای یک کاراکتر برای مقایسه باشند. به عنوان مثال، حروف “A” بزرگ ممکن است به عنوان دو خط مورب ذخیره شود که با یک خط افقی در وسط قرار دارند.
نکته: هنگامی که یک کاراکتر شناسایی میشود، به یک کد ASCII تبدیل میگردد که توسط سیستمهای رایانهای میتواند برای دستکاری بیشتر مورد استفاده قرار گیرد. کاربران باید قبل از ذخیره کردن سند برای استفادههای بعدی، خطاهای اساسی را تصحیح کنند و مطمئن شوند که چیدمان کاراکترهای پیچیده به درستی انجام شده است.
انواع OCR
فناوری OCR به دو نوع تایپی و دست نویس تقسیم میشود، درواقع یا باید یک متن که از قبل تایپ شده (مانند مجله، کتاب، روزنامه یا…) را وارد رایانه کنیم یا متون دست نویس را. متون دست نویس هم به دو دسته «گسسته» و «پیوسته» تقسیم میشوند:
متون پیوسته، متونی هستند که ما به طور روزانه آنها را مینویسیم مانند روزنوشتهها، خاطرات، نامه و...
متون گسسته، متونی هستند که در آنها حروف، جدا از هم نوشته میشوند، مانند فرمهای اطلاعاتی که نام و نام خانوادگی خود را در آنها به صورت هر حرف داخل یک کادر مینویسیم. لازم به ذکر است، OCR متون گسسته، کار بسیار راحت تری نسبت به مدل پیوسته است.
مزیت OCR چیست؟
- با OCR می توان درون فایل های پی دی اف به جست وجو پرداخت
- پردازش خودکار داده ها
- قابل جست وجوکردن کتاب های اسکن شده
- خواندن راحت تر برای کسانی که مشکل بینایی دارند
- تبدیل اسناد و روزنامه های قدیمی به متن قابل ویرایش در کامپیوتر
- استخراج و انتقال داده به برنامه های حسابداری
- ایندکس کردن اسناد برای موتور های جست وجو
- سینتی سایزر گفتار برای کسانی که توانایی صحبت کردن ندارند. مانند استفان هاوکینگ