کد خبر: ۴۷۵۵
|
۰۱ مهر ۱۳۹۹ | ۰۹:۰۰

با OCR و مزیت‌های آن آشنا شوید

شاید برای شما هم پیش آمده باشد که نوشته ای را به صورت یک عکس یا فایل پی دی اف در اختیار دارید. اما می خواهید تغییری در این نوشته انجام دهید. یا گاهی اوقات ممکن است به یک دست نوشته یا سند تایپی بر بخورید که بخواهید یک نسخه دیجیتالی از آن را در اختیار داشته باشید، اولین راهی که به ذهنتان می‌رسد تایپ آن، توسط اپراتور است که کار زمانبری است، اما فناوری OCR به شما این امکان را می‌دهد که صفحات حاوی متنی که اسکن کرده‌اید را از فرمت عکس به متن تبدیل کنید.

OCR چیست؟

OCR مخفف عبارت Optical Character Reader است. یعنی بازشناسی و تشخیص خودکار متون موجود در تصاویر. OCR نرم افزاری است که اسناد حاوی متون را اسکن می‌کند و آنها را به متونی تبدیل می‌کند که قابل ویرایش هستند. بدیهی است، یک اسکنر برای تهیه این اطلاعات برای ویرایش کافی نیست، برای استخراج و تغییر مجدد داده‌ها از اسناد اسکن شده، تصاویر دوربین یا PDF تصویری، به یک نرم افزار OCR نیاز دارید که حروف را از روی تصویر جدا کرده، آنها را به کلمات و سپس کلمات را به جملات تبدیل کند، بنابراین امکان دسترسی برای ویرایش محتوای اصلی سند را به شما می‌دهد.

چگونه OCR کار می‌کند؟

اولین قدم استفاده از یک اسکنر، برای پردازش فرم فیزیکی یک سند است. پس از کپی کردن تمام صفحات، نرم افزار سند را به نسخه ای دو رنگ یا سیاه و سفید تبدیل می‌کند. تصویر اسکن شده یا bitmap برای مناطق کم نور و تاریک تجزیه و تحلیل می‌شود، جایی که مناطق تاریک به عنوان کاراکترهایی که باید شناسایی شوند و مناطق نوری به عنوان زمینه شناسایی می‌شوند، مورد تجزیه و تحلیل قرار می‌گیرند.

سپس برای یافتن حروف الفبایی یا رقم های عددی مناطق تاریک بیشتر پردازش می‌شوند. برنامه‌های OCR می‌توانند در تکنیک‌های خود متفاوت باشند، اما به طور معمول شامل هدف قرار دادن یک کاراکتر، کلمه یا متن در یک زمان هستند. سپس کاراکترها با استفاده از یکی از این دو الگوریتم مشخص می‌شوند:

 تشخیص الگویی: برنامه‌های OCR نمونه‌هایی از متن را در فونت‌ها و قالب‌های مختلفی ارائه می‌دهند که برای مقایسه و تشخیص کاراکترهای موجود در فایل اسکن شده استفاده می‌شوند.

تشخیص ویژگی: برنامه‌های OCR قوانینی را در رابطه با ویژگی‌های یک حرف یا شماره خاص برای تشخیص کاراکترهای موجود در فایل اسکن شده اعمال می‌کنند. این ویژگی‌ها می توانند شامل تعداد خطوط زاویه دار، خطوط متقاطع یا منحنی‌های یک کاراکتر برای مقایسه باشند. به عنوان مثال، حروف “A” بزرگ ممکن است به عنوان دو خط مورب ذخیره شود که با یک خط افقی در وسط قرار دارند.

نکته: هنگامی که یک کاراکتر شناسایی می‌شود، به یک کد ASCII تبدیل می‌گردد که توسط سیستم‌های رایانه‌ای می‌تواند برای دستکاری بیشتر مورد استفاده قرار گیرد. کاربران باید قبل از ذخیره کردن سند برای استفاده‌های بعدی، خطاهای اساسی را تصحیح کنند و مطمئن شوند که چیدمان‌ کاراکترهای پیچیده به درستی انجام شده است.

انواع OCR

فناوری OCR به دو نوع تایپی و دست نویس تقسیم می‌شود، درواقع یا باید یک متن که از قبل تایپ شده (مانند مجله، کتاب، روزنامه یا…) را وارد رایانه کنیم یا متون دست نویس را. متون دست نویس هم به دو دسته «گسسته» و «پیوسته» تقسیم می‌شوند:

متون پیوسته، متونی هستند که ما به طور روزانه آنها را می‌نویسیم مانند روزنوشته‌ها، خاطرات، نامه و...

متون گسسته، متونی هستند که در آنها حروف، جدا از هم نوشته می‌شوند، مانند فرم‌های اطلاعاتی که نام و نام خانوادگی خود را در آنها به صورت هر حرف داخل یک کادر می‌نویسیم. لازم به ذکر است، OCR متون گسسته، کار بسیار راحت تری نسبت به مدل پیوسته است.

مزیت OCR چیست؟

  • با OCR می توان درون فایل های پی دی اف به جست وجو پرداخت

  • پردازش خودکار داده ها

  • قابل جست وجوکردن کتاب های اسکن شده

  • خواندن راحت تر برای کسانی که مشکل بینایی دارند

  • تبدیل اسناد و روزنامه های قدیمی به متن قابل ویرایش در کامپیوتر

  • استخراج و انتقال داده به برنامه های حسابداری

  • ایندکس کردن اسناد برای موتور های جست وجو

  • سینتی سایزر گفتار برای کسانی که توانایی صحبت کردن ندارند. مانند استفان هاوکینگ

برچسب ها: آموزش مجازی
ارسال نظرات
captcha
وبگردی