برای کسانی که به دنبال یک راهکار کاملاً رایگان، منعطف و بدون وابستگی به شرکتهای بزرگ هستند، Tesseract OCR بهترین گزینه است. این موتور OCR که در ابتدا توسط HP توسعه یافت و اکنون توسط گوگل پشتیبانی میشود، به صورت متنباز (Open Source) در دسترس است.
تسرکت به دلیل قابلیت شخصیسازی بالا، محبوبترین انتخاب برای محققان حوزه هوش مصنوعی و توسعهدهندگانی است که میخواهند مدلهای اختصاصی خود را آموزش دهند.
یکی از ویژگیهای جذاب تسرکت، امکان آموزش دادن آن برای فونتهای خاص یا زبانهای باستانی است.
اگر با متون قدیمی فارسی یا نسخههای خطی سر و کار دارید که نرمافزارهای تجاری قادر به خواندن آنها نیستند، میتوانید با ارائه نمونههای آموزشی به تسرکت، دقت آن را برای آن نوع خاص از نوشتار افزایش دهید.
این سطح از کنترل بر روی فرآیند یادگیری ماشین، در هیچ ابزار آمادهای وجود ندارد و پتانسیل بالایی برای پروژههای تخصصی ایجاد میکند.
تسرکت به تنهایی یک رابط کاربری گرافیکی ندارد و معمولاً از طریق خط فرمان (Command Line) یا کتابخانههای برنامهنویسی مانند Pytesseract در پایتون استفاده میشود.
با این حال، رابطهای گرافیکی متعددی (GUI) توسط جامعه برنامهنویسان برای آن ساخته شده است تا کاربران عادی نیز بتوانند از قدرت آن بهرهمند شوند.
این ابزار از بیش از ۱۰۰ زبان پشتیبانی میکند و در نسخههای جدید خود از شبکههای عصبی LSTM برای بهبود تشخیص حروف در هم تنیده استفاده کرده است.
استفاده از تسرکت برای پروژههایی که محدودیت بودجه دارند یا نیاز به پردازش آفلاین در حجم بسیار بالا دارند، بسیار منطقی است.
از آنجایی که این ابزار هیچ هزینهای بابت لایسنس دریافت نمیکند، میتوان آن را بر روی سرورهای شخصی نصب کرد و بدون نگرانی از حریم خصوصی، اسناد حساس را پردازش نمود.
اگرچه راهاندازی اولیه آن ممکن است کمی فنی باشد، اما دقت و انعطافپذیری آن در درازمدت، ارزش این تلاش را برای کاربران حرفهای خواهد داشت.