Document OCR
OCR اسناد فارسی و انگلیسی — OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.
Interactive Sample Demoبرای مدیر: نتیجه کسبوکار
ثبت دستی اسکن و تایپ متن از تصویر؛ صفحات فارسی و مختلط معمولاً خراب میشوند.
یک تصویر تا ۵ مگابایت به PDF قابل جستجو و فایل UTF-8 تبدیل میشود؛ فایل آپلودشده ذخیره پایدار نمیشود.
- PaddleOCR-VL-1.6
- فارسی + انگلیسی
- PDF قابل جستجو
- بدون ذخیره پایدار
«یک اسکن، یک PDF قابل جستجو — بدون نگهداری فایل روی سرور عمومی.»
مستندات عمومی
چه میکند؟
Document OCR یکی از محصولات پورتفولیوی هوش مصنوعی آریا اِیآی است. نسخه عمومی روی Hugging Face یک دموی نمونه است؛ نسخه تولید با یکپارچهسازی داده، SSO و audit trail استقرار مییابد.
OCR عمومی اسناد با رابط انگلیسی؛ پشتیبانی کامل فارسی و صفحات مختلط، خروجی PDF قابل جستجو و فایل متن یونیکد.
درخواست پایلوت از طریق فرم تماس سایت با ذکر علاقه به Document OCR ثبت میشود تا محدوده داده، قیود و معیار موفقیت مشخص گردد.
چه کسی از آن استفاده میکند؟
مالی، بایگانی، دبیرخانه، حقوقی و تیمهایی که باید متن اسکن را در ERP یا بایگانی دیجیتال بگذارند.
خروجی دمو «نمونه تعاملی» است؛ آپلود زنده فایل سازمانی روی Space عمومی توصیه نمیشود.
کاربرد در صنایع
مالی و حسابداری
تبدیل فاکتور و رسید اسکنشده به متن قابل جستجو.
دبیرخانه
ورود نامه و فرم کاغذی به گردش دیجیتال.
حقوقی
متنگذاری قرارداد و پیوست اسکنشده.
منابع انسانی
استخراج متن از مدارک پرسنلی.
بایگانی سازمانی
ساخت لایه متن پنهان روی تصویر اصلی.
خدمات مشتری
خواندن فرم و درخواست المانی از اسکن.
برای مهندس: Pipeline و معماری
Upload image → resize ≤1920px → PaddleOCR-VL-1.6 on ZeroGPU → searchable PDF + UTF-8 txt
معماری مرجع از README اسپیس روی Hugging Face پیروی میکند. استقرار تولید با Docker، متغیر محیطی و اتصال به سامانه موجود انجام میشود.
پشته فنی
- Python
- Transformers
- PaddleOCR-VL-1.6
- Gradio
- ZeroGPU
- Docker
متریکهای قابل بازتولید
| بنچمارک | جزئیات | نتیجه |
|---|---|---|
| Model | PaddleOCR-VL-1.6 | ZeroGPU |
| Input | JPG/PNG/WEBP/BMP/TIFF | 1 image |
| Limit | max 5 MB | longest side 1920 |
| Privacy | temp dir only | no persist |
سوالات پرتکرار
Document OCR چیست و چه مسئلهای را حل میکند؟
OCR عمومی اسناد فارسی و انگلیسی با خروجی PDF قابل جستجو و فایل متن یونیکد.
آیا میتوان داده واقعی سازمان را در دمو عمومی وارد کرد؟
خیر. دمو عمومی برای نمونههای ازپیشمحاسبهشده یا داده ترکیبی است. داده production باید در استقرار on-prem یا VPC با کنترل دسترسی وارد شود.
آیا این محصول جایگزین سامانه فعلی میشود؟
نمونه اولیه (POC) برای نمایش OCR اسناد است. برای حجم بالا، چندصفحه PDF و استقرار داخل سازمان پایلوت on-prem توصیه میشود.
متریکهای صفحه از کجا آمدهاند؟
از README و کارت مدل/اسپیس روی Hugging Face؛ اعداد بنچمارک را با داده سازمان خود در پایلوت بازسنجی کنید.
لینکهای Hugging Face
درخواست پایلوت
برای استقرار on-prem، یکپارچهسازی با سامانههای موجود یا fine-tune روی داده سازمان خود تماس بگیرید.