OCRِ فارسی–انگلیسی
خطلولهی ترجمهی رسمی.
مسئلهای که حل کرد
دفاتر ترجمهٔ رسمی غرقِ تایپِ دستیِ اسکنهای دوزبانهٔ فارسی–انگلیسی بودند و کیفیت و سرعت آسیب میدید. این خطلوله متنِ تمیز و ساختاریافته را بهصورتِ خودکار از اسناد کمکیفیتِ چندخطی بیرون میکشد.
مسائل مشابهی که میتواند حل کند
هر نیازِ پرحجمِ هوشِ اسنادی: فاکتور و کارتِ شناسایی، دیجیتالیسازیِ سوابقِ حقوقی/پزشکی، احرازِ هویتِ KYC، و استخراجِ سایرِ متونِ چندخطیِ RTL/LTR (عربی، عبری، اردو).
چندنسلی: PaddleOCR ← DeepSeek-OCR ← Qwen2-VL ← پسپردازشِ Gemini 2.5 Flash. تکهبندیِ صفحهآگاه، پیشرفتِ SignalR، کارهای SQL Server و کتابخانهی OcrClient به زبانِ C#.
- تشخیصِ زبان در سطحِ صفحه
- سهمیه / حسابرسی / محدودیتِ نرخ
- پیشرفتِ بیدرنگ برای کلاینتهای سبک
مرور کلی
یک سرویسِ عملیاتیِ OCR برای اسنادِ ترجمهی رسمیِ فارسی–انگلیسی. اسکنِ مدارکِ مهاجرتی را میگیرد و متنِ تمیز و ساختاریافته بازمیگرداند، و طیِ چند نسلِ مدل برای مدیریتِ متنِ چندخطی و اسکنهای کمکیفیت تکامل یافته است.
تکنولوژی
بکاندِ FastAPI با خطلولهی چندنسلی (PaddleOCR → DeepSeek-OCR → Qwen2-VL → پسپردازشِ Gemini 2.5 Flash)، ردیابیِ کارها با SQL Server، پیشرفتِ زنده با SignalR، احرازِ هویتِ کلاینت با سهمیه/محدودیتِ نرخ، و کتابخانهی مصرفِ OcrClient به زبانِ C#.