هوشِ اسنادی

OCRِ فارسی–انگلیسی

خط‌لوله‌ی ترجمه‌ی رسمی.

مسئله‌ای که حل کرد

دفاتر ترجمهٔ رسمی غرقِ تایپِ دستیِ اسکن‌های دوزبانهٔ فارسی–انگلیسی بودند و کیفیت و سرعت آسیب می‌دید. این خط‌لوله متنِ تمیز و ساختاریافته را به‌صورتِ خودکار از اسناد کم‌کیفیتِ چندخطی بیرون می‌کشد.

مسائل مشابهی که می‌تواند حل کند

هر نیازِ پرحجمِ هوشِ اسنادی: فاکتور و کارتِ شناسایی، دیجیتالی‌سازیِ سوابقِ حقوقی/پزشکی، احرازِ هویتِ KYC، و استخراجِ سایرِ متونِ چندخطیِ RTL/LTR (عربی، عبری، اردو).

چندنسلی: PaddleOCR ← DeepSeek-OCR ← Qwen2-VL ← پس‌پردازشِ Gemini 2.5 Flash. تکه‌بندیِ صفحه‌آگاه، پیشرفتِ SignalR، کارهای SQL Server و کتابخانه‌ی OcrClient به زبانِ C#.

مرور کلی

یک سرویسِ عملیاتیِ OCR برای اسنادِ ترجمه‌ی رسمیِ فارسی–انگلیسی. اسکنِ مدارکِ مهاجرتی را می‌گیرد و متنِ تمیز و ساختاریافته بازمی‌گرداند، و طیِ چند نسلِ مدل برای مدیریتِ متنِ چندخطی و اسکن‌های کم‌کیفیت تکامل یافته است.

تکنولوژی

بک‌اندِ FastAPI با خط‌لوله‌ی چندنسلی (PaddleOCR → DeepSeek-OCR → Qwen2-VL → پس‌پردازشِ Gemini 2.5 Flash)، ردیابیِ کارها با SQL Server، پیشرفتِ زنده با SignalR، احرازِ هویتِ کلاینت با سهمیه/محدودیتِ نرخ، و کتابخانه‌ی مصرفِ OcrClient به زبانِ C#.

FastAPI Gemini 2.5 SignalR