GIDORA AI
Gidora Ai؛ خواندن متن از تصویر با OCR هوشمند
در تغییرات تازه پروژه `ai`، یک صفحه جدید برای OCR اضافه شده است: `ocr.php`. این بخش به کاربر اجازه میدهد تصویر آپلود کند و خروجی متن استخراجشده را از مدل هوش مصنوعی دریافت کند.
این قابلیت برای Gidora Ai مهم است چون دستیار فقط به متن تایپشده محدود نمیماند. با OCR، میشود عکس سند، رسید، اسکرینشات، تصویر فرم، متن چاپی یا محتوای تصویری را وارد جریان هوش مصنوعی کرد و بعد روی متن استخراجشده کارهای بعدی انجام داد.
قابلیتهایی که در کد دیده میشود:
- فرم آپلود تصویر با `multipart/form-data`
- پذیرش فقط فایلهای تصویری با بررسی MIME
- تبدیل تصویر آپلودشده به base64
- ارسال تصویر به Ollama از طریق endpoint `/api/generate`
- استفاده از مدل `gemma4:e2b`
- پرامپت `Text Recognition:` برای استخراج متن
- تنظیم `temperature = 0` برای خروجی پایدارتر
- تنظیم `num_ctx` و `num_predict` برای کنترل ظرفیت ورودی و خروجی
- timeout طولانیتر برای پردازش تصویر
- نمایش خطای آپلود، خطای نوع فایل، خطای اتصال به Ollama و خطای مدل
- نمایش خروجی مدل داخل textarea با پشتیبانی از جهت متن خودکار
ارزش عملی این قابلیت این است که OCR میتواند ورودی پروژههای مختلف گیدورا را سادهتر کند: خواندن متن تصویر برای پشتیبانی، استخراج اطلاعات از رسیدها، تبدیل اسکرینشات به متن قابل جستوجو، آمادهسازی متن برای ترجمه، خلاصهسازی یا ثبت در سیستمهای داخلی.
این فقط یک ابزار OCR ساده نیست؛ یک قدم به سمت Gidora Ai چندورودی است، جایی که متن، تصویر و دادههای پروژه میتوانند وارد یک جریان واحد شوند و دستیار بتواند روی آنها تحلیل، خلاصهسازی و پیگیری انجام دهد.
#GidoraAi #OCR #VisionAI #Ollama #هوش_مصنوعی #تشخیص_متن #اتوماسیون #گیدورا