من فكرة إلى برنامج OCR عربي: تجربتي ودروس من خمسات
من فكرة إلى برنامج OCR عربي: تجربتي ودروس من خمسات
السلام عليكم،
أشارككم تجربة بناء برنامج «مداد» لتحويل الصور وملفات PDF الممسوحة والخط اليدوي العربي إلى نص قابل للتعديل، وما تعلمته من نشره على خمسات.
لماذا بنيته؟ كنت أتعامل يومياً مع وثائق إدارية ممسوحة بالعربية والفرنسية، وأغلب الأدوات تخطئ في الحروف العربية المتصلة وفي ترتيب الكلمات داخل السطر، أو تتطلب رفع الوثائق إلى الإنترنت.
أصعب التحديات التقنية: - تنظيف الصورة قبل القراءة: تصحيح الميلان، وإزالة الظلال والتشويش، وتحويلها إلى أبيض وأسود بعتبة متكيفة. هذه الخطوة وحدها رفعت الدقة أكثر من تغيير محرك القراءة. - خلط العربية والفرنسية والأرقام في نفس السطر، وإعادة ترتيبها بشكل صحيح داخل ملف Word. - الجمع بين أكثر من محرك قراءة واختيار الأفضل لكل صفحة، مع نموذج خاص بالخط اليدوي والنص المشكول. - أن يعمل كل شيء على حاسوب المستخدم دون إرسال وثائقه لأي جهة.
ما تعلمته من مراجعة خمسات (رُفضت الخدمة مرتين قبل قبولها): 1. صورة الغلاف يجب أن تكون تصميماً، لا لقطة شاشة للبرنامج. 2. إن كنت تقدم برنامجاً من تطويرك، فاذكر صراحة في الوصف أنه من برمجتك وأنك مالك حقوقه. 3. كل فقرة في محرر الخدمة لا تتجاوز 900 حرف، وإلا لن تكتمل خطوات النشر. 4. لا روابط خارجية ولا وسائل تواصل في الوصف، وانتبه لأسماء التقنيات التي فيها نقطة لأنها قد تُقرأ كروابط. 5. كل قسم في صفحة الخدمة يحتاج عنواناً، وبعد كل حفظ أعد تحميل الصفحة وتأكد أن الأقسام والتطويرات ما زالت موجودة.
أتمنى أن تفيد هذه النقاط من يجهز خدمته الأولى. ومن لديه تجربة مع قراءة الخط العربي يسعدني أن يشاركنا رأيه.
تفاصيل العمل ونسخة تجريبية في معرض أعمالي على مستقل: https://mostaql.com/portfolio/3826475