قادة الفكر

استخدام تقنية OCR لقراءة الرسومات الهندسية المعقدة

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

لقد قامت تقنية التعرف الضوئي على الحروف (OCR) بثورة في طريقة عمل الشركات فيما يتعلق بالت自動ية لمعالجة الوثائق. ومع ذلك، فإن جودة ودقة هذه التقنية لا تصلح لكل التطبيقات. وكلما كانت الوثيقة المعنية أكثر تعقيداً، زادت صعوبة قراءتها. وهذا صحيح بشكل خاص فيما يتعلق بالرسومات الهندسية. على الرغم من أن تقنيات OCR الجاهزة قد لا تكون مناسبة لهذه المهمة، إلا أنه هناك طرق أخرى لتحقيق أهداف معالجة الوثائق باستخدام تقنية OCR. في ما يلي، سأستعرض بعض الحلول القابلة للتطبيق لإعطائك فكرة عامة دون الخوض في التفاصيل الفنية.

تحديات التعرف على الرسومات الهندسية

عندما يتعلق الأمر بالرسومات الفنية، تعاني تقنية OCR في فهم معنى عناصر النص الفردية. يمكن للتقنية قراءة النص، لكنها لا تفهم معناه. هناك العديد من الفرص للengineers والmanufacturers للاستفادة من التعرف التلقائي على الوثائق الفنية إذا تم تكوينها بشكل صحيح. انظر إلى أهم هذه الفرص أدناه.

مصدر الصورة: Mobidev

Để تحقيق تحليل الوثائق الفنية المعقدة، يحتاج المهندسون إلى تدريب نماذج الذكاء الاصطناعي. مثل البشر، تحتاج نماذج الذكاء الاصطناعي إلى الخبرة والتدريب لفهم هذه الرسومات.

واحدة من التحديات في التعرف على الرسومات الهندسية والرسومات الفنية هي أن البرمجيات يجب أن تفهم كيفية فصل وجهات نظر مختلفة من الرسم. هذه هي أجزاء مختلفة من الرسم التي تعطي فكرة أساسية عن تخطيطها. من خلال فصل وجهات النظر وفهم كيفية علاقتها ببعضها البعض، يمكن للبرمجيات حساب مربع الحدود.

قد يتضمن هذا العملية عدة تحديات:

  • قد تتداخل وجهات النظر
  • قد تتعرض وجهات النظر للتلف
  • قد تكون العلامات على مسافة متساوية من وجهتي نظر
  • قد تكون وجهات النظر متداخلة

علاقة وجهات النظر هي مشكلة أخرى محتملة. يجب أن تضع في الاعتبار ما إذا كانت وجهة النظر هي جزء مسطح من الرسم، أو جزء مائل، أو كتلة، أو شيء آخر. بالإضافة إلى ذلك، قد توجد مشاكل أخرى مثل قياسات متسلسلة، أو تعليقات مفقودة، أو أبعاد محددة بشكل ضمني من خلال الإشارة إلى معيار، أو مشاكل أخرى.

من المهم أن نلاحظ أن تقنية OCR العامة لا يمكن أن تفهم بثقة النص في الرسومات التي تحيط به عناصر رسومية مثل الخطوط والرموز والتعليقات. بسبب هذا الحقائق، يجب علينا النظر بشكل أعمق في تقنية OCR مع الذكاء الاصطناعي التي ستكون أكثر فائدة لهذا التطبيق.

نماذج OCR المسبقة والمتخصصة

لا يوجد نقص في برمجيات OCR في السوق، ولكن ليس كل هذه البرمجيات يمكن تدريبها أو تعديلها من قبل المستخدم. كما تعلمنا، قد يكون التدريب ضرورياً لتحليل الرسومات الهندسية. ومع ذلك، توجد أدوات OCR للرسومات الهندسية هذه.

أدوات OCR المسبقة

هنا بعض الخيارات الشائعة لتعرف OCR على الرسومات الهندسية:

  • ABBYY FineReader: هذا البرنامج متعدد الاستخدامات لتعريف الرسومات الهندسية يقدم تقنية OCR مع khảية التعرف على النص. يدعم تنسيقات صورة مختلفة، وضبط التخطيط، وتصدير البيانات، والدمج.
  • Adobe Acrobat Pro: بالإضافة إلى تقديم تحرير وتصفح وادارة ملفات PDF، يسمح Acrobat بفحص وثائق OCR ورسومات هندسية، واستخراج النص، وتنفيذ عمليات البحث. يدعم لغات مختلفة ويسمح للمستخدمين بتكوين الخيارات.
  • Bluebeam Revu: تطبيق PDF شائع آخر، يقدم Bluebeam Revu تقنيات OCR لاستخراج النص من الرسومات الهندسية.
  • AutoCAD: يعني التصميم بمساعدة الحاسوب، يدعم AutoCAD إضافات OCR لتعريف الرسومات الهندسية وتحويلها إلى عناصر CAD قابلة للتحرير.
  • PlanGrid: يتضمن هذا البرنامج تفسير OCR للرسومات الهندسية بشكل افتراضي. مع هذه الميزة، يمكنك تحميل صور الرسومات الهندسية ثم استخراجها، وتنظيمها، وفهرستها، وعمليات البحث.
  • Textract: هذه الميزة السحابية من AWS تمكن من تحليل وثائق OCR ويمكن استخراج عناصر مثل الجداول من الوثائق. كما يمكنها التعرف على عناصر من الرسومات الهندسية وتنضم إلى تطبيقات أخرى عبر واجهات برمجة التطبيقات.
  • Butler OCR: يقدم للمطورين واجهات برمجة التطبيقات لاستخراج الوثائق، ويعزز Butler OCR من دقة التعرف على الوثائق من خلال الجمع بين الذكاء الاصطناعي والمراجعة البشرية.

حلول OCR المخصصة

إذا كنت تبحث عن حلول OCR مخصصة يمكن تدريبها لتحقيق استخراج بيانات تلقائي أفضل من الرسومات الهندسية وتكييفها مع تنسيق البيانات الخاص بك، فهناك بعض الخيارات الشائعة:

  • Tesseract: يمكن تدريب هذا المحرك OCR المرن ومفتوح المصدر الذي يتم صيانته من قبل Google على بيانات مخصصة لتعرف الأحرف والرموز الخاصة بالرسومات الهندسية.
  • OpenCV: يمكن دمج مكتبة الرؤية الحاسوبية مفتوحة المصدر مع أدوات OCR مثل Tesseract لبناء حلول تفسيرية مخصصة. يمكن أن تعزز وظائف معالجة الصور وتحليلها دقة OCR على الرسومات الهندسية عند استخدامها بشكل صحيح.

إلى جانب هذه الأدوات، من الممكن تطوير نماذج الذكاء الاصطناعي المخصصة بشكل مستقل. يمكن تحسين هذه الحلول لتعرف عناصر رسومات هندسية محددة وتحقيق دقة أعلى لاحتياجات المنظمة من خلال استخدام نماذج التدريب على مجموعات بيانات ملصقة.

تقدّم النماذج المسبقة راحة وسهولة في الاستخدام، لكنها قد لا تكون فعالة في تفسير الرسومات الهندسية مثل الحلول المخصصة. تتطلب هذه الحلول المخصصة موارد ومهارات إضافية لتطويرها وصيانتها.

تتطلب الحلول المخصصة موارد مالية وعمالة إضافية لتطويرها. أوصي ببدء برهان概念 (PoC) لتأكيد القدرات الفنية ومنتج قابل للتطبيق الأدنى (MVP) لتحقق استقبال السوق للمشروع قبل الاستثمار الكبير في حل OCR مخصص.

عملية تنفيذ وحدة OCR لقراءة الرسومات الهندسية

أفضل مكان لبدء بناء برنامج OCR للرسومات الهندسية سيكون تحليل الأدوات مفتوحة المصدر المتاحة. إذا استنفدت خياراتك مفتوحة المصدر، قد تحتاج إلى اللجوء إلى خيارات مغلقة المصدر مع دمج واجهات برمجة التطبيقات.

بناء حل OCR من الصفر غير عملي لأن ذلك يتطلب مجموعة بيانات ضخمة للتدريب. هذا صعب ومكلف للغاية لجمعها ويتطلب الكثير من الموارد لتدريب النماذج. في معظم الحالات، يجب أن تكون تعديل النماذج الحالية كافياً لاحتياجاتك.

العمليات من هنا تبدو هكذا:

  1. النظر في المتطلبات: تحتاج إلى فهم نوع الرسومات الهندسية التي يجب أن تعمل معها تطبيقك وما هي الميزات والوظائف اللازمة لتحقيق ذلك.
  2. التقاط الصور والمعالجة المسبقة: فكر في الأجهزة التي تخطط لاستخدامها لالتقاط الصور. قد تكون هناك خطوات معالجة مسبقة إضافية مطلوبة لتحسين جودة النتائج. قد تشمل هذه الخطوات القص، وتغيير الحجم، وإزالة الضوضاء، وغيرها.
  3. دمج OCR: فكر في محرك OCR الذي سيعمل بشكل أفضل مع تطبيقك. تتيح مكتبات OCR واجهات برمجة التطبيقات التي تمكن تطبيقك من استخراج النص من الصور الملتقطة. من المهم النظر في حلول OCR مفتوحة المصدر لتوفير التكاليف. يمكن أن تكون واجهات برمجة التطبيقات الخاصة بالطرف الثالث غير مستقرة فيما يتعلق بالتسعير مع مرور الوقت أو فقدان الدعم.
  4. تعرف النص والمعالجة: بعد ذلك، حان الوقت لتنفيذ المنطق لمعالجة وتنظيف النص. بعض المهام التي قد تضعها في الاعتبار في هذه الخطوة تشمل تنظيف النص، أو تحديد اللغة، أو أي تقنيات أخرى يمكن أن توفر نتائج تعرف أكثر وضوحاً.
  5. واجهة المستخدم وخبرته: واجهة مستخدم سهلة الاستخدام مهمة حتى يتمكن المستخدم من استخدام التطبيق بشكل فعال لالتقاط الصور وتنشيط OCR. يجب تقديم النتائج إلى المستخدم بطريقة سهلة الفهم.
  6. الاختبار: اختبار التطبيق بشكل شامل لضمان دقته وسهولة استخدامه. ملاحظات المستخدم ضرورية لهذا العملية.

الختام

في مواجهة تحديات إنشاء برنامج OCR للرسومات الهندسية المعقدة، لدى المنظمات خيارات متاحة لهم لمواجهة هذه القضية. من مجموعة من النماذج المسبقة والأدوات القابلة للتخصيص لإنشاء حلول أكثر شخصنة، يمكن للشركات إيجاد طرق لفهرسة وتنظيم الرسومات الهندسية والوثائق المعقدة الأخرى. كل ما يلزم هو بعض الابتكار والإبداع والوقت لصياغة حل يلبي احتياجاتهم.

قائد فريق الذكاء الاصطناعي في MobiDev، شركة تطوير برمجيات تساعد الشركات في جميع أنحاء العالم على الابتكار مع تقنيات متقدمة مثل الذكاء الاصطناعي وعلوم البيانات والواقع المعزز والإنترنت للأشياء. تركز مهنيًا على تحليل البيانات والتنبؤ واللغة الطبيعية وچاتبوت. مؤلفة مقالات عن الذكاء الاصطناعي لـ AiiotTalk و Hackernoon و DevTo. متحدثة في مؤتمرات الذكاء الاصطناعي ومحادثات التكنولوجيا.