Logo Lanfrica

Ontology-based Query Expansion for Arabic Text Retrieval توسيع الاستعلام القائم على الأنطولوجيا لاسترجاع النص العربي Extension de requête basée sur l'ontologie pour la récupération de texte arabe Expansión de consultas basada en ontologías para la recuperación de texto en árabe

Domain:

natural language processing
Creator:
WasFatRanMos
Publisher:
Ope
Host:avatar
The semantic resources are important parts in the Information Retrieval (IR) such as search engines, Question Answering (QA), etc., these resources should be available, readable and understandable.In semantic web, the ontology plays a central role for the information retrieval, which use to retrieves more relevant information from unstructured information.This paper presents a semantic-based retrieval system for the Arabic text, which expands the input query semantically using Arabic domain ontology.In the proposed approach, the search engine index is represented using Vector Space Model (VSM), and the Arabic's place nouns domain ontology has been used which constructed and implemented using Web Ontology Language (OWL) from Arabic corpus.The proposed approach has been experimented on the Arabic Quran corpus, and the experiments show that the approach outperforms in terms of both precision and recall the traditional keywordbased methods. الموارد الدلالية هي أجزاء مهمة في استرجاع المعلومات (IR) مثل محركات البحث، والإجابة على الأسئلة (QA)، وما إلى ذلك، يجب أن تكون هذه الموارد متاحة وقابلة للقراءة ومفهومة. في الويب الدلالي، تلعب الأنطولوجيا دورًا مركزيًا في استرجاع المعلومات، والتي تستخدم لاسترداد المزيد من المعلومات ذات الصلة من المعلومات غير المهيكلة. تقدم هذه الورقة نظام استرجاع قائم على الدلالة للنص العربي، والذي يوسع استعلام الإدخال بشكل دلالي باستخدام أنطولوجيا المجال العربي. في النهج المقترح، يتم تمثيل فهرس محرك البحث باستخدام نموذج فضاء المتجهات (VSM)، وقد تم استخدام أنطولوجيا مجال الأسماء المكانية العربية التي تم بناؤها وتنفيذها باستخدام لغة أنطولوجيا الويب (OWL) من المجموعة العربية. تم تجربة النهج المقترح على مجموعة القرآن العربي، وتظهر التجارب أن النهج يتفوق من حيث الدقة وتذكر الأساليب التقليدية القائمة على الكلمات الرئيسية. Les ressources sémantiques sont des parties importantes de la récupération d'informations (RI) telles que les moteurs de recherche, la réponse aux questions (AQ), etc., ces ressources doivent être disponibles, lisibles et compréhensibles. Dans le Web sémantique, l'ontologie joue un rôle central pour la récupération d'informations, qui permet de récupérer des informations plus pertinentes à partir d'informations non structurées. Cet article présente un système de récupération sémantique pour le texte arabe, qui développe la requête d'entrée sémantiquement à l'aide de l'ontologie du domaine arabe. Dans l'approche proposée, l'index du moteur de recherche est représenté à l'aide du modèle d'espace vectoriel (VSM), et l'ontologie du domaine des noms de lieux arabes a été utilisée qui a été construite et mise en œuvre à l'aide du langage d'ontologie Web (OWL) à partir du corpus arabe. L'approche proposée a été expérimentée sur le corpus coranique arabe, et les expériences montrent que l'approche surpasse en termes de précision et rappelle les méthodes traditionnelles basées sur des mots-clés. Los recursos semánticos son partes importantes en la recuperación de información (IR), como los motores de búsqueda, la respuesta a preguntas (QA), etc., estos recursos deben estar disponibles, ser legibles y comprensibles. En la web semántica, la ontología juega un papel central para la recuperación de información, que se utiliza para recuperar información más relevante de información no estructurada. Este documento presenta un sistema de recuperación basado en la semántica para el texto árabe, que expande la consulta de entrada semánticamente utilizando la ontología de dominio árabe. En el enfoque propuesto, el índice del motor de búsqueda se representa utilizando el Modelo de Espacio Vectorial (VSM), y se ha utilizado la ontología de dominio de sustantivo de lugar del árabe que se construyó e implementó utilizando el Lenguaje de Ontología Web (OWL) del corpus árabe. El enfoque propuesto se ha experimentado en el corpus del Corán árabe, y los experimentos muestran que el enfoque supera en términos de precisión y memoria los métodos tradicionales basados en palabras clave.

Languages

Licenses

Similar