چارچوبی برای تشخیص قرآن کریم در متون عربی و فارسی
چکیده
این مقاله چگونگی طراحی و پیادهسازی «موتور هوشمند قرآنی» را برای تشخیص خودکار آیات قرآن در متون ارائه میدهد. حوزه پردازش این سامانه در محدوده فرآیندهای کاوش متن قرار دارد و عملیات آن فراتر از تطبیق الگوهای چندگانه معمول است؛ دلایل این امر در مقاله توضیح داده شده است. برای پیادهسازی این سامانه، الگوریتم جدیدی مبتنی بر نمایهسازی متن و الگوها طراحی شده است که ایده اصلی آن، نگاشت متن و الگوها به آرایههای عددی و پردازش آنها به جای خود متن است. این الگوریتم آیات قرآن را در دو مرحله تشخیص میدهد: در مرحله اول، با استفاده از یک الگوریتم جدید تطبیق دقیق الگوهای چندگانه مبتنی بر نمایه، کلمات قرآنی موجود در متن شناسایی و به آرایههای عددی تبدیل میشوند. در مرحله دوم، فیلتری طراحی شده است که با جستجو در این آرایهها، قادر به تشخیص توالی نمایهشده میان آنها بوده و تعیین میکند که آیا این کلمات بخشی از قرآن هستند یا خیر. نتایج آزمایشگاهی نشان میدهد که پردازش مقادیر عددی به جای متن، تأثیر قابلتوجهی بر افزایش کارایی الگوریتم دارد و منجر به سرعت و دقت بیشتر در تشخیص عبارات قرآن کریم درون متون میشود.