معرفی پروژه
رضوان یک زیرساخت پژوهشی برای پردازش گسترده متون حدیثی است که بیش از ۱٫۲ میلیون روایت را در قالب یک پیکره ساختیافته گردآوری کرده است. مسیر مبتنی بر مدلهای زبانی بزرگ، منابع خام را بخشبندی و سند را از متن روایت جدا میکند و سپس لایههای پژوهشی تازهای به داده میافزاید.
قابلیتهای پژوهشی
ترجمه ماشینی به دوازده زبان، اعرابگذاری هوشمند، خلاصهسازی، برچسبگذاری موضوعی و تحلیل میانمتنی از اجزای سامانهاند. استفاده از مخازنی مانند مکتبة اهلالبیت، این پروژه را برای پژوهشگران حدیث و میراث شیعی نیز قابلتوجه میکند. پیکره میتواند برای بازیابی معنایی، مقایسه روایتها و طراحی پژوهشهای کمی در مطالعات اسلامی به کار رود.
ارزیابی و احتیاط روشی
پژوهشگران ۱۲۱۳ نمونه را با مشارکت شش متخصص حوزه ارزیابی کردهاند. نتایج گزارششده برای جداسازی سند و متن و خلاصهسازی قویتر است، اما در اعرابگذاری و سنجش شباهت معنایی هنوز محدودیت وجود دارد. بنابراین خروجی سامانه باید ابزار کمکی پژوهشگر تلقی شود و جایگزین نقد سند، نسخه و متن نیست. متن و جزئیات در صفحه مقاله در دسترس است.
