استایلومتری و انتساب مؤلف · FA-POET-02-SPLIT

حالت پایه Source-complete subset Beta

PARSI — ممیزی poem-level split و نشت داده — Beta

0 اجرای موفق ثبت‌شده در آمار دائمی

این ابزار بخش بازتولیدپذیرِ پروتکل داده PARSI 2025 برای انتساب مؤلف شعر را ممیزی می‌کند: هر شعر باید فقط در یک split باشد، نسبت هدف ۸۰/۱۰/۱۰ و stratification شاعر گزارش می‌شود و شاعران زیر ۵۰ بیت flag می‌شوند. ابزار split جدید نمی‌سازد و به‌تنهایی حکم انتساب صادر نمی‌کند، چون مقاله مقدار عددی random seed را منتشر نکرده است.

این خروجی چه می‌گوید؟

سنجه، طبقه‌بندی یا کنترل کیفیت تعریف‌شدهٔ همین روش را روی داده‌های واردشده گزارش می‌کند.

چه چیزی را به‌تنهایی ثابت نمی‌کند؟

دامنه ادعا از نوع ابزار، corpus و کنترل‌های روش‌شناختی فراتر نمی‌رود؛ نتیجه باید همراه محدودیت‌های زیر تفسیر شود.

توضیح علمی، محدودیت‌ها و جایگاه توسعه
این ابزار بخش بازتولیدپذیرِ پروتکل داده PARSI 2025 برای انتساب مؤلف شعر را ممیزی می‌کند: هر شعر باید فقط در یک split باشد، نسبت هدف ۸۰/۱۰/۱۰ و stratification شاعر گزارش می‌شود و شاعران زیر ۵۰ بیت flag می‌شوند. ابزار split جدید نمی‌سازد و به‌تنهایی حکم انتساب صادر نمی‌کند، چون مقاله مقدار عددی random seed را منتشر نکرده است.
توضیح علمی: Source-complete protocol subset only: poem-level non-overlap, 80/10/10 split targets, poet stratification, and the published 50-verse inclusion filter. No pseudo-reproduction of the unpublished numeric seed is generated.
محدودیت‌ها: مدل عصبی کامل PARSI تولید split دقیق مقاله، چون مقدار عددی random seed منتشر نشده است
مقاله/مرجع: Shahnazari, Kourosh; Keshtparvar, Mohammadali; Ayyoubzadeh, Seyed Moein. (2025). PARSI: Persian Authorship Recognition via Stylometric Integration. arXiv:2506.21840v1.

سطح بازتولیدپذیری: Source-complete subset

روش و منبع: Shahnazari, Kourosh; Keshtparvar, Mohammadali; Ayyoubzadeh, Seyed Moein. (2025). PARSI: Persian Authorship Recognition via Stylometric Integration. arXiv:2506.21840v1.

وضعیت بازتولیدپذیری

فقط بخشی از روش مقاله اجرا می‌شود که جزئیات آن بدون حدس کامل است؛ بخش‌های دیگر مقاله عمداً اجرا نشده‌اند.

پیاده‌سازی شده

  • ممیزی عدم هم‌پوشانی در سطح شعر
  • نسبت‌های هدف منتشرشده ۸۰/۱۰/۱۰ در سطح شعر
  • بررسی stratification در سطح شاعر
  • flag شرط منتشرشده ۵۰ بیت

پیاده‌سازی نشده / محدودیت

  • مدل عصبی کامل PARSI
  • تولید split دقیق مقاله، چون مقدار عددی random seed منتشر نشده است

مرحله دستی یا ورودی پژوهشگر

  1. split واقعیِ سطح شعرِ آزمایش خود را به CSV با ستون‌های poem_id, poet, split آماده/خروجی بگیرید.
  2. CSV را بارگذاری کنید؛ IDHR بدون اختراع seed جایگزین آن را ممیزی می‌کند.

پس از انجام این مرحله، فایل/خروجی خواسته‌شده را در فرم زیر بدهید تا IDHR عملیات خودکار را ادامه دهد.

مشاهده ممیزی بازتولیدپذیری همه روش‌ها

دامنه بازسازی فاز ۵: این ابزار خودِ مدل Transformer مقاله PARSI را بازسازی نمی‌کند؛ فقط پروتکل poem-level split منتشرشده را ممیزی می‌کند. مقاله split را در سطح شعر، با stratification برچسب شاعر و نسبت‌های ۸۰/۱۰/۱۰ گزارش می‌کند.

ساختار فایل: poem_id,poet,split؛ هر سطر یک بیت است و مقدار split باید train، validation یا test باشد. ابزار بررسی می‌کند که هیچ poem_id میان چند split پخش نشده و هر شعر فقط به یک شاعر تعلق دارد.

نسبت ۸۰/۱۰/۱۰ در مقاله در سطح شعر تعریف شده است؛ بنابراین گزارش IDHR هم نسبت شعرها و هم تعداد بیت‌ها را جدا می‌کند. فیلتر «کمتر از ۵۰ بیت برای هر شاعر» فقط flag می‌شود و داده کاربر خودکار حذف نمی‌شود.

قاعده no-guess: مقاله می‌گوید بذرهای تصادفی ثابت بوده‌اند، اما مقدار عددی seed را منتشر نمی‌کند. در نتیجه IDHR split تازه تولید نمی‌کند و فقط split ارائه‌شده پژوهشگر را ممیزی می‌کند.

پس از ثبت Job می‌توانید مرورگر را ببندید؛ پردازش روی سرور ادامه می‌یابد. پس از پایان، 168 ساعت فرصت دانلود دارید. پایان موفق یا شکست تحلیل همراه با لینک امن ایمیل می‌شود و خطای ایمیل وضعیت تحلیل را تغییر نمی‌دهد.

نحوه تفسیر

این ابزار نتیجه را همراه پارامترها، نسخه موتور علمیِ همان روش، نرمال‌سازی نویسه‌ای و SHA-256 ورودی‌ها در Research Manifest ثبت می‌کند. تغییر پارامترها باید به‌عنوان اجرای پژوهشی جداگانه در نظر گرفته شود.