عبارت‌های تکرارشده ۲ تا ۵ کلمه‌ای

IDHR-native / not paper reproduction

وضعیت بازتولیدپذیری

این ابزار یک ابزار بومی یا کمکی IDHR است و ادعای بازسازی کامل یک مقاله مشخص را ندارد.

پیاده‌سازی شده

  • شمارش عبارت‌های هم‌پوشان ۲ تا ۵ واژه‌ای
  • مقایسه اکتشافی با تفسیر پژوهشگر

پیاده‌سازی نشده / محدودیت

  • هیچ امتیاز یا قاعده انتساب مؤلف استنتاج نمی‌شود

مشاهده ممیزی بازتولیدپذیری همه ابزارها و روش‌ها

این ابزار n-gramهای واژگانی دو تا پنج‌کلمه‌ای را با پنجره لغزان می‌شمارد و نتیجه را برای تفسیر پژوهشگر عرضه می‌کند. این ابزار دست‌کم ۲ کتاب TXT نرمال‌شده را می‌پذیرد و یک کتاب را به‌عنوان مبنا تحلیل می‌کند؛ محدودیت پژوهشی برای تعداد فایل وجود ندارد.

این ابزار شمارش را به‌صورت پنجره لغزان و با احتساب تکرارهای هم‌پوشان انجام می‌دهد. حداکثر مجموع فایل‌ها: 100 مگابایت.

این ابزار در خانواده استایلومتری قرار دارد، اما خروجی آن به‌تنهایی روش کامل انتساب مؤلف نیست و تفسیر نتیجه به بررسی پژوهشگر نیاز دارد.

کتاب مبنا

پس از انتخاب فایل‌ها، کتاب مبنا را مشخص کنید.

پس از ثبت Job می‌توانید مرورگر را ببندید؛ پردازش روی سرور ادامه می‌یابد. پس از پایان، 168 ساعت فرصت دانلود دارید. پایان موفق یا شکست تحلیل همراه با لینک امن ایمیل می‌شود و خطای ایمیل وضعیت تحلیل را تغییر نمی‌دهد.

تحلیل عبارت‌های تکرارشونده و n-gram واژگانی

عبارت‌های دو تا پنج کلمه‌ای می‌توانند الگوهای سبکی، ترکیبات قالبی و بخش‌هایی از زبان مشترک یک مجموعه متنی را آشکار کنند. IDHR ابتدا عبارت‌هایی را که دست‌کم دو بار در کتاب مبنا آمده‌اند استخراج می‌کند و سپس فراوانی همان عبارت‌ها را در هر کتاب دیگر می‌شمارد.

فراوانی بالا الزاماً نشانه وابستگی متنی نیست؛ ترکیبات نحوی بسیار عمومی نیز ممکن است پرتکرار باشند. ارزش پژوهشی معمولاً با بررسی هم‌زمان طول عبارت، بسامد، پراکندگی میان کتاب‌ها و زمینه وقوع مشخص می‌شود.