از شعر تا دادهاطلس تعاملی شعر فارسیورود به اطلس تعاملی
پژوهش چهارم

آیا هوش مصنوعی می‌تواند سده یک شعر فارسی را تشخیص دهد؟

راهنمای علمی تاریخ‌گذاری محاسباتی شعر فارسی و توضیح اینکه چرا ارزیابی Leave-One-Poet-Out برای جلوگیری از تشخیص شاعر به‌جای سده ضروری است.

پاسخ در یک نگاه

هوش مصنوعی می‌تواند نشانه‌های زمانی را در زبان شعر بیابد، اما دقت ظاهراً بالا در تقسیم تصادفی ممکن است حاصل شناخت شاعر یا کتاب باشد. ارزیابی معتبر باید شاعر آزمون را کاملاً از آموزش حذف کند.

مرز ادعا: برچسب سده به زندگی شاعر نسبت داده شده و مدل تاریخ دقیق سرایش را پیش‌بینی نمی‌کند؛ نشت هویت شاعر می‌تواند دقت را بیش‌برآورد کند.

شاهد محاسباتی و واحد تحلیل

چه چیزی محاسبه شد؟

سده‌های هدف۱۳
خط مبنای یکنواخت۷٫۷٪
خط مبنای پرتکرار۲۵٫۵٪
میانگین بازیابی مقایسه‌ای۶۲٫۳٪
  1. پاسخ علمی «بله، اما با احتیاط» است: زبان شعر نشانه‌های زمانی دارد، ولی شاعر، کتاب و ژانر می‌توانند به مدل سرنخ هویتی بدهند.
  2. تقسیم تصادفی شعرها ارزیابی آسان و مستعد نشتی است؛ Leave-One-Poet-Out سخت‌گیرانه‌ترین طرح برای سنجش تعمیم تاریخی است.
  3. در ماتریس مقایسه‌ای، میانگین بازیابی سده‌ها ۶۲٫۳٪ است؛ این عدد اجرای مستقیم روی همین فایل با حذف کامل شاعر نیست.
  4. خطای یک سده‌ای باید جداگانه گزارش شود، زیرا تغییر زبان ادبی پیوسته است و پیش‌بینی سده مجاور با خطای دور تفاوت دارد.
جدول داده

خلاصه عددی قابل جست‌وجو

جدول زیر همان اعداد اصلی نمودارها را به‌صورت متنی و قابل خواندن برای موتورهای جست‌وجو، ابزارهای کمکی و پژوهشگران ارائه می‌کند.

سدهبازیابی در مطالعه مقایسه‌ای
سده ۹۶۸٪
سده ۱۰۴۷٪
سده ۱۱۵۵٪
سده ۱۲۵۴٪
سده ۱۳۵۳٪
سده ۱۴۷۳٪
سده ۱۵۷۸٪
سده ۱۶۷۹٪
سده ۱۷۸۴٪
سده ۱۸۳۲٪
سده ۱۹۵۳٪
سده ۲۰۴۵٪
سده ۲۱۸۹٪
روش و عدم‌قطعیت

این نتیجه چگونه ساخته شد؟

پروتکل پیشنهادی شامل مدل‌های واژه‌ای، نویسه‌ای، سبک‌سنجی و مدل زبانی، همراه با Macro-F1، Balanced Accuracy، MAE سده‌ای و Accuracy±1 است. بازنمونه‌گیری باید در سطح شاعر انجام شود.

مرز تفسیر

چه چیزی را نباید نتیجه گرفت؟

تقسیم ۸۵/۱۵ در پژوهش مقایسه‌ای؛ نه حذف کامل شاعر

تفسیر ادبی

این شاهد چه خوانشی را پیشنهاد می‌کند؟

هوش مصنوعی می‌تواند نشانه‌های زمانی را در زبان شعر بیابد، اما دقت ظاهراً بالا در تقسیم تصادفی ممکن است حاصل شناخت شاعر یا کتاب باشد. ارزیابی معتبر باید شاعر آزمون را کاملاً از آموزش حذف کند.

برچسب سده به زندگی شاعر نسبت داده شده و مدل تاریخ دقیق سرایش را پیش‌بینی نمی‌کند؛ نشت هویت شاعر می‌تواند دقت را بیش‌برآورد کند.

ممیزی و استفادهٔ دوباره

داده، روش و موجودیت‌های مرتبط

پرسش‌های مرتبط

خوانش درست نتیجه

آیا نمودارها رتبه ادبی شاعران را نشان می‌دهند؟

خیر. اندازه خانه‌ها، تعداد متن‌ها یا مرکزیت شبکه فقط ویژگی پیکره و روش محاسباتی را نشان می‌دهد و نباید به ارزش یا اهمیت ادبی تعبیر شود.

آیا پیوند متنی، تأثیر مستقیم را ثابت می‌کند؟

خیر. یال‌ها قرابت محاسباتی جهت‌دارند؛ یعنی شباهت عبارتی، واژگانی یا موضوعی میان شاعر متأخر و شاعر پیشین دیده شده است. اثبات تأثیر تاریخی به شواهد نسخه‌شناختی و تاریخ ادبی نیاز دارد.

آیا شعر نامتعارف حتماً انتساب نادرست دارد؟

خیر. کوتاهی یا بلندی متن، تفاوت ژانر، نشانه‌گذاری، آلودگی داده و مرحله متفاوت زندگی شاعر می‌تواند متن را از مرکز سبک او دور کند. خروجی مدل فقط فهرست اولویت بازبینی است.

چگونه می‌توان به نتایج استناد کرد؟

در هر صفحه پژوهشی یک بلوک استناد آماده، تاریخ به‌روزرسانی و پیوند پایدار وجود دارد. فایل CITATION.cff نیز برای GitHub و ابزارهای مدیریت استناد در پروژه قرار گرفته است.

استناد پیشنهادی

چگونه به این صفحه استناد کنیم؟

کریمی، حسین. (۲۰۲۶). «آیا هوش مصنوعی می‌تواند سده یک شعر فارسی را تشخیص دهد؟». از شعر تا داده: اطلس تعاملی تحلیل داده‌های شعر فارسی. https://frompoetrytodata.vercel.app/research/century-ai/