در گذشته، پژوهشگران برای دسترسی به اطلاعات علمی، به منابع محدودی مانند کتابخانهها و پایگاههای دادههای اختصاصی وابسته بودند. اما با ظهور فناوری اطلاعات، ارتباطات و همچنین گسترش اینترنت، دنیای پژوهش متحول شد. اینترنت، به عنوان یک منبع عظیم و در دسترس اطلاعات، امکان دسترسی سریع و آسان به مقالهها، کتابها و سایر منابع علمی را برای پژوهشگران فراهم کرد. با این حال، این تحول بزرگ در کنار مزایای فراوان، چالشهای جدیدی را نیز به همراه داشته است. یکی از مهمترین این چالشها، افزایش چشمگیر موارد سرقت ادبی، بهویژه سرقت ادبی بینزبانی، در متنهای علمی است. تشخیص سرقت ادبی بینزبانی، بهویژه بین زبانهایی با ساختار و فرهنگ متفاوت مانند فارسی و انگلیسی، به دلیل چالشهای زبانی و تفاوتهایی در نحوهی بیان مفاهیم، بسیار دشوار است. ابزارهای موجود برای تشخیص سرقت ادبی اغلب با مشکلاتی مانند دقت پایین و ناتوانی در تشخیص تغییرات ظریف در متن سرقت شده مواجه هستند. همچنین بیان چرایی تشخیص سرقت نیز یکی دیگر از چالشهای مهم در این حوزه است.
براین اساس، هدف از این پژوهش، بکارگیری الگوریتمهای یادگیری ماشین، تکنیکهای پردازش زبان طبیعی و الگوریتمهای هوش مصنوعی تفسیرپذیر است تا بتوان تغییرات جزئی و پیچیده در متن سرقت شده را شناسایی کرده و توضیح داد.
زرینبال ماسوله، مرضیه، الهام علایی ابوذر. زودآیند. طراحی سیستم توضیح پذیر تشخیص سرقت ادبی بینزبانی (انگلیسی-فارسی) در مستندات علمی پایگاه گنج. تهران: پژوهشگاه علوم و فناوری اطلاعات ایران.
