به نقل از هریتیج دیلی، پژوهشگران آکادمی علوم اتریش با همکاری شرکت‌های اروپایی Mistral AI و SAIL Reply، نخستین مدل زبانی بزرگ ویژه زبان یونانی باستان را توسعه داده‌اند؛ سامانه‌ای به نام «آپولو» که می‌تواند بخش‌های ازدست‌رفته پاپیروس‌ها، کتیبه‌ها و اسناد تاریخی را در چند ثانیه بازسازی کند. این فناوری که ۲۳ سپتامبر ۲۰۲۶ معرفی شد، قرار است به باستان‌شناسان و مورخان در خواندن متونی کمک کند که قرن‌ها به‌دلیل آسیب‌دیدگی یا ناقص بودن، رمزگشایی آن‌ها دشوار بوده است.

آپولو با استفاده از حدود ۶۰۰ میلیون واژه یونانی باستان آموزش دیده و می‌تواند با تحلیل بخش‌های باقی‌مانده متن، واژه‌ها، جمله‌ها و حتی بخش‌های طولانی گمشده را پیشنهاد دهد. نخستین نسخه این سامانه به‌صورت رایگان در اختیار پژوهشگران و عموم قرار گرفته است.

چالش بزرگ باستان‌شناسی؛ میلیون‌ها متن ناتمام

در موزه‌ها و کتابخانه‌های جهان صدها هزار کتیبه باستانی و بیش از یک میلیون قطعه پاپیروس نگهداری می‌شود، اما بخش بزرگی از این آثار آسیب دیده یا ناقص است. آکادمی علوم اتریش می‌گوید حدود ۹۲ درصد پاپیروس‌های شناخته‌شده هنوز به‌طور کامل رمزگشایی نشده‌اند و همین موضوع باعث شده بخش بزرگی از شواهد تاریخی همچنان ناشناخته باقی بماند.

بازسازی این متون معمولا به سال‌ها تجربه در زبان‌های باستانی، دستور زبان، سبک نگارش و زمینه تاریخی نیاز دارد و حتی متخصصان گاهی ساعت‌ها برای تکمیل چند واژه وقت صرف می‌کنند. آپولو تلاش می‌کند این روند را سرعت ببخشد؛ با این تفاوت که نقش آن ارائه پیشنهاد است و تصمیم نهایی همچنان بر عهده پژوهشگران خواهد بود.

دقت ۸۰ درصدی در آزمایش‌ها

یکی از مهم‌ترین نکات این پروژه، عملکرد آن در آزمون‌های عملی است. پژوهشگران بخش‌هایی از پاپیروس‌های اصلی را عمدا پنهان کردند و از آپولو خواستند متن را کامل کند. این سامانه توانست حدود ۸۰ درصد از بخش‌های حذف‌شده را به‌درستی بازسازی کند.

نتایج یک آزمون کور با حضور متخصصان بین‌المللی نیز قابل توجه بود. کارشناسان در ۷۷ درصد موارد، پیشنهادهای آپولو را هم‌سطح یا بهتر از بازسازی‌های انسانی ارزیابی کردند و در ۱۶ تا ۲۰ درصد موارد، نسخه هوش مصنوعی را برتر دانستند. این نتایج نشان می‌دهد مدل‌های تخصصی می‌توانند به ابزارهای ارزشمندی برای پژوهش‌های تاریخی تبدیل شوند.

از هومر تا مصر رومی؛ تشخیص سبک‌های مختلف یونانی

یکی از توانایی‌های مهم آپولو، تشخیص تفاوت میان دوره‌های مختلف زبان یونانی است. یونانیِ آثار هومر با متون اداری دوران روم تفاوت‌های چشمگیری در واژگان و دستور زبان دارد و همین موضوع بازسازی متون را پیچیده می‌کند.

پژوهشگران می‌گویند این سامانه با تحلیل ساختار جمله‌ها و انتخاب واژه‌ها، می‌تواند سبک هر دوره را تشخیص دهد و پیشنهادهایی متناسب با همان دوره ارائه کند. این ویژگی به‌ویژه برای اسنادی که تاریخ یا منشأ آن‌ها مشخص نیست، اهمیت زیادی دارد.

بازسازی اسناد تاریخی؛ از مصر تا وزوو

پژوهشگران برای نمایش توانایی‌های آپولو چند نمونه واقعی را آزمایش کردند. یکی از آن‌ها اعلامیه تولد کودکی در مصر رومی بود که به سال ۱۴۹ میلادی تعلق داشت و هوش مصنوعی توانست بخش‌های گمشده آن را بازسازی کند.

نمونه دیگر، طوماری بود که در فوران کوه وزوو در سال ۷۹ میلادی زغال‌شده و مطالعه آن بسیار دشوار است. آپولو در بازسازی بخش‌هایی از این طومار نیز عملکرد موفقی داشت و به تفسیر بهتر متن کمک کرد.

در نمونه‌ای دیگر، بازسازی یک کتیبه از منطقه دریای سیاه نشان داد که قوانین روم در آن منطقه زودتر از تصور پژوهشگران اجرا می‌شده و شواهدی از وجود مالیات بر روسپی‌گری نیز ارائه کرد. این مثال‌ها نشان می‌دهد حتی تکمیل چند واژه می‌تواند برداشت مورخان از تاریخ را تغییر دهد.

راهی تازه برای شناخت زندگی روزمره باستان

به گفته پژوهشگران، ارزش واقعی آپولو فقط در خواندن متون مشهور نیست، بلکه در بررسی انبوه اسناد روزمره نهفته است؛ اسنادی مانند رسیدهای مالیاتی، قراردادها، نامه‌های شخصی و مدارک اداری که هرکدام به‌تنهایی اهمیت چندانی ندارند، اما کنار هم تصویری دقیق‌تر از اقتصاد، تجارت، اشتغال و روابط اجتماعی جهان باستان ارائه می‌کنند.

به گفته آنا دولگانوف، سرپرست پروژه، هوش مصنوعی نه‌تنها سرعت پژوهش را افزایش می‌دهد، بلکه گاهی پیشنهادهایی ارائه می‌کند که شاید پژوهشگر هرگز به آن‌ها فکر نکرده باشد. با این حال، او تأکید می‌کند که هر بازسازی باید با شواهد تاریخی و زبانی سنجیده شود و آپولو قرار نیست جایگزین متخصصان شود.

گام بعدی؛ ساخت نسخه لاتین

پروژه آپولو قرار است در آینده گسترش پیدا کند. تیم پژوهشی قصد دارد علاوه بر بهبود توانایی بازسازی متون، امکان جست‌وجوی معنایی و موضوعی میان اسناد یونانی باستان را نیز فراهم کند تا پژوهشگران بتوانند ارتباط میان متونی را که در دوره‌ها یا مجموعه‌های مختلف قرار دارند، آسان‌تر پیدا کنند.

گام بعدی، توسعه مدلی ویژه زبان لاتین است؛ زبانی که منابع آموزشی بسیار گسترده‌تری در اختیار دارد و انتظار می‌رود نسخه لاتین آن با تکیه بر مجموعه‌ای حدود ۱۲ میلیارد واژه آموزش ببیند.

آپولو با بودجه‌ای حدود ۴۰۰ هزار یورو توسعه یافته و اکنون به‌صورت رایگان در دسترس قرار دارد. پژوهشگران امیدوارند این فناوری بتواند پنجره‌ای تازه به دنیای باستان بگشاید و به خواندن اسنادی کمک کند که قرن‌ها در سکوت و تاریکی باقی مانده‌اند.