کلید واژه ها: زبان فارسی بازیابی اطلاعات نگارش املا

حوزه های تخصصی:
شماره صفحات: ۵۹ - ۹۲
دریافت مقاله   تعداد دانلود  :  ۴۶

آرشیو

آرشیو شماره ها:
۸۱

چکیده

هدفهای پژوهش: زبان فارسی، به سبب ویژگیهای خاصّ آن و در عین حال نهادینه نشدن سبک نگارش استاندارد، در رویارویی با محیطهای الکترونیکی، با دشواریهایی روبه روست که تأثیری بسزا بر اثربخشی بازیابی اطلاعات می گذارد. پژوهش حاضر می کوشد تا با بررسی متون و پیشینه های موجود، چالشهای نگارش فارسی، تأثیر آنها بر اثربخشی بازیابی اطلاعات، و پیشنهاد های ارائه شده در جهت رفع این دشواریها را مورد بحث و بررسی قرار دهد. اهمیت پژوهش: با تحلیل و مرور جامع متونی که درباره چالشهای نگارش فارسی در محیطهای دیجیتال نگارش یافته است، می توان دانشی را که تاکنون در این باره گرد آمده است به تصویر کشید و کاستیها و پیشرفتهای به دست آمده در این زمینه را آشکار ساخت. روش پژوهش: روش پژوهش حاضر، متن پژوهی با رویکرد تحلیل محتواست که از روشهای پژوهش کیفی به شمار می آید. «پاراگراف»، «جمله» و «کلمه» به عنوان واحد تحلیل انتخاب شد، زیرا ممکن بود هر دشواری یا راهکار تنها در یک کلمه یا عبارت مورد اشاره قرار گرفته یا در جمله یا پاراگراف شرح داده شده باشد. یافته ها: آثار مورد بررسی، بیش از ۴۰ دشواری نگارشی را در رابطه با جستجو و بازیابی اطلاعات فارسی ذکر کرده اند. این گونه گونی نگارشی به نایکدستی و تطور بسیار در نگارش فارسی می انجامد که می تواند اثربخشی بازیابی را بویژه از منظر کاهش دقت یا ریزش کاذب و نیز کاهش جامعیت بازیابی، متأثر سازد. در نتیجه، ضروری است در طراحی الگوریتمهای سامانه های جستجو و بازیابی فارسی، به هنجارسازی تنوعات و چنددستیهای نگارشی و دستوری مد نظر قرار گیرد. تدوین استاندارد نگارش فارسی، استفاده از سیاهه های از پیش تعیین شده، تجهیز پایگاه اطلاعاتی به اصطلاحنامه و فرهنگهای املایی، و تدوین دستنامه یا راهنمای جستجو، از جمله راهکارهای ارائه شده است. این راهکارها با وجود جامع نبودن، کم و بیش اثربخش به نظر می رسند. نتیجه گیری: از آنجا که راهکارهای انسانی، نیازمند مشارکت فعّالانه و آموزش نویسندگان متون (تایپیستها و کاربران) است و از روندی بلندمدت و هزینه بر برخوردار است، حرکت به سوی راهکارهای خودکارسازی پردازش متن و نمایه سازی، ضروری است.