د پښتو ژبې د مصنوعي ځیرکتیا او ډیجیټلي ټکنالوژۍ لپاره یو مهم پرمختګ شوی او څېړونکو د «پښتو کارپ» په نوم د پښتو ژبې تر ټولو ستره ډیجیټلي متني زېرمه جوړه کړې ده.

 

د څېړنې له مخې، په دې پروژه کې شاوخوا ۱ اعشاریه ۲۵ میلیارده پښتو کلمې او نږدې ۲ اعشاریه ۸۱ میلیونه اسناد راټول شوي دي. څېړونکي وايي، چې دا زېرمه د پښتو لپاره تر دې مخکې له موجودو لویو ډیجیټلي زېرمو څخه څو چنده ستره ده.

 

د «پښتو کارپ» د جوړولو لپاره له ۳۹ بېلابېلو سرچینو څخه مواد راټول شوي دي. په دې کې د پښتو خبرونه، کتابونه، وېبپاڼې، وېکيپېډیا، علمي لیکنې او نور عامه خپاره شوي متنونه شامل دي. ټول معلومات د ځانګړي تخنیکي بهیر له لارې پاک، تکراري متنونه ترې لرې او معیاري شوي دي.

 

څېړونکي وايي، چې د دې زېرمې په مرسته د پښتو لپاره د مصنوعي ځیرکتیا، ژباړې، غږ پېژندنې، لټون، پوښتنې او ځواب، او لویو ژبنیو ماډلونو کیفیت د پام وړ ښه کېدی شي. د ازمایښتي پایلو له مخې، هغه ژبني ماډلونه چې پر «پښتو کارپ» روزل شوي، د پښتو د نومونو او ځایونو په پېژندنه او د متن په پوهېدو کې د پخوانیو ماډلونو په پرتله ښه نتیجه ورکوي.

 

کارپوهان وايي، چې دا پروژه یوازې د مصنوعي ځیرکتیا لپاره نه، بلکې د پښتو ژبې د ساتنې لپاره هم مهم ارزښت لري. د دوي په وینا، کله چې میلیونونه پښتو متنونه په ډیجیټلي بڼه خوندي شي، نو ژبه، ولسي اصطلاحات، ادبي سبکونه او سیمه‌ ییزې لهجې به د راتلونکو نسلونو لپاره هم پاتې شي.

 

د ژبپوهانو په اند، که د پښتو د پاکستان او افغانستان د بېلابېلو سیمو لهجې، ادبي اثار او رسنیز مواد هم په ورته پروژو کې زیات شامل شي، نو راتلونکي کمپیوټري سیستمونه به د پښتو په بېلابېلو لهجو هم په ښه ډول پوه شي او د ژبې ډیجیټلي راتلونکی به لا پیاوړی شي.