Trending now ស្នើឡើងការជួយឧបត្ថម្ភបណ្តាការឧបត្ថម្ភធនអត្រាការប្រាក់សម្រាប់សហគ្រាសវិនិយោគផ្លាស់ប្តូរថ្មីបច្ចេកវិទ្យា កសាងមជ្ឈមណ្ឌលស្រាវជ្រាវនិងមន្ទីរពិសោធន៍គំរូសម្រាប់បម្រើបច្ចេកវិទ្យាយុទ្ធសាស្ត្រ សេចក្តីសម្រេចចិត្តលេខ ៥៧៖ បើកឡើងនូវដំណាក់កាលអភិវឌ្ឍន៍ថ្មីមួយនៃប្រទេសជាតិ ឈានហួសពីវិសាលភាពវិទ្យាសាស្ត្រនិងបច្ចេកវិទ្យា វៀតណាមអះអាងបន្តគាំទ្រការដាក់ឱ្យអនុវត្តប្រកបដោយប្រសិទ្ធភាពនិងសារធាតុពិតប្រាកដនូវកិច្ចព្រមព្រៀងជាឯកច្ឆន្ទ ៥ ចំណុច វិទ្យាសាស្ត្រនិងបច្ចេកវិទ្យា ការច្នៃប្រឌិតបង្កើតថ្មីព្រមទាំងការបំប្លែងជាឌីជីថល៖ ស្ថាប័នបានគ្រប់ដណ្តប់ហើយ ការផ្តោតអារម្មណ៍គឺការអនុវត្តគោលនយោបាយ

បញ្ញាសិប្បនិម្មិត និងការភ័យខ្លាចនៃការផុតពូជនៃភាសាភាគតិច

08:00 | 11/02/2024

យុគសម័យ - បច្ចុប្បន្ននេះ ChatGPT គាំទ្រជាផ្លូវការ ៩៥ ភាសាក្នុងចំណោម ៧០០០ ភាសាដែលមាននៅក្នុងពិភពលោក។ នោះមានន័យថាជិត ៩៩% នៃភាសាមិនទាន់រកឃើញសំឡេងនៅក្នុងបរិយាកាសបញ្ញាសិប្បនិមិត្តនៅឡើយ។

ទីក្រុងហាណូយ៖ កម្មវិធី «ស្វែងយល់អំពីវៀតណាមឆ្នាំ២០២៤» ទីក្រុងហាណូយ៖ កម្មវិធី «ស្វែងយល់អំពីវៀតណាមឆ្នាំ២០២៤»
សំបុត្រមីជូនពរបុណ្យតេតប្រពៃណីរបស់វៀតណាមពីប្រធានសម្ព័ន្ធអង្គការមិត្តភាពវៀតណាម សំបុត្រមីជូនពរបុណ្យតេតប្រពៃណីរបស់វៀតណាមពីប្រធានសម្ព័ន្ធអង្គការមិត្តភាពវៀតណាម

យោងតាមគេហទំព័រ OpenAI ដែលជាម្ចាស់ ChatGPT ជារៀងរាល់ខែមានមនុស្សរហូតដល់ ១៨០ លាននាក់នៅជុំវិញពិភពលោកកំពុងប្រើប្រាស់ ChatGPT ។ ជារៀងរាល់ថ្ងៃ ការសន្ទនារាប់ពាន់លានរវាងមនុស្ស និងម៉ាស៊ីនកំពុងត្រូវបានបង្កើតឡើង។ ប៉ុន្តែនៅក្នុងការសន្ទនារាប់ពាន់លានទាំងនោះ យើងឃើញអវត្តមាននៃភាសាជនជាតិភាគតិច។ ភាសានីមួយៗគឺជាមោទនភាពរបស់ប្រទេសមួយ។ វាមិនត្រឹមតែជាមធ្យោបាយទំនាក់ទំនងប៉ុណ្ណោះទេ ថែមទាំងជាសម្បត្តិវប្បធម៌ ដែលផ្ទុកនូវប្រាជ្ញា ចំណេះដឹង និងអារម្មណ៍របស់សហគមន៍នីមួយៗ។ ប៉ុន្តែនៅក្នុងហ្គេមនៃបញ្ញាសិប្បនិមិត្ត ភាសាជាច្រើនមានហានិភ័យនៃការបំភ្លេចចោល។ ម៉ាស៊ីនរៀន "និយាយ" និង "ស្តាប់" តាមរយៈភាសាសាមញ្ញ។ ទន្ទឹមនឹងនេះ សំឡេងនៃសហគមន៍តូចៗដែលមានភាសាប្លែកៗបានស្ងប់ស្ងាត់ ហើយអាចនឹងវិនាស។

រូបថតឧទាហរណ៍
រូបថតឧទាហរណ៍

គំរូភាសាធំ (LLM)

ក្នុងចំណោមសាខាជាច្រើននៃការស្រាវជ្រាវបញ្ញាសិប្បនិមិត្ត មានសាខាមួយហៅថា AI ជំនាន់ថ្មី ហើយក្នុងចំណោមសាខាជាច្រើននៃ AI ជំនាន់នោះ មានសាខាមួយដែលចាប់អារម្មណ៍យ៉ាងខ្លាំងចំពោះទីផ្សារ ដែលជាគំរូភាសាធំ (Large language model - LLM)។ ដើម្បីពន្យល់ដោយសង្ខេប គំរូភាសាធំៗនីមួយៗគឺជាម៉ាស៊ីនដែលបង្កើតឡើងដើម្បីទស្សន៍ទាយពាក្យបន្ទាប់។ វាដូចជាការលេងហ្គេមកម្មវិធី The Magic Hat។ ពិធីករនឹងផ្តល់ riddle និងចំនួនអក្សរក្នុងចំលើយ ការងាររបស់អ្នកគឺទាយថាតើចម្លើយជាអ្វី។

ម៉ាស៊ីនគឺល្អណាស់នៅក្នុងហ្គេមភាសានេះ។ ពួកគេ​នឹង​ប្រើ​ប្រូបាប៊ីលីតេ​ស្ថិតិ​រួម​ជាមួយ​បរិបទ​ដើម្បី​ទស្សន៍ទាយ​ថា​អក្សរ​មួយ​ណា​ទំនង​ជា​ត្រូវ​គ្នា​នឹង​ចម្លើយ​បំផុត។ នៅកម្រិតកម្រិតខ្ពស់ ប្រយោគ កថាខណ្ឌ និងគំនិតមួយណាដែលសមស្របបំផុតក្នុងការឆ្លើយសំណួរ។ ដូចមនុស្សដែរ ម៉ាស៊ីនទាំងនេះនឹងត្រូវការវាក្យសព្ទ និងចំណេះដឹង ដើម្បីអាចឆ្លើយសំណួរបាន។ នៅក្នុងវិទ្យាសាស្ត្រកុំព្យូទ័រមនុស្សហៅវាថាទិន្នន័យ។

យោងតាម ​​BBC Science Focus ម៉ាស៊ីន GPT៣ ត្រូវបានបណ្តុះបណ្តាលលើទិន្នន័យអត្ថបទដែលបានត្រង ៥៧០ Gb ។ ឯកសារនេះមានប្រហែល ៣០០ ពាន់លានពាក្យ ស្មើនឹងប្រហែល ៨៥០ លានទំព័រនៃអត្ថបទដែលបានបោះពុម្ពលើក្រដាស A៤ ទំហំពុម្ពអក្សរ Arial ១២pt ។

តួលេខនេះគួរឱ្យចាប់អារម្មណ៍ខ្លាំងណាស់ ប៉ុន្តែប្រភពទិន្នន័យនេះនៅតែជាផ្នែកតូចមួយនៃឃ្លាំងព័ត៌មានរបស់មនុស្សជាតិប៉ុណ្ណោះ។ គុណភាពនៃឃ្លាំងព័ត៌មាននេះមិនអាចប្រៀបធៀបទៅនឹងបណ្ណាល័យធំៗក្នុងពិភពលោកបានទេ សូម្បីតែអាចនិយាយបានថានៅមានវត្ថុផ្សេងៗរាប់មិនអស់លាយឡំនៅខាងក្នុង។ វាគឺមានតំលៃនិយាយថាច្រើនជាង ៩/១០ នៃមូលដ្ឋានទិន្នន័យនេះបានមកពីឯកសារភាសាអង់គ្លេស។ ភាសាផ្សេងទៀតដូចជា បារាំង អាឡឺម៉ង់ អេស្បាញ និងអ៊ីតាលី បង្កើតជានំដែលនៅសេសសល់ភាគច្រើន។ ភាសា​ដទៃ​ទៀត​ក្នុង​លោក​កាន់កាប់​ចំណែក​ស្តើង​ដូច​ស្លឹក​ស្រូវ ហៅ​ថា​ឲ្យ ។

បញ្ញាសិប្បនិម្មិត និងការភ័យខ្លាចនៃការផុតពូជនៃភាសាភាគតិច
បញ្ញាសិប្បនិម្មិត និងការភ័យខ្លាចនៃការផុតពូជនៃភាសាភាគតិច

មតិព័ត៌មានចម្បងសម្រាប់ ChatGPT

នេះជាភស្តុតាងភ្លាមៗនៅក្នុងគុណភាពនៃ ChatGPT ។ ម៉ូដែល GPT ៣.៥ និង ៤ អាចឆ្លើយបានយ៉ាងស្ទាត់ជំនាញជាភាសាអង់គ្លេស ប៉ុន្តែជួបប្រទះនូវកំហុសឆ្គងជាច្រើននៅពេលប្រើពាក្យវៀតណាម ដែលជារឿយៗបង្កើតកថាខណ្ឌដែលមានលក្ខណៈច្របូកច្របល់ និងកន្សោមវេយ្យាករណ៍ច្របូកច្របល់។

សរុបមក ទិន្នន័យមានគុណភាពកាន់តែច្រើន គំរូភាសាធំ ៗ នឹងមានការស្មានកាន់តែប្រសើរ។ ហើយផ្ទុយទៅវិញ ទិន្នន័យកាន់តែតិច ទិន្នន័យមិនសូវល្អនឹងបង្កើតគំរូភាសាដែលមានគុណភាពទាប។ ដូច​ដែល​មនុស្ស​បច្ចេកវិទ្យា​តែង​តែ​និយាយ​ថា បើ​ធាតុ​ចូល​ជា​សំរាម នោះ​ទិន្នផល​ក៏​ជា​សំរាម​ដែរ។

ដូច្នេះហើយ ទោះបីជាមានបច្ចេកវិទ្យាទំនើបបំផុតនៅពីក្រោយពួកគេក៏ដោយ ក៏គំរូភាសាសំខាន់ៗនៅតែមិនអាចប៉ះជាមួយនឹងភាពសម្បូរបែបនៃភាសា និងវប្បធម៌របស់មនុស្ស។

ភាសាទាំងនេះកំពុងចុះខ្សោយ

យោងតាមកម្មវិធី International Decade of Indigenous Languages ​​របស់យូណេស្កូ មានប្រហែល ៧,០០០ ភាសាដែលកំពុងប្រើប្រាស់នៅលើពិភពលោក។ ប៉ុន្តែរៀងរាល់ពីរសប្តាហ៍ មនុស្សជាតិបាត់បង់ភាសាមួយ។ នោះគឺ មនុស្សចុងក្រោយដែលចេះភាសានោះបានស្លាប់ ឬបាត់បង់សមត្ថភាពក្នុងការទំនាក់ទំនង។ យោងតាមការទស្សន៍ទាយ នៅចុងសតវត្សរ៍ទី ២១ យើងនឹងឃើញការបាត់ខ្លួនប្រហែល ៣,០០០ ភាសា។

ភាសាដែលនៅរស់រានមានជីវិតភាគច្រើនជារបស់ជនជាតិដើមភាគតិច។ ដើម្បីទទួលបានឱកាសអភិវឌ្ឍន៍ សហគមន៍ជាច្រើនត្រូវបោះបង់ចោលជាបណ្តើរៗនូវភាសាប្រពៃណីរបស់ពួកគេ ដើម្បីបញ្ចូលគ្នាជាមួយភាសាដទៃទៀត។ ភាសា​សាមញ្ញ​របស់​អ្នក​មាន​បាន​ដើរ​តួនាទី​យ៉ាង​ធំ​ក្នុង​សេដ្ឋកិច្ច នយោបាយ អប់រំ និង​បច្ចេកវិទ្យា។

ប្រសិនបើអ្នកជាជនជាតិដើមនិយាយភាសា Naati នៅលើកោះមួយនៅប៉ាស៊ីហ្វិកខាងត្បូង អ្នកនឹងនិយាយភាសាចិនពេញមួយថ្ងៃជាមួយអ្នកទេសចរ អានកាសែតភាសាអង់គ្លេស បំពេញឯកសារអាពាហ៍ពិពាហ៍ជាភាសាបារាំង ពិភាក្សាជាមួយសហការីនៅ Bilasma ។ តើអ្នកនិយាយ Naati នៅពេលណា? ប្រហែលជានៅក្នុងសុបិនមួយ។ ដោយសារតែអ្នកគឺជាមនុស្សចុងក្រោយដែលនៅតែនិយាយ Naati យ៉ាងស្ទាត់ជំនាញ។

ក្នុងករណីធ្ងន់ធ្ងរជាងនេះ ដូចជាជនជាតិដើមអាមេរិកដើមចុងសតវត្សទី ១៩ រដ្ឋាភិបាលម្ចាស់ផ្ទះបានប្រើអំពើហិង្សាដើម្បីបង្ខំប្រជាជនឱ្យបោះបង់ភាសារបស់ពួកគេ។

ប្រជាជន​ដែល​បាត់បង់​ភាសា​នឹង​បាត់បង់​ឱកាស​រៀន​សូត្រ​ពី​ដូនតា។ ពួកគេរសាត់ក្នុងស្ថានភាពផ្លូវចិត្ត ខ្វះអត្តសញ្ញាណ និងប្រភពដើម។ នៅពេលដែលពួកគេមិនទទួលស្គាល់ថាពួកគេជានរណា ពួកគេមិនអាចភ្ជាប់ទៅកាន់សហគមន៍របស់ពួកគេបានទេ។ តែម្នាក់ឯងនៅក្នុងពិភពដ៏សែនរំខាន មនុស្សទាំងនេះនឹងទទួលរងនូវអារម្មណ៍អស់សង្ឃឹម សោកសៅ ការបាត់បង់ និងហានិភ័យនៃការបាត់បង់ឫសរបស់ពួកគេ។

ជាមួយនឹងការបាត់បង់ភាសានីមួយៗ ភាពចម្រុះនៃវប្បធម៌ បញ្ញា និងគំនិតច្នៃប្រឌិតរបស់មនុស្សជាតិមួយផ្នែកត្រូវបានបាត់បង់។ បើគ្មានភាសាទេ ទស្សនៈរបស់មនុស្សនឹងកាន់តែឯកោ។ បើគ្មានភាសាច្រើនទេ ទស្សនៈរបស់មនុស្សនឹងក្លាយទៅជាលំអៀង និងបំភ្លៃ។ បន្ទាត់សំខាន់ៗមួយចំនួននៃការគិតដែលពេញនិយមជាភាសាខ្លាំងៗនឹងឈ្នះដោយមិនប្រឈមមុខនឹងការរិះគន់ត្រឹមត្រូវ និងចាំបាច់។

ទិន្នន័យដែលធ្លាប់ពេញនិយមជាភាសាទាំងនេះនឹងកាន់តែពេញនិយម។ ខណៈពេលដែលទិន្នន័យផ្សេងទៀតដែលបង្ហាញជាភាសាសាមញ្ញតិច នឹងរលាយបាត់បន្តិចម្តងៗ បើទោះបីជាវាមានតម្លៃខ្លាំងណាស់ក៏ដោយ។

រូបថតឧទាហរណ៍
រូបថតឧទាហរណ៍

AI: ការពង្រីកភាពលំអៀង

នៅឆ្នាំ ២០១៧ ការស៊ើបអង្កេតផ្ទៃក្នុងរបស់ទស្សនាវដ្តីដ៏ល្បីល្បាញ National Geographic បានបង្ហាញថាមុនឆ្នាំ 1970 របាយការណ៍របស់ពួកគេពោរពេញទៅដោយការរើសអើងប្រឆាំងនឹងមនុស្សដែលមានពណ៌សម្បុរ។ កើតក្នុងកំឡុងកម្រិតខ្ពស់នៃអាណានិគមនិយម ទស្សនាវដ្តីនេះត្រូវបានទទួលឥទ្ធិពលយ៉ាងខ្លាំងដោយមនោគមវិជ្ជាប្រកាន់ពូជសាសន៍។

មនុស្ស​មាន​ពណ៌​សម្បុរ​តែង​តែ​បង្ហាញ​ខ្លួន​ក្នុង​សម្លៀក​បំពាក់​មិន​ស្អាត ជាពិសេស​ស្ត្រី។ ពួកវាត្រូវបានបង្ហាញពីទស្សនៈដ៏ចម្លែក ព្រៃផ្សៃ ថយក្រោយ ហើយជាញឹកញាប់រំភើប និងគ្របដណ្តប់ដោយគ្រឿងចក្រទំនើបរបស់បស្ចិមប្រទេស។

ប្រវត្តិវិទូថតរូប លោក John Edwin Mason ដែលបានចូលរួមក្នុងការស៊ើបអង្កេតនេះ បានធ្វើអត្ថាធិប្បាយថា ៖ ជនជាតិអាមេរិកបានយកគំនិតពីខ្សែភាពយន្តល្បីៗដូចជា Tarzan និងរូបគំនូរជីវចលដ៏ព្រៃផ្សៃនៃការរើសអើងជាតិសាសន៍ ដើម្បីឆ្លុះបញ្ចាំងពីពិភពលោក។ យើង​ក៏​អាច​មើល​ឃើញ​ភាព​លំអៀង​ស្រដៀង​គ្នា​នេះ​នៅ​ក្នុង​រូបថត​បារាំង​របស់​វៀតណាម​នៅ​ដើម​សតវត្សរ៍​ទី ២០។

គេ​គិត​ថា​អតីតកាល​បាន​កន្លង​ផុត​ទៅ​ហើយ ប៉ុន្តែ​ក្នុង​ឆ្នាំ ២០១៥ រូបថត​មួយ​សន្លឹក​ដែល​មាន​ឈ្មោះ​ថា Come up for air បាន​ចុះ​ផ្សាយ​ក្នុង​ទស្សនាវដ្ដី​មួយ​បាន​បង្ក​ឲ្យ​មាន​ភាព​ចម្រូងចម្រាស។ រូបថត​នេះ​បង្ហាញ​ពី​ទិដ្ឋភាព​ពីលើ​អាកាស​នៃ​ដំបូល​មួយ​ក្នុង​ទីក្រុង​វ៉ារ៉ាណាស៊ី​ប្រទេស​ឥណ្ឌា។ នៅ​លើ​ដំបូល​ផ្ទះ​នោះ​មាន​ក្រុម​គ្រួសារ​ដែល​មាន​មនុស្ស​រាប់​សិប​នាក់ រួម​ទាំង​ស្ត្រី និង​កុមារ​កំពុង​ដេក។ នៅទីនោះទារកអាក្រាតទាំងស្រុង។

អ្នកប្រឆាំងនិយាយថា National Geographic កំពុងប្រើស្តង់ដារទ្វេ។ ប្រសិនបើរូបថតនោះជាគ្រួសារស្បែកសនៅភាគខាងលិច ទស្សនាវដ្តីនេះនឹងមិនបោះពុម្ពវាទេ។ ពួកគេ​នឹង​ត្រូវ​ប្តឹង​ពី​បទ​លុកលុយ​ឯកជនភាព។ ប៉ុន្តែ​នេះ​ជា​ប្រទេស​ឥណ្ឌា លទ្ធភាព​នៃ​ការ​ប្តឹង​ផ្តល់​គឺ​មាន​កម្រិត​ទាប​ជាង ហើយ​មិន​មាន​អ្វី​ត្រូវ​បារម្ភ​នោះ​ទេ។

នៅក្នុង "មហាសមុទ្រព្រៃនៃអ៊ីនធឺណិត" ទិន្នន័យលំអៀងបែបនេះមានច្រើនដូចកាកសំណល់ប្លាស្ទិក។ ដោយត្រូវបាន "បង្រៀន" ជាមួយនឹងអត្ថបទរាប់លានដែលប្រមូលបានពីអ៊ីនធឺណិត LLMs មិនត្រឹមតែរៀនពីរបៀបប្រើប្រាស់ភាសាប៉ុណ្ណោះទេ ប៉ុន្តែថែមទាំងស្រូបយកភាពលំអៀង និងព័ត៌មានមិនត្រឹមត្រូវផងដែរ។ អ្វីក៏ដោយដែលអ្នករៀន AI អាចបង្កើតចម្លើយដែលលម្អៀង និងរើសអើង ជាពិសេសនៅពេលនិយាយអំពីបញ្ហារសើបដូចជា ពូជសាសន៍ សាសនា យេនឌ័រ និងនយោបាយ។

Open AI និយាយថាវាតែងតែយកចិត្តទុកដាក់ចំពោះក្រុមដែលជួបការលំបាក និងធ្វើអ្វីគ្រប់យ៉ាងដែលអាចធ្វើទៅបានដើម្បីការពារមនោគមវិជ្ជាពុល ដោយព្យាយាមបង្កើតបញ្ញាសិប្បនិម្មិតដែលមិនលំអៀង និងឆ្លុះបញ្ចាំងពីពិភពលោកប្រកបដោយក្រមសីលធម៌។ ប្រសិនបើនេះជាការពិត វានឹងក្លាយជាកិច្ចខិតខំប្រឹងប្រែងប្រកបដោយកិត្តិយស និងអត្ថន័យសម្រាប់មនុស្សជាតិក្នុងសម័យបច្ចុប្បន្ន។

ប៉ុន្តែ​សេវា​អ៊ីនធឺណិត​ធំៗ​ក៏​បាន​និយាយ​ដូច​គ្នា​ដែរ។ Youtube, Tiktok, Instagram, Facebook... សុទ្ធតែនិយាយថាពួកគេបានព្យាយាមបង្កើតបរិយាកាសដែលមានសុខភាពល្អ។ អ្នកប្រើប្រាស់បានឃើញលទ្ធផលរួចហើយ។ ដូច​តារា​ចម្រៀង ដេន វ៉ាវ និយាយ​ក្នុង​បទ​ថា It's very cloud today: "វា​មាន​សុវត្ថិភាព​ក្នុង​ព្រៃ​ជាង​តាម​អ៊ីនធឺណិត"។

ការស្ទង់មតិដែលធ្វើឡើងក្នុងខែមករា ឆ្នាំ ២០២៤ ដែលបានបង្ហោះនៅលើគេហទំព័រ arxiv.org ហៅថា អ្នកនិពន្ធ AI រាប់ពាន់នាក់អំពីអនាគតនៃ AI បានធ្វើឱ្យមានការព្យាករណ៍គួរឱ្យចាប់អារម្មណ៍ជាច្រើនអំពីអនាគតរបស់ AI ។ ជាឧទាហរណ៍ យ៉ាងហោចណាស់មានឱកាស ៥០% ដែលនៅឆ្នាំ ២០២៨ AI អាចបង្កើតបទចម្រៀងដូចគ្នាបេះបិទទៅនឹងសិល្បករធំៗ ឬបង្កើតគេហទំព័របង់ប្រាក់ដោយស្វ័យប្រវត្តិពី a ដល់ z ។ នេះ​ជា​ការ​ស្ទង់​មតិ​មួយ​ដែល​ធ្វើ​ឡើង​លើ​អ្នក​ស្រាវជ្រាវ​បញ្ញា​សិប្បនិមិត្ត​ឈាន​មុខ​គេ​លើ​ពិភពលោក​ចំនួន ២៧៧៨​នាក់។ នេះ​ជា​ការ​ស្ទង់​មតិ​ដែល​ធ្វើ​ឡើង​ជា​រៀង​រាល់​ឆ្នាំ។ ហើយជារៀងរាល់ឆ្នាំអ្នកស្រាវជ្រាវធ្វើការទស្សន៍ទាយថ្មីៗមុន និងខ្លាំងជាងមុនអំពីព្រឹត្តិការណ៍សំខាន់ៗនាពេលអនាគតរបស់ AI ។ នោះមានន័យថាអ្វីៗកំពុងអភិវឌ្ឍលឿនជាងអ្នកជំនាញព្យាករណ៍។

ប្រសិនបើការទស្សន៍ទាយនេះត្រឹមត្រូវ អ្នកណាម្នាក់ដែលចេះប្រើប្រាស់ AI អាចជាតន្ត្រីករ និងជាអ្នកនិពន្ធ។ នោះក៏មានន័យថា ប្រសិនបើភាពលំអៀង ឬលំអៀងទទួលបានតាមរយៈតម្រង AI នោះ វាអាចត្រូវបានចម្លងជាច្រើនដង។ នៅក្នុងបរិយាកាសដែលពោរពេញទៅដោយភាពលំអៀង និងគម្លាតបែបនេះ ការរើសអើង និងការខ្វែងគំនិតគ្នារវាងសហគមន៍ និងវប្បធម៌នឹងកាន់តែធំឡើង។ នៅទីបំផុត សិទ្ធិរបស់អ្នកងាយរងគ្រោះនឹងត្រូវរងការខូចខាតយ៉ាងធ្ងន់ធ្ងរ។

រូបថតឧទាហរណ៍
រូបថតឧទាហរណ៍

បញ្ហាប្រឈមជាមួយភាសាសាមញ្ញតិច

ការបង្កើត LLMs សម្រាប់ ៩៩% ដែលនៅសល់ប្រឈមនឹងឧបសគ្គជាច្រើន។ ទីមួយ ភាសាជនជាតិភាគតិចជាច្រើនមិនមានទិន្នន័យអត្ថបទ ឬសុន្ទរកថាគ្រប់គ្រាន់ដែលត្រូវការដើម្បីបណ្តុះបណ្តាលគំរូភាសាមួយ។ នេះរួមបញ្ចូលទិន្នន័យដែលមានគុណភាពខ្ពស់ ចម្រុះ និងតំណាងនៃភាសានោះ។

ទីពីរ បើទោះបីជាធនធានភាសាមានច្រើនក៏ដោយ ការប្រមូលវាមិនមែនជារឿងសាមញ្ញដូចការទៅផ្សារទំនើបនោះទេ។ យើង​នឹង​ត្រូវ​ការ​កម្លាំង​ដ៏​ខ្លាំង​នៃ​អ្នក​ភាសាវិទ្យា អ្នក​ជាតិ​និយម អ្នក​ស្រាវជ្រាវ​ប្រវត្តិសាស្ត្រ និង​វប្បធម៌ ... ដើម្បី​ប្រមូល វាយ​តម្លៃ និង​ផ្ទៀងផ្ទាត់​ទិន្នន័យ​ដោយ​ប្រុងប្រយ័ត្ន និង​វិជ្ជាជីវៈ។ តើយើងអាចស្វែងរកអ្នកវិទ្យាសាស្ត្រសង្គម និងមនុស្សសាស្ត្រមួយចំនួនធំបាននៅឯណា ដើម្បីបំប្លែងភាសាចំនួន ៧,០០០ ដែលនៅសល់?

ទីបី សហគមន៍ជនជាតិភាគតិចជាច្រើនក៏មិនមានលទ្ធភាពប្រើប្រាស់អ៊ីនធឺណិតដែរ ហើយចំនួនទិន្នន័យដែលពួកគេបង្កើតអំពីប្រជាជនរបស់ពួកគេគឺមិនសំខាន់ទេ។

ទីបួន ភាសាជនជាតិភាគតិច ច្រើនតែមានរចនាសម្ព័ន្ធភាសា និងវាក្យសព្ទខុសគ្នាខ្លាំង បើប្រៀបធៀបទៅនឹងភាសាធំៗ។ យើង​នឹង​ត្រូវ​ការ​គំរូ​ភាសា​ថ្មី​ដែល​មាន​ភាសា​ប្លែក​ៗ។

ហើយចុងក្រោយ MONEY ។ តើអ្នកណានឹងចំណាយសម្រាប់កិច្ចការដ៏លំបាកបែបនេះ? គំរូភាសាសំខាន់ៗនាពេលបច្ចុប្បន្ននេះត្រូវបានបង្កើតឡើងដោយក្រុមហ៊ុនឯកជន។ ក្រុមហ៊ុនទាំងនេះច្បាស់ជាត្រូវតែរកប្រាក់ចំណេញ ខណៈពេលដែលប្រាក់ចំណេញនៃភាសាដែលមនុស្សតិចណាស់និយាយគឺមិនប្រាកដប្រជា។

ទោះ​ជា​យ៉ាង​ណា​ក៏​ដោយ យើង​នៅ​មាន​មូលដ្ឋាន​សម្រាប់​ក្តី​សង្ឃឹម។ គំរូភាសាធំៗដូចជា ChatGPT កាន់តែឆ្លាតវៃ ទាមទារទិន្នន័យតិច ប៉ុន្តែផ្តល់លទ្ធផលត្រឹមត្រូវ។ ពីទិសដៅផ្ទុយ AI អាចជួយអ្នកភាសាវិទ្យាស្តារភាសាដែលជិតបាត់។

យោងតាមគេហទំព័រ Statistica ទំហំទីផ្សារ AI សកលនៅឆ្នាំ ២០២៣ គឺប្រហែល ២០៧.៩ ពាន់លានដុល្លារអាមេរិក។ នៅឆ្នាំ ២០៣០ ចំនួននេះត្រូវបានព្យាករណ៍ដោយក្រុមហ៊ុនប្រឹក្សាយោបល់នឹងកើនឡើងពី 3 ទៅ 7 ដង។ ជាមួយនឹងចំនួនទឹកប្រាក់ដ៏ច្រើននេះហូរចូលទៅក្នុងទីផ្សារ សង្ឃឹមថាមនុស្សជាតិនឹងមានធនធានគ្រប់គ្រាន់ដើម្បីបង្កើត LLMs សម្រាប់ភាសាដែលមិនសូវស្គាល់។ ឥឡូវនេះ បុគ្គលដែលខិតខំប្រឹងប្រែងក៏កំពុងស្វែងរកវិធីដើម្បីភ្ជាប់ទំនាក់ទំនងគ្នាទៅវិញទៅមកតាមរយៈបណ្តាញសង្គមដើម្បីបង្កើត LLMs ផ្ទាល់ខ្លួនរបស់ពួកគេ។ ទោះបីជាទាំងនេះគ្រាន់តែជាការខិតខំប្រឹងប្រែងតិចតួចក៏ដោយ វានាំមកនូវក្តីសង្ឃឹមសម្រាប់អនាគត សហគមន៍នឹងអាចបង្កើត LLM ផ្ទាល់ខ្លួនរបស់ពួកគេនៅពេលដែល AI ក្លាយជាការពេញនិយម។

ចូរសង្ឃឹមថាអ្នកដែលអភិវឌ្ឍ AI ជាពិសេសវិស័យ LLM នឹងបង្កើតកន្លែងសម្រាប់ភាសាជនជាតិភាគតិចដើម្បីរស់។ ព្រោះនោះជាវប្បធម៌ជាស្នូលនៃអរិយធម៌របស់មនុស្ស។ ហើយមិនដូចក្បួនដោះស្រាយ និងម៉ាស៊ីនដែលមិនស្ម័គ្រចិត្តទេ អ្នកបង្កើត AI មានបេះដូងមនុស្ស។

មតិពីមិត្តអ្នកអាន

ព័ត៌មានថ្មីៗ

សម្ពោធបណ្តាញចំណេះដឹងវៀតណាមនៅប្រទេសនូវែលសេឡង់
វៀតណាមកំណត់គោលដៅចូលក្នុងក្រុមមជ្ឈមណ្ឌលហិរញ្ញវត្ថុជំពូកមុខ ៧៥ លើពិភពលោក
វៀតណាមអំពាវនាវឱ្យមានកិច្ចសហប្រតិបត្តិការអន្តរជាតិក្នុងការគ្រប់គ្រងធនធានធម្មជាតិដើម្បីសន្តិភាព និងសន្តិសុខ
ផ្លាស់ប្តូរថ្មីការងារការទូតប្រជាជន រួមចំណែកបង្កើតកម្លាំងសរុបនៃវិស័យការទូតវៀតណាម
វៀតណាមស្នើឱ្យចិនពង្រីកទីផ្សារសម្រាប់កសិផល

អានច្រើនបំផុត

ស្នើឡើងការជួយឧបត្ថម្ភបណ្តាការឧបត្ថម្ភធនអត្រាការប្រាក់សម្រាប់សហគ្រាសវិនិយោគផ្លាស់ប្តូរថ្មីបច្ចេកវិទ្យា
កសាងមជ្ឈមណ្ឌលស្រាវជ្រាវនិងមន្ទីរពិសោធន៍គំរូសម្រាប់បម្រើបច្ចេកវិទ្យាយុទ្ធសាស្ត្រ
សេចក្តីសម្រេចចិត្តលេខ ៥៧៖ បើកឡើងនូវដំណាក់កាលអភិវឌ្ឍន៍ថ្មីមួយនៃប្រទេសជាតិ ឈានហួសពីវិសាលភាពវិទ្យាសាស្ត្រនិងបច្ចេកវិទ្យា
វៀតណាមអះអាងបន្តគាំទ្រការដាក់ឱ្យអនុវត្តប្រកបដោយប្រសិទ្ធភាពនិងសារធាតុពិតប្រាកដនូវកិច្ចព្រមព្រៀងជាឯកច្ឆន្ទ ៥ ចំណុច
វិទ្យាសាស្ត្រនិងបច្ចេកវិទ្យា ការច្នៃប្រឌិតបង្កើតថ្មីព្រមទាំងការបំប្លែងជាឌីជីថល៖ ស្ថាប័នបានគ្រប់ដណ្តប់ហើយ ការផ្តោតអារម្មណ៍គឺការអនុវត្តគោលនយោបាយ