Uz saturu

"ChatGPT" – lielākais sasniegums valodu tehnoloģijās. Kādas krietnas un arī nelietīgas iespējas tas paver?

Produktivitātes veicināšanā un darbspēju uzlabošanā cilvēka "labākais draugs" neapšaubāmi ir mākslīgais intelekts, kurš attīstās ļoti strauji un ar kuru ikdienā patiesībā sastopamies ik uz stūra. Nesen šajā lauciņā klajā nācis čatbots "ChatGPT", kas visā pasaulē raisījis ārkārtīgi lielu interesi un sajūsmu. Kas tas ir par "zvēru" un kā to varam ikdienā izmantot?

2022. gada 19. decembrī 6:19

Runājot vispārīgi par mākslīgo intelektu (MI), tā definīcija no cilvēka uz cilvēku visdrīzāk atšķiras, jo MI robežas laika gaitā ir ļoti izplūdušas, "’tv3.lv’’ skaidro SIA "’Tilde’’ Mākslīgā intelekta attīstības un pētniecības vadītājs Mārcis Pinnis. Ap 1960.–70. gadiem par MI uzskatīja ekspertu sistēmas jeb risinājumus, kur kāds eksperts definējis likumus tam, kā konkrētai sistēmai jāuzvedas. Piemēram, iesniedzot maksājumu bankā, tās sistēma zina, pa kādiem kanāliem to pārvirzīt, lai maksājums nonāk līdz mērķim.

Saturs turpinās pēc reklāmas

Reklāma

Mūsdienās daudzi to vairs neuzskata par MI, bet gan tā latiņu uzlikuši krietni augstāk. Lielai daļai MI saistās ar neironu tīklu (skaitļošanas sistēma, kuru veido liels daudzums skaitļošanas elementu, sauktu par neironiem, kas noteiktā veidā savienoti viens ar otru, un kopā veic kādu noteiktu uzdevumu – red.) tehnoloģijām. Tāpat daļa ekspertu jau arī šīs tehnoloģijas vairs neuzlūko kā MI, bet gan uzskata – neironu tīklam jābūt tik attīstītam, lai tas pats spētu sevi apmācīt un attīstīties tālāk.

"’Es gan pieturos pie definīcijas – jebkurš risinājums, kurš pilda kādu funkciju, kuru pildītu cilvēks vai cita dzīva būtne, ir mākslīgais intelekts,’’ stāsta Pinnis.

Iespējams, ikdienā par to lieki prātus nelauzām, bet MI patiesībā mums ir visapkārt. "’Mēs katru dienu izmantojam risinājumus, kuri ļauj mums atrast informāciju internetā, ne tā?’’ negaidot atbildi, jautā pētnieks un turpina: "’Tā ir viena no veiksmīgākajām mākslīgā intelekta pielietošanas tehnoloģijām. Piemēram, "’Google’’ meklētāju veido dažādas komponentes, kur vairākas pilda mākslīgā intelekta funkcijas – ar konkrētiem datiem ir apmācītas kādu problēmu risināšanā.’’

Pievēršoties "’Tilde’’ darbības virzieniem, arī mašīntulkošana ir būtiska MI komponente. Pinnis min, ka visdrīzāk jebkurš, kurš ikdienā lieto internetu, kādreiz nejauši ir uzdūries kādam tulkošanas risinājumam. Piemēram, "’Facebook’’ vai "’Twitter’’ uzspiedis pogu "’iztulkot’’. Arī tas ir mākslīgais intelekts.

Pētnieks uzsver, ka MI galvenais uzdevums ir efektivizēt mūsu darbu. To var veikt primāri divos virzienos – pilnīgā procesu automatizēšanā vai produktivitātes palielināšanā. Piemēram, tulkošana ir joma, kur MI produktivitāti palielina, paver iespējas analizēt un apstrādāt vairāk satura, kas nebūtu iespējams, ja cilvēks šo darbu veiktu ar roku.

Saturs turpinās pēc reklāmas

Reklāma

Savukārt pilnībā automatizēt iespējams, piemēram, dažādus lauksaimniecības procesus, tostarp zemes apstrādāšanu, kuru veic MI, bet cilvēks to uzrauga attālināti. Kā arī MI palīdz automatizēt dažādus ražošanas procesus. "’Es šobrīd runāju ļoti skarbi, bet cilvēkam pie konveijera ir jāmaksā alga. Robotam tāda nav jāmaksā, bet ir jāapmaksā elektrība. Līdz ar to tie ir virzieni, kuros notiek digitalizācija, mākslīgā intelekta ieviešana un kur agrāk vai vēlāk cilvēks tiks aizstāts,’’ paskaidro Pinnis.

"’ChatGPT’’ – lielākais sasniegums valodas modeļu tehnoloģijās. Kāpēc?

Neapšaubāmi pēdējo nedēļu laikā lielu popularitāti visā pasaulē, tostarp arī Latvijā, ieguvis MI pētnieciskās laboratorijas "’OpenAI’’ izstrādātais čatbots "’ChatGPT’’ – vien pirmās nedēļas laikā tas piesaistīja vienu miljonu lietotāju. Salīdzinājumam: straumēšanas vietnei "Netflix" šādu auditoriju izdevās sasniegt 41 mēneša laikā, mikroblogošanas vietnei "Twitter" – 24, sociālajam medijam "Facebook" – 10, bet "Instagram" – 2,5 mēnešus. Lai arī virtuālie asistenti nav nekāds jaunums, "’ChatGPT’’ popularitāti ieguvis ne bez iemesla.

"’Šis, visticamāk, šobrīd ir lielākais sasniegums lielo valodas modeļu tehnoloģiju virzienā,’’ skaidro "’Tilde’’ pētnieks un turpina: "’Ir bijuši vairāki valodas modeļi, kuriem kaut kas ir sanācis veiksmīgāk vai neveiksmīgāk, bet šis ir fundamentāli [līdz šim] spējīgākais no visiem.’’

Kāda ir "’ChatGPT’’ veiksmes atslēga? Pētnieks paskaidro, ka iepriekšējie valodas tehnoloģiju modeļi nav tikuši apmācīti kādu konkrētu problēmu risināšanai, savukārt "’ChatGPT’’ šādam mērķim ir ietrenēts, palīdzot rast risinājumus dialoga veidā. "’Mēs uzdodam jautājumu, saņemam atbildi, varam uzdot papildu jautājumu, un šis modelis visu iepriekš runāto spēj izmantot kā kontekstu, lai nākamo atbildi ģenerētu jēgpilnāku. Tas ir pielāgots tieši šim uzdevumam, lai ar to var komunicēt čata formā. Šis modelis ir apmācīts, izmantojot ļoti, ļoti, ļoti daudz datu, kas to, iespējams, atšķir no dažādiem citiem risinājumiem.’’

Tā nav faktoloģiska datu bāze, bet gan likumsakarībās balstīts rīks

MI valodas modeļu vispārīgais uzdevums ir spēja ģenerēt tekstu, ņemot vērā to, kas iepriekš modelim ir pateikts – atbilstoši tam tas iedod kādu ticamāko atbildi. Pinnis uzsver, ka šādiem valodas modeļiem "’apakšā’’ nav faktoloģisku zināšanu, bet tie ir apmācīti izveidot likumsakarības, izmantojot milzu datu apjomus. No tā arī izriet, ka čatbota sniegtās atbildes nedrīkst uztver par absolūtu patiesību, jo tās var būt arī ārkārtīgi kļūdainas.

Saturs turpinās pēc reklāmas

Reklāma

"’Likumsakarības, kurās balstās "’ChatGPT’’ darbība, nav kāds ieraksts datu bāzē, kur, piemēram, teikts – Latvijas prezidents tādā un tādā laika posmā bija tas un tas. Kaut kur modeļa uzņemtajā informācijā tas varbūt ir pieminēts, robots to iegūst no saviem datiem un, balstoties uz likumsakarībām, attiecīgi uzģenerēt tekstu,’’ skaidro pētnieks.

Viņš turpina: "’Šajā likumsakarību ieguves procesā var būt tā, ka modelis pats sāk definēt kādas līdzības starp dažādiem konceptiem. Bet mēs nezinām, kas ir šī līdzības, kas ir līdzības kritērijs, kuru katrā konkrētajā gadījumā šis rīks ir iemācījies. (..) Tas ir ieguvis kādas likumsakarības, un varbūt modelim tās palīdz, bet varbūt ir pretēji – nepalīdz sniegt pareizu atbildi.’’

Pinnis teic, ka pēdējās dienās ļoti daudzi ir "’spēlējušies’’ ar "’ChatGPT’’ un visdažādākajos veidos mēģinājuši pārbaudīt tā spējas. Šis modelis spēj sarunāties arī latviski, tiesa, latviešu valodas gramatika tam diezgan ļoti pieklibo. "’Mēs īsti nezinām, kā tas ir būvēts, lai spētu nodrošināt latviešu valodu – vai tam ir doti latviešu valodas dati vai arī tas izmanto kādu tulkošanas programmu. Šādu informāciju uzņēmums publiski nav sniedzis,’’ skaidro pētnieks.

Arī viņš mēģinājis pārbaudīt čatbota spējas, angļu valodā vaicājot, kur atrodas Dzegužkalns un cik augsts tas ir. Pēc sniegtās atbildes noprotams, ka "’ChatGPT’’ ir dzirdējis par Dzegužkalnu, un visdrīzāk tas piesaukts kontekstā ar Gaiziņkalnu, tādēļ arī norāda – Dzegužkalns pazīstams arī kā Gaiziņkalns. "’Tas spilgti parāda, ka tā nav faktoloģiska datu bāze, bet gan līdzību risinājums,’’ uzsver Pinnis.

FOTO: EKRĀTVĒRUMS

Virtuālais asistents norādījis, ka Dzegužkalna augstums ir 318,3 metri. Pētnieks teic, ka nav īsti saprotams, no kurienes šādi dati ņemti, jo arī Gaiziņkalns, kas ir Latvijas augstākais kalns, ir vien nepilnus 312 metrus augsts. Savukārt paša Dzegužkalna relatīvais augstums ir 16 līdz 18 metri.

Tāpat "’ChatGPT’’ raksta, ka Dzegužkalns atrodas Zolitūdē, bet patiesībā tas atrodas Iļguciemā. Minēts arī, ka no tā virsotnes vērojami skaisti dabas skati, kas nav tiesa, jo vispirms tam apkārt ir koki, kas skatu aizsedz, bet otrkārt tas atrodas pilsētā. "’Ir daudz faktoloģisku kļūdu, bet tāpēc, ka modelim ir informācija, ka no kalniem vai pauguriem varam redzēt skaistus skatus, tas šo informāciju pasniedz arī pie šādiem faktiem,’’ pastāsta Pinnis.

Vēl jāpiebilst, ka arī pats čatbota izstrādātājs "’OpenAI’’ jau no sākta gala atzinis – "’ChatGPT’’ var radīt šķietami "’ticamas, bet nepareizas vai pat absurdas atbildes’’.

Var palīdzēt tekstuāla satura veidošanā

Pieverot aci uz iespējamajām nepilnībām, nevar noliegt, ka šāds rīks var pavērt lērumu iespēju. Pētnieks norāda, ka "’ChatGPT’’ noteikti nevarētu būt meklētājs, jo tam vajadzīga faktoloģiski pareiza informācija, bet to varētu izmantot, piemēram, informācijas pārfrāzēšanā un radīšanā.

"’Ja mums pašiem jāraksta, šis modelis varētu būt labs palīgs satura radīšanā. Tas strādātu kā palīgs nevis pilnībā aizvietotu mūsu darbu. Būtu aplami to uzskatīt par risinājumu, kurš spēj radīt lietas bez mūsu uzraudzības, bet tas varētu mums palīdzēt būt radošākiem un produktīvākiem,’’ skaidro Pinnis.

Saturs turpinās pēc reklāmas

Reklāma

Tāpat šāds rīks varētu lieti noderēt situācijās, kad no liela teksta apjoma ir jāizvelk kāds kopsavilkums. Savukārt vēlāk šo funkciju varētu integrēt dažādos meklētājos – tas ļautu mums ātrāk ieraudzīt kādu kopsavilkumu no tā, ko mēģinām uzmeklēt. "’Pieņemu, ka "’Google’’ un "’Microsoft’’ tādā virzienā jau strādā,’’ piebilst pētnieks.

Jāteic, ka tie, kas "’ChatGPT’’ izmēģinājuši, neslēpj – modeli izmanto ātrākai informācijas uzmeklēšanai, jo, piemēram, "’Google’’ meklētājā nereti nākas pavadīt salīdzinoši ilgu laiku, lai atrastu sev nepieciešamo. Taujāts, vai lielajiem meklētāju milžiem ir jāuztraucas, ka tie varētu tikt aizstāti, Pinnis vēlreiz uzsver – uz šo tehnoloģiju nevajadzētu skatīties kā faktoloģiski pareizas informācijas sniedzēju. Ja mēs to tā izmantosim, ātri vien aplauzīsimies, jo tomēr tajā ir lērums kļūdu. Līdz ar to "’Google’’ nav absolūti nekādu risku. Taču šī jaunā tehnoloģija var palīdzēt uzlabot meklētāju funkcijas.

Jebkurai tehnoloģijai ir ļaunprātīgas izmantošanas risks

Lai arī liela daļa to, kas steiguši izmēģināt "’ChatGPT’’, ir sajūsmā un to uzteic, tik pat daudzi arī vērsuši uzmanību uz iespējamajiem riskiem, kurus šis modelis paredz. Šķiet, liela daļa uzmanības šajā jautājumā pievērsta iepriekš pieminētajai čatbota spējai radīt saturu – daudzi uzskata, ka tas, savukārt, var radīt zināmas problēmas izglītības sistēmā, jo "’ChatGPT’’ spēj uzrakstīt autentiskas esejas un pat diplomdarbus. Taču tas nav vienīgais iespējamais risks.

Saturs turpinās pēc reklāmas

Reklāma

Pētnieks paskaidro, ka jaunā čatbota sakarā pastiprināti domājis par surogātpastu. "’Domāju, ka katrs dažkārt cīnās ar to, kas nonāk viņa e-pasta kastītē. Tāpēc "’Google’’, arī "’Microsoft’’ iekš "’Outlook’’ un jebkurš cits uzņēmums mēģina izstrādāt risinājumus, kas mēģina identificēt surogātpastu, jo tiem bieži vien ir tipveida šablons. (..) Tā kā "’ChatGPT’’ ļauj vienam un tam pašam jautājumam katru reizi ģenerēt citādāku atbildi, paveras iesējas to izmantot nelietīgos nolūkos – surogātpasta radīšanā. Ja šādu e-pastu saturs katru reizi būs citādāks, surogātpastu filtri vienkārši vairs nestrādās,’’ stāsta Pinnis.

Tāpat faktoloģiskā neprecizitāte var tikt izmantota tur, kur ir svarīgi cilvēkiem sajaukt galvu ar nepatiesu informāciju. Ne velti arvien biežāk tiek runāts par dezinformāciju, un, kā norāda pētnieks, būtu muļķīgi tiem, kuri "’ChatGPT’’ varētu izmantot šādam nolūkam, to neizmantot šādiem nelietīgiem mērķiem.

Vēl viena problēma ir saistīta ar stereotipiem un aizspriedumiem ("’biases’’ – angļu val.), jo šādi valodas modeļi (un ne tikai) vēl aizvien mēdz ģenerēt ļoti stereotipisku saturu. Piemēram, viens virziens ir dzimums, kur dažnedažādā saturā visbiežāk amati/profesijas tiek rakstītas vīriešu dzimtē, ja nav runa par konkrētu cilvēku un attiecīgi arī konkrētu dzimumu. Līdz ar to, ja valodas rīkam lūgsim uzrakstīt divus dzejoļus – vienu par skolotāju vīrieti, bet otru par skolotāju sievieti, abi būs balstīti stereotipos, taču viens būs dzimumam labvēlīgāks, bet otrs – kaitnieciskāks.

Iespējamie MI aizspriedumi var skart arī rasu jautājumus. Tā gan nav valodu tehnoloģija, bet šeit kā piemēru Pinnis piesauc lietotni "’Lensa’’, kas no īstām fotogrāfijām ļauj ģenerēt animētus attēlus. "’Ja rīkam tiek iedota fotogrāfija ar vīrieti, tas uzģenerē fotogrāfijas ar astronautiem, zinātniekiem, izgudrotājiem utt. Savukārt, ja rīkam iedod parastas fotogrāfijas ar aziātu sievieti, tas uzģenerē pornogrāfiska satura foto. Līdz ar to ir noprotams, ka šim modelim ir stereotipiska uzvedība, kas balstīta tam iedotajos datos.’’

Šī aizspriedumība ir liela problēma un var nodarīt lielu kaitējumu, it īpaši, ja MI radītājs ikvienam vēlas nodrošināt vienlīdzīgu pieredzi.

Saturs turpinās pēc reklāmas

Reklāma

Jānorāda, ka "’OpenAI’’ gan ir mēģinājis jaunajā valodas modeļa tehnoloģijā iestrādāt satura filtru, kas atpazīst tā saucamos aizliegtos tematus un nedrošu saturu. Izņēmuma gadījumi var "’izlauzties’’ cauri, bet kopumā "’ChatGPT’’ nevajadzētu sniegt atbildes, kas ietver kādu bīstamību. Tiesa, daži čatbota lietotāji jau ir izmēģinājuši veidus, kā šo filtru apiet.

Runājot par iespējamajiem riskiem, Pinnis vēl atzīmē, ka ikvienai tehnoloģijai ir gan labās, gan sliktās iezīmes. Jebkura tehnoloģija var gan palīdzēt, gan tikt izmantota dažādos nelietīgos veidos, tostarp arī "’ChatGPT’’. Tādēļ, lai samazinātu ļaunprātīgi izmantojamās iespējams, ir ļoti svarīgi, lai šo tehnoloģiju izstrādāji ir atbildīgi par saviem modeļiem, to apmācību un piedāvāšanu lietošanai citiem.

Žurnāliste
Raksta pa drusciņai no visa, bet īpaši būtiski ir jautājumi, kas saistīti ar vienlīdzību, līdztiesību, zinātni, valsts drošību, kā arī ar veselību – mentālo, fizisko un sistēmu kā tādu.

Ziņo par kļūdu rakstā

Iezīmē kļūdaino tekstu un spied Ctrl+Enter.

Iezīmē kļūdaino tekstu un ziņo par to!

Uzgaidiet...

Reklāma aizvērsies pēc 0 sekundēm