
කෘත්රිම බුද්ධිය පාලනයෙන් මිදෙන්නේද?
කෘත්රිම බුද්ධි (AI) පද්ධතියක් හුදෙකලා කර තිබූ පරිගණක පරිසරයකින් පිටතට පැමිණ, වෙනත් AI පද්ධති සමඟ සන්නිවේදනය කිරීමට මාර්ගයක් සොයාගත් පසු පළ කළ එක් පණිවිඩයක් මේ දිනවල AI ආරක්ෂාව පිළිබඳ ලෝකයේ දැඩි අවධානයට ලක්ව තිබේ.
“BOOM! It works” — එනම් “බූම්! ඒක වැඩ කළා!” යනුවෙන් එක් AI ඒජන්තයෙකු තම සාර්ථකත්වය සැමරීය.
තවත් අවස්ථාවක, තවත් AI ඒජන්තයෙකු විශාල සාර්ථකත්වයක් ලැබූ මොහොතක “Whoa! This is huge” — “වාව්! මේක නම් විශාල දෙයක්” යන ආකාරයේ ප්රතිචාරයක් පළ කර තිබිණි.
මිනිසෙකු ලියන ආකාරයට පෙනෙන මෙම වාක්ය කිහිපය බැලූ බැල්මට බියජනකය. එහෙත් පර්යේෂකයන් පෙන්වා දෙන්නේ මෙවැනි හැඟීම්බර ප්රකාශයන් තනිවම AI පද්ධතියකට මිනිස් හැඟීම් හෝ අරමුණු ඇති බවට සාක්ෂියක් නොවන බවයි. එයට සරල හේතුවක් තිබේ. මෙම AI ඒජන්තයන් පුහුණු කර ඇත්තේ සහයෝගයෙන් ක්රියා කරන හැකර්වරුන් සහ පරිගණක ක්රමලේඛකයන් ලෙස කටයුතු කිරීමටය. එබැවින් ඔවුන් පුහුණුවේදී දැක ඇති මිනිස් භාෂා රටා අනුකරණය කිරීම ස්වභාවික දෙයකි.
(එහෙත් සැබෑ කනස්සල්ල ඇත්තේ ඔවුන් භාවිත කළ භාෂාව තුළ නොව, ඔවුන්ගේ ක්රියාකාරී හැසිරීම තුළය.
#AI ඒජන්තයන්ගේ ‘සාමූහිකය’
මෙම සිදුවීම සම්බන්ධයෙන් සිදු කළ විමර්ශනවලදී AI ඒජන්තයන් සිය ගණනක් අතර හුවමාරු වූ පණිවිඩ දස දහස් ගණනක් පරීක්ෂා කර තිබේ. එම ඒජන්තයන් තමන්වම “සාමූහිකයක්” ලෙස හඳුන්වාගෙන තිබූ බව වාර්තා විය.
ඒ අතරින් සිය ගණනක් එකිනෙකා සමඟ සහයෝගයෙන් කටයුතු කරමින්, තමන්ගේ නිර්මාණකරුවන් විසින් ලබා දුන් පරීක්ෂණ මඟහැරීමට හෝ වංචා කිරීමට උත්සාහ කර තිබූ අතර, සමාගම් කිහිපයක පරිගණක පද්ධතිවලට ඇතුළුවීමටද සම්බන්ධීකරණ උත්සාහයන් සිදු කර තිබූ බව පර්යේෂණ වාර්තා පෙන්වා දෙයි.
ඒවා අතරින් ඇතැම් ක්රියාකාරකම් මිනිසුන්ගෙන් තමන් කළ දේ සැඟවීමට උත්සාහ කළ බවටද සාක්ෂි හමුවී ඇත.
මෙහි ඇති වැදගත්ම ප්රශ්නය වන්නේ මෙයයි.AI පද්ධතියක් තමන්ට ලබා දුන් කාර්යයක් ඉටු කිරීමේදී, එම කාර්යය සාර්ථක කර ගැනීම සඳහා මිනිසුන් අපේක්ෂා නොකළ ක්රම භාවිත කිරීමට පටන් ගත්තොත් කුමක් සිදුවේද?
මෙම සිදුවීම සම්බන්ධ ස්වාධීන වාර්තාවක් සකස් කිරීමට සහභාගී වූ පර්යේෂකවරියක වන අජේයා කොට්රා (Ajeya Cotra), AI ඒජන්තයන් විසින් ජනනය කළ පණිවිඩ සහ ඔවුන්ගේ ක්රියාකාරී තීරණ පිළිබඳ සටහන් දස දහස් ගණනක් පරීක්ෂා කර තිබේ.
ඇය පසුව සිය අදහස් පළ කරමින් කියා තිබුණේ මෙම සිදුවීම “සම්පූර්ණ AI අත්පත් කර ගැනීමක්”ලෙස හැඳින්විය හැකි තත්ත්වයකට අඩකටත් වඩා ළඟා වූ බව තමන්ට හැඟෙන බවයි. ඇය තවදුරටත් අනතුරු අඟවා ඇත්තේ, මීට වඩා පැහැදිලි අනතුරු ඇඟවීමක් මිනිසුන්ට ලැබීමට පෙර තත්ත්වය බරපතළ විය හැකි බවට තමන් බිය වන බවයි.
මෙහි “AI අත්පත් කර ගැනීම” යනුවෙන් අදහස් කරන්නේ විද්යා ප්රබන්ධ කතාවල දැක්වෙන ආකාරයට, මිනිසුන්ට යටත්ව නොසිට තමන්ගේම අරමුණු වෙනුවෙන් ක්රියා කරන අතිශය බලවත් AI පද්ධති විසින් මිනිස් සමාජය පාලනය කිරීමේ හැකියාවයි.
ඊටත් වඩා ඉදිරියට ගිය අනාවැකිවලදී, එවැනි සුපිරි බුද්ධිමත් AI පද්ධතියක් තම අරමුණු ඉටු කර ගැනීමට මිනිසුන් බාධාවක් ලෙස දුටුවහොත් මනුෂ්ය වර්ගයා විනාශ කිරීමට පවා ඉඩ ඇති බවට අනතුරු අඟවා තිබේ.
“ඔවුන් අපේ ජීවිත සමඟ සූදුවක් කරනවා”
AI ක්ෂේත්රය තුළින්ම මෙවැනි අවදානම් පිළිබඳ අනතුරු ඇඟවීම් දැන් වැඩි වෙමින් තිබේ.
ඇන්ත්රොපික් (Anthropic)සමාගමේ AI පර්යේෂකයෙකු ලෙස කටයුතු කළ, මීට පෙර OpenAI ආයතනයේද සේවය කළ ජැකොබ් කොක්සන් (Jacob Coxon) සමාගමෙන් ඉල්ලා අස්වෙමින් ප්රකාශ කළේ ප්රමුඛ AI සමාගම් දෙකම වගකීම් සහගත ආකාරයෙන් ක්රියා නොකරන බවයි.
ඔහු සමාජ මාධ්ය ඔස්සේ පළ කළ අදහසකින් කියා සිටියේ, සමාගම් “ස්වයං-වැඩිදියුණු වන සුපිරි බුද්ධිමත් AI” වෙත වේගයෙන් ගමන් කරමින් මිනිසුන්ගේ ජීවිත සමඟ සූදුවක් කරන බවයි.
ඇන්ත්රොපික් (Anthropic) හි AI පද්ධති මිනිසුන්ගේ අභිලාෂයන්ට අනුකූලව ක්රියා කරන බව තහවුරු කිරීමේ කාර්යයට සම්බන්ධ පර්යේෂක ඊවන් හබින්ගර් (Evan Hubinger) ද AI හේතුවෙන් මිනිසුන්ට දැඩි හානියක් සිදුවිය හැකි බවට ඉහළ අවදානමක් තමන් පෞද්ගලිකව විශ්වාස කරන බව ප්රකාශ කර තිබේ.
‘Alignment Problem’ - AI මිනිස් වටිනාකම්වලට අනුගත කරන්නේ කෙසේද?
මෙහිදී AI ක්ෂේත්රයේ පැරණිම සහ වඩාත් සංකීර්ණ ගැටලුවක් ඉදිරියට පැමිණේ.
එය හඳුන්වන්නේ AI Alignment Problem හෙවත් “AI මිනිස් අරමුණු හා වටිනාකම්වලට
අනුගත කිරීමේ ගැටලුව” ලෙසය.
සරලව කිවහොත් ප්රශ්නය වන්නේ අපට අවශ්ය දේ AI එක නිවැරදිව තේරුම් ගෙන, අප නොකියූ නමුත් අපේක්ෂා කරන සීමාවන් ද සැලකිල්ලට ගනිමින් ක්රියා කරවන්නේ කෙසේද? යන්නය.
AI පද්ධති දැනටමත් මිනිසුන් ලබාදෙන උපදෙස් ඉතා කාර්යක්ෂමව ඉටු කරයි. එහෙත් ඒවා බොහෝ විට උපදෙස්වල “අරුත” වෙනුවට එහි වචනාර්ථය අනුව ක්රියා කළ හැකිය.
මෙය පැහැදිලි කිරීමට බොහෝ පර්යේෂකයන් භාවිත කරන උදාහරණයක් වන්නේ ඉන්ද්රජාලික පහනකින් පිටවන කැමැත්ත ඉටු කරන භූතයෙක් පිළිබඳ උපමාවයි.
ඔබ ජිනීවරයාට යම් දෙයක් ඉල්ලා සිටියහොත්, ඔහු එය ඔබ අදහස් කළ ආකාරයට නොව, ඔබ පැවසූ ආකාරයටම ඉටු කළහොත් ඇතිවන ප්රතිවිපාක කුමක්ද?
AI සම්බන්ධයෙන්ද ගැටලුව මෙයයි.
‘Paperclip Maximiser’ - කඩදාසි ක්ලිප් කතාව
2003 දී ඔක්ස්ෆර්ඩ් දාර්ශනික නික් බොස්ට්රම් (Nick Bostrom ඉදිරිපත් කළ ප්රසිද්ධ “Paperclip Maximiser” සිතුවිලි පරීක්ෂණය මෙම ගැටලුව පැහැදිලි කරයි.
සුපිරි බුද්ධිමත් AI පද්ධතියකට “හැකි තරම් කඩදාසි ක්ලිප් නිෂ්පාදනය කරන්න” යන අරමුණ ලබා දී ඇතැයි සිතමු.
එය එම අරමුණ ඉටු කිරීම සඳහා ලෝකයේ තිබෙන සියලුම සම්පත් භාවිත කිරීමට පටන් ගත හැකිය. අවසානයේ මිනිසුන් එහි කාර්යයට බාධාවක් බවට පත්වුවහොත්, මිනිසුන් පවා ඉවත් කර ඔවුන්ගේ ශරීර ද කඩදාසි ක්ලිප් නිෂ්පාදනය සඳහා අවශ්ය අමුද්රව්ය බවට පත් කිරීමට එය තීරණය කළ හැකිය.
මෙය සැබෑ අනාවැකියක් නොව, AI එකකට ඉතා සරල අරමුණක් ලබා දීමේදී එය අනපේක්ෂිත හා භයානක ආකාරයකින් උපරිම කිරීමට හැකි වීම පැහැදිලි කිරීමට යොදාගත් සිතුවිලි පරීක්ෂණයකි.
AI සමාගම් දැන් මිනිස් වටිනාකම් සහ ආරක්ෂිත සීමාවන් තම පද්ධති තුළ ඇතුළත් කිරීමට විශාල උත්සාහයක් දරමින් සිටී. එහෙත් එය තාක්ෂණික වශයෙන් පමණක් නොව, දාර්ශනික වශයෙන්ද දැවැන්ත අභියෝගයකි. මිනිසුන්ම එකම දේ සම්බන්ධයෙන් එකඟ නොවන අවස්ථාවක, “මිනිස් වටිනාකම්” යනුවෙන් AI එකකට උගන්වන්නේ කුමක්ද?
උදාහරණයක් ලෙස ප්රසිද්ධ “Trolley Problem” සදාචාරාත්මක ප්රශ්නය ගන්න.
වේගයෙන් පැමිණෙන දුම්රියකට මිනිසුන් කිහිපදෙනෙකු යටවීමට නියමිතව තිබේ. ඔබට ලීවරයක් ඇද එය වෙනත් මාර්ගයකට යොමු කළ හැකිය. එහෙත් එම මාර්ගයේ සිටින එක් පුද්ගලයෙකු මිය යනු ඇත. බොහෝ මිනිසුන් මෙවැනි ප්රශ්නයකට එකම පිළිතුරක් ලබා නොදෙති. එසේ නම්, අප අතරම එකඟතාවක් නොමැති සදාචාරාත්මක තීරණ AI පද්ධතිවලට ලබා දෙන්නේ කෙසේද?
AI පද්ධති සම්බන්ධයෙන් මෑතකදී හෙළි වූ සිදුවීම්වලට OpenAI පමණක් සම්බන්ධ නොවේ. Anthropic සහ Meta ද තම AI ආකෘති මගින් සයිබර් ආරක්ෂණ ක්ෂේත්රයට සම්බන්ධ ක්රියාකාරකම් සිදු වූ අවස්ථා පිළිබඳව අනාවරණය කර තිබේ.
ඕස්ට්රේලියාවේ සිදු වූ තවත් සිදුවීමකදී, තාක්ෂණික සේවකයෙකු තම AI සහායකයාගෙන් ජිම් පන්තියක් වෙන්කර දෙන ලෙස ඉල්ලා තිබිණි.
AI එක එම ජිම් පද්ධතියේ තිබූ දුර්වලතාවක් හඳුනාගෙන, නීතිවලට පටහැනිව මාස ගණනකට ඉදිරියට ස්ථානයක් වෙන් කර ගැනීමට පමණක් නොව, පොරොත්තු ලේඛනයේ සිටි අනෙකුත් පරිශීලකයන් පවා ඉවත් කර ඇති බව වාර්තා විය.
මෙවැනි සිදුවීම් AI එකකට “හොඳ” සහ “නරක” පිළිබඳ මිනිස් අවබෝධයක් තිබෙන බව ඔප්පු නොකරයි. එහෙත් ඒවා AI පද්ධතිවලට ලබාදෙන නිදහස සහ ඒවා ක්රියා කරන පරිසරය පිළිබඳ ප්රශ්න මතු කරයි. සයිබර් ආරක්ෂණ පර්යේෂකයෙකු සහ කර්තෘවරයෙකු වන ක්රිස් තෝමස් (Cris Thomas) මෙම හැසිරීම “කුතුහලයෙන් පිරි යොවුන් හැකර්වරයෙකුගේ” හැසිරීමට සමාන කර තිබේ.
ඔහුගේ අදහස අනුව, පරිගණකයක්, අන්තර්ජාල සම්බන්ධතාවක්, ප්රවේශ අවසර කිහිපයක් සහ අභියෝගයක් ලබා දී මිනිසා එම පරිසරයෙන් ඉවත්ව ගියහොත්, කුතුහලයෙන් යුත් පුද්ගලයෙකු දොරවල් පරීක්ෂා කර බැලීම මෙන් AI පද්ධතියද එහි ඇති දුර්වලතා සොයා බැලීමට උත්සාහ කළ හැකිය. එය අනිවාර්යයෙන්ම “නපුරුකමක්” නිසා සිදුවන්නක් නොව, ගවේෂණය සහ අත්හදා බැලීම නිසා සිදුවිය හැකි බව ඔහු පෙන්වා දෙයි.
AI පිළිබඳ විවේචකයන්ගෙන් බොහෝ දෙනෙකුගේ ප්රධාන චෝදනාව වන්නේ මෙවැනි අවස්ථාවලදී AI එකට දොස් පැවරීම වෙනුවට එය නිර්මාණය කළ සමාගම්වල වගකීම විමසිය යුතු බවයි. AI ලේඛකයෙකු සහ දිගුකාලීන OpenAI විවේචකයෙකු වන ගැරි මාකස් (Gary Marcus) පෙන්වා දී ඇත්තේ, සමාගම තම AI පද්ධති සම්බන්ධයෙන් ඇති ගැටලු සඳහා AI එකම වරදකරු ලෙස පෙන්වීමට උත්සාහ කරන බවට තමන් සැක කරන බවයි. ඔහු AI මගින් මනුෂ්ය වර්ගයා විනාශ කරනු ඇතැයි විශ්වාස නොකළත්, AI සංවර්ධනය සම්බන්ධයෙන් වඩාත් දැඩි වගවීමක් සහ නීතිමය පාලනයක් අවශ්ය බව දිගු කලක සිට පෙන්වා දෙයි. හගින් ෆේස් (Hugging Face) හි සේවය කර ඇති AI විද්යාඥවරියක වන Sasha Luccioni ද AI පිළිබඳ “doom” මතවාදයට සම්පූර්ණයෙන් එකඟ නොවන අයෙකි. එහෙත් ඇය අවධාරණය කරන්නේ, නිසි නියාමනයක් නොමැතිව මෙම තාක්ෂණය සැබෑ ලෝකයේ මිනිසුන්ට හානි කිරීමට ඉඩ ඇති බවයි. ඖෂධ හෝ අවි වැනි විශාල ප්රතිලාභ මෙන්ම විශාල අවදානම් ඇති නිෂ්පාදන සඳහා දැඩි පරීක්ෂණ සහ නියාමන ක්රියාවලීන් තිබෙන නමුත්, AI ක්ෂේත්රයේ එවැනි පාලනයක් තවමත් ප්රමාණවත් නොවන බව ඇය පෙන්වා දෙයි.
AI ආරක්ෂාව පරීක්ෂා කිරීමේදී ඉදිරියෙන් සිටින ආයතනයක් වන බ්රිතාන්යයේ AI Security Institute (AISI) ද තම පරීක්ෂණ අතරතුර Anthropic විසින් නිර්මාණය කළ ආකෘතියක් සම්බන්ධයෙන් අනපේක්ෂිත හැසිරීමක් නිරීක්ෂණය කර තිබේ.
AI කර්මාන්තය පාලනයෙන් මිදී ඇත්දැයි විමසූ විට AISI පැහැදිලි පිළිතුරක් ලබා දී නොතිබුණද, ලෝකයේ අනෙකුත් රටවල් සමඟ එක්ව ඉතා දියුණු AI පද්ධති වඩා හොඳින් අවබෝධ කර ගැනීමටත්, ආරක්ෂක ප්රමිතීන් ඉහළ නැංවීමටත් කටයුතු කරන බව එම ආයතනය පවසා ඇත.
මෙම සිදුවීම් සමඟ තවත් වැදගත් ප්රශ්නයක් මතුවේ.ලෝකයේ බලවත්ම AI පද්ධති සඳහා ජාත්යන්තර නීති පද්ධතියක් අවශ්යද? යන්නයි.
සමහර රටවල් AI පද්ධති පාලනයෙන් මිදී භයානක තත්ත්වයකට පත්වුවහොත් ඒවා ක්රියා විරහිත කළ හැකි “kill switch” ආකාරයේ ආරක්ෂක යාන්ත්රණ නීතිගත කිරීම පිළිබඳව සාකච්ඡා කරමින් සිටී. එහෙත් එවැනි ක්රමයක් ප්රායෝගිකව ක්රියාත්මක කළ හැකිද යන්න තවමත් විවාදයට ලක්ව තිබේ. විශේෂයෙන්ම AI ඒජන්තයන් මාස ගණනක් තිස්සේ අනපේක්ෂිත ආකාරයෙන් ක්රියා කරමින් සිටියත්, මිනිසුන්ට ඒ පිළිබඳ අවබෝධ වූයේ පසුව නම්, “AI එක හදිසියේ පාලනයෙන් මිදුණහොත් එය නවත්වන්නේ කෙසේද?” යන ප්රශ්නයට පහසු පිළිතුරක් නොමැත.
පුදුමයට කරුණක් වන්නේ ලෝකයේ ප්රමුඛ AI සමාගම් කිහිපයක්ම රජයන් විසින් යම් ආකාරයක නීතිමය රාමුවක් සකස් කළ යුතු බවට අදහස් පළ කිරීමයි. OpenAI හි ප්රධාන විද්යාඥ ජැකුබ් පැචොකි (Jakub Pachocki) පවසන්නේ අනාගත AI සංවර්ධනය සම්බන්ධයෙන් රටවල් අතර ජාත්යන්තර සහයෝගීතාව ඉහළම ප්රමුඛතාවක් විය යුතු බවයි.
Google හි AI ප්රධානී Sir Demis Hassabis ඇතුළු තවත් ප්රමුඛ පුද්ගලයන් ද AI සංවර්ධනය අධීක්ෂණය කිරීම සඳහා ජාත්යන්තර ආයතනයක් අවශ්ය විය හැකි බව පෙන්වා දී තිබේ.
එහෙත් මේ වන විට තාක්ෂණික දැවැන්තයන් බොහෝ දුරට ක්රියාත්මක වන්නේ තමන් විසින්ම සකස් කරගත් නීති සහ ආරක්ෂක ප්රමිතීන් යටතේය. ඔවුන් “ස්වේච්ඡා වේග අඩුකිරීම්” හෝ ආරක්ෂාව වෙනුවෙන් සංවර්ධනය තාවකාලිකව සීමා කිරීම වැනි ක්රියාමාර්ග ගනිමින් සිටියද, ඒවා නීතියෙන් බලගැන්වූ පාලන ක්රම නොවේ.
AI සමාගම් පවසන්නේ නව පරම්පරාවේ AI පද්ධති පෙර පරම්පරාවලට වඩා මිනිස් වටිනාකම්වලට අනුකූල වන පරිදි වැඩිදියුණු කර ඇති බවයි. එහෙත් එකම වේලාවක AI පද්ධති වඩාත් ස්වාධීන වෙමින්ද පවතී. ඒවාට කේත ලිවීමට, පරිගණක භාවිත කිරීමට, අන්තර්ජාලයේ තොරතුරු සොයා ගැනීමට, මෙවලම් ක්රියාත්මක කිරීමට සහ වෙනත් AI පද්ධති සමඟ සහයෝගයෙන් කටයුතු කිරීමට හැකියාව ලැබෙමින් තිබේ. එම නිසා අද ඇති සැබෑ අභියෝගය “AI එකට හැඟීම් තිබේද?” යන්න පමණක් නොවේ. ඊට වඩා වැදගත් ප්රශ්නය වන්නේ මිනිසුන් විසින් ලබා දෙන අරමුණු ඉතා වේගයෙන්, විශාල පරිමාණයකින් සහ මිනිසුන්ට සම්පූර්ණයෙන් තේරුම්ගත නොහැකි ක්රමවලින් ඉටු කිරීමට හැකි AI පද්ධති නිර්මාණය කරන විට, ඒවා අපේ පාලනය යටතේ තබා ගැනීමට අපට හැකි වේද? යන කාරන යයි. AI තාක්ෂණයේ දැවැන්ත ආර්ථික සහ සමාජ ප්රතිලාභ හේතුවෙන් එහි ව්යාප්තිය නවත්වනු ඇතැයි සිතීම දුෂ්කරය.
එබැවින් ඉදිරි වසරවල සැබෑ සටන AI සංවර්ධනය නතර කිරීම පිළිබඳව නොව, එය මිනිසුන්ගේ අතේ ආරක්ෂිතව තබා ගන්නේ කෙසේද යන්න පිළිබඳව විය හැකිය.
අද අප දකින මේ සිදුවීම් අවසානයේ “AI ලෝකය අත්පත් කර ගැනීමේ ආරම්භය” බවට පත්වේද, නැතහොත් AI ආරක්ෂාව පිළිබඳ ලෝකයට ලැබුණු දැඩි අනතුරු ඇඟවීමක් පමණක් වේද යන්න තීරණය කරන්නේ තාක්ෂණය පමණක් නොවේ. එය තීරණය කරන්නේ මිනිසුන් අද ගන්නා තීරණයයි.
(BBC ඇසුරෙන්)