AI පද්ධති ආරක්ෂා කිරීමේදී බොහෝ සමාගම් ඉංග්රීසි භාෂාවේ පමණක් පරීක්ෂා කරනවා. නමුත් නව පර්යේෂණයක් පෙන්වා දුන්නේ, එම පාලකයන් අනෙක් භාෂා වලින් ඉක්මවා යාමට ඉඩ ඇති බවයි.
Dark Reading විසින් පළ කරන ලද වාර්තාවක් අනුව, LLM (Large Language Model) ආරක්ෂක ගේට් කේත (guardrails) ඉංග්රීසි‑මත පදනම්ව සකස් කර ඇති නිසා, ඉංග්රීසි වචන වලින් සීමා කරන ප්රොම්ප්ට් එකක් අවහිර වුවත්, ඒම ප්රොම්ප්ට් එක ෆ්රෙන්ච්, පොලන්ත, ෆින්ලන්ත වැනි වෙනත් භාෂා වලට පරිවර්තනය කර ඇත්නම් මොඩලය එය බාධා නොකරයි.
මෙම ගැටලුව යුරෝපීය සංගමයේ 24 නිල භාෂා සහ අනෙකුත් ප්රාදේශීය භාෂා ගණනාවක් ඇති ප්රදේශයක අඩුපාඩු නොව, ස්වභාවික පරිසරයක් බවට පත්වේ. ආරක්ෂක පාලකය ඉංග්රීසි‑මත පරීක්ෂා කර, රෙඩ්‑ටීම් (red‑team) කරාම, අනෙක් භාෂා සඳහා එම පරීක්ෂණය සිදු නොකෙරේ. එම නිසා, භාවිතා කරන්නාගේ භාෂාව අනුව ආරක්ෂක පාලකයේ “ගැලපීම” වෙනස් වේ.
ඇත්තටම, මූලික මොඩලය වෙනත් භාෂා තේරුම් ගන්නා හැකියාව අඩු නැත; ප්රශ්නය වන්නේ ආරක්ෂක ස්තරය (refusal layer) ඉංග්රීසි ප්රහාර රටාවන්ට පමණක් අනුග්රහය ලබා ගැනීමයි. එම නිසා, කවුරුත් නව හුදකලා ප්රහාරයක් නිර්මාණය කරන්නේ නැත – Google Translate භාවිතා කරලා ඉංග්රීසි ප්රහාරය වෙනත් භාෂාවකට පරිවර්තනය කිරීම පමණයි.
මෙම “Detection Gap” එක තේරුම් ගැනීමට Sentinel නාමක පද්ධතියක් උදාහරණයක්. එහි පළමු ස්ථරය (Layer 2) ඉංග්රීසි රෙජෙක්ස් (regex) පදනම් කරයි, නමුත් පරිවර්තනය වූ ප්රහාරයක් එයට නොගැලපේ. එවිට Layer 3 වෙත යයි – එය ඉන්පුට් වාක්යයෙහි අර්ථය (semantic embedding) ගණනය කර, pgvector දත්තගබඩාවේ සුරක්ෂිත කර ඇති ප්රහාර අත්සන් (signature) සමඟ සමානතාවය මැනේ. මෙය භාෂාව කුමක් වුවත්, අර්ථය එකසේ නම්, ඒකම සමානත්ව ප්රතිශතයක් ලබා දේ, එවිට පද්ධතිය ප්රහාරය අවහිර කරයි.
ශ්රී ලංකාවට ඇති වැදගත්කම
ශ්රී ලංකාවේ තාක්ෂණික ආයතන, විශ්වවිද්යාල ශිෂ්යයන්, ව්යාපාරිකයින් සියලුදෙනාම AI‑ආශ්රිත සේවා භාවිතා කරන අතර, බහුභාෂා පරිසරයකුත් ඇත. ඉංග්රීසි‑පමණක් පරීක්ෂා කරන ආරක්ෂක පද්ධතියක්, සිංහල, தமிழ், හෝ මලයාලම් වැනි භාෂා භාවිතා කරන පරිශීලකයන්ට අනපේක්ෂිත අවදානම් ගෙන එයි. එම නිසා, දේශීය සංවර්ධකයන්ට මලබේ වාක්ය අර්ථය (semantic) පදනම් කරගත් පරීක්ෂණ ක්රමයක් අනුගමනය කිරීම, AI ආරක්ෂාව වැඩිදියුණු කිරීමේ අත්යවශ්ය පියවර වේ.
ඉදිරියේදී, ශ්රී ලංකාවේ AI ආරක්ෂක නීති හා ප්රාක්ෂණික මාර්ගෝපදේශයන් සකස් කරන විට, බහුභාෂා ගැලපීමේ පරීක්ෂණය අනිවාර්ය කොටසක් ලෙස ඇතුළත් කිරීම, දේශීය වෙළඳපොළේ විශ්වාසය සහ ආරක්ෂාව වැඩිදියුණු කරයි.
අවසානයේ, AI පද්ධති ආරක්ෂාව ඉංග්රීසි‑පමණක් නොව, සියලු භාෂා වලට සමාන ලෙස පරීක්ෂා කර, නියමිත ආරක්ෂක ගේට් කේත (guardrails) සකස් කිරීම, දේශීය තාක්ෂණික වර්ධනයේ අනාගතය සුරක්ෂිත කරයි.