ශ්‍රී ලංකාවේ නවතම තාක්ෂණික පුවත් 2026-07-23, Thursday
💻 ක්‍රමලේඛනය · 🕒 කියවීමට විනාඩි 2 · 👁 1

Claude AI‑වෙත සොලවෙනියානු හෝ ඉංග්‍රීසි ප්‍රොම්ප්ට්? 2,300 පරීක්ෂණයෙන් ලැබුන තත්ත්වය

Claude AI‑වෙත සොලවෙනියානු හෝ ඉංග්‍රීසි ප්‍රොම්ප්ට්? 2,300 පරීක්ෂණයෙන් ලැබුන තත්ත්වය

සොලවෙනියානු සංවර්ධකයෙක් තමන්ගේ දෛනික කේත ලිවීමේ වැඩකටයුතු සඳහා Claude Code‑ව ඉංග්‍රීසි වෙනුවට සොලවෙනියානු භාෂාවෙන් ප්‍රොම්ප්ට් කරයි. එම ප්‍රොම්ප්ට් 2,300 කට වැඩි සංඛ්‍යාවක් ගෙන, එය ඉංග්‍රීසියට පරිවර්තනය කර token ගණන, නිරවද්‍යතාව, කාර්ය සාධනය වැනි කරුණු අධික්ෂේප කර පරීක්ෂා කළේය.

ඉදිරිපත් කර ඇති දත්ත අනුව, WSL (Linux) සහ Windows PowerShell පරිසර දෙකේදී සොලවෙනියානු භාෂාවෙන් 1,362 සහ 537 ප්‍රොම්ප්ට් (මුළු 1,899) භාවිතා කර ඇත. එහි 98‑99% කට භාෂාව තීරණය කළ හැකි අතර, සාමාන්‍ය ප්‍රොම්ප්ට් දිග 54 සිට 90 අක්ෂර දක්වා වේ. ප්‍රොම්ප්ට් වලට වැරදි, ඩයකෘටික් ලකුණු (š, č, ž) නැතිව, ඉංග්‍රීසි තාක්ෂණික පදයන් සමඟ මිශ්‍රව ලියන ලදී.

ගවේෂණයෙන් ලැබුන ප්‍රධාන තත්ත්වය නම්, විශාල AI මොඩල (Claude Opus, GPT‑4 වැනි) සඳහා භාෂා ගැටළුව බොහෝ දුරට අඩුය. EPFL, Anthropic වැනි පර්යේෂණ පෙන්වන්නේ, මොඩලයන්ගේ මධ්‍යම සංකල්ප අවකාශය ඉංග්‍රීසියට සමීප බවයි; අනෙකුත් භාෂා තලයක් පමණක් අතිරේක පරිවර්තනයක් ලෙස ක්‍රියා කරයි. ඒ නිසා "ඉංග්‍රීසි භාෂාවෙන් සිතන්න, සොලවෙනියානු භාෂාවෙන් පිළිතුරු දෙන්න" කියන උපදෙස් දැන් වඩාත් අහිංසකයි.

2022 වසරේ PaLM මොඩලය ඉංග්‍රීසි ගණිත ගැටලු 62% විසඳුවේ, අඩු ප්‍රතිශතයක් අනෙකුත් භාෂා සඳහා. නමුත් Anthropic නවතම දත්ත පෙන්වන්නේ, ස්පාඤ්ඤ භාෂාව 98.2% සහ ජර්මානු 97.0% ක් ඉංග්‍රීසි කාර්ය සාධනය සමඟ සමාන බවයි. සොලවෙනියානු සඳහා නිශ්චිත බෙන්ච්මාර්ක් නොමැති නමුත් SloPragEval පරීක්ෂණයකදී GPT‑5 හි 0.81 (සොලවෙනියානු) vs 0.83 (ඉංග්‍රීසි) ලැබුණි – වැදගත් වෙනසක් නොවේ.

කෙසේ වෙතත්, කුඩා මොඩල (Claude Haiku) භාවිතා කරන විට, භාෂා වෙනස් කිරීමේ බලපෑම වැඩි වේ. Haiku 4.5 හි ඉංග්‍රීසි කාර්ය සාධනයේ 53% පමණක් සොලවෙනියානු භාෂාවට අඩු වී ඇත. එබැවින්, ඔබේ වැඩ සඳහා අඩු‑වියළි මොඩලයක් තෝරන්නේ නම්, භාෂාව පරීක්ෂා කර බැලීම වැදගත්.

භාෂා මිශ්‍රණය පිළිබඳවත් අධ්‍යයනයක් පෙන්වන්නේ, ඉංග්‍රීසි පදයන් අනෙකුත් භාෂා වාක්‍ය තුළ ඇතුළත් කිරීම මොඩලයේ අවබෝධය වැඩි කරන බවයි. එබැවින්, සොලවෙනියානු කේත ප්‍රොම්ප්ට් වල ඉංග්‍රීසි තාක්ෂණික පදයන් තබා ගැනීම ප්‍රයෝජනවත්.

Token ගණනේදී, පසුගිය පර්යේෂණයක් කියූවට වඩා සත්‍ය ප්‍රොම්ප්ට් වල token premium අඩුයි. cl100k tokenizer (GPT‑4) භාවිතා කළ විට 34% ක token වැඩි වීමක්, නව o200k tokenizer (GPT‑4o / GPT‑5) භාවිතා කළ විට 16% ක token වැඩි වීමක් පමණක් තිබුණි. මෙය ප්‍රොම්ප්ට් වල පාරිභාෂා, පාරමිතී, SQL, පථ නාමය වැනි අංගවල English tokenization සමඟ සමාන වීම නිසාය. ඩයකෘටික් ලකුණු (š, č, ž) token ගණනට අමතර බරක් නොදෙයි.

ශ්‍රී ලංකාවට ඇති වැදගත්කම

ශ්‍රී ලංකාවේ සංවර්ධකයින්ට, AI මොඩලයන් භාෂා සීමා නොමැතිව භාවිතා කළ හැකි බව මේ පර්යේෂණයෙන් පෙනේ. ඉංග්‍රීසි පරීක්ෂා කිරීමේ පිරිවැය හා කාලය ඉතිරි කර, සිංහල, තමිල්, හෝ ත්‍රිකුණාමලාව භාෂාවෙන්ම කේත ප්‍රොම්ප්ට් ලියන්න හැකිවේ.

  • ඉගෙනුම් වශයෙන් – සිංහල භාෂාවෙන් AI සමඟ වැඩ කිරීම, විශ්ව විද්‍යාත්මක පදනමක් ගොඩනැගීමට උපකාරී.
  • ව්‍යාපාරික වශයෙන් – දේශීය භාෂාවෙන් AI‑ආශ්‍රිත සේවා නිර්මාණය කිරීමෙන්, පාරිභෝගික රුචිය වැඩිවීමේ අවස්ථාව ලැබේ.
  • ආර්ථික වශයෙන් – token පිරිවැය අඩු වීම නිසා, ව්‍යාපාරික AI යෙදුම් පවත්වා ගැනීමට අඩු පිරිවැයක්.

ඉදිරියේදී, මලටිලින්ගුයල් AI මොඩලයන් වැඩි දියුණුවක් ලබන විට, ශ්‍රී ලංකාවේ තාක්ෂණික පරිසරය ඉතා සාර්ථකව ප්‍රගතියට පත් වනු ඇත.

අවසන් වශයෙන්, ඔබේ කේත ප්‍රොම්ප්ට් භාෂාව තෝරා ගැනීමේදී, මොඩලයේ ප්‍රමාණය, token ගණන, සහ භාෂා මිශ්‍රණය යන කරුණු සැලකිල්ලට ගත යුතුය. විශාල මොඩලයන් සඳහා, ඔබේම භාෂාවෙන්ම ප්‍රොම්ප්ට් කිරීමේ අඩු වැදගත්කම ඉතාමත් වැදගත් බව දැක්කා.

💡 ඔබේ AI ප්‍රොම්ප්ට් භාෂාව තෝරා, වැඩි කාර්යක්ෂමතාවක් ලබාගන්න!
මූලාශ්‍රය මෙම ලිපිය AI මගින් රචිත මුල් සාරාංශයකි. සම්පූර්ණ වාර්තාව කියවන්න:
Dev.to ↗
#Claude #Prompting #Multilingual AI #Token Cost #Developer Tips