ශ්‍රී ලංකාවේ නවතම තාක්ෂණික පුවත් 2026-07-25, Saturday
🤖 කෘත්‍රිම බුද්ධිය · 🕒 කියවීමට විනාඩි 2 · 👁 1

LLM ඩ්‍රිෆ්ට් ට්‍රැකර් එකේ සති අන්තයේ අසත්‍ය අනතුරු ඇඟවීම් හතර – ඇයි වැරදියි?

LLM ඩ්‍රිෆ්ට් ට්‍රැකර් එකේ සති අන්තයේ අසත්‍ය අනතුරු ඇඟවීම් හතර – ඇයි වැරදියි?

ඉන්ටරනෙට් අඩවියක දිනපතා 16 ක් AI මොඩල 35 ක්‍රියාකාරකම් පරීක්ෂා කරන ලද LLM ඩ්‍රිෆ්ට් ට්‍රැකර් එක, පසුගිය සතියේ හතරක් වැරදි අඩු වීමක් වාර්තා කළා.

මෙම අඩු වීමන් වාර්තා කළ දිනයන්: 21 ජූලි ග්‍රෝක් 4.3, 22 ජූලි ල්ලාමා 3.3 70B, 23 ජූලි Gemini 3.5 Flash, 24 ජූලි Gemini 3.1 Pro. එක් එක් මොඩලයක් පසුගිය දිනයට සාපේක්ෂව ලකුණු ගණනෙන් අඩු වී තිබුණා, ඒ නිසා ස්වයංක්‍රීයව GitHub issue එකක් සහ මූලික ලිපියක් සකස් වුණා.

ඇත්ත වශයෙන් බලන විට, මේ අඩු වීමන් සත්‍ය දෝෂ නොවෙයි. Gemini 3.5 Flash සහ 3.1 Pro සඳහා reliability අගයත් එක්ක අඩු වීමක් දැකිය හැකි අතර, එය API ඇමතුම් අසාර්ථකවීම (rate‑limit) නිසාය. අසාර්ථක ඇමතුමකට පිළිතුරක් නොලැබීම නිසා “accuracy” අගය 0% ලෙස ගණනය කරයි, එමඟින් අඩු ලකුණු පෙන්වයි. Llama 3.3 70B කේස් එකේ 429 දෝෂයක් (rate limit) 34/35 ඇමතුම් අසාර්ථක කර තිබුණා, එයත් අඩු ලකුණු ලෙස වැලඳුනේ.

Grok 4.3 සහ Llama 3.3 70B සඳහා reliability 1.0 නමුත් accuracy ට්‍රැක් එකේ කුඩා වෙනස්කම් පමණක් තිබුණා – එක්‑දෙක ප්‍රශ්නවල පිළිතුරු වෙනස් වීම. 35 ක්‍රියාකාරකම් මත එකක් 2.86 ලකුණු පමණ, එම නිසා “‑2.9 pts” වැනි සංඛ්‍යාතය වත්මන් ප්‍රශ්නයක් වෙනස් වූ බව පෙන්වයි.

ශ්‍රී ලංකාවට ඇති වැදගත්කම

මෙවැනි නිරීක්ෂණ පද්ධති ශ්‍රී ලාංකීය AI සංවර්ධකයන්ට, විශ්වවිද්‍යාල සිසුන්ට, සහ තාක්ෂණික ව්‍යාපාරයන්ට බොහෝ ප්‍රයෝජන ලබා දෙයි:

  • වෙළෙඳපල තොරතුරු – මොඩලයක් අච්චු අඩු වීමක් දැකීමේදී ව්‍යාපාරිකයන්ට ඉක්මනින් පිළිතුරු සැපයීමට හැකියාව ලැබේ.
  • ඉගෙනුම් පදනම – සිසුන්ට AI මොඩල වල නිවැරදිත්වය හා විශ්වාසනීයතාවය අතර සම්බන්ධතාවය වටහා ගැනීමට උදව් වේ.
  • අවදානම් පාලනය – API rate‑limit හෝ සේවා බාධාවන් දැකීමෙන් පසු, පද්ධතියේ විශ්වාසනීයතාවය වැඩි දියුණු කරගත හැක.

ඉහත පරිදි, අධික සංවේදීතාවය ඇති tracker එකක් වැරදි ඇඟවීම් ලබා දුන් පසු, ඒවා පරීක්ෂා කර නිවැරදි තීරණ ගැනීමේ වැදගත්කම පෙන්වයි.

අවසානයේ, සතියේ හතරක් ඇඟවීම් ලැබුනත්, පළ කළ ලිපි කිසිවක් නොවීය. නිවැරදි පරීක්ෂණයක් කරන්නේ කවුද, ඒ නිසා තොරතුරු වගකීමෙන් භාවිතා කළ හැකිය.

💡 වැරදි ඇඟවීම් වලින් ඉදිරියට යන්න, දැන්ම තොරතුරු පරීක්ෂා කරන්න!
මූලාශ්‍රය මෙම ලිපිය AI මගින් රචිත මුල් සාරාංශයකි. සම්පූර්ණ වාර්තාව කියවන්න:
Dev.to ↗
#LLM #AI #Drift #Reliability #Tech