Anthropic සමාගම අලුත්ම Opus 5 මොඩලය සියලුම AI සේවා සඳහා නිකුත් කර තිබේ. මෙය පසුගිය සතියේ නිල වශයෙන් ප්රකාශිත අතර, Fable වැනි නව AI සංකල්පවල උනන්දුව වැඩිවීම නිසා තාක්ෂණික විශ්ලේෂකයින් අතර බොහෝ කතා බහක් ඇතිවී ඇත.
මම Opus 4.8 මත පදනම් වූ කේත සමාලෝචන ඒජන්ට්වලට Opus 5 වෙත මාරු වීමට තීරණය කළේ, ඒ සඳහා workflow ගොනුවේ එක් පේළියක් වෙනස් කිරීම පමණක් අවශ්ය බව සිතීය. නමුත් මේ සරල පියවර 22 commit, 23 සමාලෝචන වටය, දෙදින කාලයක් ගත කරමින් 18 ගොනු, 2,717 පේළි එකතු කිරීම සහ 1,34 පේළි ඉවත් කිරීමක් සමඟ ඉතා විස්තරාත්මක උත්සාහයක් බවට පත්වුණි.
ප්රධාන අත්දැකීම වන්නේ Opus 5 මොඩලය severity filter (ගුණාත්මක පිරික්සුම) අධික ලෙස අනුගමනය කරන බවයි. "style nits" (අලංකාර පරීක්ෂණ) නොදැක්වීමට ප්රොම්ප්ට් එකක් දුන් විට, Opus 5 අඩු ගැටළු පෙන්වයි – එය ගැටළු අඩු වීමක් නොව, නියමිත පිරික්සුමට කඩිනම්ව පිළිපැදීමක් වන අතර, Opus 4.8 ඒ වගේම නොවීය.
ඉන් පසු, මගේ පරීක්ෂණය A/B වශයෙන් වෙනස් කළෙමි: Arm A – පරණ severity‑filtered ප්රොම්ප්ට්, Arm B – සියලු ගැටළු වාර්තා කරන, severity, confidence, evidence tier යන තොරතුරු එක් කරන නව ප්රොම්ප්ට්. මේ අතර, මොඩලය 17 ක් පමණ වැරදි තොරතුරු (false claims) ලබා දුන්නේ, ඒවා තත්ත්වය සත්ය පරීක්ෂණයෙන් තත්ක්ෂණිකව වැරදියි. මෙය AI මොඩලයක් භාවිතා කරන සංවිධාන තුළ විශ්වාසභංගයක් ඇති කළ හැකි බව ඉඟියක් වේ.
ශ්රී ලංකාවට ඇති වැදගත්කම
- සිසුන් – Opus 5 වැනි නව AI මොඩලයන් සමඟ කේත සමාලෝචන අත්හදා බැලීම, පරිගණක විද්යා පාඨමාලා වල ප්රායෝගික අංශයක් ලෙස එක් කළ හැකිය.
- ඩිවෙලපර් – මොඩලයේ නිරවද්ය පිරික්සුම් ක්රමය, දෝෂ හඳුනා ගැනීමේ කාලය කෙටි කරයි, නමුත් ප්රොම්ප්ට් සැකසීමේ නියමයන් පිළිබඳ අවධානය අවශ්ය බව පෙන්වයි.
- ව්යාපාර – AI‑driven code review විසින් නිෂ්පාදන ගුණාත්මකතාව වැඩි කරයි, නමුත් false claim ගණනාවක් නිසා අතිරේක පරීක්ෂණ (human audit) අවශ්ය වේ. මෙය ශ්රී ලංකා තාක්ෂණික සමාගම්වල AI අනුගමනයේ සැලකිල්ලක් වශයෙන් වැදගත් වේ.
අවසානයේ, Opus 5 නව හැකියාවන් ගෙන එන අතර, ප්රොම්ප්ට් සැකසීමේ නීති රීති, දත්ත අධීක්ෂණය, සහ AI‑වල විශ්වාසභංගය පිළිබඳ අවධානය යොමු කිරීම අත්යවශ්ය බව පෙනේ. එබැවින්, AI මොඩලයක් සංවිධානයේ ඇතුළත භාවිතා කරන විට, “scope‑discipline” නීතිකයන් අනුගමනය කිරීම මූලික කරුණක් බවට පත්වේ.