Meta (Facebook, Instagram) සමාජ ජාලය 2025 ජනවාරි 7 වනදා තම එක්සත් ජනපද තෙවන පාර්ශ්ව තත්ත්ව පරීක්ෂණ වැඩසටහන අත්හරින බව ප්රකාශ කළා. එය මිනිස් පරීක්ෂකයන් වෙනුවට "Community Notes" කියන සමාජ‑ආධාරිත පද්ධතියක් හරහා තොරතුරු තහවුරු කිරීමට යොමු කිරීමක් වූ අතර, "නිදහස් ප්රකාශනය" කියා හුදකලා කරුණක් ලෙස ඉදිරිපත් කළා.
මෙම තීරණය පසුබැසීමක් නොව, අන්තර්ජාලයේ දත්ත ගුණාත්මකභාවය සෘජුවම වෙනස් කරන සිදුවීමක්. AI ආදර්ශන බොහෝදෙනා විවෘත‑වෙබ් තොරතුරු මත පුහුණුවේ. තත්ත්ව පරීක්ෂණය නැතිවූ විට, වැරදි, අසත්ය, හෝ වංචාකාරී පණිවිඩයන් අඩු පරීක්ෂාවකින් පවා AI මොඩලයන්ට ආහාර විය හැක.
දත්ත දූෂණය (Data Poisoning) යනු, අසත්ය තොරතුරු පුහුණු දත්ත කට්ටලයට ඇතුළත් වීමෙන් AI ආකෘතිවල නිවැරදිභාවය අඩුවීමයි. ETH Zurich (2024) පර්යේෂණයක් පෙන්වා දුන්නේ වෛද්ය දත්ත 0.001%ක් අසත්යයෙන් පිරිවිතර කළාම, මොඩලය නුසුදුසු උපදෙස් දෙයි. Anthropic (2024) මගින් 250 ක් පමණ කේතගත ලේඛන පවා මොඩලයක් විශාල වශයෙන් විකෘත කරයි. arXiv (2024) පෙන්වා දුන්නේ “persistent pre‑training poisoning” නමින්, කුඩා දූෂණයක් නැවත‑පුහුණුවීමේදී පවා පවත්නා බවයි.
Meta තම ආභ්යන්තර AI (Llama 3 වැනි) සඳහා පිරිසිදු, බලපත්රගත, අභ්යන්තර දත්ත භාවිතා කරන අතර, එය පොදු වෙබ් දත්ත වලින් තොරව පවතී. ඒ නිසා, Meta විසින් නිර්මාණය කරන AI පද්ධති තවත් සමාජ ජාලවල දූෂිත දත්ත වලින් ආබාධිත නොවෙයි. එහෙත්, විවෘත‑මූලාශ්ර, අකඩමික, හෝ වෙනත් සමාජ‑ප්රතිපත්ති ආකෘතිවලට මෙම දූෂණය වඩාත් ප්රබල බලපෑමක් කරයි.
ශ්රී ලංකාවට ඇති වැදගත්කම
ශ්රී ලංකාවේ තොරතුරු තාක්ෂණ ශිෂ්යයෝ, සංවර්ධකයින්, ව්යාපාරිකයින් සඳහා මෙම සිදුවීමේ ප්රතිඵල පහත පරිදි වේ:
- ශිෂ්යයන් – AI‑සහයෝගී අධ්යයන උපකරණ (ChatGPT, Copilot) දූෂිත දත්ත මත පදනම් වූ විකෘත පිළිතුරු ලබා දෙයි. නිවැරදි ගැඹුරු අධ්යයන සඳහා විශ්වාසදායී දත්ත මූලාශ්ර තෝරා ගැනීම අත්යවශ්ය වේ.
- සංවර්ධකයින් – විවෘත‑මූලාශ්ර මොඩලයන් (LLaMA, StableDiffusion) දූෂිත දත්ත සමඟ පුහුණුවේ නම්, ඔවුන්ගේ යෙදුම් වල දෝෂ සහ අසත්ය තොරතුරු පෙනී යයි. දත්ත සත්යාපනය, සත්ය‑පරීක්ෂණ පද්ධති ඇතුළත් කිරීමේ අවශ්යතාවය ඉහළ යයි.
- ව්යාපාරිකයින් – AI‑චලිත තීරණ‑ගැනීම (අලෙවිය, සපයන්නා කළමනාකරණය) දූෂිත ආදර්ශන මත පදනම් විය හැක, ඒත් ඒ නිසා ආර්ථික හා නීතිමය අවදානම් වැඩිවේ. දත්ත ගුණාත්මකභාවය පිළිබඳ ප්රතිපත්ති ගොඩනැගීම, ස්ථානීය AI මූලාශ්ර සංවර්ධනය ඉතා වැදගත් වේ.
එම නිසා, ශ්රී ලංකාවේ AI පර්යේෂකයින්, ආයතනික නායකයින්, හා අධ්යාපන ආයතන “දත්ත විශ්වාසය” ගැන සජීවීව කතාබස් කර, පාරිභෝගික‑මිතුරන්ගේ දත්ත පිරිසිදු කිරීමේ ක්රම හඳුන්වා දීමට කටයුතු කළ යුතුය.
අන්තර්ජාලය තවදුරටත් “විෂබීජ” වෙමින් පවතී. AI තාක්ෂණය භාවිතා කරන සෑම කෙනෙකුටම දත්ත ගුණාත්මකභාවය පරීක්ෂා කිරීම, සත්ය‑පරීක්ෂණය, සහ පාරිසරික‑සුරක්ෂිත AI සංවර්ධනය යන කරුණු අත්යවශ්ය වේ. එමඟින්, අපේ AI පද්ධති “සත්ය” මත පදනම් වූ, දරුණු අනාගතයක් නොව, විශ්වාසදායක අනාගතයක් බවට පත්වේ.