නැවීඩියාගේ නවතම පාරිභෝගික GPU වලින් NVLink තාක්ෂණය ඉවත් කර ඇත. 2026 අප්රේල් මාසයේ තෙක් RTX 3090 පසුගිය එකම කාඩ් එක වන අතර, ඒ සඳහා අවශ්ය බ්රිජ් එකක් $200‑$400 අතර මිලට ලැබේ. මේ මිලකට වටිනාකමක් තිබේදැයි තීරණය කිරීම සඳහා ලේඛකයා තම RTX 3090 දෙකක් එක්ක පරීක්ෂා කළේය.
පරීක්ෂණයන් තුනක් කරා: (1) ලේයර් වෙන් කිරීම (layer split) සමඟ මොඩල ඉන්ෆරෙන්ස්, (2) ටෙන්සර් පාරලෙල් (tensor parallel) ඉන්ෆරෙන්ස්, (3) TinyLlama 1.1B සඳහා DDP සහ Qwen2.5 3B සඳහා FSDP ප්රශික්ෂණ. ලේයර් වෙන් කිරීමේදී GPU අතර සන්නිවේදනය අඩුව තිබූ නිසා NVLink එකෙන් කිසිදු ප්රතිලාභයක් නොදැක්කා. එත් ටෙන්සර් පාරලෙල් ඉන්ෆරෙන්ස්හි ප්රෝම්ප්ට් ප්රොසෙසින් වේගය 30% කින් වැඩිවුණා, නමුත් ටෝකන් ජනනය වේගය ඒකකයෙන් වෙනස් නොවීය.
FSDP ප්රශික්ෂණය තුළ NVLink එකේ බලපෑම දැක්ම අතිශය වූවා; පුළුල් 3 ගුණයක වැඩි වේගයක් ලැබුණා. එයට විරුද්ධව DDP ප්රශික්ෂණය සම්පූර්ණයෙන්ම NVLink වලින් බලපෑමක් නොලැබීය. පරීක්ෂණයේදී පළමු වරට NCCL_P2P_DISABLE=1 භාවිතා කර NVLink නොමැති පරිසරය සකසා තිබුණද, එය GPU අතර P2P (PCIe) වෙනුවට SHM (Shared Host Memory) භාවිතා කරනු නිසා දෝෂයක් විය. Nvidia පාරිභෝගික GPU වල P2P අක්රිය කර තිබීම නිසා, open‑gpu‑kernel‑modules වැනි පච්ච් පෑච් එකක් ස්ථාපනය කළ විට පමණක් P2P සක්රිය කළ හැකි බව පෙනුණි.
ශ්රී ලංකාවට ඇති වැදගත්කම
- ඉගෙනුම් පිරිස – උසස් AI මොඩල පුහුණු කිරීමේදී NVLink මඟින් ග්රැෆික් මතකය අතර දත්ත මාරු වේගය වැඩිවීම නිසා කාලය අඩු වේ. මෙය විශ්වවිද්යාල පර්යේෂකයන්ට වැදගත්.
- සොෆ්ට්වෙයා සංවර්ධකයින් – ටෙන්සර් පාරලෙල් ඉන්ෆරෙන්ස් භාවිතා කරන වෙබ්‑අපලිකේෂන් හෝ කේත‑ඇජන්ට් සෙවීමේදී ප්රෝම්ප්ට් සකස් කිරීමේ වේගය 30% කින් වැඩිවීම නිසා ප්රතිචාර වේගය වැඩි වේ.
- ව්යාපාරිකයින් – FSDP මගින් පුළුල් මොඩල පුහුණු කිරීමේ කාලය අඩු කර ගැනීම, මූල්යය හා පරිසර පිරිවැය ඉතිරි කිරීමේ අරමුණින් ග්රාහක‑අදාල AI සේවා සැපයුම්කරුන්ට උපකාරී වේ.
අවසානයේ, NVLink කෙරෙහි වියදම සහ පරිසරය සලකා බැලීම වැදගත්. ටෙන්සර් පාරලෙල් ප්රෝම්ප්ට් හෝ FSDP මගින් පුළුල් පුහුණු කිරීම අවශ්ය නම්ම එය වටිනාකමක් ගෙන එයි, නමුත් සාමාන්ය ඉන්ෆරෙන්ස් හෝ DDP පරිසරයන් සඳහා එය අතිශය වැදගත් නොවේ.