Alibaba Cloud විසින් නව Qwen2 මොඩල ශ්රේණිය නිල වශයෙන් හඳුන්වා දී තිබේ. මෙය 0.5 බිලියන පරාමිතීන් සිට 72 බිලියන පරාමිතීන් දක්වා විවිධ ප්රමාණයන්ගෙන් යුතු, පෙර-පුහුණු කර instruction‑tuned AI භාෂා මොඩලයකි. එම මොඩල අතර MoE (Mixture‑of‑Experts) අනුවාදයක්ද ඇතුළත් වන අතර, ඉංග්රීසි සහ චීන භාෂා පමණක් නොව, අතිරේක 27 භාෂා සඳහා පුහුණු කර ඇත.
Qwen2 මොඩලයන්ගේ විශේෂත්වය නම්, විශාල කොන්ටෙක්ස්ට් කවුන්ට් (token) ප්රමාණය හසුරවීමට හැකියාවයි. 72B අනුවාදය 128K tokens දක්වා ප්රතිචාර සැපයීමට සමත් වන අතර, Group Query Attention (GQA) වැනි නව ගොඩනැගීමේ තාක්ෂණය භාවිතා කර ගණනාවක තොරතුරු ගණනය කිරීමේ බර අඩු කරයි. මේ නිසා ලොකු ලේඛන විශ්ලේෂණ, විස්තරාත්මක සාරාංශ, සහ දිගු‑කාලීන සංවාද වැනි වැඩ සඳහා ඉතා සුදුසු වේ.
ඉතිරියට, Qwen2 මොඩලයන් Hugging Face වෙතින් ලබා ගත හැකි නිසා, developers ලාට transformers පුස්තකාලය සමඟ පහසුවෙන් ඒකාබද්ධ කිරීමට හැකියාව ලැබේ. කේත උදාහරණයක් මගින් model_name="Qwen/Qwen2-72B-Instruct" ලෙස සකසා, device_map="auto" යොදා GPU/CPU ව්යාප්ත කිරීම සිදු කර ගත හැකිය. මෙය open‑source AI ක්ෂේත්රයට නව සීමා ගෙන එන අතර, ව්යාපාරික හෝ පර්යේෂණ අවශ්යතා සඳහා අධි‑කාර්යක්ෂම මොඩලයක් ලබා දේ.
ශ්රී ලංකාවට ඇති වැදගත්කම
Qwen2 මොඩලයන් ශ්රී ලංකාවේ AI පරිසරයට පහල ලාභ කිහිපයක් ගෙන එයි:
- දේපළ පිරිවැය අඩු කිරීම: මොඩලයන් open‑source වන නිසා, cloud සේවා වල අධික ගාස්තුවක් නොවී, ස්ථානීය සර්වර් හෝ GPU කුලියට ගෙන පාවිච්චි කළ හැකිය.
- බහුභාෂා සහාය: 27 නව භාෂා සමඟ පුහුණු කර ඇති නිසා, සිංහල, දෙමළ හෝ වෙනත් දේශීය භාෂා සඳහා fine‑tuning කිරීම පහසු වේ.
- දිගු කොන්ටෙක්ස්ට් හැකියාව: ලොකු පත්රිකා, රජයේ වාර්තා, හෝ අධ්යාපනික පදනම් ලේඛන විශ්ලේෂණය සඳහා 128K token පරාසය ප්රයෝජනවත්.
- දේශීය ඩෙවලපර් සමාජය: Hugging Face හි සම්පත් සහ transformers ලයිබ්රරිය භාවිතා කර, නව AI යෙදුම් ඉක්මනින් නිර්මාණය කළ හැකිය.
ඉදිරියේදී, ශ්රී ලංකාවේ තාක්ෂණික ආරම්භකයන්, විශ්වවිද්යාල සිසුන්, සහ ව්යාපාරිකයන් Qwen2 මොඩලයන් භාවිතා කර, AI‑ආධාරිත නිෂ්පාදන, සේවා, සහ පර්යේෂණ කටයුතු වලින් නව ගමනක් අරඹා ගැනීමට හැකියාව ලැබේ.
Qwen2 නවතම open‑source AI තාක්ෂණයක් වන අතර, ඔබේ ඊළඟ AI ව්යාපෘතිය සඳහා මෙය සලකා බලන්න.