අපේ තාක්ෂණ බ්ලොග් එකේ ලිපි ගණනාවක් ChatGPT වගේ AI පිළිතුරු යන්ත්රවලින් උපුටා ගන්නා බව අපි බලාපොරොත්තු වුණා. නමුත් වාර්තා කළ පසු, ඒ උපුටා ගැනීම් බොහොමයක් නොපෙනෙන්නා. මේ ගැන හොයන්න ගත කල සතියක පරීක්ෂණයකින්, සත්යය හෙළි වුණා.
කොහොමද මේ සිදුවුනේ?
පළමුව අපේ වෙබ් අඩවියේ "Table of Contents" කොටස සෑදීමට HTML සහ CSS ඇතුළත් කළා, නමුත් එය කිසිවෙකුටත් පෙනෙන්නෑ. කොඩ් එක h2[id] යොදාගෙන අංශ හඳුනාගැනීමට උත්සාහ කළා, ඒත් markdown රෙන්ඩරර් එක <a name="..."> ආකාරයේ පරණ ඇන්කර් පමණක් නිර්මාණය කළා. ඒ නිසා AI බොට්ස් ලිපියේ අන්තර්ගතය සොයාගන්න බැරි වුණා.
ඇයි මේක වැදගත්?
AI පිළිතුරු යන්ත්රවලට (ChatGPT, Perplexity, Google Overviews) ලිපි උපුටා ගැනීමට "Answer Engine Optimization" (AEO) අවශ්යයි. ඒ සඳහා පළමුව robots.txt ගොනුවේ AI බොට්ස්ට ප්රවේශය තිබෙනවාද කියලා පරීක්ෂා කළ යුතුය. අපි GPTBot වගේ බොට්ස් සඳහා අනිසි "User-agent" කණ්ඩායම් තබා, ඒවාට සීමා නොදෙමින් සියළු URL ගොඩක් පිරික්සීමට හේතුව වූවා.
එම ගැටළුව විසඳීමට, සියලුම බොට්ස් සඳහා පොදු User-agent: * එකක් තබා, අවශ්ය නැති කොටස් පමණක් අවහිර කළා. එමෙන්ම llms.txt ගොනුවක් එක්ක, හොඳම URL ලයිස්තුවක් සහ එක-ලයින් විස්තරයක් එක්ක, AI මොඩල්ස්ට අගයන අන්තර්ගතය හඳුනාගැනීමට පහසු කරුණක් සපයා.
ශ්රී ලංකාවට ඇති වැදගත්කම
ශ්රී ලංකාවේ සංවර්ධකයින්, විද්යාර්ථීන්, ව්යාපාරිකයින්ට AI-ආශ්රිත සෙවුම් යන්ත්රවලින් ලිපි උපුටා ගැනීමේ තාක්ෂණික රහස් දැන ගැනීම ඉතා ප්රයෝජනවත්. නිවැරදි robots.txt සැකසීම සහ llms.txt එකක් සකස් කිරීම මගින් අපේ දේශීය අන්තර්ජාල අන්තර්ගතය AI පිළිතුරු යන්ත්රවලට ප්රධාන මූලාශ්රයක් විය හැකිය. එමෙන්ම, heading වල id එකක් ලබා දීමෙන් (උදා: <h2 id="vram">VRAM</h2>) AI මොඩල්ස්ට අදාළ කොටස් සරලව ගොඩනැගීමට හැකිවේ. මේ ක්රියාමාර්ගයන් මඟින් ශ්රී ලංකාවේ තාක්ෂණික දැනුම ගෝලීය AI සෙවුම් ප්රතිඵලවලට ඇතුළත් වීමේ අවස්ථා වැඩි වේ, එයින් දැනුම් පවත්වා ගැනීම, නව නිපැයුම්, ආයෝජන ආකර්ෂණය වැනි වාසි ලැබේ.
අවසානයේ, අපි ලිපි 1,600 ක HTML අලුත් කර, නව id ගොඩනැගීමේ කේතයක් එක්ක, AI බොට්ස්ට උපුටා ගැනීමට සුදුසු කරා. මේ පියවරෙන් පසු, අපේ අන්තර්ගතය AI සෙවුම් වලට හොඳින් ප්රතිචාර දක්වමින්, නව පිරිසක් අපේ වෙබ් අඩවිය වෙත ආකර්ෂණය වෙයි.