නවතම කෘත්රිම බුද්ධිය (AI) තාක්ෂණය සමඟ නව පරිකථන පොත් (Audiobook) නිර්මාණය කිරීමේදී, කථාකරුවන්ගේ හඬ නිරූපණය කිරීමේ ගැටළුවක් තවදුරටත් පවතින බව නව පර්යේෂණයක් පෙන්වයි. කතා පුවරු (dialogue) හඳුනාගෙන, ඒවාට සුදුසු හඬක් නියම කිරීම ඉතාමත් සංකීර්ණ කාර්යයක් බවට පත්වෙයි.
ආරම්භයේදී, උපුටා ගැනීමේ ලකුණු (quotation marks) පදනම් කරගෙන කතා පුවරු හඳුනාගැනීමේ උත්සාහයක් ගත්තාහ. නමුත්, ඒ ක්රමය සත්ය නවකතාවේ අර්ථය හා ගැලපෙන්නේ නැත. "මම ඔබට කියා තිබුණා" වැනි වාක්යයක් දෙකක් වෙන්වූ කොටස් දෙකකට බෙදා හරින අතර, ඒ අතරමැද කථිකයාගේ නාමය පැමිණෙයි. මෙය නිවැරදිව විග්රහ නොකළහොත්, එකම වාක්යය තුළ දෙදෙනෙකු වෙන වෙනම හඬක් ලබා ගත හැකිය.
තවත් තරඟකාරී ගැටළුවක් නම්, කථිකයන්ගේ නාමය කිසිදාත් සඳහන් නොවීමයි. "ඔයා එනවාද?" "එක මිනිත්තුවකට පසු" "ඔයා පැයකට පෙර කියලා තිබුණා" වැනි තත්ත්වයන්හි, පසුබැසීමේ (turn‑taking) රීතිය සහ පසුබැසීමේ නාමය හඳුනා ගැනීම අත්යවශ්ය වේ. මෙය සාර්ථකව කරගැනීමට, වාක්ය තුළ "said", "asked", "whispered" වැනි ක්රියා පද හා ඒවායේ වර්ගය (inflection) පරීක්ෂා කිරීම වැදගත්.
ශ්රී ලංකාවට ඇති වැදගත්කම
ශ්රී ලංකාවේ ඉගෙනුම් හා විනෝද කලාපය සඳහා මෙම තාක්ෂණය විශාල අවස්ථාවක් සපයයි. සිසුන්ට ඉංග්රීසි නවකතා, තාක්ෂණික පොත්, සහ පුවත් පත්රිකා අඩංගු බහු-ශ්රව්ය පොත් ලබා ගැනීමෙන්, අසාධාරණ පරිසරයන්හිද වාචික අවබෝධය වැඩිදියුණු කරගත හැක. එසේම, දේශීය සංවර්ධකයින්ට AI‑පදනම් වූ පූර්ව-විශ්ලේෂණ (pre‑parsing) මෙවලම් භාවිතා කර, තමාගේම අඩු පිරිවැයෙන් අඩු පිරිවැයෙන් පොත් හඬ ගොනුවලට පරිවර්තනය කළ හැකිය. ව්යාපාරික පැතිකඩින්, කතානායක හඬ සැකසීමේ ස්වයංක්රීය පද්ධතියක් හරහා, අන්තර්ජාතික වෙළෙඳපොලේ අඩංගු අඩු-වියදම් අඩු-වියදම් ඩිජිටල් නිෂ්පාදන නිර්මාණය කළ හැකිය.
මෙම ක්රියාවලිය සම්පූර්ණ පොත පූර්ණ වශයෙන් විශ්ලේෂණය කිරීමෙන් පසු, පූර්ණ-පොත පරිභාෂක (character inventory) සකස් කර, ඉහළම පාවිච්චිය ඇති N කථිකයන්ට හඬ නියම කර, ඉතිරි අන්තර්ගතය නාට්යකරුගේ හඬට පවරා, පසුකාලීනව පරිවර්තන පරිගණක (render) කිරීමේ පියවර ගනී. මෙම පද්ධතිය VoxForge නමින් හඳුන්වා දී ඇත.
කෙසේ වෙතත්, පළමු පුද්ගල නරේෂණය, ලිපි-ලේඛන (epistolary) වර්ග, හා මැදපෙළේ නිරන්තර දෘශ්ය පරිවර්තනය නොකළ විට, පද්ධතියේ අඩුපාඩු පෙනී යයි. එවැනි අවස්ථා සඳහා මනුවලින් අත්තිකාරම් (manual overrides) අවශ්ය වේ.
ඉදිරි කාලයේ, AI‑මූලික කථා නිරූපණය තවත් නිරවද්ය කරගැනීමට, Coreference Resolution හා Context‑aware Modeling තාක්ෂණයන් එකතු කිරීමේ අවශ්යතාවය ඉහළ යයි.