Dev.to වෙතින් නිකුත් වූ MedSpeak යෙදුමේ නවතම සංස්කරණය දැන් ඡායාරූපයක් මගින් ලේබලය පකවා, ඒකම තත්ක්ෂණිකව පරිවර්තනය කළ හැකිය.
පෙර සංස්කරණයේ පරිශීලකයන්ට ලේබලයේ ශෝට්කට් අකුරු කීපයක් තනි තනිව ටයිප් කරන්න විය. එය පෙන්වන්නෙත් දර්ශනමය වුවත්, ලේබලයක් පූර්ණයෙන් ලියලා තියෙන එකක් කියලා හිතාගත හැකි නෙවෙයි.
අලුත් සංස්කරණය තුළ Tesseract.js නාමක JavaScript OCR එන්ජින් බ්රවුසරයේම ක්රියා කරයි. පරිශීලකයා ඡායාරූපයක් තෝරන හෝ කැමරාවෙන් සජීවීව ගතත්, එම රූපය සර්වරයට යවා නොමැතිව, බ්රවුසරය තුළම අකුරු හඳුනාගෙන, ඒක තත්ක්ෂණික පෙළ කොටසකට පරිවර්තනය කරයි.
එම පරිවර්තනය කළ පෙළය JSON API එකට fetch() මඟින් යවා, decode() ක්රියාකාරීත්වය සමඟ එකතු කරයි. මෙයින් පිටු පූරණයක් නොව, පේජ් එකේම ප්රතිඵලය නවීකරණය වන නිසා අත්දැකීම ඉතා වේගවත් වේ. එසේම රූපය සර්වරයට උඩුගත නොකළ බැවින් පෞද්ගලිකත්වය රැකේ.
ඩෙවලපර්වරුන්ට API ආකාරය JSON ආකාරයට පරිවර්තනය කර ඇති නිසා, වෙනත් යෙදුම් සමඟ ඒකාබද්ධ කිරීම පහසුයි. තවත් වාසියක් ලෙස, OCR ක්රියාවලිය පූර්ණයෙන්ම client‑side හි සිදු වීම නිසා, අඩු බෑන්ඩ්විඩ්ත්ථ් හා වේගවත් පිළිතුරු ලැබේ.
ශ්රී ලංකාවට ඇති වැදගත්කම
- විශ්වවිද්යාල සිසුන්ට ප්රතිකාර ලේබල පරීක්ෂා කිරීමේ පර්යේෂණ ව්යාපෘති වලට භාවිතා කළ හැකිය.
- ස්ථානයේම OCR තාක්ෂණය භාවිතා කරමින්, රෝහලන් සහ ඖෂධ සැපයුම්කරුවන්ට කාර්ය සාධනය වැඩි කළ හැකිය.
- ශ්රී ලංකාවේ තාක්ෂණික සමාජයට AI‑මූලික ව්යාපෘති නිර්මාණය සඳහා නව උදාහරණයක් ලබා දේ.
- ඩෙවලපර්වරුන්ට JSON API සහ client‑side OCR එකතු කරගැනීමේ නව පදනමක් සපයයි, එයින් ස්ථානීය ඇප් සංවර්ධනයේ ගුණාත්මකතාව ඉහළ යයි.
මෙම නවතම MedSpeak සංස්කරණය, ලේබල පරිවර්තනයේ අඩු පියවරක් ඉවත් කරමින්, තාක්ෂණික ප්රවේශය සරල කරයි. ඉදිරියේදී OCR නිවැරදිත්වය වැඩිදියුණු කර, බහුභාෂා සහාය එක්කර ගැනීමට අපේක්ෂා කරයි.