දුරස්ථ රැකියා වෙළඳපල වර්ධනය වෙමින් පවතින අතර, නවතම අවස්ථා සොයාගැනීමට අධික වෙබ් පිටු පිරික්සීමේ කාලය අධික වේ. එවකට Python, Scrapy, Beautiful Soup වැනි මෙවලම් සමඟ ඔබට සරලව Job Board Scraper එකක් නිර්මාණය කර, රියල්‑ටයිම් දත්ත ලබාගත හැකිය.
මෙම ලිපියෙහිදී, We Work Remotely වෙබ් අඩවියෙන් රැකියා ලැයිස්තු ලබා ගැනීමට Scrapy Spider එකක් සකස් කර, Beautiful Soup සමඟ HTML පාර්ස් කර තොරතුරු උපුටා ගැනීමේ ක්රියාවලිය පියවරෙන් පියවර විස්තර කරයි. පළමුව pip මඟින් scrapy සහ beautifulsoup4 ස්ථාපනය කර, remote_job_spider නමින් Spider එකක් සකස් කරමු. එය start_urls හි We Work Remotely රැකියා පිටුවට යොමු කර, LinkExtractor මගින් රැකියා විස්තර පිටු අනුගමනය කරයි. parse_item ක්රමය තුළ soup = BeautifulSoup(response.body, 'html.parser') යොදා, title, company, location වැනි ක්ෂේත්ර උපුටා ගනී.
කේතය සම්පූර්ණයෙන් ධාවනය කිරීමෙන් පසු, scrapy crawl remote_job_spider -o remote_jobs.csv කමන්ඩ් එකෙන් CSV ගොනුවකට දත්ත සුරකින්න පුළුවන්. ඔබට අවශ්ය තවත් ක්ෂේත්ර (salary, job type) එක් කිරීම සඳහා parse_item ක්රමය සකස් කළ හැකිය.
ශ්රී ලංකාවට ඇති වැදගත්කම
- සිසුන්ට දුරස්ථ රැකියා සොයාගැනීමේ නව තාක්ෂණික කුසලතා ඉගෙනීමට ප්රායෝගික උදාහරණයක්.
- දෙපාර්ශ්විකයන්ට Python, Scrapy, Beautiful Soup වැනි ජනප්රිය ලයිබ්රරී භාවිතය ඉගෙනීමට අවස්ථාව.
- ස්ථානාධිපති ව්යාපාර සඳහා රැකියා වෙළඳපල විශ්ලේෂණය කර, නිවැරදි බදුකරණය සහ නියෝග සැලසුම් කිරීමේ හැකියාව.
- ඉදිරි පරපුරේ තාක්ෂණික පදනම ශක්තිමත් කර, ග්ලෝබල් දුරස්ථ කාර්යබලයට සූදානම් කිරීම.
මෙම සරල ව්යාපෘතිය ඔබේ දැනුම වර්ධනය කර, රැකියා සෙවීමේ ගැටලු අඩු කර, ශ්රී ලාංකීය තාක්ෂණික ප්රජාවට නව ආකෘතිකාරකයක් සපයයි. දැන් ඔබත් Python සමඟ ඔබේම Job Board Scraper එකක් සෑදීමට පිවිසෙන්න!