WebMCP: AI দিয়ে ওয়েব অটোমেশনের নতুন আর্কিটেকচারাল শিফট

বর্তমানে AI এজেন্ট দিয়ে ব্রাউজারে কোনো অটোমেশন বা কাজ করাতে গেলে বেশ ঝামেলায় পড়তে হয়। এজেন্টগুলো সাধারণত DOM স্ক্র্যাপ করে বা স্ক্রিন দেখে আন্দাজ করার চেষ্টা করে যে কোথায় ক্লিক করতে হবে। ওয়েবসাইটের ডিজাইন বা UI একটু চেঞ্জ হলেই পুরো সিস্টেম ব্রেক করে। ডেমো হিসেবে এগুলো দেখতে চমৎকার হলেও রিয়েল-লাইফ প্রোডাকশনে ভরসা করার মতো ছিল না।
এই আনপ্রেডিক্টেবল সমস্যার একদম সলিড একটা সমাধান নিয়ে আসছে WebMCP। এটি মূলত অ্যানথ্রপিকের Model Context Protocol (MCP)-এর একটি ব্রাউজার-নেটিভ ভার্সন, যা Chrome 149-এ (Origin trial হিসেবে) রিলিজ হতে যাচ্ছে।
সহজ কথায়, AI এখন আর স্ক্রিন দেখে আন্দাজ করে ওয়েবপেজে ক্লিক করবে না। বরং ওয়েব অ্যাপগুলোই AI-কে সরাসরি বলে দেবে যে পেজে কী কী অ্যাকশন করা সম্ভব।
ব্রাউজারের navigator.modelContext API ব্যবহার করে ডেভেলপাররা খুব সহজেই registerTool বা provideContext-এর মাধ্যমে বিভিন্ন টুল আর এক্সিকিউশন হ্যান্ডলার রেজিস্টার করে রাখতে পারবেন। আবার দরকার শেষে সেগুলো আনরেজিস্টারও করা যাবে।
সবচেয়ে দারুণ ব্যাপার হলো, ডেভেলপারদের টেস্টিংয়ের সুবিধার জন্য Chrome DevTools-এ আলাদা একটি WebMCP ট্যাবও যুক্ত হচ্ছে। অর্থাৎ, কোনো রিয়েল AI এজেন্ট কানেক্ট করার আগেই আমরা লোকাললি টুলগুলো টেস্ট করে দেখতে পারব।
এটির সবচেয়ে বড় ইনসাইট হলো—আমরা এতকাল কেবল মানুষের চোখের সামনে স্ক্রিন সাজানোর কথা চিন্তা করে ফ্রন্টএন্ড ডিজাইন করেছি। WebMCP-এর মাধ্যমে এখন থেকে ওয়েবসাইটের ব্যাকঅফিস লজিক ও ইন্টারঅ্যাকশনগুলোকে AI এজেন্টের কাছেও সমানভাবে অ্যাক্সেসিবল ও রিডেবল করে তোলার একটা নতুন ট্রেন্ড শুরু হতে যাচ্ছে।
ভবিষ্যতের ওয়েব ইকোসিস্টেম আর AI অটোমেশনের ক্ষেত্রে এটি বেশ বড় একটা আর্কিটেকচারাল শিফট!
Comments