নতুন: অ্যাডমিন-বারে স্ট্যাটাস ইন্ডিকেটর সহ ভাসমান চ্যাট উইজেট — এখন যেকোনো লগইন করা ব্যবহারকারী ফ্রন্ট এন্ড থেকেই সরাসরি ব্রাউজার-সাইড LLM ব্যবহার করে প্রম্পট দিতে পারবেন।
নতুন: SharedWorker রানটাইম — এখন MLC ইঞ্জিনটি একটি SharedWorker-এ চলে, ফলে একাধিক ট্যাব একে অপরের সাথে GPU ব্যবহারের জন্য প্রতিযোগিতা না করে একটি GPU সেশন ভাগ করে নিতে পারে।
নতুন: apiFetch মিডলওয়্যার ইন্টারসেপ্টর — WordPress REST অনুরোধগুলি যা AI Client SDK প্যাটার্নের সাথে মেলে, সেগুলিকে স্থানীয় WebLLM ব্রোকারে স্বচ্ছভাবে রুট করা হয়। এর জন্য কোনো লুপব্যাক HTTP রাউন্ড-ট্রিপ করার প্রয়োজন নেই।
নতুন: কানেক্টর প্যানেলে উইজেট সেটিংস UI যোগ করা হয়েছে, যা চ্যাট উইজেট চালু/বন্ধ করতে এবং অটো-প্রম্পট আচরণ কনফিগার করতে সাহায্য করে।
ফিক্স: IndexedDB ক্যাশে ব্যাকএন্ডকে জোর করে ব্যবহার করা হয়েছে, যাতে মডেল ওজন ডাউনলোডগুলি HuggingFace xet CDN রিডাইরেক্ট থেকে সুরক্ষিত থাকে, যা ডিফল্ট Cache API পাথ ভেঙে দিত।
ফিক্স: এমবেডিং মডেলগুলির জন্য context_window KV-cache ওভাররাইড এড়িয়ে যাওয়া হয়েছে (কারণ এদের কোনো ডিকোডার নেই এবং এই ওভাররাইডটি একটি রানটাইম ত্রুটি সৃষ্টি করছিল)।
ফিক্স: ওয়ার্কার ট্যাব লোড হওয়ার আগেই /webllm/v1/models এ কোল্ড-স্টার্ট ক্যান্ডিডেট মডেলটি ঘোষণা করা হয়েছে, যাতে SDK ব্যবহারকারীরা সাথে সাথেই একটি মডেল দেখতে পান।
ফিক্স: WebLLM কে wpai_preferred_text_models ফিল্টারে যুক্ত করা হয়েছে, যাতে মডেল কনফিগার করা থাকলে AI Experiments ফিচারটি ব্রাউজার ইঞ্জিনে রুট হয়।
উন্নত: এন্ড-টু-এন্ড টেস্টিং করার সময় ক্যাশে-বাস্টিং, কন্টেন্ট নরমালাইজেশন এবং হার্ডওয়্যার-রেফারেন্সের কিছু ত্রুটি সংশোধন করা হয়েছে।