नवीन: फ्लोटिंग चॅट विजेट आणि ॲडमिन-बार स्टेटस इंडिकेटर: आता लॉग-इन केलेला कोणताही वापरकर्ता फ्रंट-एंडवरून थेट ब्राउझर-साइड LLM ला प्रॉम्प्ट देऊ शकतो.
नवीन: SharedWorker रनटाइम: आता MLC engine एका SharedWorker मध्ये चालतो, ज्यामुळे अनेक टॅब एकमेकांशी GPU सेशनसाठी स्पर्धा न करता ते एकाच सेशनवर काम करतात.
नवीन: apiFetch मिडलवेअर इंटरसेप्टर: WordPress REST विनंत्या (requests) ज्या AI Client SDK पॅटर्नशी जुळत ात, त्या आपोआप (transparently) स्थानिक WebLLM ब्रोकरकडे रूट केल्या जातात. यासाठी लूपबॅक HTTP राउंड-ट्रिप करण्याची गरज नाही.
नवीन: कनेक्टर पॅनेलमध्ये विजेट सेटिंग्ज UI: चॅट विजेट चालू/बंद करण्यासाठी आणि ऑटो-प्रॉम्प्ट वर्तन (auto-prompt behaviour) कॉन्फिगर करण्यासाठी.
फिक्स: IndexedDB कॅशे बॅकएंडला फोर्स केले आहे, जेणेकरून मॉडेल वेट डाउनलोड्स HuggingFace xet CDN रीडायरेक्ट्समुळे खराब होणार नाहीत.
फिक्स: एम्बेडिंग मॉडेल्ससाठी context_window KV-cache ओव्हरराईड वगळला आहे (कारण त्यांना डीकोडर नसतो आणि या ओव्हरराईडमुळे रनटाइम एरर येत होता).
फिक्स: वर्कर टॅब लोड होण्यापूर्वीच /webllm/v1/models वर कोल्ड-स्टार्ट कॅन्डिडेट मॉडेल घोषित केले जाते, ज्यामुळे SDK वापरकर्त्यांना मॉडेल त्वरित दिसते.
फिक्स: WebLLM ला wpai_preferred_text_models फिल्टरमध्ये जोडले आहे, जेणेकरून मॉडेल कॉन्फिगर केल्यावर AI Experiments फीचर ब्राउ झर इंजिनकडे रूट होईल.
सुधारित: एंड-टू-एंड टेस्टिंग दरम्यान कॅशे-बस्टिंग, कंटेंट नॉर्मलायझेशन आणि हार्डवेअर-रेफरन्समधील त्रुटी दूर केल्या आहेत.
Version 1.0.0 — प्रारंभिक प्रकाशन (Initial Release)