جدید: ویجت چت شناور با نشانگر وضعیت نوار مدیریت — اکنون هر کاربری که وارد شده باشد میتواند مستقیماً از فرانتاند، با مدل زبان بزرگ (LLM) سمت مرورگر تعامل کند.
جدید: محیط اجرای SharedWorker — موتور MLC اکنون در یک SharedWorker اجرا میشود، بنابراین چندین تب به جای اینکه با هم برای آن رقابت کنند، یک جلسه GPU مشترک را به اشتراک میگذارند.
جدید: رهگیر (Interceptor) میانافزار apiFetch — درخواستهای WordPress REST که الگوی AI Client SDK را مطابقت میدهند، به طور شف اف به بروکر محلی WebLLM هدایت میشوند؛ دیگر نیازی به رفت و برگشت HTTP لوپبک نیست.
جدید: رابط کاربری تنظیمات ویجت در پنل Connector برای روشن/خاموش کردن ویجت چت و پیکربندی رفتار پرامپت خودکار.
اصلاح: اجبار بکاند کش IndexedDB تا دانلود وزنهای مدل در برابر ریدایرکتهای CDN خت HuggingFace که مسیر پیشفرض Cache API را خراب میکنند، باقی بمانند.
اصلاح: نادیده گرفتن بازنویسی کش KV پنجره زمینه (context_window) برای مدلهای جاسازی (embedding models) (زیرا این مدلها دیکودر ندارند و این بازنویسی باعث خطای زمان اجرا میشد).
اصلاح: اعلام مدل کاندید شروع سرد (cold-start) در /webllm/v1/models قبل از بارگذاری تب Worker، تا مصرفکنندگان SDK بلافاصله مدلی را ببینند.
اصلاح: اتصال WebLLM به فیلتر wpai_preferred_text_models تا قابلیت AI Experiments در صورت پیکربندی مدل، به موتور مرورگر هدایت شود.
بهبود: رفع اشکالهای مربوط به کشبستینگ (Cache-busting)، نرمالسازی محتوا و ارجاع سختافزاری که طی تست سرتاسری (end-to-end) مشخص شدند.