Нове: Плаваючий чат-віджет зі статусом у адмін-пані — будь-який авторизований користувач може подавати запити до LLM у браузері безпосередньо з фронтенду.
Нове: Середовище виконання SharedWorker — двигун MLC тепер працює у SharedWorker, тому кілька вкладок ділять одну GPU-сесію, а не конкурують за неї.
Нове: Перехоплювач middleware apiFetch — запити WordPress REST, які відповідають шаблону AI Client SDK, прозоро маршрутизуються до локального брокера WebLLM, не потрібен HTTP-цикл зворотного шляху.
Нове: Інтерфейс налаштувань віджета в панелі Connector для вмикання/вимикання чат-віджета та налаштування поведінки авто-промптів.
Виправлення: Примусове використання бекенду кешу IndexedDB, щоб завантаження ваг моделі виживали при перенаправленнях HuggingFace xet CDN, які порушують стандартний шлях Cache API.
Виправлення: Пропускання перезапису KV-кешу context_window для моделей вбудовування (у них немає декодера, і цей перезапис спричинив помилку виконання).
Виправлення: Оголошення кандидата моделі для холодного запуску в /webllm/v1/models до завантаження вкладки worker, щоб споживачі SDK бачили модель негайно.
Виправлення: Підключення WebLLM до фільтра wpai_preferred_text_models, щоб функція AI Experiments маршрутизувалася до браузерного двигуна при налаштуванні моделі.
Покращено: Виправлення кешування (cache-busting), нормалізації вмісту та посилань на апаратне забезпечення, виявлені під час end-to-end тестування.