Новый: Плавающий чат-виджет со статусом в админ-баре — любой вошедший пользователь может напрямую запустить LLM на стороне браузера с фронтенда.
Новый: Среда выполнения SharedWorker — движок MLC теперь работает в SharedWorker, поэтому несколько вкладок делят одну сессию GPU, вместо того чтобы конкурировать за неё.
Новый: Перехватчик middleware apiFetch — запросы WordPress REST, соответствующие шаблону AI Client SDK, прозрачно направляются к локальному брокеру WebLLM, не требуя обратного HTTP-запроса (loopback).
Новый: Интерфейс настроек виджета в панели Connector для включения/выключения чат-виджета и настройки поведения авто-промпта.
Исправлено: Принудительное использование бэкенда кэша IndexedDB, чтобы загрузка весов модели не прерывалась из-за перенаправлений CDN HuggingFace xet, которые нарушают путь по умолчанию в Cache API.
Исправлено: Пропуск переопределения KV-кэша context_window для моделей встраивания (у них нет декодера, и это переопределение вызывало ошибку во время выполнения).
Исправлено: Объявление кандидата модели для холодного старта в /webllm/v1/models до загрузки вкладки worker, чтобы потребители SDK сразу видели модель.
Исправлено: Подключение WebLLM к фильтру wpai_preferred_text_models, чтобы функция AI Experiments направлялась в браузерный движок при настройке модели.
Улучшено: Исправлены проблемы с кэшированием (cache-busting), нормализацией контента и аппаратными ссылками, выявленные в ходе сквозного тестирования.