Providerə Uyğun Prompt Cacheləmə
Superdav AI Agent v1.12.0, müxtəlif LLM (Böyük Dil Modeli) providerları arasında promptları cacheləyərək API xərclərini və gecikməni (latency) optimallaşdıran providerə uyğun prompt cacheləmə funksionallığını təqdim edir. Hər bir providerun özünəməxsus cacheləmə mexanizmləri və konfiqurasiyaları var.
Ümumi Baxış
Prompt cacheləmə sizə aşağıdakıları etməyə imkan verir:
- Tez-tez istifadə olunan böyük promptları cacheləmək
- Təkrar emal etməkdən çəkinərək API xərclərini azaltmaq
- Cachelənmiş sorğular üçün gecikməni yaxşılaşdırmaq
- Cache həyat dövrünü (lifecycle) açıq şəkildə idarə etmək
Fərqli providerlar cacheləməni fərqli şəkildə tətbiq edir:
- Google Gemini:
cachedContentsAPI - Azure OpenAI: TTL ilə Prompt cacheləmə
- OpenRouter: Providerə xas cacheləmə
- Vertex Anthropic: Cache nəzarəti ilə Prompt cacheləmə
Google Gemini: cachedContents API
Google Gemini, cachedContents API vasitəsilə açıq cache idarəetməsi təmin edir.
Konfiqurasiya
$config = [
'provider' => 'google-gemini',
'model' => 'gemini-2.0-flash',
'caching' => [
'enabled' => true,
'ttl' => 3600, // 1 saat saniyə ilə
'max_tokens' => 1000000, // Cachelənməyə maksimum token sayı
],
];
Cachelənmiş Prompt Yaratmaq
use Superdav\AI\Providers\GoogleGemini;
$gemini = new GoogleGemini( $config );
$cached_content = $gemini->create_cached_content(
[
'system_prompt' => 'Siz köməkçi bir asistanınız...',
'context' => 'Böyük kontekst sənədi...',
'ttl' => 3600,
]
);
// Nəticə: ['cache_id' => 'abc123', 'expires_at' => timestamp]
Cachelənmiş Promptdan İstifadə Etmək
$response = $gemini->generate(
[
'cache_id' => 'abc123',
'prompt' => 'İstifadəçi sualı burda',
]
);
Cache Həyat Dövrü
// Cachelənmiş məzmunları siyahıla
$caches = $gemini->list_cached_contents();
// Cache detallarını al
$cache = $gemini->get_cached_content( 'abc123' );
// Cache TTL-ni uzatmaq
$gemini->update_cached_content(
'abc123',
['ttl' => 7200] // 2 saatə qədər uzat
);
// Cache-i silmək
$gemini->delete_cached_content( 'abc123' );
Gemini üçün Ən Yaxşı Praktikalara Nəzarət
- Uyğun TTL təyin edin: Xərclərdən qənaət və cache köhnəlməsi arasında balans tapın
- Sistem promptlarını cacheləyin: Sorğular arasında eyni sistem promptundan istifadə edin
- Cache istifadəsini monitorinq edin: Hansı cachelərin ən çox istifadə olunduğunu izləyin
- Expired cacheləri təmizləyin: İstifadə edilməyən cacheləri müntəzəm olaraq silin
Azure OpenAI: Prompt Cacheləmə
Azure OpenAI, avtomatik TTL idarəetməsi ilə prompt cacheləməni dəstəkləyir.
Konfiqurasiya
$config = [
'provider' => 'azure-openai',
'model' => 'gpt-4-turbo',
'api_version' => '2024-08-01-preview',
'caching' => [
'enabled' => true,
'cache_control' => 'max_age=3600',
],
];