வழங்குநர்-அடிப்படையிலான ப்ராம்ட் கேச்சிங்
Superdav AI Agent v1.12.0 ஆனது வழங்குநர்-அடிப்படையிலான ப்ராம்ட் கேச்சிங் அம்சத்தை அறிமுகப்படுத்துகிறது. இது வெவ்வேறு LLM வழங்குநர்கள் (providers) முழுவதும் ப்ராம்ட்களை கேச் செய்வதன் மூலம் API செலவுகளையும் தாமதத்தையும் (latency) மேம்படுத்துகிறது. ஒவ்வொரு வழங்குநருக்கும் வெவ்வேறு கேச்சிங் வழிமுறைகள் மற்றும் அமைப்புகள் உள்ளன.
கண்ணோட்டம் (Overview)
ப்ராம்ட் கேச்சிங் மூலம் நீங்கள் செய்யக்கூடியவை:
- அடிக்கடி பயன்படுத்தப்படும் பெரிய ப்ராம்ட்களை கேச் செய்யலாம்.
- தேவையற்ற செயலாக்கத்தைத் தவிர்ப்பதன் மூலம் API செலவுகளைக் குறைக்கலாம்.
- கேச் செய்யப்பட்ட கோரிக்கைகளுக்கு தாமதத்தை மேம்படுத்தலாம்.
- கேச் வாழ்க்கைச் சுழற்சியை (cache lifecycle) வெளிப்படையாக நிர்வகிக்கலாம்.
வெவ்வேறு வழங்குநர்கள் கேச்சிங்கை வெவ்வேறு விதமாக செயல்படுத்து கின்றன:
- Google Gemini:
cachedContentsAPI - Azure OpenAI: TTL உடன் ப்ராம்ட் கேச்சிங்
- OpenRouter: வழங்குநர்-குறிப்பிட்ட கேச்சிங்
- Vertex Anthropic: கேச் கட்டுப்பாட்டுடன் ப்ராம்ட் கேச்சிங்
Google Gemini: cachedContents API
Google Gemini ஆனது cachedContents API மூலம் வெளிப்படையான கேச் நிர்வாகத்தை வழங்குகிறது.
உள்ளமைவு (Configuration)
$config = [
'provider' => 'google-gemini',
'model' => 'gemini-2.0-flash',
'caching' => [
'enabled' => true,
'ttl' => 3600, // 1 hour in seconds
'max_tokens' => 1000000, // Max tokens to cache
],
];