Bot Maliyeti %70 Nasıl Düşer? — Akıllı Cache + Prompt Optimizasyonu
Aynı soruyu farklı müşterilerden 10 defa alırsınız. Celer akıllı cache ile OpenAI çağrısını 1'e düşürür.
Trendyol'da tekrar eden soru problemi
Bir kot pantolonda "34 numara stokta var mı?" sorusu haftada 20 kez gelir. Her seferinde bot OpenAI'ye yeni soru göndermek zorunda mı? Hayır.
3 seviyeli maliyet düşürme
1. Cache hit — %30-50 tasarruf
Sistem her cevabı fingerprint ile cache'ler. Aynı ürüne aynı soru geldiğinde OpenAI çağrısı YOK, direkt cache'ten cevap gider (~5ms).
Damga Jeans mağazasında ortalama %35 cache hit. Yani 100 sorunun 35'i ücretsiz cevap.
2. Prompt cache (OpenAI native) — %60 token tasarrufu
OpenAI 1024+ token'lı prompt'ları cache'ler. Sistem prompt'umuz sabit (sektör template + firma custom + beden tablosu), toplam 2500-3000 token. Her istekte 2500 token cache hit (kırmızı fiyat).
Sonuç: prompt token maliyeti $0.15/1M yerine $0.075/1M (%50 indirim).
3. gpt-4o-mini — %10 model maliyeti
gpt-4o'nun %10 fiyatına gpt-4o-mini. Sektörel prompt + RAG ile kalite fark yaratmadan.
Gerçek rakamlar
Damga Jeans — Temmuz 2026 ayı:
- 1200 cevap, 420 cache hit (%35)
- 780 OpenAI çağrısı — 2.34M prompt token, 26K completion
- Prompt cache: %72 (1.68M token yarı fiyat)
- Toplam maliyet: ~$0.35 (~₺15) / ay
Yani 1200 müşteri sorusu = ₺15 OpenAI maliyeti. Aynı iş manuel yapılsa 4-5 saat/gün insan mesai = binlerce TL.
Fiyatlandırma modelimiz
Bu tasarrufları müşterimize yansıtıyoruz — kredi fiyatları:
- 500 kredi — ₺1.000 (₺2 / kredi)
- 1000 kredi — ₺1.900 (₺1.90)
- 25.000 kredi — ₺35.000 (₺1.40 · %30 indirim)
- 50.000 kredi — ₺65.000 (₺1.30 · en ucuz)
Aylık abonelik YOK — kredi paketi tek seferlik ve sınırsız saklanır.
Peki sizin bot ne kadara mal olurdu?
Panel'deki Dashboard'da Token & Tahmini Maliyet grafiği anlık gösteriyor. İlk 50 kredi hediye ile risksiz denersiniz.