İçeriğe geç
YZF
Rehber· 11 dakika okuma

Yapay Zeka API Maliyeti Nasıl Hesaplanır? Token Mantığı ve Tasarruf Yöntemleri

1M token kaç TL? Türkçe metin neden daha pahalı? Prompt caching ile faturanızı yarıya nasıl indirirsiniz? API maliyetlerini örneklerle hesapladık.

Yapay Zeka API Maliyeti Nasıl Hesaplanır? Token Mantığı ve Tasarruf Yöntemleri — yazının kapak görseli

Yapay Zeka Fiyatları · Son güncelleme

Token nedir?

Dil modelleri metni kelime kelime değil, token adı verilen parçalar halinde işler. Bir token ortalama 4 karaktere denk gelir. İngilizce'de yaklaşık 1 token ≈ 0,75 kelime kabul edilir.

Türkçe için durum farklı. Eklemeli bir dil olduğumuz için "gelebileceklerimizden" gibi bir kelime tek token olmaz; 5-6 token'a bölünür. Pratikte:

Türkçe metin, aynı anlamı taşıyan İngilizce metne göre yaklaşık 1,5-2 kat daha fazla token tüketir.

Bu, Türkçe çalışan bir uygulamanın API faturasının doğrudan iki katına çıkması demektir. Maliyet planlarken bu çarpanı ihmal etmeyin.

Girdi ve çıktı ayrı fiyatlanır

Her sağlayıcı iki ayrı fiyat açıklar:

  • Girdi (input): modele gönderdiğiniz istem, sistem mesajı, doküman.
  • Çıktı (output): modelin ürettiği yanıt.

Çıktı tipik olarak girdinin 4 ila 8 katı pahalıdır. Nedeni teknik: girdi tek seferde paralel işlenirken, çıktı token token üretilir.

Pratik sonuç: Maliyeti düşürmek istiyorsanız önce çıktı uzunluğuna bakın. "Kısa ve öz cevap ver" talimatı veya max_tokens sınırı, uzun istemleri kısaltmaktan çok daha etkilidir.

Örnek hesaplama: müşteri destek botu

Varsayımlar:

  • Günde 1.000 konuşma
  • Her konuşmada 4 tur
  • Sistem istemi: 1.500 token (her turda tekrar gönderiliyor)
  • Kullanıcı mesajı: ortalama 100 token
  • Model yanıtı: ortalama 300 token

Tur başına girdi: 1.500 + (birikmiş sohbet ~400) + 100 = 2.000 token Tur başına çıktı: 300 token

Günlük toplam:

  • Girdi: 1.000 × 4 × 2.000 = 8.000.000 token = 8M
  • Çıktı: 1.000 × 4 × 300 = 1.200.000 token = 1,2M

Orta segment bir modelde (girdi 0,30 $/M, çıktı 2,50 $/M):

  • Girdi: 8 × 0,30 = 2,40 $
  • Çıktı: 1,2 × 2,50 = 3,00 $
  • Günlük: 5,40 $ → aylık ~162 $

Aynı iş amiral gemisi bir modelde (girdi 3 $/M, çıktı 15 $/M):

  • Girdi: 8 × 3 = 24 $
  • Çıktı: 1,2 × 15 = 18 $
  • Günlük: 42 $ → aylık ~1.260 $

Aradaki fark 8 kat. Model seçimi, optimizasyonların hepsinden daha büyük etki yaratır.

Yapay Zeka API Maliyeti Nasıl Hesaplanır? Token Mantığı ve Tasarruf Yöntemleri — konuyu anlatan soyut illüstrasyon
Yapay Zeka API Maliyeti Nasıl Hesaplanır? Token Mantığı ve Tasarruf Yöntemleri — konuyu anlatan soyut illüstrasyon

Tasarruf yöntemi 1: Prompt caching

Yukarıdaki örnekte sistem istemi her turda yeniden gönderiliyor: günde 1.500 × 4.000 = 6M token, yani girdinin %75'i. Prompt caching bu tekrar eden bölümü önbellekte tutar ve sonraki isteklerde normal fiyatın %10'u kadar ücretlendirir.

Yeni girdi maliyeti:

  • Önbellekten: 6M × 0,03 $/M = 0,18 $
  • Yeni içerik: 2M × 0,30 $/M = 0,60 $
  • Toplam: 0,78 $ (önceden 2,40 $)

Girdi maliyetinde %67 tasarruf.

Caching'in çalışması için önbelleğe alınan bölümün istemin başında ve birebir aynı olması gerekir. Sistem istemine tarih/saat gibi değişken bir şey koyarsanız önbellek her seferinde ıskalar.

Tasarruf yöntemi 2: Batch API

Acil olmayan işler (gece toplu özetleme, veri etiketleme, raporlama) için toplu iş API'leri %50 indirim sunar. Karşılığında yanıt saatler içinde döner. Kullanıcı beklemiyorsa bu takas neredeyse her zaman mantıklıdır.

Tasarruf yöntemi 3: Model kademelendirme

Her isteği en güçlü modele göndermeyin. Tipik bir kademelendirme:

  1. Sınıflandırma / yönlendirme → en küçük ve ucuz model
  2. Rutin yanıtlar → orta segment model
  3. Karmaşık akıl yürütme → amiral gemisi model

İsteklerin %80'i genellikle ilk iki kademede çözülür. Bu tek başına faturayı yarıdan aşağı indirebilir.

Tasarruf yöntemi 4: Çıktıyı yapılandırın

Serbest metin yerine JSON şeması zorunlu kılmak, modelin gereksiz açıklama üretmesini engeller. "İşte istediğiniz analiz: ..." gibi dolgu cümleleri çıktı token'ı yakar.

Bütçe koruması kurun

Her sağlayıcı hesap düzeyinde harcama limiti tanımlamanıza izin verir. Üretime çıkmadan önce mutlaka:

  • Sert limit (hard limit) belirleyin — aşınca API durur.
  • Uyarı eşiği koyun — %50 ve %80'de e-posta alın.
  • Kullanıcı başına hız sınırı uygulayın; kötüye kullanım faturayı bir gecede katlayabilir.

TL cinsinden planlama

API faturaları dolar kesilir ve kur riski size aittir. Aylık 200 dolarlık bir kullanım, kurun %10 oynamasıyla bütçenizde 20 dolarlık sapma yaratır. Kurumsal bütçelemede:

  • Kuru güncel değerinin %10-15 üzerinden planlayın.
  • Sağlayıcının Türkiye faturasına dijital hizmet vergisi eklenip eklenmediğini kontrol edin.

Özet kontrol listesi

  • ☐ Türkçe için token çarpanını 1,5-2 aldınız mı?
  • ☐ Çıktı uzunluğunu sınırladınız mı?
  • ☐ Sabit sistem istemi için caching açık mı?
  • ☐ Acil olmayan işler batch'e taşındı mı?
  • ☐ Model kademelendirmesi var mı?
  • ☐ Harcama limiti ve uyarı tanımlı mı?

Bu altı maddeyi uygulayan ekipler, tipik olarak ilk faturalarının üçte birine iniyor.

Bu yazıda geçen araçların güncel fiyatları

#api#token#maliyet#openai#anthropic

İlgili yazılar