
Yapay zekâ tabanlı bir yazılım, SaaS ürünü veya otonom şirket ajanı geliştiriyorsanız ay sonunda karşınıza çıkacak en büyük sürpriz genellikle API token faturasıdır. 2024 başında astronomik olan dil modeli fiyatları, 2026 Eylül ayına geldiğimizde açık kaynak baskısı ve mimari yeniliklerle dramatik şekilde geriledi.
Peki bugün piyasanın 4 büyük devi (OpenAI, Anthropic, Google ve DeepSeek) 1 milyon token başına ne kadar ücret talep ediyor? İşte geliştiriciler için güncel maliyet endeksi:
2026 Eylül Güncel Fiyat Tablosu (1 Milyon Token Başına)
Fiyatlar 1.000.000 (1M) token baz alınarak Amerikan Doları ($) cinsinden listelenmiştir:
| Model Adı ve Sağlayıcı | Girdi (Input) Fiyatı | Çıktı (Output) Fiyatı | Önbellek Okuma (Cache Read) | Bağlam Penceresi (Context) |
|---|---|---|---|---|
| DeepSeek V3 (DeepSeek) | $0.14 | $0.28 | $0.014 (%90 İndirim) | 128.000 Token |
| DeepSeek R1 (Muhakeme) | $0.55 | $2.19 | $0.14 | 128.000 Token |
| Google Gemini 2.5 Flash | $0.075 | $0.30 | $0.018 | 1.000.000 Token |
| Google Gemini 2.5 Pro | $1.25 | $5.00 | $0.31 | 2.000.000 Token |
| OpenAI GPT-4o-mini | $0.15 | $0.60 | $0.075 | 128.000 Token |
| OpenAI GPT-4o (Amiral) | $2.50 | $10.00 | $1.25 | 128.000 Token |
| OpenAI o1 (Muhakeme) | $15.00 | $60.00 | $7.50 | 200.000 Token |
| Claude 3.5 Haiku (Hızlı) | $0.80 | $4.00 | $0.08 | 200.000 Token |
| Claude 3.5 / 5.1 Sonnet | $3.00 | $15.00 | $0.30 (%90 İndirim) | 200.000 / 1.000.000 |
DeepSeek Depremi: Fiyatlar Neden Çöktü?
Yukarıdaki tabloda en çarpıcı nokta DeepSeek V3’ün girdi fiyatıdır: Milyon token başına sadece 14 sent! Bu rakam, GPT-4o’dan yaklaşık 18 kat, Claude 3.5 Sonnet’ten ise 21 kat daha ucuzdur.
DeepSeek’in bu fiyat devrimini yapabilmesinin sebebi kar amacı gütmemesi değil, mimarisindeki radikal verimliliktir:
- MLA (Multi-head Latent Attention): Geleneksel modeller her token için bellekte devasa KV önbelleği tutarken, DeepSeek bunu düşük boyutlu bir vektöre sıkıştırır; bu da sunucu GPU ihtiyacını 5’te 1’e indirir.
- Seyrek MoE: Her soruda 671 milyar parametrenin sadece 37 milyarı çalışır; elektrik ve işlemci faturası dip yapar.
Önbellekleme (Prompt Caching) Savaşı
2026’da faturaları en çok düşüren özellik Prompt Caching oldu. Örneğin 50.000 tokenlik bir kod tabanınız veya şirket rehberiniz varsa:
- İlk soruda bu 50.000 token için tam girdi ücreti ödersiniz.
- Sonraki 50 soruda bu doküman önbellekten okunur ve Anthropic’te yüzde 75-90, DeepSeek’te yüzde 90 indirimle neredeyse bedavaya gelir.
- Bu özellik, otonom yazılım ajanlarının (SWE-agents) operasyon maliyetlerini yüzde 60 oranında aşağı çekmiştir.
Şirketler İçin Akıllı Karma Strateji (Routing)
En karlı şirketler tek bir modele bağlı kalmaz; akıllı bir yönlendirici (AI Gateway / Router) kurar:
- Basit Sınıflandırma ve Veri Ayıklama: Gemini 2.5 Flash veya DeepSeek V3’e yönlendirilir (Maliyet: Sıfıra yakın).
- Kodlama ve Ajan Görevleri: Claude 3.5/5.1 Sonnet’e teslim edilir (Kalite: Zirve).
- Karmaşık Matematik ve Stratejik Mantık: OpenAI o1 veya DeepSeek R1’e çözdürülür.
Sonuç
2026 yılında yapay zekâ rekabeti laboratuvarlardan çıkarak çıkarım ekonomisi (inference economics) savaşına dönüştü. Doğru model kombinasyonunu ve önbellekleme mimarisini kurgulayan geliştiriciler, rakiplerinin onda biri maliyetle aynı zekâ seviyesini kullanıcılarına sunabiliyor.
Sık sorulan sorular
1 milyon token maliyeti hangi modelde en düşük?
Gemini 3.8 Flash, 1 milyon token başına 0.08 dolarla en düşük maliyetli modeldir.
DeepSeek neden bu kadar ucuz?
DeepSeek, MLA ve seyrek MoE mimarisiyle çıkarım maliyetlerini radikal biçimde düşürmüştür.
Dil Modelleri kategorisinden
- Alan Turing ve Makine Düşünmesi: Yapay Zekânın Felsefi Doğuşu
- Alibaba'dan Batı'ya Ağır Darbe: 2.4 Trilyon Parametreli Qwen 3.8-Max ve 27B Açık Kaynak Devrimi
- Doğu'dan Gelen Açık Kaynak Fırtınası: Alibaba Qwen 3 Max ile 1 Trilyon Parametreli Frontier Model
- Geliştiriciler Ayakta: Anthropic'in '20 Kat Fazla Kullanım' Vaadi Neden 2 Kata Düştü?
- Tüm haberler →




