Opus 5.5 ve GPT-6 Sol/Luna: fiyat savaşı cache'lenmiş token'lara kaydı

Opus 5.5 cache okumalarını %60, GPT-6 cache'lenmiş input'u %90 ucuzlattı; agent maliyeti artık sabit bir prompt prefix'ine bağlı.

Opus 5.5 ile GPT-6 Sol ve Luna fiyat değişiklikleri ve kontrol listesi: cache hit oranı, önce statik context, eval'ler, thinking hep açık

İki frontier model lansmanı bir gün arayla geldi. Manşet daha ucuz token'lar. Asıl hikaye cache'lenmiş token'lar.

Anthropic, Claude Opus 5.5'i yayınladı. Input ve output %20 ucuzladı, ama cache okumaları %60 düştü. Anthropic'e göre agentic ve kodlama işlerinde maliyetin büyük kısmını cache okumaları oluşturuyor.

OpenAI, GPT-6 Sol ve Luna'yı önceki API fiyatının yarısına yayınladı. Cache'lenmiş input okumalarında da %90 indirim var ve reasoning effort'u ya da tool'ları değiştirmek artık cache'i bozmuyor.

Yani bir agent'ın faturası artık hangi modeli seçtiğinizden çok, prompt prefix'inizin ne kadar sabit olduğuna bağlı.

Bu hafta kontrol edilecekler:

  1. Endpoint başına cache hit oranı
  2. Önce statik context, en son kullanıcı girdisi
  3. Model id'lerini değiştirmeden önce eval setiniz
  4. Opus 5.5 thinking kapalıyken çalışmıyor. Entegrasyonunuzu test edin.

Ucuz token'lar işe yarar. Yeniden kullanılan token'lar daha çok işe yarar.

Bu yazı İngilizce aslından Türkçeye çevrilmiştir.

Videoyu LinkedIn'de izle ↗