OpenAI, GPT-5.6 Luna'nın API fiyatını yüzde 80 düşürdü
OpenAI 30 Temmuz 2026'da GPT-5.6 Luna'nın API fiyatını yüzde 80, Terra'nın fiyatını yüzde 20 düşürdü. Amiral gemisi Sol'un fiyatı değişmedi. Aynı gün Priority Processing hizmet katmanı Fast mode adını aldı. En ucuz katman ile amiral gemisi arasındaki fark beş kattan yirmi beş kata çıktı.
İndirim, aynı gün yürürlüğe girdi
OpenAI kendi API değişiklik kaydında indirimi tek cümleyle duyurdu: "Starting July 30, GPT-5.6 Luna costs 80% less, while GPT-5.6 Terra costs 20% less." Kayıt 30 Temmuz 2026 tarihli ve bir geçiş süresi tanımlamıyor, yeni fiyatlar duyuruyla aynı gün geçerli oldu.
Rakamlar şöyle. GPT-5.6 Luna'da milyon giriş tokenı 1,00 dolardan 0,20 dolara, milyon çıkış tokenı 6,00 dolardan 1,20 dolara indi. GPT-5.6 Terra'da giriş 2,50 dolardan 2,00 dolara, çıkış 15,00 dolardan 12,00 dolara geldi. Amiral gemisi GPT-5.6 Sol'un fiyatına dokunulmadı, milyon giriş tokenı 5,00 dolar ve çıkış 30,00 dolar olarak duruyor. Yeni fiyatlar OpenAI'ın resmî fiyat dokümanında, indirim öncesi rakamlar ise bağımsız haberlerde teyit ediliyor.
Zamanlama dikkat çekici. OpenAI'ın kendi değişiklik kaydına göre GPT-5.6 ailesi 9 Temmuz 2026'da yayımlanmıştı, indirim tam üç hafta sonra geldi.
Manşetteki rakam, faturanın tamamı değil
Yukarıdaki fiyatlar kısa bağlam tarifesi. OpenAI'ın fiyat dokümanı uzun bağlam için ayrı ve daha yüksek bir tarife listeliyor: Luna'da milyon giriş tokenı 0,40 dolar ve çıkış 1,80 dolar, Terra'da 4,00 ve 18,00 dolar, Sol'da 10,00 ve 45,00 dolar. Yani uzun bağlamla çalışan bir Luna çağrısı, manşette geçen giriş fiyatının iki katına denk geliyor. İncelediğimiz haberler yalnızca kısa bağlam rakamını aktardı.
Aynı doküman iki yönde daha sapma tanımlıyor. Önbelleğe alınmış giriş, giriş fiyatının onda birine iniyor: Luna'da milyon token 0,02 dolar. Batch ve Flex katmanları standart tarifenin yarısı, yani Luna'da giriş 0,10 dolar, çıkış 0,60 dolar ve önbellekli giriş 0,01 dolar. Fast mode ise üç katmanın hepsinde standardın iki katı. Sonuç olarak tek bir modelin faturası, çağrının nasıl yapıldığına göre milyon giriş tokenı başına 0,01 dolar ile 0,40 dolar arasında değişebiliyor; bölgesel işleme uçları için tanımlanan yüzde 10 ek yük bu üst sınırı biraz daha yukarı taşıyabiliyor.
Fast mode'un kendisi yeni bir ürün değil, bir isim değişikliği. OpenAI'ın fiyat sayfası Priority Processing'in 30 Temmuz 2026'da Fast mode olarak yeniden adlandırıldığını ve service_tier alanında hem "priority" hem "fast" değerinin kabul edilmeye devam ettiğini yazıyor. Mevcut entegrasyonların bir şey değiştirmesi gerekmiyor. Sol için değişiklik kaydı standarda göre 2,5 kata kadar hız artışı, iki kat fiyat diyor. Sol'un fiyatı sabit kaldı ama katman büsbütün yerinde saymadı; Fast mode üzerinden gelen bir hız iyileştirmesi bu tarafta duruyor.
İndirimin gerekçesi kapasite değil verimlilik. The Decoder'ın aktardığına göre OpenAI iyileştirmeyi GPT-5.6 Sol'un kendi GPU yazılımını optimize etmesine bağlıyor: dağıtım maliyetinde yüzde 20 azalma ve spekülatif kod çözme yoluyla token üretiminde yüzde 15'in üzerinde iyileşme. Aynı kaynak fiyat baskısının ucuz Çin modelleri ile Microsoft'un düşük maliyetli MAI modellerinden geldiğini not düşüyor ve agresif fiyatlamanın sektörde gelir büyümesini yavaşlatması hâlinde bunun bir risk olabileceğini hatırlatıyor.
Katmanlar arasındaki makas beşten yirmi beşe açıldı
30 Temmuz öncesinde Sol'un giriş fiyatı Luna'nın beş katıydı. İndirimden sonra yirmi beş katı. Bu tek başına mimari bir sonuç doğuruyor: hangi işin hangi modele gittiğine karar veren yönlendirme katmanı, üç hafta öncesine göre çok daha fazla değer üretiyor. Toplu ve tekrarlı işleri Luna'ya, gerçekten zor olanı Sol'a gönderen bir kurgu artık maliyet tarafında ciddi bir kaldıraç.
Rakamı somutlaştırmak gerekirse: 9 Temmuz'da Luna üzerinde milyon giriş tokenına 1,00 dolar ödenen bir iş, bugün 0,20 dolara, Batch indirimiyle birlikte 0,10 dolara iniyor. Bu, katalog metni üretmek, gelen mesajları sınıflandırmak, uzun kayıtları özetlemek gibi hacimli ve tekrarlı işlerde ekonomiyi tümüyle değiştiren bir aralık. InfoWorld'ün aktardığı analist yorumları da aynı yöne bakıyor: pilotların üretime geçmesi kolaylaşıyor ve daha önce ekonomik olarak gerekçelendirilmesi zor olan çok adımlı ajan akışları hesaba oturuyor.
Bir de rekabetin nerede yürüdüğüne dair bir işaret var. OpenAI ucuz katmanları indirdi, amiral gemisinin fiyatına dokunmadı ve mevcut ücretli hız katmanını amiral gemisinde hızlandırdı. Yani üst segmentte fiyatı savunuyor, rekabeti alt segmentte fiyat üzerinden veriyor. Buna karşılık fiyat yapısı sadeleşmedi: kısa ile uzun bağlam, önbellek, Batch, Fast mode ve bölgesel işleme için tanımlanan yüzde 10'luk ek yük bir arada durduğunda, manşetteki 0,20 dolara dayanan bir bütçe tahmini uzun bağlamlı ya da Fast mode trafiğinde yanlış çıkar.
Türkiye'deki işletmeler için anlamı
Aşağıdaki değerlendirme kaynaklarda yer almıyor, bizim okumamız. İncelediğimiz kaynakların hiçbirinde Türkiye'ye özgü bir kırılım, lira karşılığı ya da yerel erişim notu yok; fiyat dokümanındaki tek coğrafya ilgili kayıt, bölgesel işleme uçlarında uygulanan yüzde 10 ek yük ve orada bir ülke adı geçmiyor. Dolayısıyla indirim, Türkiye'den yapılan API çağrıları için ayrı bir duyuru değil, küresel tarifedeki bir değişiklik.
Pratik dört not. Birincisi yönlendirme: tek model üzerine kurulu bir sistemin bugün bıraktığı para, katmanlar arasındaki makas açıldığı için büyüdü, hacimli işleri ucuz katmana taşıyan bir ayrım en hızlı kazanç. İkincisi Batch: gecikmeye duyarlı olmayan gece işleri, katalog güncellemeleri ve toplu sınıflandırmalar Batch katmanına alındığında fatura yarıya iniyor. Üçüncüsü ölçüm: bütçeyi manşet fiyata göre değil, kendi trafiğinizdeki kısa ve uzun bağlam dağılımına göre kurun, aksi hâlde tahmin ile fatura ayrışır. Dördüncüsü kalıcılık varsayımı: kaynaklarda yeni fiyatlar için bir bitiş tarihi ya da tanıtım dönemi ifadesi yok, ancak bunu kalıcı bir taahhüt gibi de okumamak gerekir; üç hafta içinde beşe bölünen bir kalem, tersi yönde de hareket edebilir. Bu son cümle bizim yorumumuz.
UNALSOFT açısı
Bizim agentic AI çalışmalarımızda model seçimi bir marka tercihi değil, akış içinde verilen bir karar. Hangi adımın ucuz katmanla çözüleceği, hangi adımın gerçekten güçlü modeli hak ettiği ve ikisi arasındaki devir noktası baştan tasarlanıyor. Bu indirim o tasarımın değerini artırıyor: maliyet gerekçesiyle rafa kaldırılan akışların yeniden hesaplanması için iyi bir hafta. Sorulacak soru "hangi modeli kullanalım" değil, "hangi iş hangi katmanda çözülür" olmalı.
Maliyet düştü, karar mimaride.
Hangi işin hangi katmanda çözüleceğini birlikte netleştirelim.