FireAI Güvenlik Blogu

Yazan FireAI Security & Research Team · Yayınlandı

AI Token'ın Maliyeti, 2022'den 2026'ya: OpenAI, Antropik ve DeepSeek

AI Token'ın Maliyeti, 2022'den 2026'ya: OpenAI, Antropik ve DeepSeek

OpenAI'nin kendi fiyatlandırma sayfası, 2022'de, 35 jetonluk bir cümlenin maliyetinin bir sentin çok altında olduğunu belirttikten hemen sonra, bir tokenın kabaca İngilizce bir kelimenin dörtte üçü kadar olduğunu açıklamıştı. Bu çerçeve 2026'ya zar zor dayanabiliyor: En küçük modellerin maliyeti artık token başına yüzde birin çok altında bir maliyete sahipken, en büyük modelin maliyeti milyon çıkış tokenı başına elli dolar ve üç tedarikçinin (OpenAI, Anthropic ve DeepSeek) her biri fiyatlarını birkaç kez düşürdü, yükseltti, böldü ve yeniden böldü. Aşağıdaki her rakam, getirdiğimiz bir sayfadan geliyor: ya satıcının mevcut fiyatlandırma sayfasından ya da aynı sayfanın gösterilen tarihten itibaren İnternet Arşivi anlık görüntüsünden. Bir oran hesapladığımızda, oranın oluşturulduğu her iki sayı da aynı paragrafta belirtilir.

OpenAI, 2022'den 2026'ya

Kasım 2022'de OpenAI'nin fiyatlandırma sayfasında Ada, Babbage, Curie ve Davinci olmak üzere dört temel model listelendi; bunların her biri, istem veya çıktı olmasına bakılmaksızın her token için aynı fiyattaydı; henüz bir girdi/çıktı ayrımı yoktu. Dördü arasında en yeteneklisi olan Davinci'nin fiyatı 1.000 token başına 0,02 dolardı. OpenAI'nin mevcut kullanımdan kaldırma sayfası, bağımsız olarak, bu seviyede inşa edilen özel model olan text-davinci-003'ün 2024 kapanışına kadar faturalandırıldığı fiyat olarak milyon token başına 20,00 dolar olan kesin rakamı doğruluyor. Dört ay sonra, GPT-4, 8K bağlamlı sürümü için 1.000 istem tokenı başına 0,03 ABD Doları ve 1.000 tamamlama tokeni başına 0,06 ABD Doları fiyatla piyasaya sürüldü ve 32K sürümü için iki katına çıkarak 0,06 ABD Doları ve 0,12 ABD Doları'na çıktı. gpt-3.5-turbo aynı ay, yine girdi/çıktı ayrımı olmaksızın, 1.000 token başına 0,002 dolardan sabit bir fiyatla piyasaya sürüldü.

OpenAI liste fiyatları. "Geçerli" satırlar bu makalenin yayınlanma tarihidir.
ModeliGiriş $/1 milyonÇıkış $/1 milyonŞu tarihten itibaren fiyatlandırılmıştır:Kaynak
metin-davinci-00320,00$20,00$Kasım 2022arşivlenmiş fiyatlandırma sayfası
gpt-3.5-turbo (lansman)2,00$2,00$Mart 2023arşivlenmiş fiyatlandırma sayfası
GPT-4, 8K bağlamı (lansman)30,00$60,00$Mart 2023arşivlenmiş fiyatlandırma sayfası
gpt-4o-2024-05-13 (lansman)5,00$15,00$Mayıs 2024OpenAI fiyatlandırma belgeleri
o1 (akıl yürütme)15,00$60,00$mevcut listeOpenAI fiyatlandırma belgeleri
gpt-4o (mevcut fiyat)2,50$10,00$akımOpenAI fiyatlandırma belgeleri
gpt-6-luna (en ucuz akım)0,10$0,50$akımOpenAI fiyatlandırma belgeleri
gpt-6-astra (mevcut amiral gemisi)10,00$50,00$akımOpenAI fiyatlandırma belgeleri

Her ikisi de yalnızca yukarıdaki satırlardan oluşturulan iki karşılaştırma: Text-davinci-003'ün 20,00 ABD doları giriş fiyatı ile gpt-6-luna'nın şu anki 0,10 ABD doları girdi fiyatı, OpenAI'nin her zaman için mevcut en ucuz katmanı için yaklaşık dört yılda 200 katlık bir düşüş. Ancak GPT-4'ün orijinal 30,00 lık giriş fiyatı, gpt-6-astra'nın şu anki 10,00 ına karşılık, amiral gemisi ile amiral gemisi karşılaştırması için yalnızca 3 kat bir düşüş; ucuz seviye, pahalı olandan çok daha hızlı düştü. gpt-4o'nun fiyatı, piyasaya sürüldükten sonra Mayıs 2024'teki 5,00 ABD Doları/15,00 ABD Doları'ndan bugün 2,50 ABD Doları/10,00 ABD Doları'na düşerek yeniden fiyatlandırıldı; bu, aynı modelin kapasitesini hiçbir şekilde değiştirmeden daha ucuz hale gelmesinin basit bir örneğidir.

Antropik, 2023 - 2026

Anthropic'in kurtarabildiğimiz en eski geliştirici fiyatlandırma tablosu, Temmuz 2023'e ait arşivlenmiş bir PDF, aynı ay piyasaya sürülen Claude 2'yi milyon girdi tokenı başına 11,02 dolar ve milyon çıktı tokeni başına 32,68 dolardan fiyatlandırdı ve Claude 1'in aynı fiyatta kaldığını kaydetti. O zamanın en ucuz katmanı olan Claude Instant, 1,63 dolarlık girdi ve 5,51 dolarlık çıktıydı. 2024'ün başlarında, Claude 3 piyasaya sürülmeden önce, arşivlenmiş bir anlık görüntü, Claude 2.0 ve 2.1'in 8,00 ABD Doları/24,00 ABD Doları'na ve Anında kesintinin 0,80 ABD Doları/2,40 ABD Doları'na düştüğünü gösteriyor; bu, mevcut seride mütevazı indirimler. Mart 2024'te piyasaya sürülen Claude 3, aralığın en alt noktasını tamamen sıfırladı: Haiku, Anthropic'in daha önce sunduğu tüm tekliflerin çok altında, 0,25 ABD Doları/1,25 ABD Doları seviyesinde gelirken, Sonnet ve Opus, 3,00 ABD Doları/15,00 ABD Doları ve 15,00 ABD Doları/75,00 ABD Doları seviyesinden piyasaya sürüldü. Claude 3.5 Sonnet, üç ay sonra, Claude 3 Sonnet ile tamamen aynı 3,00$/15,00$ fiyatla piyasaya sürüldü; bu, modelin kendisi gelişirken fiyatın sabit kaldığı bir durum.

Antropik liste fiyatları, Claude API.
ModeliGiriş $/1 milyonÇıkış $/1 milyonŞu tarihten itibaren fiyatlandırılmıştır:Kaynak
Claude 1 / Claude 2 (aynı fiyat)11,02$32,68$Temmuz 2023arşivlenmiş fiyatlandırma PDF'si
Claude Anında1,63$5,51$Temmuz 2023arşivlenmiş fiyatlandırma PDF'si
Claude 2.0 / 2.1 (fiyat indiriminden sonra)8,00$24,00$Şubat 2024arşivlenmiş fiyatlandırma PDF'si
Claude 3 Haiku (lansman)0,25$1,25$Mart 2024arşivlenmiş API sayfası
Claude 3 Sonnet (lansman)3,00$15,00$Mart 2024arşivlenmiş API sayfası
Claude 3 Opus (lansman)15,00$75,00$Mart 2024arşivlenmiş API sayfası
Claude 3.5 Sonnet (lansman)3,00$15,00$Haziran 2024arşivlenmiş fiyatlandırma anlık görüntüsü
Haiku 4.5 (şu anki en ucuz)1,00$5,00$akımClaude fiyatlandırması
Sonnet 5 (güncel)2,00$10,00$akımClaude fiyatlandırması
Fable 5.1 (mevcut amiral gemisi)10,00$50,00$akımClaude fiyatlandırması

Burada eğri basitçe düşmez. Claude 3 Haiku, Mart 2024'te 0,25 ABD Doları girdiyle piyasaya sürüldü; Anthropic'in şu anki en ucuz modeli Haiku 4.5, 1,00 dolardan listeleniyor; bu, iki yıl önceki ucuz seviyeye göre token başına dört kat daha pahalı. Tek başına okuyun, yapay zeka daha pahalı hale gelmiş gibi görünüyor. Bu makalenin geri kalanını okuyun, başka bir şeye benziyor: Anthropic, en düşük kademenin token başına fiyatını kabaca sabit tuttu ve bu kademeyi çok daha yetenekli hale getirirken hafif bir artış gösterdi ve aynı zamanda Opus'un eskiden en üst seviyede olduğu seviyenin üzerine yeni, daha pahalı bir amiral gemisi kademesi (10,00 $/50,00 da Fable 5.1) ekledi. Diziliş aynı oranda ucuzlamak yerine daha fazla kademe büyüttü.

DeepSeek ve mantık-fiyat şoku

DeepSeek bu pazara zaten iki rakibinin çok altında fiyatla girdi. Mayıs 2024'te, arşivlenmiş fiyatlandırma sayfası, DeepSeek-V2 tarafından desteklenen, sabit 0,14 ABD doları giriş ve 0,28 ABD doları çıktıyla deepseek-chat'i gösteriyor; bu, her ikisi de 0,25 ABD dolarından daha ucuz bir token göndermeden önce OpenAI veya Anthropic'in o sırada sunduğu her şeyden daha ucuz. Aralık 2024 itibarıyla deepseek-chat, DeepSeek-V3'e yükseltildi ve DeepSeek'in fiyatlandırma sayfası, önbellek isabeti/önbellek kaçırma ayrımını uygulamaya koydu: arşivlenmiş bir anlık görüntü, standart (promosyon sonrası) ücreti 0,07 ABD doları önbellek isabeti girişi, 0,27 ABD doları önbellek kaçırma girişi ve 1,10 ABD doları çıktı olarak gösterir. Daha sonra, 20 Ocak 2025'te DeepSeek, 0,14 ABD Doları önbellek isabet girişi, 0,55 ABD Doları önbellek kaçırma girişi ve 2,19 ABD Doları çıktı değerinde bir akıl yürütme modeli olan R1'i piyasaya sürdü; sekiz gün sonrasına ait arşivlenmiş bir anlık görüntü, herhangi bir promosyon indiriminin açıkça hariç tutulduğu bu fiyatı doğruluyor.

DeepSeek liste fiyatları; mevcut satırlar yoğun olmayan oranları gösterir (DeepSeek yoğun saatlerdeki kullanımı tersine indirir - aşağıya bakın).
Modeli$/1M giriş yapın (önbellek isabeti / önbellek kayıp)Çıkış $/1 milyonŞu tarihten itibaren fiyatlandırılmıştır:Kaynak
DeepSeek-V2 (derin arama sohbeti)daire 0,14$0,28$Mayıs 2024arşivlenmiş fiyatlandırma sayfası
DeepSeek-V3 (derin arama sohbeti, standart ücret)0,07 ABD Doları / 0,27 ABD Doları1,10$Aralık 2024arşivlenmiş fiyatlandırma sayfası
DeepSeek-R1 (derin arama-akıl yürütücü, başlatma)0,14 ABD Doları / 0,55 ABD Doları2,19$Ocak 2025arşivlenmiş fiyatlandırma sayfası
deepseek-flash (mevcut, yoğun olmayan)0,003 ABD Doları / 0,15 ABD Doları0,60$akımDeepSeek fiyatlandırma belgeleri
deepseek-v4-pro (güncel, yoğun olmayan dönem)0,022 ABD Doları / 0,66 ABD Doları1,98$akımDeepSeek fiyatlandırma belgeleri

R1'in lansmanı, bu makalenin tamamındaki en keskin rakamdır: OpenAI'nin o1'ine karşı 2,19 dolarlık çıktı, benzer bir mantık modeli, 60,00 dolarlık çıktı - 27 kat fark, her ikisi de yukarıdaki tablolarda yer alan rakamlar. Bu karşılaştırma, R1'i Ocak 2025'teki olağan geliştirici kitlesinin ötesinde bir hikaye haline getiren şeydi. Aynı zamanda DeepSeek'in kendi rakamlarının özellikle mantık yürütme konusunda söylediklerine de dikkat etmek gerekiyor: R1'in 2,19 dolarlık çıkış fiyatı, aynı satıcıda, aynı anda V3'ün 1,10 dolarlık çıkış fiyatının kabaca iki katı. Düşünce zinciri akıl yürütme yalnızca API düzeyinde bir maliyet çarpanı eklemez; DeepSeek'in kendi belgeleri, bir muhakeme modelinin çıktı token sayısının yalnızca son cevabı değil, muhakeme izinin her tokenini içerdiğini, dolayısıyla bir muhakeme sorgusunun, token başına fiyat uygulanmadan önce bile doğrudan bir sorguya göre çok daha fazla çıktı tokeni yaktığını belirtiyor. Ve DeepSeek'in mevcut fiyatlandırması, diğer satıcıların kullanmadığı bir mekanizma ekliyor: yoğun saat oranları aynı modelde yoğun olmayan oranların kabaca iki katı; bu, sabit fiyat listesinden ziyade elektrik faturalamasına daha yakın olan talep bazlı bir fiyatlandırma biçimidir.

Düz sayıların gizlediği desen

Üç satıcının mevcut en ucuz token rakamlarını tek bir zaman çizelgesine koyarsanız şekil düzgün bir eğri olmaz. OpenAI'nin ucuz katmanı bugün 20,00 dolardan (Kasım 2022) 0,10 dolara düştü, esasen monoton bir şekilde. Anthropic'in ucuz katmanı bir kez 1,63 dolardan (2023, Claude Instant) 0,25 dolara (Mart 2024, Claude 3 Haiku) sert bir düşüş yaşadı, ardından bu seviye daha yetenekli hale geldikçe tekrar 1,00 dolara (şu anki, Haiku 4,5) yükseldi. DeepSeek zaten ucuza girdi ve günün saatine göre fiyatlandırmayı da ekleyerek orada kaldı. Üç satıcı eğrisinin hiçbiri birbirine benzemiyor ve "bu yılın en ucuz modeli ne olursa olsun" yerine belirli bir kademeyi takip ettiğinizde hiçbiri basit bir üstel düşüşe benzemiyor.

Çıktı maliyetleri girdiden daha yüksek ve oran genişledi

GPT-4'ün Mart 2023'teki lansmanında çıktı maliyeti girdinin tam iki katıydı: 30,00 ABD Dolarına karşı 60,00 ABD Doları. Üç satıcının mevcut amiral gemisi ve orta seviye modellerine bakınca oran genişledi: gpt-6-astra 5 kat (10,00 ABD dolarına karşı 50,00 ABD doları), Claude 3 Opus 5 kattan (15,00 ABD dolarına karşı 75,00 ABD doları) piyasaya sürüldü ve Haiku 4,5'e kadar orada kaldı (5x, 1,00 ABD dolarına karşı 5,00 ABD doları) ve DeepSeek-V3'ün standart ücreti kabaca 4 kat (0,27 dolarlık önbellek kaçırmaya karşı 1,10 dolar). Genel teknik açıklama, ticari olmaktan ziyade mimaridir: Çıkış tokenlarının oluşturulması teker teker, otoregresif olarak gerçekleşirken, bir istemin giriş tokenleri tek bir ileri geçişte paralel olarak işlenebilir, dolayısıyla bir sağlayıcının çıktı tokenı başına gerçek hesaplama maliyeti, girdi tokenı başına olduğundan daha yüksektir ve fiyatlandırma, zaman içinde bu boşluğu GPT-4'ün orijinal, daha yuvarlak 2x bölünmesinden daha doğru bir şekilde yansıtmaya doğru kaymıştır.

Önbellek ve toplu indirimler

Her üç satıcı da artık modelin daha önce fiilen gördüğü tokenlara indirim yapıyor. OpenAI'nin mevcut fiyatlandırma sayfası, gpt-6-astra'nın önbelleğe alınmış girişini 10,00 ABD Doları standart giriş ücretine karşılık 1,00 ABD Doları olarak listeliyor; aynı istem önekini yeniden kullanmak için 10 kat indirim sağlıyor ve Batch API'sinin istekleri 24 saatlik bir pencere içinde uygun modeller genelinde standart eşzamanlı fiyatın yarısı kadar bir sürede işlediğini ayrıca belirtiyor. Anthropic'in mevcut fiyatlandırması, Fable 5.1'in anında önbelleğe alma okuma fiyatını, 10,00 ABD doları standart giriş hızına karşılık 0,25 ABD doları olarak gösteriyor - 40 kat daha ucuz -, önbellek yazma maliyeti ise 12,50 ABD doları, yani 10,00 ABD doları standart ücretin üzerinde bir prim, çünkü yeni bir önbellek girişi yazmak ilk seferde gerçekten fazladan iş yapıyor. DeepSeek'in yukarıda açıklanan önbellek isabeti/önbellek kaçırılan ayrımı, ayrı bir özellik olarak sunulmak yerine temel fiyatlandırmasının içine yerleştirilmiştir: R1'in 0,55 ABD doları önbellek kaçırma oranına karşı 0,14 ABD doları önbellek isabet oranı, yalnızca kaydolan isteklerde değil, her bir çağrıda kabaca 4 kat bir farktır. Birçok çağrıda uzun bir sistem istemini veya sabit bir araç tanımları kümesini tekrarlayan herhangi bir iş yükü için - aynı talimatlara göre bir günlük satırını birbiri ardına sınıflandıran bir güvenlik önceliklendirme hattı Bunun açık bir örneği; bu indirimler, hangi satıcının en ucuz olduğunu, başlık başına token fiyatından daha fazla değiştiriyor.

Jevons paradoksu: Neden daha ucuz tokenlar toplam harcamayı artırdı?

1865'te iktisatçı William Stanley Jevons, James Watt'ın daha yakıt tasarruflu buhar motorunun kömürle çalışan işleri daha ucuz hale getirmesinin ardından Britanya'nın kömür tüketiminin düşmek yerine arttığını savunan Kömür Sorunu'nu yayınladı. Wikipedia'nın argüman özetinin belirttiği gibi, doğrudan Jevons'tan alıntı yaparak:

Yakıtın ekonomik kullanımının tüketimin azalmasına eşdeğer olduğunu varsaymak bir fikir karmaşasıdır. Gerçek bunun tam tersidir.

William Stanley Jevons, 1865, as quoted in Wikipedia: Jevons paradox

Kömürün çok ötesinde genelleştirilmiş olan argüman, bir kaynağın kullanımını daha verimli hale getirmenin etkin fiyatını düşürdüğü ve daha düşük bir fiyatın, talep edilen miktarı verimlilik kazancının sağladığı tasarruftan daha fazla arttırdığı, dolayısıyla toplam tüketimin arttığı yönündedir. Aynı Wikipedia özetine göre, bu kesin argüman 2025'in başlarında DeepSeek'in ucuz R1 modeli etrafında geniş çapta dile getirilmişti; aralarında Microsoft CEO'su Satya Nadella ve ekonomist Erik Brynjolfsson'un da bulunduğu yorumcular radikal biçimde daha ucuz yapay zeka çıkarımının yapay zeka için harcanan toplam kaynakları küçültüp küçültmeyeceğini veya büyüteceğini tartıştıklarından alıntı yaptı. Burada, toplam etkiyi ölçen birincil bir ekonomik çalışma yerine, adlandırılmış yorumların ikincil özetine güveniyoruz ve sektör çapında yapay zeka harcamalarının ayrı, ilgisiz bir talep patlamasına rağmen değil, daha ucuz tokenlar nedeniyle arttığı iddiası, yerleşik bir istatistik değil, tartışılan bir yorumdur. Yukarıdaki fiyat tablolarının doğrudan desteklediği şey argümanın önkoşuludur: 2022'de hesaplamada onlarca dolara mal olan aynı sorgu, bugün her satıcıda sentlere mal olabilir; bu da tam olarak tarihsel olarak tüketimin düşmesinden ziyade artmasından önce gelen türden bir fiyat çöküşüdür.

Yapay zekanın bulut yerine yerel olarak çalıştırılması açısından bunun anlamı nedir?

Bu makaledeki her fiyat, yanıtlama isteminizi zorunlu olarak alan bir şirket tarafından faturalandırılan, ölçülü, arama başına maliyettir; API çağrısı da budur. Tamamen kendi cihazınızda çalışan bir modelin, ödemesini yaptıktan veya bir kez indirdikten sonra jeton başına faturası yoktur ve istek yolunda hiçbir uzak uç nokta olmadığından herhangi bir yere gönderecek hiçbir şeyi yoktur. Bu, cihazdaki modellerin yukarıda fiyatlandırılan sınır katmanlarıyla eşleştiği iddiası değildir; Bir dizüstü bilgisayarda rahatça çalışacak kadar küçük bir model, Fable 5.1 veya gpt-6-astra'nın ötesine geçmeyecektir. Bu farklı bir ticarettir: Gerçekte sahip olduğunuz hafızaya uyan yetenek karşılığında sabit bir maliyet ve sağlam bir gizlilik sınırı.

Bu değiş-tokuş soyut değildir; bu, küçük, dar kapsamlı bir cihaz modelinin, bir güvenlik yazılımı parçası içinde yaptığı modelin aynısıdır. HisnLabs'ın Mac güvenlik duvarı FireAI, tek işi henüz kuralı olmayan bir uygulamadan gelen bağlantıyı incelemek olan isteğe bağlı bir yerel model sunar; yukarıdaki tablolarda fiyatlandırılanlardan çok daha küçük bir kapsama sahip olan ve modelin bu API'lerden herhangi birini çağırmak yerine Mac'in kendisinde çalıştığı bir görev. OpenAI, Anthropic ve DeepSeek'in fiyat geçmişini bu kadar detaylı incelemenin amacı o tasarımı satmak değil; ticareti somut hale getirmektir: bulut belirteçleri, 2022 ile 2026 arasında çok daha az parayla çok daha fazla yetenek satın aldı ve bu fiyat noktalarının her birinde bunları kullanmak, yanıt almak için verilerinizi başka birinin sunucusuna göndermek anlamına geliyordu.

FireAI ve HisnLabs burada nereye oturuyor

None of this makes FireAI a cost story — it is a firewall, not a rented model — but the same bet sits underneath its own on-device reviewer: no per-token bill and nothing sent off the Mac, because the review happens locally instead of being shipped to a server.

FireAI, HisnLabs’in kendi ürünüdür: doğrudan Mac’inizde çalışan, yapay zekâ destekli bir güvenlik duvarı. Uygulamalarınızın kurduğu her bağlantıyı sade bir dille gösterir ve Mac’inizden neyin çıkacağına sizin karar vermenizi sağlar — yapay zekâsı yerel olarak çalışır, yani trafiğiniz asla bize ya da başka birine gönderilmez. HisnLabs güvenlik araştırma ekibi bu kararların isabetli kalmasını sağlayan ekiptir: hangi alan adlarının sıradan telemetri, hangilerinin gerçek bir hizmet olduğunu kataloglar, bir bağlantının ardındaki ülkeyi ve ağı izler ve cihaz üzerindeki modeli (Autopilot özelliği) gerçek trafik örüntüleriyle eğitir — üstelik bunların hiçbiri Mac’inizden dışarı çıkmadan.

Arkasındaki teknik kararları okuyabilir ya da FireAI’yi 17 gün boyunca deneyebilirsiniz: HisnLabs’ten FireAI.

Kaynaklar