A Claude Fable 5.1 jelentősen csökkenti a valós használati költséget, akár 45%-kal az összetett, AI-ügynökökre épülő feladatoknál. Az Anthropic által bejelentett új változat, amelyről a The Verge is beszámolt, nem az alap tokenárakat módosítja, hanem az összetett alkalmazásokban gyorsan felhalmozódó költséget, a már feldolgozott információk újrahasználatát célozza.

Mi lett olcsóbb a Claude Fable 5.1-ben?

Az API díjszabása változatlanul 10 dollár, nagyjából 3600 forint egymillió bemeneti tokenért és 50 dollár, megközelítőleg 18 000 forint egymillió generált tokenért. A cache-ből olvasott információ díja viszont egymillió tokenenként mindössze 0,25 dollárra, körülbelül 90 forintra esik, ami 75%-kal kevesebb a Fable 5 áránál. Az Anthropic becslése szerint ez a következő hatással jár:

  • körülbelül 25%-kal alacsonyabb költség egy átlagos munkafolyamatban;
  • akár 45%-os megtakarítás az erősen AI-ügynökös feladatoknál;
  • 0,25 dollár egymillió, cache-ből olvasott tokenért.

A kedvezmény üdvözlendő, de a számok igazán akkor érdekesek, ha a Claude-ot néhány kínai modellel vetjük össze.

Mennyibe kerül a nyugati AI a kínai modellekhez képest?

ModellBemenet / 1 millió tokenKimenet / 1 millió tokenMegjegyzés
Claude Fable 5.110 USD (kb. 3600 Ft)50 USD (kb. 18 000 Ft)normál API-díj
DeepSeek V4 Pro1,32 USD (kb. 475 Ft)3,96 USD (kb. 1430 Ft)csúcsidős tarifa; csúcsidőn kívül a költség megfeleződik
Qwen3 Max0,359 USD (kb. 130 Ft)1,434 USD (kb. 520 Ft)Kína, Peking; legfeljebb 32K tokenes kérések

A DeepSeek a V4 Pro esetében csúcsidőn kívül mindössze 0,66 dolláros bemeneti és 1,98 dolláros kimeneti árat közöl, míg a Qwen3 Max Kínában 0,359 dollártól indul egymillió bemeneti tokenért.

A táblázat természetesen nem azt jelenti, hogy a három modell tökéletesen egyenértékű. Eltér a teljesítményük, a kontextusablakuk, az infrastruktúrájuk, a biztonsági megoldásaik és a felhasználási területük is. A piaci tanulság mégis egyszerű: a kínai fejlesztők bebizonyították, hogy erős AI-modellt jóval alacsonyabb áron is lehet kínálni.

A kínai verseny akkor is számít, ha nem kínai modellt választunk

Ez az AI-verseny egyik legegészségesebb hatása. Nem kell DeepSeeket telepíteni vagy Qwenre költöztetni egy projektet ahhoz, hogy a fejlesztők profitáljanak belőle. Elég, ha a kínai alternatívák kellően jók és sokkal olcsóbbak ahhoz, hogy a nyugati szolgáltatók árazása is kérdésessé váljon.

Ez a nyomás már a nagyvállalatoknál is látható. Júniusban arról lehetett olvasni, hogy a Microsoft vizsgálta a DeepSeek V4 használatát egyes Copilot-szolgáltatások költségének csökkentésére. Ugyanekkor a GLM-5.2-t a Claude Fable 5-höz hasonlították, többek között a jelentős árkülönbség miatt.

Ez az a fajta „demokratizálódás”, amelynek hatása a leggyorsabban érződik. A kínai modelleknek nem kell minden benchmarkban elsőnek lenniük: elég versenyképesnek lenniük ahhoz, hogy egy fejlesztő kimondhassa, az alternatíva többszörösen kevesebbe kerül. Ettől kezdve az egymillió kimeneti tokenenkénti 50 dolláros árat konkrét előnyökkel kell alátámasztani, nem csupán a vállalat nevével.

A Claude Fable 5.1 továbbra is elérhető a Claude Platformon, valamint a Pro, Max, Team és Enterprise csomagokban. Az Anthropic szerint az új változat a Fable 5-nél jobb teljesítményt nyújt, és módosított szűrőket kapott a kevesebb indokolatlan blokkolás érdekében. A Mythos 5.1 egyelőre korlátozott hozzáférésű, a vállalat erre kijelölt programjain keresztül érhető el.