A Claude Fable 5.1 jelentősen csökkenti a valós használati költséget, akár 45%-kal az összetett, AI-ügynökökre épülő feladatoknál. Az Anthropic által bejelentett új változat, amelyről a The Verge is beszámolt, nem az alap tokenárakat módosítja, hanem az összetett alkalmazásokban gyorsan felhalmozódó költséget, a már feldolgozott információk újrahasználatát célozza.
Mi lett olcsóbb a Claude Fable 5.1-ben?
Az API díjszabása változatlanul 10 dollár, nagyjából 3600 forint egymillió bemeneti tokenért és 50 dollár, megközelítőleg 18 000 forint egymillió generált tokenért. A cache-ből olvasott információ díja viszont egymillió tokenenként mindössze 0,25 dollárra, körülbelül 90 forintra esik, ami 75%-kal kevesebb a Fable 5 áránál. Az Anthropic becslése szerint ez a következő hatással jár:
- körülbelül 25%-kal alacsonyabb költség egy átlagos munkafolyamatban;
- akár 45%-os megtakarítás az erősen AI-ügynökös feladatoknál;
- 0,25 dollár egymillió, cache-ből olvasott tokenért.
A kedvezmény üdvözlendő, de a számok igazán akkor érdekesek, ha a Claude-ot néhány kínai modellel vetjük össze.
Mennyibe kerül a nyugati AI a kínai modellekhez képest?
| Modell | Bemenet / 1 millió token | Kimenet / 1 millió token | Megjegyzés |
|---|---|---|---|
| Claude Fable 5.1 | 10 USD (kb. 3600 Ft) | 50 USD (kb. 18 000 Ft) | normál API-díj |
| DeepSeek V4 Pro | 1,32 USD (kb. 475 Ft) | 3,96 USD (kb. 1430 Ft) | csúcsidős tarifa; csúcsidőn kívül a költség megfeleződik |
| Qwen3 Max | 0,359 USD (kb. 130 Ft) | 1,434 USD (kb. 520 Ft) | Kína, Peking; legfeljebb 32K tokenes kérések |
A DeepSeek a V4 Pro esetében csúcsidőn kívül mindössze 0,66 dolláros bemeneti és 1,98 dolláros kimeneti árat közöl, míg a Qwen3 Max Kínában 0,359 dollártól indul egymillió bemeneti tokenért.
A táblázat természetesen nem azt jelenti, hogy a három modell tökéletesen egyenértékű. Eltér a teljesítményük, a kontextusablakuk, az infrastruktúrájuk, a biztonsági megoldásaik és a felhasználási területük is. A piaci tanulság mégis egyszerű: a kínai fejlesztők bebizonyították, hogy erős AI-modellt jóval alacsonyabb áron is lehet kínálni.
A kínai verseny akkor is számít, ha nem kínai modellt választunk
Ez az AI-verseny egyik legegészségesebb hatása. Nem kell DeepSeeket telepíteni vagy Qwenre költöztetni egy projektet ahhoz, hogy a fejlesztők profitáljanak belőle. Elég, ha a kínai alternatívák kellően jók és sokkal olcsóbbak ahhoz, hogy a nyugati szolgáltatók árazása is kérdésessé váljon.
Ez a nyomás már a nagyvállalatoknál is látható. Júniusban arról lehetett olvasni, hogy a Microsoft vizsgálta a DeepSeek V4 használatát egyes Copilot-szolgáltatások költségének csökkentésére. Ugyanekkor a GLM-5.2-t a Claude Fable 5-höz hasonlították, többek között a jelentős árkülönbség miatt.
Ez az a fajta „demokratizálódás”, amelynek hatása a leggyorsabban érződik. A kínai modelleknek nem kell minden benchmarkban elsőnek lenniük: elég versenyképesnek lenniük ahhoz, hogy egy fejlesztő kimondhassa, az alternatíva többszörösen kevesebbe kerül. Ettől kezdve az egymillió kimeneti tokenenkénti 50 dolláros árat konkrét előnyökkel kell alátámasztani, nem csupán a vállalat nevével.
A Claude Fable 5.1 továbbra is elérhető a Claude Platformon, valamint a Pro, Max, Team és Enterprise csomagokban. Az Anthropic szerint az új változat a Fable 5-nél jobb teljesítményt nyújt, és módosított szűrőket kapott a kevesebb indokolatlan blokkolás érdekében. A Mythos 5.1 egyelőre korlátozott hozzáférésű, a vállalat erre kijelölt programjain keresztül érhető el.




