AI-modeller och LLM

Claude Fable 5.1 sänker cachepriset 75 procent – men du kan ändå betala mer

Anthropics nya toppmodell Claude Fable 5.1 sänker cachepriset 75 procent men producerar 70 procent fler output-tokens. Så räknar du på totalkostnaden.

Källbild till artikeln: Claude Fable 5.1 sänker cachepriset 75 procent – men du kan ändå betala mer

Claude Fable 5.1 och Claude Mythos 5.1 släpptes den 2 september som Anthropics nya toppmodeller. Den siffra som får mest uppmärksamhet är cachepriset, som enligt Anthropic sjunker med 75 procent jämfört med föregångaren. Men den siffran talar inte hela sanningen om vad en agent faktiskt kommer att kosta.

Samma modeller producerar nämligen omkring 70 procent fler output-tokens per uppgift. För ett team som faktureras per token betyder det att en stor del av cachebesparingen kan ätas upp av att modellen helt enkelt genererar mer text per körning. Den som bara läser rubriksiffran om cachepris riskerar att budgetera fel.

Räkneexemplet är enkelt. Cachepris är priset på att återanvända redan bearbetad kontext i stället för att skicka allt på nytt. Ett lägre cachepris gynnar därför främst arbetsflöden med långa, återkommande kontexter. Men eftersom output-tokens prissätts separat och volymen ökar, är det totalkostnaden per uppgift som avgör om bytet lönar sig – inte en enskild prissänkning.

Det som är klart är att modellerna är nya state of the art-nivåer från Anthropic och att de är tillgängliga via Claude API, bland annat genom Vercel AI Gateway. Det som fortfarande saknas i de officiella kanalerna är exakta priser per token för varje variant. Den som ska bygga en budget bör därför räkna på total tokenvolym och inte bara på cachepris.

Källa: Latent Space – Claude Fable/Mythos 5.1

Källa: Anthropic – Claude Fable 5.1 och Mythos 5.1

Läs mer om ämnet

Anthropic Claude prissättning

Källor