Anthropics Fable 5.1 kutter hurtigminnekostnader med 75% og mer enn dobler agentiske poengsummer

Anthropics Fable 5.1 kutter hurtigminnekostnader med 75% og mer enn dobler agentiske poengsummer
View on original source
Category: SciTech
Share
Archive
Like
Anthropic oppdaterte Claude 1. september med Fable 5.1, og kuttet kostnaden for cachelagrede input-tokens fra $1,00 til $0,25 per million – en reduksjon på 75 prosent som kommer akkurat i det øyeblikket de fleste produksjons-AI-utviklere har oppdaget at kontekstakkumulering, ikke rå datakraft, er der infrastrukturbudsjettene faktisk konsentreres. I en live agentisk økt kan en enkelt Claude-samtale inneholde hundretusenvis av tokens i cache ettersom konteksten bygges opp over flere runder. Til $0,25 per million blir denne akkumuleringen et bevisst designvalg snarere enn en kostnadstak som utvikleren må jobbe seg rundt. Referanseresultatene som følger med prisfallet, viser ytelsesforbedringer som forsterker det økonomiske argumentet. På Terminal-Bench-Science 0.1, som måler flertrinns vitenskapelig resonnering som krever eksperimentell design og iterativ analyse, oppnådde Fable 5.1 52,6 % mot Fable 5s 24,7 % – mer enn en dobling av det forrige resultatet. AutomationBench forbedret seg fra 17,1 % til 31,4 %, og Terminal-Bench 4.0, en bredere agentisk kapabilitetsevaluering, steg fra 42,0 % til 55,8 %. CursorBench 3.2.0 endte på 73,4 %. Mønsteret på tvers av alle fire evalueringene er konsistent: Fable 5.1 er ikke marginalt bedre, den er vesentlig mer pålitelig på de kategoriene av oppgaver som definerer agentisk verdi. Den kombinerte effekten skriver om kostnadsregnestykket for å bygge med Claude. En agentisk applikasjon som fullfører en oppgave i færre runder – fordi modellen er mer pålitelig – bruker færre totale token-sykluser på veien til et vellykket resultat. Bruk 75 % cache-kuttet på tokenene den faktisk bruker, og den effektive kostnadsreduksjonen per oppgave i høyt gjenbrukte agentiske arbeidsflyter når 45 % eller mer. Anthropic har ikke publisert et enkelt overskriftstall for de samlede besparelsene, men utviklere som modellerer sin egen token-økonomi, vil komme frem til tall i det området for konteksttunge arbeidsmengder. Fable 5.1 er umiddelbart tilgjengelig via Anthropics direkte API under modellidentifikatoren claude-fable-5-1, og via Amazon Web Services Bedrock, Google Cloud Platform og Microsoft Azure. Anthropic annonserte Enterprise Frontier Safeguards som en samtidig kapabilitet: kundestyrt datalagring, kundeadministrerte krypteringsnøkler, og distribusjon innenfor hver kundes eksisterende skyleverandørleie, inkludert uten ekstra kostnad utover de underliggende skykostnadene. I tillegg til den generelle lanseringen introduserte Anthropic Mythos 5.1, en variant av den samme underliggende modellen som opererer med det selskapet beskriver som mer permissive sikkerhetstiltak for godkjente organisasjoner. Tilgangen er begrenset til verifiserte cybersikkerhetsforskningsinstitusjoner og livsvitenskapsbedrifter. Selskapet viste til dokumenterte anvendelser inkludert proteindesign og biologisk modelloptimalisering med opptil 2,5 ganger inferensgjennomstrømmingen i standardutgaven. Mythos 5.1-tilgang er ikke selvbetjent: Anthropic vurderer søknader individuelt og har ikke offentliggjort størrelsen på den registrerte kohorten. Fable 5.1s agentiske tall, spesielt på Terminal-Bench-Science, plasserer Anthropics publiserte resultater foran OpenAIs sist offentliggjorte tall på sammenlignbare evalueringer. Tversover-selskap benchmark-sammenligninger medfører metodologisk forsiktighet – leverandører velger evalueringer som favoriserer deres modeller, og de spesifikke testene Anthropic fremhevet ble antagelig valgt for deres gunstige utfall. Det som er vanskeligere å bortforklare, er det interne doblingsmønsteret: Fable 5.1 er ikke den samme modellen med en prisreduksjon påheftet. Ytelsesendringen er stor nok til at prishistorien og ytelseshistorien ikke kan skilles ad. For utviklere som ikke allerede bruker Claude, er cache-prisjusteringen tallet som er verdt å oversette til sin egen token-økonomi. Enhver AI-leverandør som ikke nærmer seg $0,25 per million cachelagrede tokens, vil nå møte direkte kostnadssammenligningsspørsmål i bedriftssalgssamtaler. Anthropics cache-pris var allerede lavere enn flere konkurrenter før denne reduksjonen; gapet har blitt større. Ytelsesforbedringer er vanskeligere å generalisere på tvers av bruksområder, men i det agentiske og vitenskapelig-resonnerende segmentet setter Fable 5.1 et benchmark-nivå som den neste store lanseringen fra enhver leverandør vil bli målt mot. Tagger: kunstig intelligens, Anthropic, språkmodeller, Claude Fable 5.1, Mythos 5.1

(0)Comments

 

A note on cookies

Newshunt uses essential cookies to keep you signed in and to remember your language and country, so the site works the way you expect. With your permission, we'd also like to use analytics cookies to understand how people use Newshunt and improve it over time.

Accepting only affects analytics. To learn more, view our Privacy Policy or Terms & Conditions.