Open-weight modellen verwerken voor het eerst meerderheid AI-tokens

Open-weight AI-modellen zijn voor het eerst goed voor de meerderheid van het AI-gebruik via de AI Gateway van Vercel. In augustus verwerkten open-weight modellen 56 procent van alle tokens, terwijl de gemiddelde prijs per token met 23,2 procent daalde. Uit de nieuwste AI Gateway Production Index blijkt dat de prijs-prestatieverhouding steeds belangrijker wordt als het aankomt op het kiezen van een AI-model.
Een token is een klein brokje tekst — een teken, een deel van een woord, een heel woord of een leesteken — dat een taalmodel (zoals GPT) gebruikt als fundamentele eenheid om taal te lezen, te begrijpen en te genereren.
Open-weight modellen verwerkten in augustus 56 procent van alle tokens via AI Gateway, tegenover 13 procent in april. Daarmee verwerkten open-weight modellen voor het eerst meer tokens dan alle closed-weight modellen samen. Ondanks deze sterke toename, waren open-weight modellen in augustus goed voor slechts 14 procent van de totale uitgaven via de AI Gateway.
De groei van relatief goedkope open-weight modellen valt samen met een verdere daling van de gemiddelde kosten. De prijs per token daalde in augustus met 23,2 procent; de derde maandelijkse daling op rij en de sterkste sinds april. Ook bij grotere gebruikers waren de lagere kosten zichtbaar. Van de teams die zowel in juli als augustus meer dan 10 miljoen tokens gebruikten, daalden de kosten per token met mediaan 7,6 procent. Dit is een verdubbeling in vergelijking met de daling van 2,9 procent in juli.
Ook binnen het aanbod van Anthropic verschuift het gebruik naar goedkopere modellen. Het aandeel van Claude Fable 5 in de totale AI Gateway-uitgaven daalde van 13,2 procent in juli naar 4,9 procent in augustus. Tegelijkertijd groeide het aantal van Opus 5 naar 22,5 procent.
Opus 5 kost per token ongeveer de helft van Fable 5. Negen op de tien teams die Fable 5 gebruikten, schroefden hun gebruik terug. Daarbij stapten meer teams over op Opus 5 dan op andere modellen. Een groot deel van het gebruik bleef zo bij Anthropic, dat in augustus 64 procent van alle uitgaven via de AI Gateway voor zijn rekening nam. Sinds december gaat elke maand minstens 61 procent van de uitgaven via AI Gateway naar Anthropic.
De verschuiving laat zien dat gebruikers vaker voor een goedkoper model kiezen als dat aan hun eisen voldoet. Voor AI-aanbieders betekent dit dat ze gebruikers kunnen behouden als ze binnen hun aanbod een passend alternatief bieden.
Bij OpenAI is een vergelijkbare verdeling tussen premium en goedkopere modellen te zien. GPT-6 Astra werd op 3 september toegevoegd aan AI Gateway en kost twee keer zoveel per token als GPT-5.6 Sol. Toch was het model twee dagen later al goed voor een derde van alle uitgaven aan OpenAI-modellen. Sindsdien schommelt het aandeel tussen de 28 en 39 procent.
Ook in vergelijking met andere premium modellen presteert Astra goed. Anthropic lanceerde Fable 5.1 twee dagen eerder tegen dezelfde prijs. In de eerste twaalf dagen was Astra goed voor 7,7 procent van alle Gateway-uitgaven, meer dan twee keer zoveel als de 3,7 procent van Fable 5.1. Astra werd in die periode ook door twee keer zoveel teams gebruikt.
Het verschil tussen premium en goedkopere modellen is ook zichtbaar in het gebruik. Van 4 tot en met 16 september waren GPT-6 Astra en GPT-5.6 Sol samen goed voor 27 procent van alle OpenAI-tokens via de AI Gateway, maar voor 71 procent van de uitgaven. Luna en Nano verwerkten ruim twee keer zoveel tokens, terwijl de uitgaven aan deze modellen negen keer lager lagen.
Ook gespecialiseerde AI-modellen vinden snel hun weg naar gebruikers. Binnen 24 uur na de introductie van Jev van TypeSafe AI gebruikte bijna 13 procent van de betalende teams het model. Daarmee bereikte Jev meer dan twee keer zoveel teams als eerdere modellen in hun eerste 24 uur en werd het het snelst geadopteerde model in de geschiedenis van de AI Gateway. Binnen 18 uur gebruikte al 10 procent van de betalende teams Jev, terwijl andere recente modellen na 24 uur onder de 7 procent bleven.
Jev is een gespecialiseerd model voor gestructureerde besluitvorming binnen software. In tegenstelling tot algemene taalmodellen genereert het geen vrije tekst, maar geeft het gestructureerde antwoorden die direct door software kunnen worden gebruikt. De snelle adoptie laat zien hoe snel gespecialiseerde modellen een plek kunnen vinden in productieomgevingen.
De data uit de AI Gateway Production Index laat zien dat prijs een steeds grotere rol speelt bij de keuze voor een AI-model. Open-weight en goedkopere modellen nemen een groeiend deel van het tokenvolume voor hun rekening, terwijl premium modellen een aanzienlijk aandeel van de uitgaven behouden. Dit wijst erop dat teams per toepassing afwegen welk model het beste aansluit bij hun behoeften en budget.

Plaats een reactie
Uw e-mailadres wordt niet op de site getoond