welkmodeldoor westveen

Methode en bronnen

Deze pagina legt vast waar elk getal vandaan komt, zodat je zelf kunt beoordelen hoeveel waarde je aan de vergelijking hecht.

Waar de data vandaan komt

Prijzen, contextvensters, modaliteiten, ondersteuning voor tools en releasedata komen uit de publieke modelcatalogus van OpenRouter. Die catalogus telt op dit moment 445 modellen. De kwaliteitsscores (Intelligence Index, Coding Index, Agentic Index) komen van Artificial Analysis; de elo per bouwtaak komt van Design Arena. Beide worden door OpenRouter in dezelfde reactie meegeleverd.

De laatste verversing was 15 september 2026 om 03:20. Een geplande taak draait elke nacht, vergelijkt de uitkomst met wat er staat en legt een wijziging vast in de repository. Daardoor is de datum bovenaan de site ook echt de datum van de cijfers.

Hoe de selectie tot stand komt

Van 445 modellen blijven er 47 over. Het filter werkt in vier stappen: alleen aanbieders die we kunnen thuisbrengen (19 stuks, met land van vestiging), dan de best scorende modellen, dan de beste prijs-kwaliteitverhoudingen, dan de goedkoopste modellen die nog bruikbaar zijn en de nieuwste aanwinsten. Per aanbieder komen er maximaal zes in de lijst, zodat één partij met veertig varianten het overzicht niet overneemt.

Varianten voor batchverwerking, gratis proefvarianten en aliassen die naar een ander model wijzen, blijven buiten de lijst. Ze verdubbelen de rijen zonder een andere keuze te vertegenwoordigen.

Wat de scores wel en niet zeggen

De Intelligence Index is een gemiddelde over een reeks benchmarks. Hij is bruikbaar om te zien in welke categorie een model speelt en waardeloos om te voorspellen hoe het presteert op jouw contracten, jouw jargon of jouw klantvragen. Een model dat twee punten lager scoort kan op jouw taak beter zijn. Test met je eigen data voordat je een systeem eromheen bouwt.

Modellen zonder gepubliceerde score staan in de lijst met een streepje. Dat is een gebrek aan meting, geen oordeel over het model.

Twee soorten kwaliteit

Naast de Intelligence Index staat de elo uit Design Arena op de site, waar mensen twee resultaten naast elkaar zien en de winnaar aanwijzen, per bouwtaak. Die twee metingen zijn het geregeld oneens, en dat is precies waarom ze er allebei staan. Claude Opus 5 staat op de Intelligence Index boven Claude Fable 5 (63,1 tegen 62,1), terwijl Fable op het tekstleaderboard van Arena op de eerste plaats staat en op SWE-bench Pro hoger scoort (80,0 tegen 79,2 procent). Wie lange, zelfstandig lopende taken draait, herkent dat verschil eerder dan wie korte opdrachten geeft.

Kies daarom hierboven in de lijst de arenacategorie die op jouw werk lijkt, en gebruik het gemiddelde alleen om de grove categorie te bepalen.

Prijzen

Alle bedragen zijn in Amerikaanse dollars per miljoen tokens, zoals de aanbieders ze publiceren. Kortingen voor caching, batchverwerking, volumeafspraken of een jaarcontract zitten er niet in. Wie via Azure, Vertex AI of Bedrock afneemt, betaalt andere tarieven en kan het model in een Europese regio draaien; dat verandert niets aan de modelkeuze, wel aan de rekening en aan het antwoord op vragen over dataverwerking.

Land van vestiging

Bij elke aanbieder staat het land waar het bedrijf gevestigd is. Dat zegt iets over jurisdictie en over de vraag wie er bij je data kan, en niets over waar het model technisch draait. Een Amerikaans model kan in een Europees datacenter staan; een Chinees model met open gewichten kan op je eigen servers draaien.

Wie dit maakt

WelkModel is een project van Westveen, het bureau van Lucas Albada Jelgersma. Westveen begeleidt bedrijven bij de invoering van AI in hun processen. De site verkoopt niets, bevat geen affiliatelinks en verdient niets aan een klik naar een aanbieder.

Klopt er iets niet, of mist er een model dat je nodig hebt? Mail info@westveen.com.