Die pagina is alleen in het Engels. Dit is de Nederlandse startpagina.

Vergelijken

Dex vs LLM's

Een algemene LLM kan dezelfde beslissingen nemen als Dex. Zo verhouden de twee zich, regel voor regel. Cijfers komen uit onze eigen opgenomen races, al het andere over de LLM's van de eigen pagina's van de aanbieders, elk met de datum waarop we het lazen.

Vergelijking

Dex vergeleken met algemene LLM's, regel voor regel, met bronnen
OnderwerpDexLLM'sBron
Tijd tot alle antwoordenDex anders108 tot 153 ms per workflow, alle vragen in een request. Minstens 6,0 keer zo snel als de snelste LLM, in elke workflow.754 ms tot 11,6 s per workflow voor de 8 geracete LLM's, elk in een gestreamde call met alle vragen.Dex draaide op zijn eigen inferentienode in Nederland, gemeten als heen-en-terugreis over het netwerk zoals de LLM-calls, een request tegelijk. De snelheid van een LLM hangt af van de drukte bij de aanbieder op dat moment.thinQit Dex, opgenomen races tegen LLM'sgelezen 25 sep 2026Mediaan van 10 runs per model en workflow, 4 workflows
Kosten per callDex andersEUR 0,000060 tot 0,00011 per workflow-call tegen het Fierce-tarief, EUR 0,09 per miljoen invoertokens (EUR 39,00 per maand). Minstens 5,4 keer zo goedkoop als de goedkoopste LLM, in elke workflow. Uitvoer is gratis.Meer over Dex (Engels)EUR 0,00038 tot 0,051 per workflow-call: de opgenomen invoer- en uitvoertokens maal de lijstprijs van elk model. Uitvoertokens worden gerekend, denktokens inbegrepen.Met pay as you go kost Dex EUR 1,00 per miljoen invoertokens. Prijzen zijn exclusief btw.thinQit Dex, opgenomen races tegen LLM'sgelezen 25 sep 2026Azure Retail Prices API, Foundry Models, Sweden Centralgelezen 25 sep 2026Claude API docs, Pricinggelezen 25 sep 2026Mediane kosten per model en workflow; lijstprijzen in USD omgerekend tegen 0,858664 EUR per USD
Zelfde invoer, zelfde antwoordenDex andersDezelfde antwoorden in elke run: 4 van de 4 workflows, elk 10 identieke calls. Op een GPU-modelversie geven identieke requestbytes byte-identieke antwoorden, zo is het ontworpen.Meer over Dex (Engels)4 van de 8 LLM's gaven bij identieke calls minstens een keer een ander antwoord (GPT-5.3 chat, GPT-5.4 mini, GPT-4.1 mini en Claude Sonnet 5), met temperatuur 0 waar het model dat toestaat.Antwoorden van de Dex-fallback zijn niet bit voor bit herhaalbaar en zeggen dat ook (served_by is fallback).thinQit Dex, opgenomen races tegen LLM'sgelezen 25 sep 202610 identieke calls per model en workflow, antwoorden per vraag vergeleken
Getypeerde antwoordenDex andersGetypeerd van opzet. Kies een van maximaal 255 opties, plaats op 2 tot 10 geordende niveaus, of controleer ja of nee. Elk antwoord heeft gekalibreerde kansen en een zekerheid, en met min_confidence onthoudt een onzeker antwoord zich.Meer over Dex (Engels)Gegenereerde tekst. In de races schreef elke LLM zijn antwoorden als JSON volgens een strikt schema (de structured output van de aanbieder), die je code moet parsen. De JSON bevat een label per vraag en geen kans per optie.thinQit Dex, opgenomen races tegen LLM'sgelezen 25 sep 2026Racemethode, call-instellingen per model
Waar requests worden verwerktDex andersAlleen in de EU. De gateway in Azure West Europe in Nederland, de eigen inferentienodes van Dex op toegewijde hardware die thinQit in Nederland beheert, en Azure OpenAI in de EU-datazone voor de fallback.Meer over Dex (Engels)Hangt af van het aanbod. Azure OpenAI Global-deployments, gebruikt in de races, kunnen prompts verwerken in elke regio waar het model draait; DataZone-deployments in een EU-resource blijven in de EU. De Claude API draait inferentie standaard in elke beschikbare regio, of alleen in de VS; een optie voor alleen de EU staat er niet bij.Microsoft Learn, Data, privacy, and security for Foundry Models sold by Azuregelezen 27 sep 2026Claude API docs, Data residencygelezen 27 sep 2026Location of processing for Global and Data zone deployments; tabel Inference geo en Current limitations
Standaard bewaarde requestinhoudDex andersGeen, voor elk account. Inhoud wordt alleen bewaard als de accounteigenaar content logging aanzet.Meer over Dex (Engels)Azure OpenAI kan prompts en antwoorden die het misbruiktoezicht markeert bewaren voor menselijke controle in de regio van de resource, tenzij Microsoft aangepast misbruiktoezicht goedkeurt. De Claude API verwijdert invoer en uitvoer standaard binnen 30 dagen; zero data retention vraagt een overeenkomst.Een uitzondering aan de kant van Dex. Op het fallbackpad kan Azure OpenAI, tot Microsoft aangepast misbruiktoezicht goedkeurt, prompts die zijn classifiers markeren bewaren binnen de EU-datazone. Stuur fallback op never om op de eigen nodes van Dex te blijven.Microsoft Learn, Data, privacy, and security for Foundry Models sold by Azuregelezen 27 sep 2026Anthropic Privacy Center, How long do you store my organization's data?gelezen 27 sep 2026Sectie Preventing abuse; alinea over standaardbewaring en de uitzonderingen
Trainen op klantgegevensGelijkNooit. Klantinhoud wordt niet gebruikt om een model te trainen, af te stemmen of te kalibreren.Meer over Dex (Engels)Azure OpenAI gebruikt prompts en antwoorden niet om de basismodellen te trainen, opnieuw te trainen of te verbeteren. Anthropic gebruikt gegevens die het van de Claude API bewaart niet voor training zonder uitdrukkelijke toestemming.Microsoft Learn, Data, privacy, and security for Foundry Models sold by Azuregelezen 27 sep 2026Claude API docs, API and data retentiongelezen 27 sep 2026Samenvatting en sectie over inferentie; How Anthropic approaches data retention
Overeenkomst met de racereferentieLLM's voor92,3% van de antwoorden gelijk aan de referentie, gemiddeld over de 4 workflows.Meer over Dex (Engels)87,6% tot 99,8% gemiddeld per LLM; de hoogste, Claude Sonnet 5, 99,8%.Geen kwaliteitsbenchmark. De referentie is het meerderheidsantwoord van drie van de geracete LLM's, wat hen bevoordeelt, en elke workflow heeft een state. De kwaliteit van Dex meten we op onze eigen Engelse en Nederlandse testsets.thinQit Dex, opgenomen races tegen LLM'sgelezen 25 sep 2026agreement_with_reference per model en workflow
Grootste requestLLM's voor16.384 factureerbare tokens per request, waarvan de vragen samen maximaal 4.096 mogen gebruiken.Meer over Dex (Engels)De geracete Claude-modellen nemen 200.000 tot 1.000.000 tokens context.Elke telling gebruikt zijn eigen tokenizer, dus gelijke aantallen zijn geen gelijke hoeveelheden tekst.Claude API docs, Models overviewgelezen 27 sep 2026Tabel Compare models, rij Context window
Wat het kanLLM's voorAlleen beslissingen. Kiezen, beoordelen en controleren over een state in tekst of JSON. Het schrijft, vat samen, vertaalt of extraheert geen tekst, en leest geen afbeeldingen.Meer over Dex (Engels)Algemeen. De geracete Claude-modellen nemen tekst en afbeeldingen als invoer, schrijven tekst en werken in veel talen.Claude API docs, Models overviewgelezen 27 sep 2026Compare models, de alinea boven de tabel

Waar LLM's voorlopen

  • 01Overeenkomst met de racereferentie. 87,6% tot 99,8% gemiddeld per LLM; de hoogste, Claude Sonnet 5, 99,8%.
  • 02Grootste request. De geracete Claude-modellen nemen 200.000 tot 1.000.000 tokens context.
  • 03Wat het kan. Algemeen. De geracete Claude-modellen nemen tekst en afbeeldingen als invoer, schrijven tekst en werken in veel talen.

Hoe we deze vergelijking maakten

De cijfers van de LLM's zijn onze eigen metingen: dezelfde workflows en dezelfde vragen voor elk model, elk 10 opgenomen runs, op 25 sep 2026. Elke run staat op de startpagina, waar je hem kunt afspelen.

De kosten van Dex zijn tegen het tarief van het Fierce-abonnement, EUR 0,09 per miljoen invoertokens; pay as you go is EUR 1,00 per miljoen invoertokens. De kosten van een LLM zijn de tokens van elke call maal de lijstprijs van de aanbieder op de dag dat we die lazen.

Al het andere over de LLM's komt van de eigen openbare pagina's van de aanbieders, met de pagina en de datum waarop we die lazen. Waar LLM's voorlopen, staat dat in de regel.

Speel de races afKosten en snelheid per model (Engels)

Bronnen