Het Europese alternatief voor Jev
Getypeerde beslissingen uit tekst. Gemaakt in de EU.
thinQit Dex leest je tekst of JSON één keer en beantwoordt getypeerde vragen: kies één optie, geef een score op een schaal, of controleer ja of nee. Elk antwoord heeft gekalibreerde kansen. Dezelfde invoer geeft hetzelfde antwoord. Alles draait in de EU, en standaard wordt niets opgeslagen.
Opgenomen runs
Dex tegen LLM's, op dezelfde workflow.
Elk paneel speelt een opgenomen run af van dezelfde workflow met meerdere vragen: Dex aan de ene kant, algemene LLM's aan de andere. Antwoorden verschijnen op het moment dat ze binnenkwamen. Tijd en kosten lopen mee zoals ze liepen.
Dex tegenover Claude Fable 5.1
39×sneller
547×goedkoper
Tegenover de snelste LLM die we maten (GPT-5.4 mini): 7.0× sneller. Tegenover de goedkoopste (GPT-4.1 mini): 11× goedkoper.
Tegenover Anthropic's Claude Fable 5.1 (claude-fable-5-1 (effort low; thinking cannot be disabled, thinking tokens billed as output)), dat dezelfde 7 vragen beantwoordt in één aanroep met gestructureerde uitvoer. Medianen van 10 runs, opgenomen 2026-09-25, AI agent guardrail check before a tool call, op de eigen EU-inferentienodes van Dex. Claude Fable 5.1 lijstprijs: USD 10 input and 50 output per million tokens, gelezen 2026-09-25 (bron). Dex: rondreis over het netwerk, tegen zijn lijstprijs, uitvoer gratis. USD omgerekend tegen de koers van Azure (0.858664 EUR per USD, gelezen 2026-09-25).
Dex, round trip: KOSTEN EUR 0.00003310, klaar in 0.102 s. Claude Fable 5.1: KOSTEN USD 0.02112, klaar in 4.17 s.
Raceresultaten als tabel
| Deelnemer | Model | Mediane tijd | Kosten van de afgespeelde run | Runs | Overeenstemming met referentie |
|---|---|---|---|---|---|
| Dex, GPU compute (alleen in tabel) | Dex prototype, EU, Dex's own inference node | 0.077 s | EUR 0.00003310 | 10 | 100.0% |
| Dex, round trip | Dex prototype, EU, Dex's own inference node | 0.108 s | EUR 0.00003310 | 10 | 100.0% |
| GPT-5.4 mini | gpt-5.4-mini 2026-03-17 (reasoning_effort none), Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | 0.762 s | USD 0.0009248 | 10 | 88.6% |
| GPT-5.3 chat | gpt-5.3-chat (gpt-chat-latest 2026-05-05), Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | 1.039 s | USD 0.002329 | 10 | 100.0% |
| GPT-4.1 | gpt-4.1 2025-04-14, Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | 1.139 s | USD 0.002224 | 10 | 100.0% |
| GPT-4.1 mini | gpt-4.1-mini 2025-04-14, Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | 1.320 s | USD 0.0004448 | 10 | 87.1% |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 (no thinking), Anthropic API, global routing (default inference_geo) | 1.439 s | USD 0.001638 | 10 | 100.0% |
| Claude Sonnet 5 | claude-sonnet-5 (thinking disabled), Anthropic API, global routing (default inference_geo) | 2.359 s | USD 0.004220 | 10 | 100.0% |
| Claude Opus 5.5 | claude-opus-5-5 (effort low; thinking cannot be disabled, thinking tokens billed as output), Anthropic API, global routing (default inference_geo) | 2.373 s | USD 0.008448 | 10 | 85.7% |
| Claude Fable 5.1 | claude-fable-5-1 (effort low; thinking cannot be disabled, thinking tokens billed as output), Anthropic API, global routing (default inference_geo) | 4.249 s | USD 0.02112 | 10 | 85.7% |
Overeenstemming is het aandeel antwoorden dat gelijk is aan de referentieantwoorden die bij de race zijn vastgelegd. Het Dex-paneel is de tragere van onze twee Dex-metingen: de rondreis over het netwerk, net als de LLM-aanroepen. Alleen de GPU-rekentijd staat in de tabel.
Hoe we maten
- 01Eén workflow per race: dezelfde state en dezelfde vragen voor elke deelnemer.
- 02Elke deelnemer beantwoordde de workflow 10 keer na één opwarmaanroep. We tonen de mediane tijd en spelen de mediane run af.
- 03LLM's beantwoordden alle vragen in één gestreamde aanroep met gestructureerde uitvoer; de tijd per antwoord is het moment dat het compleet was in de stream.
- 04Dex las alle vragen in één pass, zonder tekst te genereren. Twee Dex-tijden: GPU-rekentijd op de inferentienode van Dex, en de rondreis over het netwerk. De kop gebruikt de rondreis.
- 05De tijd loopt van het versturen tot het laatste antwoord. Kosten zijn tokens maal lijstprijs, met bron en leesdatum per prijs. Dex tegen zijn lijstprijs, uitvoer gratis.
- 06Overeenstemming vergelijkt de antwoorden van elke deelnemer met referentieantwoorden die bij de race zijn vastgelegd.
- 07Geen enkel getal is met de hand ingevoerd. De pagina wordt gebouwd uit de opgenomen resultaatbestanden.
Waar Dex draaide
- Dex
- de eigen EU-inferentienodes van Dex, op toegewijde EU-hardware die thinQit beheert
- recorded
- 2026-09-25T16:40:19+00:00
Deelnemers en lijstprijzen
| Deelnemer | Model en regio | Invoer / uitvoer per Mtok | Prijsbron |
|---|---|---|---|
| Dex, GPU compute | Dex prototype, EU, Dex's own inference node | EUR 0.05 / 0 | Prijzen |
| Dex, round trip | Dex prototype, EU, Dex's own inference node | EUR 0.05 / 0 | Prijzen |
| GPT-5.4 mini | gpt-5.4-mini 2026-03-17 (reasoning_effort none), Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | USD 0.75 / 4.5 | lijstprijs, 2026-09-25 |
| GPT-5.3 chat | gpt-5.3-chat (gpt-chat-latest 2026-05-05), Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | USD 1.75 / 14 | lijstprijs, 2026-09-25 |
| GPT-4.1 | gpt-4.1 2025-04-14, Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | USD 2 / 8 | lijstprijs, 2026-09-25 |
| GPT-4.1 mini | gpt-4.1-mini 2025-04-14, Azure OpenAI, Sweden Central resource, GlobalStandard deployment (global processing) | USD 0.4 / 1.6 | lijstprijs, 2026-09-25 |
| Claude Haiku 4.5 | claude-haiku-4-5-20251001 (no thinking), Anthropic API, global routing (default inference_geo) | USD 1 / 5 | lijstprijs, 2026-09-25 |
| Claude Sonnet 5 | claude-sonnet-5 (thinking disabled), Anthropic API, global routing (default inference_geo) | USD 2 / 10 | lijstprijs, 2026-09-25 |
| Claude Opus 5.5 | claude-opus-5-5 (effort low; thinking cannot be disabled, thinking tokens billed as output), Anthropic API, global routing (default inference_geo) | USD 4 / 20 | lijstprijs, 2026-09-25 |
| Claude Fable 5.1 | claude-fable-5-1 (effort low; thinking cannot be disabled, thinking tokens billed as output), Anthropic API, global routing (default inference_geo) | USD 10 / 50 | lijstprijs, 2026-09-25 |
Jev doet niet mee aan de race. Niemand die aan Dex werkt gebruikt het. De grafiek over kosten en snelheid op de prijspagina toont Jev alleen via de eigen gepubliceerde cijfers van TypeSafe, met bron.
Hoe het werkt
Chatmodellen schrijven. Dex beslist.
Een chatmodel schrijft een antwoord woord voor woord, en je code moet het proza ontleden. Dex leest de tekst één keer, vergelijkt alleen de antwoorden die jij toestaat, en geeft getallen terug waar je code op kan handelen.
Het ticketIllustratieve waarden
- pick
Welke afdeling moet {{ticket.bericht}} oppakken? - rate
Hoe snel moeten we reageren op {{ticket.bericht}}? - check
Is de schrijver van {{ticket.bericht}} boos?
Chatmodelschrijft
Vrije tekst, één token tegelijk. Je code moet de afdeling, de urgentie en de stemming er nog uit halen.
Dexbeslist
Leest één keer. Alleen jouw labels kunnen terugkomen. Elk antwoord heeft kansen en een zekerheid.
- 01Verwerkt in de EU. Azure West Europe en de eigen inferentienodes van Dex op toegewijde EU-hardware die thinQit beheert. Standaard wordt niets opgeslagen. Gegevensverwerking (Engels)
- 02Zelfde invoer, zelfde antwoord. Dezelfde verzoekbytes naar dezelfde GPU-versie geven dezelfde antwoorden, byte voor byte. Je kunt er tests tegen schrijven. Determinisme (Engels)
- 03Kansen waar je op kunt handelen. Gekalibreerd: 0,8 hoort ongeveer 8 van de 10 keer te kloppen. Onder je drempel onthoudt een antwoord zich. Kalibratie (Engels)
- 04Je ziet wie antwoordde. Elk antwoord noemt de exacte modelversie, het pad dat het leverde (gpu of fallback) en de kalibratie. served_by (Engels)
Beginnen
Eén aanroep, drie antwoorden.
Meld je aan, maak een gratis testsleutel en doe vandaag je eerste aanroep. Betaald opwaarderen volgt binnenkort.
curl https://api.thinqit.ai/v1/decide \
-H "authorization: Bearer $DEX_API_KEY" \
-H "content-type: application/json" \
-d '{
"state": { "ticket": { "body": "Charged twice for order 4471. Fix it today." } },
"questions": {
"team": { "type": "pick", "instructions": "Which team should handle {{ticket.body}}?",
"options": { "billing": null, "technical": null, "other": null }, "min_confidence": 0.5 },
"urgency": { "type": "rate", "instructions": "How fast must we reply?", "levels": ["Can wait", "This week", "Today"] },
"angry": { "type": "check", "instructions": "Is the writer angry?" }
}
}'from thinqit_dex import Client, pick, rate, check
client = Client() # reads DEX_API_KEY
decision = client.decide(
state={"ticket": {"body": "Charged twice for order 4471. Fix it today."}},
questions={
"team": pick("Which team should handle {{ticket.body}}?",
{"billing": None, "technical": None, "other": None}, min_confidence=0.5),
"urgency": rate("How fast must we reply?", ["Can wait", "This week", "Today"]),
"angry": check("Is the writer angry?"),
},
)
team = decision.pick("team")
route = "human" if team.abstained else team.choiceimport { Client, pick, rate, check } from "@thinqit/dex";
const client = new Client(); // reads DEX_API_KEY
const decision = await client.decide({
state: { ticket: { body: "Charged twice for order 4471. Fix it today." } },
questions: {
team: pick("Which team should handle {{ticket.body}}?", { billing: null, technical: null, other: null }, { min_confidence: 0.5 }),
urgency: rate("How fast must we reply?", ["Can wait", "This week", "Today"]),
angry: check("Is the writer angry?"),
},
});
const team = decision.answers.team;
const route = team.abstained ? "human" : team.choice;EUR 0.05 per miljoen invoertokens, bij elk volume. Uitvoer is gratis. Prijzen (Engels)
Toepassingen
Wanneer je Dex gebruikt in plaats van een LLM.
Je code leest het antwoord en kiest op basis daarvan een pad.
Gebruik Dex.
Een mens leest de gegenereerde tekst.
Gebruik een LLM.