Modellen
Elk model, één efficiënte API
Open-weight modellen voor taal, redeneren, programmeren, beeld, embeddings en spraak, allemaal door ons gehost op 100% groene stroom en afgestemd op efficiëntie. Eén catalogus, één sleutel, het laagste energieverbruik dat de klus nog klaart.
De catalogus
Elk model, per categorie
Open-weight modellen draaien op 100% groene stroom met toonaangevende efficiëntie, bereikbaar via één OpenAI-compatibele API en één sleutel.
Foundation-modellen
Open-weight foundation-modellen die we zelf hosten, afgestemd op het laagste energieverbruik per taak.
- z.ai
glm-5.3
Ons vlaggenschip voor agentisch codeerwerk en toolgebruik: de GLM-5.2-basis met opgeschaalde post-training, 1M tokens context en 50% hogere Z.ai Code Bench-scores met minder uitvoertokens.
- Functies
- Tool Choice
- Redeneren
- Agentisch coderen
- Invoer
- €1,10
- Cache
- €0,275
- Uitvoer
- €4,40
per 1M tokens
- Moonshot AI
kimi-k3
Open-weight multimodaal agentisch model met 2,8T parameters en hybride redeneren, voor langlopend codeerwerk, kenniswerk en redeneren.
- Chat
- Hybride redeneren
- Agentisch coderen
- Beeld
- Invoer
- €3,30
- Cache
- €0,825
- Uitvoer
- €16,50
per 1M tokens
- z.ai
glm-5.3-flash
Lichte variant van GLM-5.3: een mixture-of-experts-model van 320B met 18B actief, native beeld- en video-invoer en dezelfde 1M tokens context voor een tiende van de prijs.
- Functies
- Tool Choice
- Redeneren
- Beeld
- Invoer
- €0,11
- Cache
- €0,022
- Uitvoer
- €0,44
per 1M tokens
- z.ai
glm-5.2
Zeer intelligent redeneermodel met agentisch toolgebruik en een contextvenster van 1M tokens.
- Functies
- Tool Choice
- Redeneren
- Invoer
- €1,10
- Cache
- €0,275
- Uitvoer
- €4,40
per 1M tokens
- DeepSeek
deepseek-v4-flash-0731
Snel en goedkoop DeepSeek-redeneermodel met toolgebruik en een context van 1M tokens.
- Functies
- Tool Choice
- Redeneren
- Invoer
- €0,14
- Cache
- €0,04
- Uitvoer
- €0,35
per 1M tokens
- Moonshot AI
kimi-k2.6
Agentisch multimodaal model met beeldbegrip en een context van 256K tokens.
- Functies
- Tool Choice
- Redeneren
- Beeld
- Invoer
- €0,66
- Cache
- €0,22
- Uitvoer
- €3,751
per 1M tokens
- Qwen
qwen3.5-397b-a17b
Groot mixture-of-experts-model voor codegeneratie en agentische taken.
- Code
- Agentisch
- Functies
- Invoer
- €0,70
- Uitvoer
- €4,35
per 1M tokens
- Qwen
qwen3-235b-a22b-instruct-2507
Meertalig redeneren met een ruim contextvenster van 250K tokens.
- Meertalig
- Redeneren
- Lange context
- Invoer
- €0,90
- Uitvoer
- €2,70
per 1M tokens
- Qwen
qwen3.6-35b-a3b
Compact frontier-model van Qwen voor agentisch werk en redeneren in veel talen.
- Agentisch
- Redeneren
- Beeld
- Code
- Invoer
- €0,30
- Uitvoer
- €1,80
per 1M tokens
- OpenAI
gpt-oss-120b
Open-weight 120B-model met beeldbegrip en redeneren over lange context.
- Beeld
- Redeneren
- Functies
- Invoer
- €0,20
- Uitvoer
- €0,70
per 1M tokens
- Mistral
mistral-small-3.2-24b-instruct-2506
Efficiënt instruct-model met function calling en beeldbegrip.
- Functies
- Beeld
- Invoer
- €0,20
- Uitvoer
- €0,40
per 1M tokens
- Meta
llama-3.3-70b-instruct
Meertalig instructiemodel van 70B voor breed algemeen gebruik.
- Meertalig
- Invoer
- €1,10
- Uitvoer
- €1,10
per 1M tokens
- Mistral
mistral-medium-3.5-128b
Redeneren, coderen en beeldbegrip op frontier-niveau met een lang contextvenster.
- Redeneren
- Code
- Beeld
- Invoer
- €1,80
- Uitvoer
- €9,00
per 1M tokens
Chat & taal
Open-weight modellen onder de vlag van GreenPT voor dagelijkse chat, redeneren en schrijven, afgestemd op Europese talen.
- Google Gemma 4
gemma4
Multimodaal redeneren met een lang contextvenster voor documenten en uitgebreide prompts.
- Beeld
- Redeneren
- Lange context
- Invoer
- €0,50
- Uitvoer
- €1,50
per 1M tokens
- GPT-OSS
green-r
Geavanceerd redeneren, schrijven en multimodaal begrip, met de waarborgen van GreenPT.
- Redeneren
- Beeld
- Invoer
- €0,35
- Uitvoer
- €0,95
per 1M tokens
- Mistral Small 3.2 24B
green-l
Snel meertalig model met Nederlandse grammaticawaarborgen voor Europese workloads.
- Meertalig
- Functies
- Invoer
- €0,25
- Uitvoer
- €0,80
per 1M tokens
Programmeren
Twee modellen die specifiek op softwarewerk zijn afgestemd. Voor een codeeragent raden we meestal glm-5.3, kimi-k3 of glm-5.3-flash aan uit de foundation-modellen hierboven; van glm-5.2 bestaan bovendien compressievarianten tegen dezelfde prijs per token. Bekijk de codeermodellen
- Moonshot AI
kimi-k2.7-code
Op code en software-engineering gerichte Kimi-variant met beeldbegrip en een context van 256K tokens.
- Functies
- Tool Choice
- Redeneren
- Beeld
- Invoer
- €0,77
- Cache
- €0,165
- Uitvoer
- €3,85
per 1M tokens
- MiniMax
minimax-m2.5
Redeneermodel afgestemd op agentisch coderen en langlopende workflows, met een maximale uitvoer van 128K.
- Agentisch
- Redeneren
- Langlopend
- Invoer
- €0,33
- Uitvoer
- €1,32
per 1M tokens
Audio & spraak
Transcriptie en spraakbegrip, meertalig en nauwkeurig.
- Deepgram Nova-2
green-s
Brede taaldekking voor dagelijkse workloads: twaalf talen, realtime en batch, slimme opmaak en sprekerherkenning.
- Audio
- Meertalig
- Batch
- €0,12
- Live
- €0,16
per uur, 50% zomerkorting t/m 30 sep 2026
- Deepgram Nova-3
green-s-pro
De hoogste nauwkeurigheid, gemaakt voor medische, juridische en contactcenter-opnames, met een echt meertalig model dat taalwissels midden in een zin volgt.
- Audio
- Meertalig
- Batch
- vanaf €0,12
- Live
- vanaf €0,16
per uur, 50% zomerkorting t/m 30 sep 2026
Embeddings & retrieval
Vectoren en reranking voor semantisch zoeken en RAG-pipelines.
- Qwen3-Embedding
green-embedding
Meertalige embeddings tot 2560 dimensies voor semantisch zoeken en RAG.
- Embeddings
- Meertalig
- Prijs
- €0,20
per 1M tokens
- Qwen
qwen3-embedding-8b
Groter meertalig embeddingmodel met dimensies instelbaar tot 4096.
- Embeddings
- Meertalig
- Prijs
- €0,25
per 1M tokens
- Qwen3-Reranker-4B
green-rerank
Herordent opgehaalde documenten op echte relevantie, de laatste stap van het zoeken.
- Reranking
- Prijs
- €0,12
per 1M tokens
Modellen, kort samengevat
Hoe kies ik een model?
Kies op basis van capaciteit en budget. Elk model is open-weight en wordt door ons gehost, dus je kiest het kleinste model dat je taak aankan en krijgt sterke resultaten tegen het laagste energieverbruik en de laagste kosten.
Waarom zijn deze modellen efficiënter?
Ze zijn open-weight en draaien op 100% groene stroom in datacenters met een PUE van 1,25 en een WUE van 0,25, ruim onder de branchegemiddelden van 1,55 en 1,8. Lichtere, gekwantiseerde modellen en automatische routing zorgen dat elke aanvraag de minste rekenkracht gebruikt die de taak nog klaart.
Hoe wordt de prijs berekend?
De meeste modellen worden geprijsd per miljoen invoer- en uitvoertokens; spraakmodellen per uur audio. Elk tarief, inclusief cache-invoer, staat op de modelkaarten.
Bekijk de prijs per model →Mis je een model dat je nodig hebt?
We breiden de catalogus doorlopend uit met open-weight modellen. Staat het model dat je zoekt er niet bij, laat ons weten welk model het is en waarvoor je het wilt gebruiken, dan kijken we of we het kunnen toevoegen.
Vraag een model aan →Hoe roep ik een model aan?
Via de OpenAI-compatibele API: stel de base-URL en sleutel in en geef het model-id mee. Eén sleutel dekt elk model, plus embeddings, reranking, OCR, spraak, scraping en zoeken.
Lees de API-documentatie →Ervaar het verschil
Eén sleutel voor elk model.
Start een gratis proefperiode van 14 dagen, zonder creditcard. Roep elk model aan via één OpenAI-compatibele API, door ons gehost op 100% groene stroom en afgestemd op het laagste energieverbruik vanaf de eerste aanvraag.
Geen creditcard vereist.
- 100% groene stroom
- PUE 1,25
- Open-weight