Modelle
Jedes Modell, eine effiziente API
Open-Weight-Modelle für Sprache, Reasoning, Programmieren, Bilder, Embeddings und Spracherkennung, alle von uns mit 100% Ökostrom gehostet und auf Effizienz getrimmt. Ein Katalog, ein Schlüssel, der niedrigste Energieverbrauch, der die Aufgabe noch erledigt.
Der Katalog
Jedes Modell, nach Kategorie
Open-Weight-Modelle laufen mit 100% Ökostrom und führender Effizienz, erreichbar über eine OpenAI-kompatible API und einen einzigen Schlüssel.
Foundation-Modelle
Open-Weight-Foundation-Modelle, die wir selbst hosten, abgestimmt auf den geringsten Energieverbrauch je Aufgabe.
- z.ai
glm-5.3
Unser Flaggschiff für agentisches Coding und Tool-Nutzung: die GLM-5.2-Basis mit skaliertem Post-Training, 1M Tokens Kontext und 50 % höheren Z.ai-Code-Bench-Werten bei weniger Output-Tokens.
- Funktionen
- Tool Choice
- Reasoning
- Agentisches Coding
- Eingabe
- €1,10
- Cache
- €0,275
- Ausgabe
- €4,40
pro 1M Tokens
- Moonshot AI
kimi-k3
Open-Weight-Modell mit 2,8T Parametern, nativ multimodal und agentisch, mit hybridem Reasoning für langfristiges Coding, Wissensarbeit und Reasoning.
- Chat
- Hybrides Reasoning
- Agentisches Coding
- Bilder
- Eingabe
- €3,30
- Cache
- €0,825
- Ausgabe
- €16,50
pro 1M Tokens
- z.ai
glm-5.3-flash
Leichte Variante von GLM-5.3: ein Mixture-of-Experts-Modell mit 320B Parametern und 18B aktiv, nativer Bild- und Videoeingabe und demselben 1M-Token-Kontext zu einem Zehntel des Preises.
- Funktionen
- Tool Choice
- Reasoning
- Bilder
- Eingabe
- €0,11
- Cache
- €0,022
- Ausgabe
- €0,44
pro 1M Tokens
- z.ai
glm-5.2
Hochintelligentes Reasoning-Modell mit agentischer Tool-Nutzung und einem Kontextfenster von 1M Tokens.
- Funktionen
- Tool Choice
- Reasoning
- Eingabe
- €1,10
- Cache
- €0,275
- Ausgabe
- €4,40
pro 1M Tokens
- DeepSeek
deepseek-v4-flash-0731
Schnelles, günstiges DeepSeek-Reasoning-Modell mit Tool-Nutzung und 1M-Token-Kontext.
- Funktionen
- Tool Choice
- Reasoning
- Eingabe
- €0,14
- Cache
- €0,04
- Ausgabe
- €0,35
pro 1M Tokens
- Moonshot AI
kimi-k2.6
Agentisches multimodales Modell mit Bildverständnis und 256K-Token-Kontext.
- Funktionen
- Tool Choice
- Reasoning
- Bilder
- Eingabe
- €0,66
- Cache
- €0,22
- Ausgabe
- €3,751
pro 1M Tokens
- Qwen
qwen3.5-397b-a17b
Großes Mixture-of-Experts-Modell für Codegenerierung und agentische Aufgaben.
- Code
- Agentic
- Funktionen
- Eingabe
- €0,70
- Ausgabe
- €4,35
pro 1M Tokens
- Qwen
qwen3-235b-a22b-instruct-2507
Mehrsprachiges Reasoning mit einem großzügigen Kontextfenster von 250K Tokens.
- Mehrsprachig
- Reasoning
- Langer Kontext
- Eingabe
- €0,90
- Ausgabe
- €2,70
pro 1M Tokens
- Qwen
qwen3.6-35b-a3b
Kompaktes Frontier-Modell von Qwen für agentische Aufgaben und Reasoning in vielen Sprachen.
- Agentic
- Reasoning
- Bilder
- Code
- Eingabe
- €0,30
- Ausgabe
- €1,80
pro 1M Tokens
- OpenAI
gpt-oss-120b
Open-Weight-120B-Modell mit Bildverständnis und Reasoning über langen Kontext.
- Bilder
- Reasoning
- Funktionen
- Eingabe
- €0,20
- Ausgabe
- €0,70
pro 1M Tokens
- Mistral
mistral-small-3.2-24b-instruct-2506
Effizientes Instruct-Modell mit Function Calling und Bildverständnis.
- Funktionen
- Bilder
- Eingabe
- €0,20
- Ausgabe
- €0,40
pro 1M Tokens
- Meta
llama-3.3-70b-instruct
Mehrsprachiges Instruktionsmodell mit 70B Parametern für den breiten allgemeinen Einsatz.
- Mehrsprachig
- Eingabe
- €1,10
- Ausgabe
- €1,10
pro 1M Tokens
- Mistral
mistral-medium-3.5-128b
Reasoning, Coding und Bildverständnis auf Frontier-Niveau mit langem Kontextfenster.
- Reasoning
- Code
- Bilder
- Eingabe
- €1,80
- Ausgabe
- €9,00
pro 1M Tokens
Chat & Sprache
Open-Weight-Modelle unter der Marke GreenPT für alltäglichen Chat, Reasoning und Schreiben, abgestimmt auf europäische Sprachen.
- Google Gemma 4
gemma4
Multimodales Reasoning mit langem Kontextfenster für Dokumente und umfangreiche Prompts.
- Bilder
- Reasoning
- Langer Kontext
- Eingabe
- €0,50
- Ausgabe
- €1,50
pro 1M Tokens
- GPT-OSS
green-r
Fortgeschrittenes Reasoning, Schreiben und multimodales Verständnis, mit den Leitplanken von GreenPT.
- Reasoning
- Bilder
- Eingabe
- €0,35
- Ausgabe
- €0,95
pro 1M Tokens
- Mistral Small 3.2 24B
green-l
Schnelles mehrsprachiges Modell mit niederländischen Grammatik-Leitplanken für europäische Workloads.
- Mehrsprachig
- Funktionen
- Eingabe
- €0,25
- Ausgabe
- €0,80
pro 1M Tokens
Programmieren
Zwei Modelle, die speziell auf Softwarearbeit abgestimmt sind. Für einen Coding-Agent empfehlen wir meist glm-5.3, kimi-k3 oder glm-5.3-flash aus den Foundation-Modellen oben; von glm-5.2 gibt es zusätzlich Kompressionsvarianten zum gleichen Preis pro Token. Zu den Coding-Modellen
- Moonshot AI
kimi-k2.7-code
Auf Code und Software-Engineering ausgerichtete Kimi-Variante mit Bildverständnis und 256K-Token-Kontext.
- Funktionen
- Tool Choice
- Reasoning
- Bilder
- Eingabe
- €0,77
- Cache
- €0,165
- Ausgabe
- €3,85
pro 1M Tokens
- MiniMax
minimax-m2.5
Reasoning-Modell für agentisches Coding und langfristige Workflows, mit bis zu 128K Ausgabe-Tokens.
- Agentic
- Reasoning
- Langfristig
- Eingabe
- €0,33
- Ausgabe
- €1,32
pro 1M Tokens
Audio & Sprache
Transkription und Sprachverständnis, mehrsprachig und präzise.
- Deepgram Nova-2
green-s
Breite Sprachabdeckung für alltägliche Workloads: zwölf Sprachen, Echtzeit und Batch, smarte Formatierung und Sprechererkennung.
- Audio
- Mehrsprachig
- Batch
- €0,12
- Live
- €0,16
pro Stunde, 50% Sommerangebot bis 30. Sep. 2026
- Deepgram Nova-3
green-s-pro
Die höchste verfügbare Genauigkeit für medizinische, juristische und Contact-Center-Aufnahmen, mit einem echt mehrsprachigen Modell, das Sprachwechsel mitten im Satz korrekt transkribiert.
- Audio
- Mehrsprachig
- Batch
- ab €0,12
- Live
- ab €0,16
pro Stunde, 50% Sommerangebot bis 30. Sep. 2026
Embeddings & Retrieval
Vektoren und Reranking für semantische Suche und RAG-Pipelines.
- Qwen3-Embedding
green-embedding
Mehrsprachige Embeddings mit bis zu 2560 Dimensionen für semantische Suche und RAG.
- Embeddings
- Mehrsprachig
- Preis
- €0,20
pro 1M Tokens
- Qwen
qwen3-embedding-8b
Größeres mehrsprachiges Embedding-Modell mit bis zu 4096 konfigurierbaren Dimensionen.
- Embeddings
- Mehrsprachig
- Preis
- €0,25
pro 1M Tokens
- Qwen3-Reranker-4B
green-rerank
Ordnet abgerufene Dokumente nach echter Relevanz neu, die letzte Meile der Suche.
- Reranking
- Preis
- €0,12
pro 1M Tokens
Modelle, kurz erklärt
Wie wähle ich ein Modell?
Wähle nach Leistung und Budget. Jedes Modell ist Open-Weight und wird von uns gehostet, sodass du das kleinste Modell nimmst, das deine Aufgabe bewältigt, und starke Ergebnisse bei geringstem Energieverbrauch und niedrigsten Kosten erzielst.
Warum sind diese Modelle effizienter?
Sie sind Open-Weight und laufen mit 100% Ökostrom in Rechenzentren mit einem PUE von 1,25 und einem WUE von 0,25, deutlich unter den Branchenschnitten von 1,55 und 1,8. Leichtere, quantisierte Modelle und automatisches Routing sorgen dafür, dass jede Anfrage nur so viel Rechenleistung nutzt, wie die Aufgabe wirklich braucht.
Wie wird der Preis berechnet?
Die meisten Modelle werden pro Million Eingabe- und Ausgabe-Tokens berechnet; Sprachmodelle pro Stunde Audio. Jeder Satz, auch für zwischengespeicherte Eingaben, steht auf den Modellkarten.
Preise je Modell ansehen →Fehlt ein Modell, das du brauchst?
Wir erweitern den Katalog laufend um Open-Weight-Modelle. Ist deines nicht dabei, schreib uns, welches Modell es ist und wofür du es einsetzen willst, dann prüfen wir die Aufnahme.
Modell anfragen →Wie rufe ich ein Modell auf?
Über die OpenAI-kompatible API: Base-URL und Schlüssel setzen, dann die Modell-ID übergeben. Ein Schlüssel deckt jedes Modell ab, dazu Embeddings, Reranking, OCR, Sprache, Scraping und Suche.
API-Dokumentation lesen →Der Unterschied
Ein Schlüssel für jedes Modell.
Starte 14 Tage kostenlos, ohne Kreditkarte. Rufe jedes Modell über eine OpenAI-kompatible API auf, von uns mit 100% Ökostrom gehostet und ab der ersten Anfrage auf geringsten Energieverbrauch getrimmt.
Keine Kreditkarte nötig.
- 100% Ökostrom
- PUE 1,25
- Open-Weight