Skip to content
Luftaufnahme eines stillen Sees, umgeben von dichtem grünem Wald.

Modelle

Jedes Modell, eine effiziente API

Open-Weight-Modelle für Sprache, Reasoning, Programmieren, Bilder, Embeddings und Spracherkennung, alle von uns mit 100% Ökostrom gehostet und auf Effizienz getrimmt. Ein Katalog, ein Schlüssel, der niedrigste Energieverbrauch, der die Aufgabe noch erledigt.

Der Katalog

Jedes Modell, nach Kategorie

Open-Weight-Modelle laufen mit 100% Ökostrom und führender Effizienz, erreichbar über eine OpenAI-kompatible API und einen einzigen Schlüssel.

Foundation-Modelle

Open-Weight-Foundation-Modelle, die wir selbst hosten, abgestimmt auf den geringsten Energieverbrauch je Aufgabe.

  • z.ai Neu 1M

    glm-5.3

    Unser Flaggschiff für agentisches Coding und Tool-Nutzung: die GLM-5.2-Basis mit skaliertem Post-Training, 1M Tokens Kontext und 50 % höheren Z.ai-Code-Bench-Werten bei weniger Output-Tokens.

    • Funktionen
    • Tool Choice
    • Reasoning
    • Agentisches Coding
    Eingabe
    €1,10
    Cache
    €0,275
    Ausgabe
    €4,40

    pro 1M Tokens

  • Moonshot AI Neu 1M

    kimi-k3

    Open-Weight-Modell mit 2,8T Parametern, nativ multimodal und agentisch, mit hybridem Reasoning für langfristiges Coding, Wissensarbeit und Reasoning.

    • Chat
    • Hybrides Reasoning
    • Agentisches Coding
    • Bilder
    Eingabe
    €3,30
    Cache
    €0,825
    Ausgabe
    €16,50

    pro 1M Tokens

  • z.ai Neu 1M

    glm-5.3-flash

    Leichte Variante von GLM-5.3: ein Mixture-of-Experts-Modell mit 320B Parametern und 18B aktiv, nativer Bild- und Videoeingabe und demselben 1M-Token-Kontext zu einem Zehntel des Preises.

    • Funktionen
    • Tool Choice
    • Reasoning
    • Bilder
    Eingabe
    €0,11
    Cache
    €0,022
    Ausgabe
    €0,44

    pro 1M Tokens

  • z.ai 1M

    glm-5.2

    Hochintelligentes Reasoning-Modell mit agentischer Tool-Nutzung und einem Kontextfenster von 1M Tokens.

    • Funktionen
    • Tool Choice
    • Reasoning
    Eingabe
    €1,10
    Cache
    €0,275
    Ausgabe
    €4,40

    pro 1M Tokens

  • DeepSeek Neu 1M

    deepseek-v4-flash-0731

    Schnelles, günstiges DeepSeek-Reasoning-Modell mit Tool-Nutzung und 1M-Token-Kontext.

    • Funktionen
    • Tool Choice
    • Reasoning
    Eingabe
    €0,14
    Cache
    €0,04
    Ausgabe
    €0,35

    pro 1M Tokens

  • Moonshot AI Neu 256K

    kimi-k2.6

    Agentisches multimodales Modell mit Bildverständnis und 256K-Token-Kontext.

    • Funktionen
    • Tool Choice
    • Reasoning
    • Bilder
    Eingabe
    €0,66
    Cache
    €0,22
    Ausgabe
    €3,751

    pro 1M Tokens

  • Qwen 250K

    qwen3.5-397b-a17b

    Großes Mixture-of-Experts-Modell für Codegenerierung und agentische Aufgaben.

    • Code
    • Agentic
    • Funktionen
    Eingabe
    €0,70
    Ausgabe
    €4,35

    pro 1M Tokens

  • Qwen 250K

    qwen3-235b-a22b-instruct-2507

    Mehrsprachiges Reasoning mit einem großzügigen Kontextfenster von 250K Tokens.

    • Mehrsprachig
    • Reasoning
    • Langer Kontext
    Eingabe
    €0,90
    Ausgabe
    €2,70

    pro 1M Tokens

  • Qwen 256K

    qwen3.6-35b-a3b

    Kompaktes Frontier-Modell von Qwen für agentische Aufgaben und Reasoning in vielen Sprachen.

    • Agentic
    • Reasoning
    • Bilder
    • Code
    Eingabe
    €0,30
    Ausgabe
    €1,80

    pro 1M Tokens

  • OpenAI 128K

    gpt-oss-120b

    Open-Weight-120B-Modell mit Bildverständnis und Reasoning über langen Kontext.

    • Bilder
    • Reasoning
    • Funktionen
    Eingabe
    €0,20
    Ausgabe
    €0,70

    pro 1M Tokens

  • Mistral 128K

    mistral-small-3.2-24b-instruct-2506

    Effizientes Instruct-Modell mit Function Calling und Bildverständnis.

    • Funktionen
    • Bilder
    Eingabe
    €0,20
    Ausgabe
    €0,40

    pro 1M Tokens

  • Meta 128K

    llama-3.3-70b-instruct

    Mehrsprachiges Instruktionsmodell mit 70B Parametern für den breiten allgemeinen Einsatz.

    • Mehrsprachig
    Eingabe
    €1,10
    Ausgabe
    €1,10

    pro 1M Tokens

  • Mistral 180K

    mistral-medium-3.5-128b

    Reasoning, Coding und Bildverständnis auf Frontier-Niveau mit langem Kontextfenster.

    • Reasoning
    • Code
    • Bilder
    Eingabe
    €1,80
    Ausgabe
    €9,00

    pro 1M Tokens

Chat & Sprache

Open-Weight-Modelle unter der Marke GreenPT für alltäglichen Chat, Reasoning und Schreiben, abgestimmt auf europäische Sprachen.

  • Google Gemma 4 256K

    gemma4

    Multimodales Reasoning mit langem Kontextfenster für Dokumente und umfangreiche Prompts.

    • Bilder
    • Reasoning
    • Langer Kontext
    Eingabe
    €0,50
    Ausgabe
    €1,50

    pro 1M Tokens

  • GPT-OSS 128K

    green-r

    Fortgeschrittenes Reasoning, Schreiben und multimodales Verständnis, mit den Leitplanken von GreenPT.

    • Reasoning
    • Bilder
    Eingabe
    €0,35
    Ausgabe
    €0,95

    pro 1M Tokens

  • Mistral Small 3.2 24B 128K

    green-l

    Schnelles mehrsprachiges Modell mit niederländischen Grammatik-Leitplanken für europäische Workloads.

    • Mehrsprachig
    • Funktionen
    Eingabe
    €0,25
    Ausgabe
    €0,80

    pro 1M Tokens

Programmieren

Zwei Modelle, die speziell auf Softwarearbeit abgestimmt sind. Für einen Coding-Agent empfehlen wir meist glm-5.3, kimi-k3 oder glm-5.3-flash aus den Foundation-Modellen oben; von glm-5.2 gibt es zusätzlich Kompressionsvarianten zum gleichen Preis pro Token. Zu den Coding-Modellen

  • Moonshot AI Neu 256K

    kimi-k2.7-code

    Auf Code und Software-Engineering ausgerichtete Kimi-Variante mit Bildverständnis und 256K-Token-Kontext.

    • Funktionen
    • Tool Choice
    • Reasoning
    • Bilder
    Eingabe
    €0,77
    Cache
    €0,165
    Ausgabe
    €3,85

    pro 1M Tokens

  • MiniMax 192K

    minimax-m2.5

    Reasoning-Modell für agentisches Coding und langfristige Workflows, mit bis zu 128K Ausgabe-Tokens.

    • Agentic
    • Reasoning
    • Langfristig
    Eingabe
    €0,33
    Ausgabe
    €1,32

    pro 1M Tokens

Audio & Sprache

Transkription und Sprachverständnis, mehrsprachig und präzise.

  • Deepgram Nova-2

    green-s

    Breite Sprachabdeckung für alltägliche Workloads: zwölf Sprachen, Echtzeit und Batch, smarte Formatierung und Sprechererkennung.

    • Audio
    • Mehrsprachig
    Batch
    €0,12
    Live
    €0,16

    pro Stunde, 50% Sommerangebot bis 30. Sep. 2026

  • Deepgram Nova-3

    green-s-pro

    Die höchste verfügbare Genauigkeit für medizinische, juristische und Contact-Center-Aufnahmen, mit einem echt mehrsprachigen Modell, das Sprachwechsel mitten im Satz korrekt transkribiert.

    • Audio
    • Mehrsprachig
    Batch
    ab €0,12
    Live
    ab €0,16

    pro Stunde, 50% Sommerangebot bis 30. Sep. 2026

Embeddings & Retrieval

Vektoren und Reranking für semantische Suche und RAG-Pipelines.

  • Qwen3-Embedding 32K

    green-embedding

    Mehrsprachige Embeddings mit bis zu 2560 Dimensionen für semantische Suche und RAG.

    • Embeddings
    • Mehrsprachig
    Preis
    €0,20

    pro 1M Tokens

  • Qwen 32K

    qwen3-embedding-8b

    Größeres mehrsprachiges Embedding-Modell mit bis zu 4096 konfigurierbaren Dimensionen.

    • Embeddings
    • Mehrsprachig
    Preis
    €0,25

    pro 1M Tokens

  • Qwen3-Reranker-4B 32K

    green-rerank

    Ordnet abgerufene Dokumente nach echter Relevanz neu, die letzte Meile der Suche.

    • Reranking
    Preis
    €0,12

    pro 1M Tokens

Modelle, kurz erklärt

Wie wähle ich ein Modell?

Wähle nach Leistung und Budget. Jedes Modell ist Open-Weight und wird von uns gehostet, sodass du das kleinste Modell nimmst, das deine Aufgabe bewältigt, und starke Ergebnisse bei geringstem Energieverbrauch und niedrigsten Kosten erzielst.

Warum sind diese Modelle effizienter?

Sie sind Open-Weight und laufen mit 100% Ökostrom in Rechenzentren mit einem PUE von 1,25 und einem WUE von 0,25, deutlich unter den Branchenschnitten von 1,55 und 1,8. Leichtere, quantisierte Modelle und automatisches Routing sorgen dafür, dass jede Anfrage nur so viel Rechenleistung nutzt, wie die Aufgabe wirklich braucht.

Wie wird der Preis berechnet?

Die meisten Modelle werden pro Million Eingabe- und Ausgabe-Tokens berechnet; Sprachmodelle pro Stunde Audio. Jeder Satz, auch für zwischengespeicherte Eingaben, steht auf den Modellkarten.

Preise je Modell ansehen →
Fehlt ein Modell, das du brauchst?

Wir erweitern den Katalog laufend um Open-Weight-Modelle. Ist deines nicht dabei, schreib uns, welches Modell es ist und wofür du es einsetzen willst, dann prüfen wir die Aufnahme.

Modell anfragen →
Wie rufe ich ein Modell auf?

Über die OpenAI-kompatible API: Base-URL und Schlüssel setzen, dann die Modell-ID übergeben. Ein Schlüssel deckt jedes Modell ab, dazu Embeddings, Reranking, OCR, Sprache, Scraping und Suche.

API-Dokumentation lesen →

Der Unterschied

Ein Schlüssel für jedes Modell.

Starte 14 Tage kostenlos, ohne Kreditkarte. Rufe jedes Modell über eine OpenAI-kompatible API auf, von uns mit 100% Ökostrom gehostet und ab der ersten Anfrage auf geringsten Energieverbrauch getrimmt.

Keine Kreditkarte nötig.

  • 100% Ökostrom
  • PUE 1,25
  • Open-Weight