Ein dichtes Modell mit 27 Milliarden Parametern und offenen Gewichten, gemacht für Reasoning, Code und mehrsprachigen Dialog. Wir betreiben es auf unseren europäischen GPUs, und Sie rufen es auf wie jede OpenAI-kompatible API.
Parameter
27 Mrd.
Kontext
262 K
Sprachen
100+
Durchsatz
~90 t/s
Wechseln Sie zwischen schneller Antwort und schrittweisem Denken für Mathematik, Logik und Code — im selben Endpoint, über einen einfachen Parameter.
Strukturierte JSON-Ausgaben und deklarierte Tools: Das Modell fügt sich ohne Adapterschicht in Ihre bestehenden Agenten und Workflows ein.
Trainiert auf über 100 Sprachen und Dialekten: Ein einziges Modell bedient Ihre Kunden von Lissabon bis Helsinki — ohne zwischengeschaltete Übersetzung.
Permissive Lizenz und öffentliche Gewichte: Sie wissen genau, was läuft, und können die Inferenz intern replizieren, sobald Sie es möchten. Warum Mistral und Qwen Akteure der europäischen Souveränität sind → · Cybersicherheit: die Open-Weights-Antwort →
| Benchmark | Qwen3.8-27B | Klasse 20–30 Mrd. |
|---|---|---|
| MMLU-Pro (Wissen) | 72,7 | 65-74 |
| GPQA (Naturwissenschaften) | 53,5 | 45-56 |
| AIME (Mathematik) | 30,3 | 18-34 |
| LiveCodeBench (Code) | 28,8 | 22-31 |
Richtwerte aus den Veröffentlichungen des Modellherausgebers; die endgültigen Zahlen werden auf unserer Infrastruktur gemessen und auf dieser Seite veröffentlicht.
OpenAI-SDK, LangChain, LlamaIndex: Alles funktioniert, sobald Sie Basis-URL und Schlüssel ändern. Der Parameter reasoning aktiviert den Reasoning-Modus.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Fasse diesen Vertrag zusammen"}],
extra_body={"reasoning": True})
Ohne Abonnement, ohne Mindestabnahme — der Preis souveräner Inferenz, ohne versteckte Kosten. Mehr Durchsatz für weniger Geld gesucht? Ministral 3 14B ansehen →