En tät modell med 27 miljarder parametrar och öppna vikter, byggd för resonemang, kod och flerspråkig dialog. Vi driftar den på våra europeiska GPU:er och ni anropar den som vilket OpenAI-kompatibelt API som helst.
Parametrar
27 mdr
Kontext
262 K
Språk
100+
Levererad genomströmning
~90 t/s
Växla mellan snabbt svar och steg-för-steg-resonemang för matematik, logik och kod — i samma endpoint, med en enda parameter.
Strukturerade JSON-utdata och deklarerade verktyg: modellen infogar sig i era befintliga agenter och arbetsflöden utan anpassningslager.
Tränad på fler än 100 språk och dialekter: en enda modell betjänar era kunder från Lissabon till Helsingfors, utan mellanliggande översättning.
Tillåtande licens och offentliga vikter: ni vet exakt vad som körs och kan replikera inferensen internt den dag ni vill. Därför är Mistral och Qwen aktörer i den europeiska suveräniteten → · Cybersäkerhet: svaret med öppna vikter →
| Benchmark | Qwen3.8-27B | Klass 20-30 mdr |
|---|---|---|
| MMLU-Pro (kunskap) | 72,7 | 65-74 |
| GPQA (naturvetenskap) | 53,5 | 45-56 |
| AIME (matematik) | 30,3 | 18-34 |
| LiveCodeBench (kod) | 28,8 | 22-31 |
Vägledande värden från modellutgivarens publikationer; de definitiva siffrorna mäts på vår infrastruktur och publiceras på denna sida.
OpenAI-SDK, LangChain, LlamaIndex: allt fungerar genom att byta bas-URL och nyckel. Parametern reasoning aktiverar resonemangsläget.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Sammanfatta det här avtalet"}],
extra_body={"reasoning": True})
Utan abonnemang, utan minimum — priset för suverän inferens, utan dolda kostnader. Behöver ni mer genomströmning för mindre pengar? Se Ministral 3 14B →