Un model dens de 27 de miliarde de parametri cu ponderi deschise, croit pentru raționament, cod și dialog multilingv. Îl operăm pe GPU-urile noastre europene, iar dumneavoastră îl apelați ca pe orice API compatibil OpenAI.
Parametri
27 mld
Context
262 K
Limbi
100+
Debit servit
~90 t/s
Comutați între răspuns rapid și raționament pas cu pas pentru matematică, logică și cod — în același endpoint, printr-un simplu parametru.
Ieșiri structurate JSON și instrumente declarate: modelul se integrează în agenții și fluxurile dumneavoastră de lucru existente, fără strat de adaptare.
Antrenat pe mai mult de 100 de limbi și dialecte: un singur model vă deservește clienții de la Lisabona la Helsinki, fără traducere intermediară.
Licență permisivă și ponderi publice: știți exact ce rulează și puteți replica inferența intern în ziua în care doriți. De ce Mistral și Qwen sunt actori ai suveranității europene → · Cibersecuritate: răspunsul open-weights →
| Benchmark | Qwen3.8-27B | Clasa 20-30 mld |
|---|---|---|
| MMLU-Pro (cunoștințe) | 72,7 | 65-74 |
| GPQA (științe) | 53,5 | 45-56 |
| AIME (matematică) | 30,3 | 18-34 |
| LiveCodeBench (cod) | 28,8 | 22-31 |
Valori orientative provenite din publicațiile editorului modelului; cifrele definitive vor fi măsurate pe infrastructura noastră și publicate pe această pagină.
SDK OpenAI, LangChain, LlamaIndex: totul funcționează schimbând URL-ul de bază și cheia. Parametrul reasoning activează modul de raționament.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Rezumă acest contract"}],
extra_body={"reasoning": True})
Fără abonament, fără minim — prețul inferenței suverane, fără costuri ascunse. Aveți nevoie de mai mult debit la un preț mai mic? Vezi Ministral 3 14B →