Gęsty model o 27 miliardach parametrów z otwartymi wagami, stworzony do rozumowania, kodu i wielojęzycznego dialogu. Obsługujemy go na naszych europejskich GPU, a Ty wywołujesz go jak każde API zgodne z OpenAI.
Parametry
27 mld
Kontekst
262 K
Języki
100+
Serwowana przepustowość
~90 t/s
Przełączaj się między szybką odpowiedzią a rozumowaniem krok po kroku dla matematyki, logiki i kodu — w tym samym endpoincie, jednym parametrem.
Ustrukturyzowane wyjścia JSON i deklarowane narzędzia: model wpina się w Twoich agentów i istniejące workflow bez warstwy adaptacyjnej.
Trenowany na ponad 100 językach i dialektach: jeden model obsługuje Twoich klientów od Lizbony po Helsinki, bez pośredniego tłumaczenia.
Permisywna licencja i publiczne wagi: wiesz dokładnie, co działa, i możesz odtworzyć inferencję u siebie w dniu, w którym zechcesz. Dlaczego Mistral i Qwen współtworzą europejską suwerenność → · Cyberbezpieczeństwo: odpowiedź open-weights →
| Benchmark | Qwen3.8-27B | Klasa 20-30 mld |
|---|---|---|
| MMLU-Pro (wiedza) | 72,7 | 65-74 |
| GPQA (nauki ścisłe) | 53,5 | 45-56 |
| AIME (matematyka) | 30,3 | 18-34 |
| LiveCodeBench (kod) | 28,8 | 22-31 |
Wartości orientacyjne pochodzące z publikacji wydawcy modelu; ostateczne liczby zostaną zmierzone na naszej infrastrukturze i opublikowane na tej stronie.
SDK OpenAI, LangChain, LlamaIndex: wszystko działa po zmianie bazowego URL-a i klucza. Parametr reasoning włącza tryb rozumowania.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Résume ce contrat"}],
extra_body={"reasoning": True})
Bez abonamentu, bez minimum — cena suwerennej inferencji, bez ukrytych kosztów. Potrzebujesz większej przepustowości za mniej? Zobacz Ministral 3 14B →