Qwen3.8-27B — modello open-weights servito in Europa | europeanGPU
Catalogo — 2 modelli: Qwen3.8-27B Ministral 3 14B
Modello a catalogo

Qwen3.8-27B, servito dall’Europa

Un modello denso da 27 miliardi di parametri a pesi aperti, pensato per il ragionamento, il codice e il dialogo multilingue. Lo gestiamo sulle nostre GPU europee e lo chiamate come una qualsiasi API compatibile OpenAI.

Richiedi l’accesso Vedi il prezzo

Parametri

27 mld

Architettura densa, pesi aperti

Contesto

262 K

token nativi, estendibile a 1 M

Lingue

100+

tra cui le 24 lingue ufficiali dell’UE

Throughput servito

~90 t/s

per flusso, latenza al primo token < 1 s

Capacità

Modalità di ragionamento attivabile

Passate dalla risposta rapida al ragionamento passo dopo passo per matematica, logica e codice — nello stesso endpoint, con un semplice parametro.

Chiamata di funzioni

Output strutturati JSON e strumenti dichiarati: il modello si inserisce nei vostri agenti e nei vostri workflow esistenti senza strati di adattamento.

Multilingue nativo

Addestrato su oltre 100 lingue e dialetti: un solo modello serve i vostri clienti da Lisbona a Helsinki, senza traduzione intermedia.

Pesi aperti, verificabili

Licenza permissiva e pesi pubblici: sapete esattamente che cosa gira, e potete replicare l’inferenza in casa il giorno in cui lo desiderate. Perché Mistral e Qwen sono protagonisti della sovranità europea → · Cybersicurezza: la risposta open-weights →

Riferimenti di prestazione
BenchmarkQwen3.8-27BClasse 20-30 mld
MMLU-Pro (conoscenze)72,765-74
GPQA (scienze)53,545-56
AIME (matematica)30,318-34
LiveCodeBench (codice)28,822-31

Valori indicativi tratti dalle pubblicazioni del vendor del modello; i numeri definitivi saranno misurati sulla nostra infrastruttura e pubblicati su questa pagina.

Chiamatelo come chiamate già gli altri

SDK OpenAI, LangChain, LlamaIndex: tutto funziona cambiando la base URL e la chiave. Il parametro reasoning attiva la modalità di ragionamento.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.europeangpu.com/v1",
    api_key=EGPU_API_KEY)

r = client.chat.completions.create(
    model="qwen3.8-27b",
    messages=[{"role": "user",
               "content": "Riassumi questo contratto"}],
    extra_body={"reasoning": True})

0,38 € in input, 2,60 € in output, per milione di token

Senza abbonamento, senza minimi — il prezzo dell’inferenza sovrana, senza costi nascosti. Vi serve più throughput a un costo inferiore? Vedi Ministral 3 14B →

Prenota un appuntamento