Qwen3.8-27B — modèle open-weights servi en Europe | europeanGPU
Catalogue — 2 modèles : Qwen3.8-27B Ministral 3 14B
Modèle au catalogue

Qwen3.8-27B, servi depuis l'Europe

Un modèle dense de 27 milliards de paramètres à poids ouverts, taillé pour le raisonnement, le code et le dialogue multilingue. Nous l'opérons sur nos GPU européens et vous l'appelez comme n'importe quelle API compatible OpenAI.

Demander un accès Voir le prix

Paramètres

27 Mds

Architecture dense, poids ouverts

Contexte

262 K

tokens en natif, extensible à 1 M

Langues

100+

dont les 24 langues officielles de l'UE

Débit servi

~90 t/s

par flux, latence premier token < 1 s

Capacités

Mode raisonnement activable

Basculez entre réponse rapide et raisonnement pas-à-pas pour les mathématiques, la logique et le code — dans le même endpoint, par simple paramètre.

Appel de fonctions

Sorties structurées JSON et outils déclarés : le modèle s'insère dans vos agents et vos workflows existants sans couche d'adaptation.

Multilingue natif

Entraîné sur plus de 100 langues et dialectes : un seul modèle sert vos clients de Lisbonne à Helsinki, sans traduction intermédiaire.

Poids ouverts, auditables

Licence permissive et poids publics : vous savez exactement ce qui tourne, et vous pouvez répliquer l'inférence en interne le jour où vous le souhaitez. Pourquoi Mistral et Qwen sont acteurs de la souveraineté européenne → · Cybersécurité : la réponse open-weights →

Repères de performance
BenchmarkQwen3.8-27BClasse 20-30 Mds
MMLU-Pro (connaissances)72,765-74
GPQA (sciences)53,545-56
AIME (mathématiques)30,318-34
LiveCodeBench (code)28,822-31

Valeurs indicatives issues des publications de l'éditeur du modèle ; les chiffres définitifs seront mesurés sur notre infrastructure et publiés sur cette page.

Appelez-le comme vous appelez déjà les autres

SDK OpenAI, LangChain, LlamaIndex : tout fonctionne en changeant la base URL et la clé. Le paramètre reasoning active le mode raisonnement.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.europeangpu.com/v1",
    api_key=EGPU_API_KEY)

r = client.chat.completions.create(
    model="qwen3.8-27b",
    messages=[{"role": "user",
               "content": "Résume ce contrat"}],
    extra_body={"reasoning": True})

0,38 € en entrée, 2,60 € en sortie, par million de tokens

Sans abonnement, sans minimum — le prix de l’inférence souveraine, sans coût caché. Besoin de plus de débit pour moins cher ? Voir Ministral 3 14B →

Prendre rendez-vous