Un modèle dense de 27 milliards de paramètres à poids ouverts, taillé pour le raisonnement, le code et le dialogue multilingue. Nous l'opérons sur nos GPU européens et vous l'appelez comme n'importe quelle API compatible OpenAI.
Paramètres
27 Mds
Contexte
262 K
Langues
100+
Débit servi
~90 t/s
Basculez entre réponse rapide et raisonnement pas-à-pas pour les mathématiques, la logique et le code — dans le même endpoint, par simple paramètre.
Sorties structurées JSON et outils déclarés : le modèle s'insère dans vos agents et vos workflows existants sans couche d'adaptation.
Entraîné sur plus de 100 langues et dialectes : un seul modèle sert vos clients de Lisbonne à Helsinki, sans traduction intermédiaire.
Licence permissive et poids publics : vous savez exactement ce qui tourne, et vous pouvez répliquer l'inférence en interne le jour où vous le souhaitez. Pourquoi Mistral et Qwen sont acteurs de la souveraineté européenne → · Cybersécurité : la réponse open-weights →
| Benchmark | Qwen3.8-27B | Classe 20-30 Mds |
|---|---|---|
| MMLU-Pro (connaissances) | 72,7 | 65-74 |
| GPQA (sciences) | 53,5 | 45-56 |
| AIME (mathématiques) | 30,3 | 18-34 |
| LiveCodeBench (code) | 28,8 | 22-31 |
Valeurs indicatives issues des publications de l'éditeur du modèle ; les chiffres définitifs seront mesurés sur notre infrastructure et publiés sur cette page.
SDK OpenAI, LangChain, LlamaIndex : tout fonctionne en changeant la base URL et la clé. Le paramètre reasoning active le mode raisonnement.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Résume ce contrat"}],
extra_body={"reasoning": True})
Sans abonnement, sans minimum — le prix de l’inférence souveraine, sans coût caché. Besoin de plus de débit pour moins cher ? Voir Ministral 3 14B →