Um modelo denso de 27 mil milhões de parâmetros de pesos abertos, talhado para o raciocínio, o código e o diálogo multilingue. Operamo-lo nos nossos GPU europeus e chama-o como qualquer API compatível com OpenAI.
Parâmetros
27 mil M
Contexto
262 K
Idiomas
100+
Débito servido
~90 t/s
Alterne entre resposta rápida e raciocínio passo a passo para matemática, lógica e código — no mesmo endpoint, por simples parâmetro.
Saídas estruturadas JSON e ferramentas declaradas: o modelo integra-se nos seus agentes e workflows existentes sem camada de adaptação.
Treinado em mais de 100 idiomas e dialetos: um único modelo serve os seus clientes de Lisboa a Helsínquia, sem tradução intermédia.
Licença permissiva e pesos públicos: sabe exatamente o que está a correr, e pode replicar a inferência internamente no dia em que o desejar. Porque é que a Mistral e a Qwen são atores da soberania europeia → · Cibersegurança: a resposta open-weights →
| Benchmark | Qwen3.8-27B | Classe 20-30 mil M |
|---|---|---|
| MMLU-Pro (conhecimentos) | 72,7 | 65-74 |
| GPQA (ciências) | 53,5 | 45-56 |
| AIME (matemática) | 30,3 | 18-34 |
| LiveCodeBench (código) | 28,8 | 22-31 |
Valores indicativos provenientes das publicações do editor do modelo; os números definitivos serão medidos na nossa infraestrutura e publicados nesta página.
SDK OpenAI, LangChain, LlamaIndex: tudo funciona mudando o base URL e a chave. O parâmetro reasoning ativa o modo de raciocínio.
from openai import OpenAI
client = OpenAI(
base_url="https://api.europeangpu.com/v1",
api_key=EGPU_API_KEY)
r = client.chat.completions.create(
model="qwen3.8-27b",
messages=[{"role": "user",
"content": "Resume este contrato"}],
extra_body={"reasoning": True})
Sem assinatura, sem mínimo — o preço da inferência soberana, sem custos escondidos. Precisa de mais débito por menos dinheiro? Ver o Ministral 3 14B →