Qwen3.8-27B — modelo open-weights servido na Europa | europeanGPU
Catálogo — 2 modelos: Qwen3.8-27B Ministral 3 14B
Modelo no catálogo

Qwen3.8-27B, servido a partir da Europa

Um modelo denso de 27 mil milhões de parâmetros de pesos abertos, talhado para o raciocínio, o código e o diálogo multilingue. Operamo-lo nos nossos GPU europeus e chama-o como qualquer API compatível com OpenAI.

Pedir acesso Ver o preço

Parâmetros

27 mil M

Arquitetura densa, pesos abertos

Contexto

262 K

tokens nativos, extensível a 1 M

Idiomas

100+

incluindo as 24 línguas oficiais da UE

Débito servido

~90 t/s

por fluxo, latência do primeiro token < 1 s

Capacidades

Modo de raciocínio ativável

Alterne entre resposta rápida e raciocínio passo a passo para matemática, lógica e código — no mesmo endpoint, por simples parâmetro.

Chamada de funções

Saídas estruturadas JSON e ferramentas declaradas: o modelo integra-se nos seus agentes e workflows existentes sem camada de adaptação.

Multilingue nativo

Treinado em mais de 100 idiomas e dialetos: um único modelo serve os seus clientes de Lisboa a Helsínquia, sem tradução intermédia.

Pesos abertos, auditáveis

Licença permissiva e pesos públicos: sabe exatamente o que está a correr, e pode replicar a inferência internamente no dia em que o desejar. Porque é que a Mistral e a Qwen são atores da soberania europeia → · Cibersegurança: a resposta open-weights →

Referências de desempenho
BenchmarkQwen3.8-27BClasse 20-30 mil M
MMLU-Pro (conhecimentos)72,765-74
GPQA (ciências)53,545-56
AIME (matemática)30,318-34
LiveCodeBench (código)28,822-31

Valores indicativos provenientes das publicações do editor do modelo; os números definitivos serão medidos na nossa infraestrutura e publicados nesta página.

Chame-o como já chama os outros

SDK OpenAI, LangChain, LlamaIndex: tudo funciona mudando o base URL e a chave. O parâmetro reasoning ativa o modo de raciocínio.

from openai import OpenAI

client = OpenAI(
    base_url="https://api.europeangpu.com/v1",
    api_key=EGPU_API_KEY)

r = client.chat.completions.create(
    model="qwen3.8-27b",
    messages=[{"role": "user",
               "content": "Resume este contrato"}],
    extra_body={"reasoning": True})

0,38 € em entrada, 2,60 € em saída, por milhão de tokens

Sem assinatura, sem mínimo — o preço da inferência soberana, sem custos escondidos. Precisa de mais débito por menos dinheiro? Ver o Ministral 3 14B →

Marcar reunião