MandAPI Radar · Models

Qwen3.8 Max

Provedor: alibaba · configuração principal: alibaba/qwen3.8-max#default · configurações avaliadas: default — esforços distintos nunca são mesclados

Atualizado em 13/09/2026 03:13 UTC

Preço (snapshot público)

fonte: modelsdev

Entrada

US$ 2,00
US$ por 1M tokens

Saída

US$ 6,00
US$ por 1M tokens

Disponibilidade MandAPI

integração pendente; nenhum valor inventado

Configuração de avaliação

configId: alibaba/qwen3.8-max#default

Nível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

94,9
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

95,7
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Agente

66,3
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1480,9143 96,63 0,40 2026-09-11 16263
LMArena lmarena:text_style_control:overall 1481,0653 94,89 1,20 2026-09-11 16263
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1670,5774 95,70 1,00 2026-09-11 3221
Agente — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:agent:overall 0,0397 66,28 1,00 2026-09-10 1821791

Comparações

somente pares com dados reais publicados

Qwen3.8 Max vs Claude Fable 5 · Qwen3.8 Max vs Anthropic: Claude Fable 5.1 · Qwen3.8 Max vs Claude Opus 4.6 · Qwen3.8 Max vs Claude Opus 4.7 · Qwen3.8 Max vs Claude Opus 4.8 · Qwen3.8 Max vs Claude Opus 5 · Qwen3.8 Max vs Claude Sonnet 5 · Qwen3.8 Max vs DeepSeek: R1 0528 · Qwen3.8 Max vs DeepSeek: DeepSeek V4.1 Flash · Qwen3.8 Max vs Google: Gemini 2.5 Pro Preview 05-06 · Qwen3.8 Max vs Gemini 3.6 Flash · Qwen3.8 Max vs Gemini 3.7 Flash · Qwen3.8 Max vs Gemini 3.8 Flash · Qwen3.8 Max vs GLM-5.2 · Qwen3.8 Max vs GLM-5.3 · Qwen3.8 Max vs GLM-5.3-Flash · Qwen3.8 Max vs GPT-5 · Qwen3.8 Max vs GPT-6 Astra · Qwen3.8 Max vs Grok 4.5 · Qwen3.8 Max vs Grok 4.6 · Qwen3.8 Max vs Kimi K3 · Qwen3.8 Max vs o3 · Qwen3.8 Max vs o3-pro · Qwen3.8 Max vs o4-mini

Metodologia e fontes Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.