MandAPI Radar · Models

Grok 4.5

Provedor: xai · configuração principal: xai/grok-4.5#default · configurações avaliadas: default — esforços distintos nunca são mesclados

Atualizado em 13/09/2026 03:13 UTC

Preço (snapshot público)

fonte: modelsdev

Entrada

US$ 2,00
US$ por 1M tokens

Saída

US$ 6,00
US$ por 1M tokens

Disponibilidade MandAPI

integração pendente; nenhum valor inventado

Configuração de avaliação

configId: xai/grok-4.5#default

Nível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

89,9
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

79,3
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Agente

61,6
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1450,9619 89,90 0,40 2026-09-11 29617
LMArena lmarena:text_style_control:overall 1469,0229 89,90 1,20 2026-09-11 29617
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1555,1049 79,30 1,00 2026-09-11 8133
Agente — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:agent:overall 0,0383 61,63 1,00 2026-09-10 1817830

Comparações

somente pares com dados reais publicados

Grok 4.5 vs Claude Fable 5 · Grok 4.5 vs Anthropic: Claude Fable 5.1 · Grok 4.5 vs Claude Opus 4.6 · Grok 4.5 vs Claude Opus 4.7 · Grok 4.5 vs Claude Opus 4.8 · Grok 4.5 vs Claude Opus 5 · Grok 4.5 vs Claude Sonnet 5 · Grok 4.5 vs DeepSeek: R1 0528 · Grok 4.5 vs DeepSeek: DeepSeek V4.1 Flash · Grok 4.5 vs Google: Gemini 2.5 Pro Preview 05-06 · Grok 4.5 vs Gemini 3.6 Flash · Grok 4.5 vs Gemini 3.7 Flash · Grok 4.5 vs Gemini 3.8 Flash · Grok 4.5 vs GLM-5.2 · Grok 4.5 vs GLM-5.3 · Grok 4.5 vs GLM-5.3-Flash · Grok 4.5 vs GPT-5 · Grok 4.5 vs GPT-6 Astra · Grok 4.5 vs Grok 4.6 · Grok 4.5 vs Kimi K3 · Grok 4.5 vs o3 · Grok 4.5 vs o3-pro · Grok 4.5 vs o4-mini · Grok 4.5 vs Qwen3.8 Max

Metodologia e fontes Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.