MandAPI Radar · Models

Claude Opus 4.8

Provedor: anthropic · configuração principal: anthropic/claude-opus-4-8#default · configurações avaliadas: default · high — esforços distintos nunca são mesclados

Atualizado em 13/09/2026 03:13 UTC

Preço (snapshot público)

fonte: modelsdev

Entrada

US$ 5,00
US$ por 1M tokens

Saída

US$ 25,00
US$ por 1M tokens

Disponibilidade MandAPI

integração pendente; nenhum valor inventado

Configuração de avaliação

configId: anthropic/claude-opus-4-8#default

Nível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

91,4
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

77,0
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1451,9736 90,15 0,40 2026-09-11 52970
LMArena lmarena:text_style_control:overall 1472,6451 91,40 1,20 2026-09-11 52970
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1538,8062 76,95 1,00 2026-09-11 12654

Configuração de avaliação

configId: anthropic/claude-opus-4-8#high

Nível de raciocínio: high — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

95,6
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

81,6
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1461,7696 91,90 0,40 2026-09-11 52123
LMArena lmarena:text_style_control:overall 1482,3854 95,64 1,20 2026-09-11 52123
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1558,8328 81,64 1,00 2026-09-11 13787

Comparações

somente pares com dados reais publicados

Claude Opus 4.8 vs Claude Fable 5 · Claude Opus 4.8 vs Anthropic: Claude Fable 5.1 · Claude Opus 4.8 vs Claude Opus 4.6 · Claude Opus 4.8 vs Claude Opus 4.7 · Claude Opus 4.8 vs Claude Opus 5 · Claude Opus 4.8 vs Claude Sonnet 5 · Claude Opus 4.8 vs DeepSeek: R1 0528 · Claude Opus 4.8 vs DeepSeek: DeepSeek V4.1 Flash · Claude Opus 4.8 vs Google: Gemini 2.5 Pro Preview 05-06 · Claude Opus 4.8 vs Gemini 3.6 Flash · Claude Opus 4.8 vs Gemini 3.7 Flash · Claude Opus 4.8 vs Gemini 3.8 Flash · Claude Opus 4.8 vs GLM-5.2 · Claude Opus 4.8 vs GLM-5.3 · Claude Opus 4.8 vs GLM-5.3-Flash · Claude Opus 4.8 vs GPT-5 · Claude Opus 4.8 vs GPT-6 Astra · Claude Opus 4.8 vs Grok 4.5 · Claude Opus 4.8 vs Grok 4.6 · Claude Opus 4.8 vs Kimi K3 · Claude Opus 4.8 vs o3 · Claude Opus 4.8 vs o3-pro · Claude Opus 4.8 vs o4-mini · Claude Opus 4.8 vs Qwen3.8 Max

Também conhecido como / source aliases Ids de registro que representam o mesmo modelo real em outras fontes: anthropic/claude-opus-4.8. Cada id mantém sua própria evidência e página (sem mescla de dados).
Metodologia e fontes Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.