MandAPI Radar · Models
Atualizado em 13/09/2026 03:13 UTC
GPT-5.1
Provedor: openai · configuração principal: openai/gpt-5.1#default · configurações avaliadas: default · high · medium — esforços distintos nunca são mesclados
Preço (snapshot público)
fonte: modelsdevEntrada
US$ 1,25
Saída
US$ 10,00
Disponibilidade MandAPI
—
Configuração de avaliação
configId:openai/gpt-5.1#defaultNível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.
Preferência humana
78,9
Código
23,0
Intelligence
—
Evidência de benchmarks
fonte · valor bruto · valor normalizado · confiança · última atualizaçãoPreferência humana — confiança Baixa
| Fonte | Benchmark | Valor bruto | Normalizado (percentil) | Peso | Última atualização | Amostras/votos |
|---|---|---|---|---|---|---|
| LMArena | lmarena:text:overall | 1422,5526 | 75,69 | 0,40 | 2026-09-11 | 42992 |
| LMArena | lmarena:text_style_control:overall | 1438,9632 | 78,93 | 1,20 | 2026-09-11 | 42992 |
Código — confiança Baixa
| Fonte | Benchmark | Valor bruto | Normalizado (percentil) | Peso | Última atualização | Amostras/votos |
|---|---|---|---|---|---|---|
| LMArena | lmarena:webdev:overall | 1340,9030 | 23,05 | 1,00 | 2026-09-11 | 10326 |
Configuração de avaliação
configId:openai/gpt-5.1#highNível de raciocínio: high — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.
Preferência humana
84,2
Intelligence
—
Evidência de benchmarks
fonte · valor bruto · valor normalizado · confiança · última atualizaçãoPreferência humana — confiança Baixa
| Fonte | Benchmark | Valor bruto | Normalizado (percentil) | Peso | Última atualização | Amostras/votos |
|---|---|---|---|---|---|---|
| LMArena | lmarena:text:overall | 1441,7970 | 84,66 | 0,40 | 2026-09-11 | 40277 |
| LMArena | lmarena:text_style_control:overall | 1455,0450 | 84,16 | 1,20 | 2026-09-11 | 40277 |
Configuração de avaliação
configId:openai/gpt-5.1#mediumNível de raciocínio: medium — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.
Código
37,9
Intelligence
—
Evidência de benchmarks
fonte · valor bruto · valor normalizado · confiança · última atualizaçãoCódigo — confiança Baixa
| Fonte | Benchmark | Valor bruto | Normalizado (percentil) | Peso | Última atualização | Amostras/votos |
|---|---|---|---|---|---|---|
| LMArena | lmarena:webdev:overall | 1392,0298 | 37,89 | 1,00 | 2026-09-11 | 4751 |
Comparações
somente pares com dados reais publicadosAinda não há pares de comparação publicados para este modelo.
Metodologia e fontes
Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.
