MandAPI Radar · Models

GPT-5.1

Provedor: openai · configuração principal: openai/gpt-5.1#default · configurações avaliadas: default · high · medium — esforços distintos nunca são mesclados

Atualizado em 13/09/2026 03:13 UTC

Preço (snapshot público)

fonte: modelsdev

Entrada

US$ 1,25
US$ por 1M tokens

Saída

US$ 10,00
US$ por 1M tokens

Disponibilidade MandAPI

integração pendente; nenhum valor inventado

Configuração de avaliação

configId: openai/gpt-5.1#default

Nível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

78,9
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

23,0
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1422,5526 75,69 0,40 2026-09-11 42992
LMArena lmarena:text_style_control:overall 1438,9632 78,93 1,20 2026-09-11 42992
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1340,9030 23,05 1,00 2026-09-11 10326

Configuração de avaliação

configId: openai/gpt-5.1#high

Nível de raciocínio: high — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

84,2
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1441,7970 84,66 0,40 2026-09-11 40277
LMArena lmarena:text_style_control:overall 1455,0450 84,16 1,20 2026-09-11 40277

Configuração de avaliação

configId: openai/gpt-5.1#medium

Nível de raciocínio: medium — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Código

37,9
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1392,0298 37,89 1,00 2026-09-11 4751

Comparações

somente pares com dados reais publicados

Ainda não há pares de comparação publicados para este modelo.

Metodologia e fontes Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.