MandAPI Radar · Models

GPT-5.4

Provedor: openai · configuração principal: openai/gpt-5.4#default · configurações avaliadas: default · high — esforços distintos nunca são mesclados

Atualizado em 13/09/2026 03:13 UTC

Preço (snapshot público)

fonte: modelsdev

Entrada

US$ 2,50
US$ por 1M tokens

Saída

US$ 15,00
US$ por 1M tokens

Disponibilidade MandAPI

integração pendente; nenhum valor inventado

Configuração de avaliação

configId: openai/gpt-5.4#default

Nível de raciocínio: default — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

88,9
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Código

35,5
Confiança: Baixa · cobertura 50% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1452,6007 90,40 0,40 2026-09-11 63529
LMArena lmarena:text_style_control:overall 1465,6482 88,90 1,20 2026-09-11 63529
Código — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:webdev:overall 1386,7368 35,55 1,00 2026-09-11 2493

Configuração de avaliação

configId: openai/gpt-5.4#high

Nível de raciocínio: high — esforços diferentes nunca são mesclados; cada configuração tem scores próprios.

Preferência humana

93,9
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Agente

47,7
Confiança: Baixa · cobertura 100% · 1 família(s)
Atualizado em 13/09/2026 01:00 UTC

Intelligence

Confiança: Insuficiente
Sem fonte de raciocínio ingerida nesta fase — o valor nunca é preenchido com estimativa.

Evidência de benchmarks

fonte · valor bruto · valor normalizado · confiança · última atualização
Preferência humana — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:text:overall 1469,5210 93,64 0,40 2026-09-11 60538
LMArena lmarena:text_style_control:overall 1476,3198 93,89 1,20 2026-09-11 60538
Agente — confiança Baixa
FonteBenchmarkValor brutoNormalizado (percentil)PesoÚltima atualizaçãoAmostras/votos
LMArena lmarena:agent:overall 0,0154 47,67 1,00 2026-09-10 3647572

Comparações

somente pares com dados reais publicados

Ainda não há pares de comparação publicados para este modelo.

Metodologia e fontes Cada score é rastreável até a evidência bruta (hash de snapshot). Metodologia · Fontes · Intelligence permanece vazia (Insuficiente) até existir fonte ingerida de raciocínio.