ForecastBench exige cautela ao comparar IA e previsores humanos
17 de setembro de 2026
O ranking do ForecastBench compara modelos a grupos de referência, incluindo superprevisores humanos, e usa um ajuste estatístico por dificuldade para lidar com conjuntos de perguntas diferentes.
Como explicamos ontem, os grupos humanos foram avaliados pela última vez em julho de 2024 e responderam a perguntas diferentes das atribuídas aos modelos posteriores. O ranking serve para acompanhar tendência e orientar testes paralelos em planejamento, risco ou orçamento, não para concluir que a IA já substitui o julgamento humano.
Este destaque faz parte da newsletter Limiar #174: Google Home abre acesso a agentes, Claude ganha Docs e modelos de pesos abertos encurtam a distância
Receba conteúdo direto no seu email
Escolha o que funciona melhor pra você.