ValorFinal

Dados abertos do Brasileirão 2026

A classificação, as probabilidades, as projeções, o índice de impacto e o histórico por rodada em JSON e CSV, com a documentação de cada campo e a forma recomendada de citação.

Atualizado após a 25ª rodada · números de 31/08/2026 às 17:30 · fonte conferida a cada 30 minutos

Os arquivos

LicençaCC BY 4.0uso livre com crédito
Fotografia atual25ª2026.R25.6874df9b-244.m1.1.0
Rodadas no histórico18fotografias preservadas
Confrontos em aberto136com probabilidade calculada

Como citar

Formato recomendado

Fonte: Modelo ValorFinal - Campeonato Brasileiro Série A 2026, dados após a 25ª rodada (fotografia 2026.R25.6874df9b-244.m1.1.0). valorfinal.com.br/brasileirao

Em texto corrido, "segundo o Modelo ValorFinal" com a rodada resolve. O importante é a rodada aparecer: uma probabilidade sem rodada é uma afirmação que ninguém consegue conferir depois, porque o número muda quando o campeonato anda. Quem quiser precisão total cita o identificador da fotografia, que devolve exatamente os mesmos valores.

Não exigimos link, aprovação prévia nem aviso de uso. Uso comercial está liberado pela licença CC BY 4.0.

Campos de clubes.csv e do bloco de clubes do JSON

CampoTipoO que é
snapshottextoIdentificador da fotografia: temporada, rodada de referência, assinatura dos resultados e versão do modelo. Duas linhas com o mesmo snapshot vieram do mesmo cálculo.
rodada_referenciainteiroMaior rodada com pelo menos 80% dos jogos disputados. É onde o campeonato está.
atualizado_emdata ISO 8601Instante da última leitura da fonte de resultados que alimentou esta fotografia.
codetextoIdentificador do clube no ValorFinal, estável entre temporadas (exemplo: atletico-mg).
posicao, pontos, jogos, vitorias, empates, derrotas, gols_pro, gols_contra, saldointeiroClassificação real no momento da fotografia, montada dos placares encerrados com os critérios de desempate do regulamento.
ratinginteiroForça estimada do clube no estilo Elo, calculada apenas com os resultados desta temporada. Todos começam em 1500.
prob_titulo, prob_g6, prob_7_a_12, prob_rebaixamentonúmero, 0 a 100Probabilidade de terminar em 1º, entre 1º e 6º, entre 7º e 12º e entre 17º e 20º. São faixas de posição final, não vagas de competição: o número de vagas depende de outras competições que este modelo não simula.
posicao_projetada, pontos_projetadosinteiroMediana da posição e da pontuação final nas simulações.
posicao_p10, posicao_p90, pontos_p10, pontos_p90inteiroLimites do intervalo típico: em 80% das simulações o resultado ficou entre os dois.
pontos_esperados_restantesnúmeroSoma de três vezes a chance de vitória mais uma vez a chance de empate em cada jogo que falta. Conta fechada, sem amostragem.
incertezanúmero, 0 a 1Entropia de Shannon da distribuição de posições finais, normalizada. Zero é destino selado, um é tudo em aberto.
posicoes_provaveisnúmeroExponencial da entropia: o número efetivo de posições em que o clube pode terminar.
dificuldade_calendarionúmeroPontos por jogo que um clube médio somaria enfrentando os jogos que faltam a este clube, no mesmo mando. Menor é mais difícil.
rank_dificuldadeinteiro, 1 a 20Posição no ranking de dificuldade do calendário restante. 1 é o calendário mais duro.

Campos de confrontos.csv

CampoTipoO que é
jogo_idtextoIdentificador estável da partida na base de origem.
prob_mandante, prob_empate, prob_visitantenúmero, 0 a 100Probabilidade de cada resultado pelo modelo, com o mando de campo embutido. Conta fechada sobre a distribuição de Poisson, sem amostragem.
gols_esperados_mandante, gols_esperados_visitantenúmeroMédia da distribuição de Poisson de cada lado.
impacto_geral, impacto_titulo, impacto_g6, impacto_rebaixamentonúmeroÍndice de Impacto: deslocamento total de probabilidade, em pontos percentuais somados entre os vinte clubes, provocado pelo resultado deste jogo. Só é calculado para os jogos da próxima janela; fica vazio nos demais.

Campos de historico.csv

O histórico repete os campos de clube com o valor que eles tinham em cada rodada arquivada, mais três campos próprios.

CampoTipoO que é
rodadainteiroRodada da fotografia arquivada.
corte_atedata ISO 8601Instante do último jogo que a fotografia conhece. Nenhum resultado posterior a essa data entrou no cálculo.
origemtextopublicado quando a fotografia foi registrada enquanto era a atual; reconstruido quando ela foi calculada depois, com o mesmo método e sobre o mesmo corte de resultados.

Uma rodada arquivada nunca é reescrita. Se a fonte corrigir um placar antigo, a fotografia antiga continua no arquivo do jeito que foi publicada, e é a diferença entre as duas que conta a história.

Notas de uso

Estabilidade dos identificadores. O campo code de cada clube é estável entre temporadas e é a chave recomendada para cruzar dados. O jogo_id é estável dentro da temporada. O campo snapshot muda a cada recálculo e serve para detectar mudança sem comparar o arquivo inteiro.

Probabilidades. Todas vêm em escala de 0 a 100, com duas casas decimais. Valores exatamente 0 ou 100 aparecem nos arquivos quando a contagem da simulação deu isso, e devem ser lidos como "não apareceu na amostra", nunca como impossibilidade ou certeza. Nas páginas, esses casos são escritos como "menos de 0,1%" e "mais de 99,9%" justamente para não afirmar o que o modelo não demonstrou.

Faixas de posição, não vagas. Os campos de probabilidade descrevem faixas de posição final. O número de vagas brasileiras na Libertadores e na Sul-Americana depende de resultados de outras competições, que este modelo não simula.

Reprodutibilidade. Cada arquivo traz a semente e o número de simulações. Sobre a mesma fotografia, refazer a conta devolve exatamente os mesmos valores. A metodologia descreve o método inteiro, e a página de desempenho mede o quanto ele acerta.

Cabeçalho comum. Todo arquivo repete, em cada linha ou no topo do JSON, o snapshot, a temporada, a rodada de referência e a data da última leitura da fonte. Isso deixa cada linha auto-suficiente: um recorte copiado para outro lugar continua carregando de onde veio.

O que não é publicado

Não existe endpoint de dado bruto de terceiros aqui. O calendário e os placares vêm de uma base pública de dados esportivos sob licença própria, e redistribuir aquele acervo não é nosso direito. O que este site publica é o que ele produz: a classificação montada por nós, as probabilidades do modelo, as projeções e os índices derivados.

Também não são publicados dados de jogadores, escalações ou estatísticas de partida, porque o ValorFinal não coleta nem produz esse tipo de informação. Publicar número que não se produz é a forma mais rápida de perder a confiança de quem cita.

Continue por aqui

Perguntas frequentes

Posso usar esses dados em uma matéria, num trabalho acadêmico ou num site?

Pode. Os arquivos são publicados sob licença CC BY 4.0, que permite uso, adaptação e redistribuição, inclusive comercial, desde que a fonte seja creditada. O crédito pedido é curto: o nome do modelo, a competição, a temporada e a rodada dos dados. Não pedimos link obrigatório, aprovação prévia nem aviso de uso.

Com que frequência os arquivos mudam?

Eles mudam junto com as páginas: quando um resultado novo entra, quando um jogo é remarcado ou quando o dia vira. Entre uma coisa e outra, o conteúdo é idêntico, byte a byte, e o campo snapshot é o mesmo. Se o seu programa guarda o snapshot da última leitura, dá para saber se algo mudou sem reprocessar nada.

Existe um limite de requisições?

Existe um limite por endereço de IP para evitar abuso, generoso para uso normal. Um programa que baixa os arquivos algumas vezes por hora nunca esbarra nele. Para reprocessamento em massa, o caminho eficiente é ler o histórico completo uma vez e depois acompanhar só o snapshot atual.

Por que o CSV usa ponto decimal e não vírgula?

Porque o público do arquivo é programático. Vírgula decimal junto com vírgula separadora exige configuração extra em quase toda ferramenta e é uma fonte clássica de erro silencioso de leitura. As páginas continuam mostrando tudo em português, com vírgula decimal; os arquivos seguem a convenção de dados.

As probabilidades de Libertadores são de vaga ou de posição?

De posição, e o nome do campo diz isso. O campo prob_g6 é a probabilidade de terminar entre o 1º e o 6º lugar. O número de vagas do Brasil na Libertadores pode mudar conforme resultados de outras competições, que este modelo não simula, então publicar aquilo como probabilidade de vaga seria impreciso.

Os dados incluem resultados de jogos e escalações?

Incluem os placares encerrados, dentro da classificação e do histórico, e o calendário dos jogos em aberto com a probabilidade de cada resultado. Escalação, estatística de partida e dado de jogador não fazem parte: o ValorFinal não coleta esse tipo de informação e não publicaria número que não produz.

Fotografia 2026.R25.6874df9b-244.m1.1.0Modelo ValorFinal 1.1.0Amostra 20.000 campeonatosCalculada em 31/08/2026 às 17:53 Metodologia · Dados abertos