Dados abertos do Brasileirão 2026
A classificação, as probabilidades, as projeções, o índice de impacto e o histórico por rodada em JSON e CSV, com a documentação de cada campo e a forma recomendada de citação.
Atualizado após a 25ª rodada · números de 31/08/2026 às 17:30 · fonte conferida a cada 30 minutos
Os arquivos
dados.jsona fotografia completa: clubes, probabilidades, projeções, confrontos e impacto.clubes.csvuma linha por clube, pronta para planilha.confrontos.csvuma linha por jogo em aberto, com a probabilidade de cada resultado.historico.csvuma linha por rodada arquivada e por clube, desde o início da série.
Como citar
Fonte: Modelo ValorFinal - Campeonato Brasileiro Série A 2026, dados após a 25ª rodada (fotografia 2026.R25.6874df9b-244.m1.1.0). valorfinal.com.br/brasileirao
Em texto corrido, "segundo o Modelo ValorFinal" com a rodada resolve. O importante é a rodada aparecer: uma probabilidade sem rodada é uma afirmação que ninguém consegue conferir depois, porque o número muda quando o campeonato anda. Quem quiser precisão total cita o identificador da fotografia, que devolve exatamente os mesmos valores.
Não exigimos link, aprovação prévia nem aviso de uso. Uso comercial está liberado pela licença CC BY 4.0.
Campos de clubes.csv e do bloco de clubes do JSON
| Campo | Tipo | O que é |
|---|---|---|
snapshot | texto | Identificador da fotografia: temporada, rodada de referência, assinatura dos resultados e versão do modelo. Duas linhas com o mesmo snapshot vieram do mesmo cálculo. |
rodada_referencia | inteiro | Maior rodada com pelo menos 80% dos jogos disputados. É onde o campeonato está. |
atualizado_em | data ISO 8601 | Instante da última leitura da fonte de resultados que alimentou esta fotografia. |
code | texto | Identificador do clube no ValorFinal, estável entre temporadas (exemplo: atletico-mg). |
posicao, pontos, jogos, vitorias, empates, derrotas, gols_pro, gols_contra, saldo | inteiro | Classificação real no momento da fotografia, montada dos placares encerrados com os critérios de desempate do regulamento. |
rating | inteiro | Força estimada do clube no estilo Elo, calculada apenas com os resultados desta temporada. Todos começam em 1500. |
prob_titulo, prob_g6, prob_7_a_12, prob_rebaixamento | número, 0 a 100 | Probabilidade de terminar em 1º, entre 1º e 6º, entre 7º e 12º e entre 17º e 20º. São faixas de posição final, não vagas de competição: o número de vagas depende de outras competições que este modelo não simula. |
posicao_projetada, pontos_projetados | inteiro | Mediana da posição e da pontuação final nas simulações. |
posicao_p10, posicao_p90, pontos_p10, pontos_p90 | inteiro | Limites do intervalo típico: em 80% das simulações o resultado ficou entre os dois. |
pontos_esperados_restantes | número | Soma de três vezes a chance de vitória mais uma vez a chance de empate em cada jogo que falta. Conta fechada, sem amostragem. |
incerteza | número, 0 a 1 | Entropia de Shannon da distribuição de posições finais, normalizada. Zero é destino selado, um é tudo em aberto. |
posicoes_provaveis | número | Exponencial da entropia: o número efetivo de posições em que o clube pode terminar. |
dificuldade_calendario | número | Pontos por jogo que um clube médio somaria enfrentando os jogos que faltam a este clube, no mesmo mando. Menor é mais difícil. |
rank_dificuldade | inteiro, 1 a 20 | Posição no ranking de dificuldade do calendário restante. 1 é o calendário mais duro. |
Campos de confrontos.csv
| Campo | Tipo | O que é |
|---|---|---|
jogo_id | texto | Identificador estável da partida na base de origem. |
prob_mandante, prob_empate, prob_visitante | número, 0 a 100 | Probabilidade de cada resultado pelo modelo, com o mando de campo embutido. Conta fechada sobre a distribuição de Poisson, sem amostragem. |
gols_esperados_mandante, gols_esperados_visitante | número | Média da distribuição de Poisson de cada lado. |
impacto_geral, impacto_titulo, impacto_g6, impacto_rebaixamento | número | Índice de Impacto: deslocamento total de probabilidade, em pontos percentuais somados entre os vinte clubes, provocado pelo resultado deste jogo. Só é calculado para os jogos da próxima janela; fica vazio nos demais. |
Campos de historico.csv
O histórico repete os campos de clube com o valor que eles tinham em cada rodada arquivada, mais três campos próprios.
| Campo | Tipo | O que é |
|---|---|---|
rodada | inteiro | Rodada da fotografia arquivada. |
corte_ate | data ISO 8601 | Instante do último jogo que a fotografia conhece. Nenhum resultado posterior a essa data entrou no cálculo. |
origem | texto | publicado quando a fotografia foi registrada enquanto era a atual; reconstruido quando ela foi calculada depois, com o mesmo método e sobre o mesmo corte de resultados. |
Uma rodada arquivada nunca é reescrita. Se a fonte corrigir um placar antigo, a fotografia antiga continua no arquivo do jeito que foi publicada, e é a diferença entre as duas que conta a história.
Notas de uso
Estabilidade dos identificadores. O campo code de cada clube é estável entre temporadas e é a chave recomendada para cruzar dados. O jogo_id é estável dentro da temporada. O campo snapshot muda a cada recálculo e serve para detectar mudança sem comparar o arquivo inteiro.
Probabilidades. Todas vêm em escala de 0 a 100, com duas casas decimais. Valores exatamente 0 ou 100 aparecem nos arquivos quando a contagem da simulação deu isso, e devem ser lidos como "não apareceu na amostra", nunca como impossibilidade ou certeza. Nas páginas, esses casos são escritos como "menos de 0,1%" e "mais de 99,9%" justamente para não afirmar o que o modelo não demonstrou.
Faixas de posição, não vagas. Os campos de probabilidade descrevem faixas de posição final. O número de vagas brasileiras na Libertadores e na Sul-Americana depende de resultados de outras competições, que este modelo não simula.
Reprodutibilidade. Cada arquivo traz a semente e o número de simulações. Sobre a mesma fotografia, refazer a conta devolve exatamente os mesmos valores. A metodologia descreve o método inteiro, e a página de desempenho mede o quanto ele acerta.
Cabeçalho comum. Todo arquivo repete, em cada linha ou no topo do JSON, o snapshot, a temporada, a rodada de referência e a data da última leitura da fonte. Isso deixa cada linha auto-suficiente: um recorte copiado para outro lugar continua carregando de onde veio.
O que não é publicado
Não existe endpoint de dado bruto de terceiros aqui. O calendário e os placares vêm de uma base pública de dados esportivos sob licença própria, e redistribuir aquele acervo não é nosso direito. O que este site publica é o que ele produz: a classificação montada por nós, as probabilidades do modelo, as projeções e os índices derivados.
Também não são publicados dados de jogadores, escalações ou estatísticas de partida, porque o ValorFinal não coleta nem produz esse tipo de informação. Publicar número que não se produz é a forma mais rápida de perder a confiança de quem cita.
Continue por aqui
Perguntas frequentes
Posso usar esses dados em uma matéria, num trabalho acadêmico ou num site?
Pode. Os arquivos são publicados sob licença CC BY 4.0, que permite uso, adaptação e redistribuição, inclusive comercial, desde que a fonte seja creditada. O crédito pedido é curto: o nome do modelo, a competição, a temporada e a rodada dos dados. Não pedimos link obrigatório, aprovação prévia nem aviso de uso.
Com que frequência os arquivos mudam?
Eles mudam junto com as páginas: quando um resultado novo entra, quando um jogo é remarcado ou quando o dia vira. Entre uma coisa e outra, o conteúdo é idêntico, byte a byte, e o campo snapshot é o mesmo. Se o seu programa guarda o snapshot da última leitura, dá para saber se algo mudou sem reprocessar nada.
Existe um limite de requisições?
Existe um limite por endereço de IP para evitar abuso, generoso para uso normal. Um programa que baixa os arquivos algumas vezes por hora nunca esbarra nele. Para reprocessamento em massa, o caminho eficiente é ler o histórico completo uma vez e depois acompanhar só o snapshot atual.
Por que o CSV usa ponto decimal e não vírgula?
Porque o público do arquivo é programático. Vírgula decimal junto com vírgula separadora exige configuração extra em quase toda ferramenta e é uma fonte clássica de erro silencioso de leitura. As páginas continuam mostrando tudo em português, com vírgula decimal; os arquivos seguem a convenção de dados.
As probabilidades de Libertadores são de vaga ou de posição?
De posição, e o nome do campo diz isso. O campo prob_g6 é a probabilidade de terminar entre o 1º e o 6º lugar. O número de vagas do Brasil na Libertadores pode mudar conforme resultados de outras competições, que este modelo não simula, então publicar aquilo como probabilidade de vaga seria impreciso.
Os dados incluem resultados de jogos e escalações?
Incluem os placares encerrados, dentro da classificação e do histórico, e o calendário dos jogos em aberto com a probabilidade de cada resultado. Escalação, estatística de partida e dado de jogador não fazem parte: o ValorFinal não coleta esse tipo de informação e não publicaria número que não produz.
Fotografia 2026.R25.6874df9b-244.m1.1.0Modelo ValorFinal 1.1.0Amostra 20.000 campeonatosCalculada em 31/08/2026 às 17:53 Metodologia · Dados abertos