Metodologia e governança
Como o Prisma lê os dados, quais fontes usa e quais limites cada análise tem.
Fontes
| Dado | Fonte oficial | Atualização |
|---|---|---|
| Resultados por Brasil, estado e município | Tribunal Superior Eleitoral, divulgação oficial de resultados | Contínua durante a apuração |
| População, PIB e valor adicionado por setor | IBGE, SIDRA (tabelas 6579 e 5938) | Anual |
| Inflação acumulada em 12 meses, geral e alimentos | IBGE, IPCA por área de pesquisa (tabela 7060) | Mensal |
| Séries macroeconômicas de contexto | Banco Central, SGS | Mensal |
| Cota-parte do FPM e receita corrente líquida | Tesouro Nacional, SICONFI (RREO, Anexo 3) | Bimestral |
| Famílias no Bolsa Família | CGU, Portal da Transparência, ou MDS | Mensal |
| Saldo de empregos formais e IDHM | Novo CAGED (MTE) e Atlas Brasil, importados por planilha | Conforme publicação |
Índice de Vulnerabilidade Econômica
Cada município recebe uma posição de 0 a 100 em quatro dimensões: dependência do Bolsa Família (famílias atendidas sobre o número estimado de famílias), renda (PIB per capita, invertido), emprego formal (saldo do CAGED por mil habitantes, invertido) e inflação de alimentos em 12 meses. O índice é a média ponderada dessas posições; quando um componente não está disponível, os pesos são redistribuídos entre os demais e o fato é registrado. Os municípios são agrupados em quintis.
Transferência de votos
Antes do 2º turno não existe dado individual sobre para onde vai o eleitor de quem foi eliminado. O Prisma usa uma leitura ecológica: mede, entre os municípios, o quanto a votação de cada eliminado se parece com a de cada finalista, inclusive dentro de cada faixa de vulnerabilidade econômica. Eleitorados territorialmente parecidos tendem a convergir. Uma fração configurável é tratada como vazamento para branco, nulo ou abstenção. O resultado é apresentado como faixa de cenários com nível de confiança, nunca como número único.
Base histórica e ensemble
O Prisma também mede como os eleitorados se moveram entre o 1º e o 2º turno em 2018 e 2022, com dados abertos do TSE por município. A estimação é uma inferência ecológica RxC por mínimos quadrados com restrições (cada linha da matriz soma 100% e não tem valores negativos), feita separadamente em cada estado para reduzir o viés de agregação. Cada candidatura de 2026 herda as transições de candidaturas históricas cujo voto se distribuiu pelo território de forma parecida, medida pela correlação entre os municípios, sem classificação ideológica. Os dois modelos, afinidade e histórico, foram testados prevendo o 2º turno de 2022 a partir do 1º turno; o cenário final combina os dois com pesos proporcionais ao inverso do erro de cada um nesse teste.
Aprendizado de máquina
Modelos de Gradient Boosting e Random Forest foram treinados com 2018 e testados em 2022. Ambos erraram mais do que as alternativas simples: com só duas eleições presidenciais comparáveis, aprendem particularidades de cada pleito em vez de padrões gerais. Por isso não são usados. Entraram dois elementos que passaram no teste nos dois sentidos: a probabilidade de cada município trocar de líder entre os turnos, estimada pela margem do 1º turno, e a assimetria histórica do líder do 1º turno, usada apenas para ampliar a faixa de incerteza.
Projeção de fechamento
A ordem de totalização das seções não é aleatória, por isso o Prisma não extrapola a curva da apuração. Cada município projeta o próprio eleitorado ainda não apurado com o comportamento já observado nele; os que ainda não começaram herdam o comportamento de municípios semelhantes do mesmo estado.
Uso de inteligência artificial
Os textos do Termômetro, do Radar, do Parecer cidadão e do Dossiê são redigidos por um modelo de linguagem que recebe apenas os números calculados pela plataforma, com regras fixas: isenção partidária, nenhum dado externo, nenhuma previsão categórica e distinção explícita entre correlação e causa. Cada texto é registrado com modelo, horário e assinatura dos dados de entrada. Sem o serviço de IA, a plataforma publica textos automáticos montados diretamente dos dados.
Governança e neutralidade
A plataforma trata todas as candidaturas com os mesmos métodos. As cores seguem a ordem do número de urna, sem relação com identidade partidária. A análise sob a ótica de uma candidatura, na área restrita, funciona de forma simétrica para qualquer finalista. Projeções ficam restritas à área de coordenação até validação jurídica. Não há coleta nem tratamento de dados pessoais de eleitores: todos os dados são públicos e agregados por território.
Limites
Associação estatística entre economia e voto não demonstra causa. Inferências ecológicas descrevem territórios, não indivíduos. Indicadores têm defasagens distintas: o valor adicionado por setor do IBGE, por exemplo, é publicado com cerca de três anos de atraso.