Ir para o conteúdo principal

Fontes e Metodologia

Esta página explica, em linguagem acessível, de onde vêm os dados utilizados na área de Dados Abertos, como são tratados e quais são as limitações dos indicadores.

Como os dados chegam até você

Pesquisa, Inteligência Judicial e Comparador | STJ

  1. 1Dados públicos do STJ (decisões e acórdãos do Diário da Justiça) são obtidos na fonte oficial.
  2. 2Ingestão: os documentos são coletados por rotinas de sincronização da plataforma.
  3. 3Normalização: campos como classe, ministro relator, órgão julgador e resultado são padronizados.
  4. 4Armazenamento: o conteúdo é guardado em um banco PostgreSQL dedicado a esses dados públicos.
  5. 5Indexação: cada decisão recebe um índice de busca textual (full-text search, tolerante a variações de escrita) e um vetor semântico (embedding) que captura o significado do texto.
  6. 6Uso: os mesmos dados alimentam a Pesquisa, a Inteligência Judicial (Jurimetria) e o Comparador de Casos.
  7. 7IA explicativa: quando aplicável (síntese analítica e comparação de casos), modelos de linguagem interpretam os números e textos já recuperados. Os dados originais não são alterados.

Busca Nacional | DataJud

  1. 1O usuário informa o tribunal e, opcionalmente, classes processuais, assuntos, órgão julgador e período de ajuizamento.
  2. 2O Estag.ia valida os filtros aceitos pela Busca Nacional e rejeita parâmetros não previstos.
  3. 3A consulta entra na infraestrutura compartilhada de fila e limitação de requisições ao DataJud.
  4. 4O backend consulta sob demanda a API Pública DataJud do Conselho Nacional de Justiça.
  5. 5A resposta é normalizada pelo mesmo serviço usado na Busca Nacional autenticada.
  6. 6Os metadados processuais são apresentados ao usuário e não geram histórico ou monitoramento.
  7. 7A fonte permanece identificada como CNJ/DataJud e os dados originais não são alterados.

A Busca Nacional consulta a fonte pública sob demanda. Esse fluxo não faz ingestão permanente, vetorização nem análise por inteligência artificial dos metadados retornados pelo DataJud.

Fontes de dados

Superior Tribunal de Justiça (STJ)

Dataset:
Íntegras de Decisões Terminativas e Acórdãos do Diário da Justiça.
Organização responsável:
Superior Tribunal de Justiça.
Conteúdo utilizado:
texto integral das decisões.
Licença:
Creative Commons Atribuição, conforme o catálogo oficial.
Periodicidade de verificação:
diária. A data mais recente disponível depende da publicação dos arquivos pelo STJ.
Uso:
fonte principal da Pesquisa, da Inteligência Judicial e do Comparador. Cada decisão exibida pode ser conferida na fonte oficial.

Conselho Nacional de Justiça (CNJ) | DataJud

Fonte: Conselho Nacional de Justiça (CNJ), Base Nacional de Dados do Poder Judiciário (DataJud).

Organização responsável:
Conselho Nacional de Justiça.
Fonte:
Base Nacional de Dados do Poder Judiciário (DataJud).
Informações utilizadas:
número do processo, tribunal, classe processual, assuntos, órgão julgador e data de ajuizamento.
Tribunais consultáveis:
os aliases oficiais disponibilizados pela API Pública DataJud e listados na interface.
Forma de consulta:
sob demanda, a partir dos filtros informados pelo usuário, por meio do backend do Estag.ia e da infraestrutura compartilhada de fila e rate limit.
Atualização:
depende das remessas dos tribunais de origem e da disponibilidade da infraestrutura do CNJ.
Tratamento:
o Estag.ia valida a consulta, normaliza a resposta para exibição e não altera os dados originais.
Limitações:
os metadados podem apresentar atrasos, lacunas ou inconsistências decorrentes das informações remetidas pelos tribunais de origem.

Banco Central do Brasil

1. Cadastro Selic - Taxa Selic

Organização responsável:
Banco Central do Brasil (BCB), Departamento de Operações do Mercado Aberto (Demab).
Licença:
Open Data Commons Open Database License (ODbL), conforme o catálogo oficial.
Forma de acesso:
consulta à função OData oficial recuperarCotacaoPublicaByFiltro, pelo backend do Estag.ia, com validação do payload e cache. Consulte a documentação oficial da API.
Dado exibido:
último valor válido disponível no período consultado, preservando a unidade informada pela própria fonte.
Atualização:
conforme disponibilidade da fonte oficial; o Estag.ia mantém cache fresco por 6 horas e identifica quando precisa apresentar o último valor válido previamente consultado.
Uso:
bloco “Fator diário da Taxa Selic - último valor disponível” na Visão Geral pública.

2. SGS 4390 - Taxa de juros - Selic acumulada no mês (%)

Série:
SGS 4390: Selic acumulada no mês (%).
Organização responsável:
Banco Central do Brasil.
Licença:
Open Data Commons Open Database License (ODbL), conforme o catálogo oficial.
Forma de acesso:
JSON via API oficial SGS.
Atualização:
mensal, conforme publicação do BCB.
Uso:
consumida pela plataforma nas ferramentas de juros e correção monetária; nesta área pública, alimenta a tabela de registros recentes e a calculadora demonstrativa com memória mensal.
Método da calculadora:
capitalização composta das taxas mensais integrais retornadas pela série, sem rateio proporcional dentro de cada mês. O resultado é informativo e não substitui a metodologia aplicável a um caso específico.
Carregando cobertura e atualização das fontes…

Como funciona a pesquisa e a comparação

Busca por palavra-chave (textual): procura as palavras informadas nos campos pesquisáveis das decisões, ignorando acentos e variações de escrita. Os resultados são ordenados por relevância textual.

Busca semântica (por significado): cada decisão foi transformada em um vetor numérico (embedding) que representa seu significado. A busca converte a consulta em vetor e calcula a proximidade por similaridade de cosseno, recuperando as decisões com significado mais próximo, mesmo sem as palavras exatas.

Relevância semântica: medida de proximidade de significado entre o texto pesquisado (ou o caso descrito) e a decisão recuperada, calculada por meio de embeddings e similaridade de cosseno. Quanto maior o percentual, maior a proximidade semântica entre os textos. O indicador não representa probabilidade de êxito nem equivalência jurídica entre os casos.

Aderência jurídica: combina uma análise qualitativa assistida por IA, responsável por identificar pontos comuns, divergências e aplicabilidade, com um cálculo matemático determinístico que produz o indicador exibido. O score busca diferenciar mera proximidade textual de correspondência fática e jurídica mais relevante, sendo um indicador distinto da relevância semântica. Não representa probabilidade de resultado.

Classificação relativa no Comparador: a classificação exibida como Convergente, Divergente ou Neutro é gerada por IA e considera como o entendimento do precedente se relaciona com a pretensão descrita pelo usuário. Ela não corresponde necessariamente ao resultado processual original da decisão no STJ e não representa previsão do caso informado.

Diferenças relevantes (distinguishing): comparação que identifica pontos materialmente comuns e divergentes entre o caso informado e o precedente, ajudando a verificar em que medida o entendimento pode ou não ser aplicável ao contexto analisado. A comparação não prevê o resultado do caso.

Validação da comparação pública: a área pública utiliza instruções exclusivas e uma resposta estruturada com evidências e lacunas antes da classificação. Se a saída introduzir previsão, aconselhamento, fatos implícitos ou referências ausentes das fontes fornecidas, o precedente recebe uma classificação neutra e orientação para conferência na decisão oficial.

Cálculo dos indicadores

Categorias de resultado: os indicadores utilizam o campo categórico de resultado disponibilizado nos metadados oficiais do STJ. O Estag.ia realiza um mapeamento determinístico desses valores para quatro categorias analíticas: Provido, Negado, Não conhecido e Outros. Resultados de provimento parcial são atualmente incluídos na categoria Provido, acompanhando a classificação categórica disponibilizada pela fonte.

Taxa de provimento observada: proporção entre decisões classificadas como providas e o total de decisões da amostra analisada, multiplicada por 100.

Distribuição dos resultados observados: apresenta separadamente Provido, Negado, Não conhecido e Outros. Nenhuma categoria ou taxa é inferida por complemento. Outros contém somente registros classificados como OUTROS na base analítica.

Filtro de assunto / área temática: embora os metadados do STJ também contenham códigos de assuntos vinculados à TPU/CNJ, o filtro de assunto utilizado neste painel realiza atualmente correspondência textual nos campos pesquisáveis das decisões.

Duração: diferença observada entre a data de distribuição e a data de julgamento, considerando apenas registros com ambas as datas disponíveis e válidas. Os resultados são agrupados em 0–6 meses, 6–12 meses, 1–2 anos e 2+ anos.

Menções expressas a súmulas: contabiliza menções expressas às Súmulas 7, 83, 182 e 211 nas decisões classificadas como negadas ou não conhecidas. A presença da referência não permite, isoladamente, afirmar que a Súmula tenha causado o resultado.

Tendência temporal: calcula mensalmente a proporção de decisões providas no respectivo período, permitindo observar a evolução histórica da taxa de provimento. O indicador não realiza projeções futuras.

Por Ministro Relator: apresenta os 10 relatores com maiores amostras no recorte selecionado. A taxa de provimento de cada relator corresponde à divisão entre decisões providas e o total de decisões atribuídas a ele na amostra.

Órgãos julgadores: Compara a taxa de provimento observada entre órgãos com mais de 10 decisões no recorte selecionado. São considerados até 10 órgãos com maior volume de decisões, apresentados na interface conforme a taxa de provimento observada.

Classe recursal: calcula a proporção entre decisões providas e o total de cada classe. Em todos os recortes, são consideradas somente classes com mais de 10 decisões. A interface apresenta até 8 classes.

Síntese Analítica: a inteligência artificial recebe os indicadores já calculados e produz uma explicação descritiva do recorte. A IA não calcula, modifica ou substitui as métricas estatísticas exibidas no painel. A resposta passa por uma validação textual exclusiva da área pública. Se a revisão ainda não atender às limitações metodológicas, a interface exibe uma síntese descritiva determinística produzida com os mesmos indicadores já calculados.

Diferença entre estatística observada e previsão: todos os indicadores desta área descrevem o que aconteceu na amostra analisada. Eles não permitem prever o resultado de um processo específico.

Nota Metodológica: Todos os indicadores estatísticos exibidos na Inteligência Judicial da área Dados Abertos utilizam as mesmas regras de negócio e cálculos determinísticos da Inteligência Judicial do Estag.ia. A inteligência artificial é utilizada apenas para interpretação explicativa desses resultados e não para geração das estatísticas exibidas.

Limitações e papel da IA

Amostra: os indicadores refletem apenas as decisões públicas indexadas pela plataforma no período selecionado, e não a totalidade dos processos do tribunal.

Papel da IA: na Inteligência Judicial e no Comparador, a IA é usada de forma explicativa para interpretar métricas e comparar textos. Ela não decide o que é exibido no banco de dados nem altera o conteúdo das decisões.

Possibilidade de erro: análises geradas por IA podem conter imprecisões. Use os resultados como ponto de partida e confirme sempre na fonte oficial.

Auditoria pela fonte oficial: As decisões e precedentes exibidos podem ser conferidos individualmente no SCON do STJ.

Privacidade no Comparador: o texto descrito anonimamente não é salvo, não gera histórico e não é associado a você. Ele existe apenas durante o processamento da sua consulta.

Privacidade na Busca Nacional: os filtros e resultados do job público permanecem apenas pelo tempo técnico necessário ao processamento e à consulta do resultado. Eles não são associados a usuário ou workspace, não criam monitor e não geram histórico na aplicação.

Limitações do DataJud: a disponibilidade, cobertura e atualização dos metadados dependem da API Pública DataJud e das remessas dos tribunais de origem ao CNJ. Eventuais inconsistências de datas ou campos podem refletir os dados recebidos pela fonte pública.

Quer explorar os dados? Volte para a visão geral ou conheça o Estag.ia completo.