Fontes e Metodologia
Esta página explica, em linguagem acessível, de onde vêm os dados utilizados na área de Dados Abertos, como são tratados e quais são as limitações dos indicadores.
Como os dados chegam até você
Pesquisa, Inteligência Judicial e Comparador | STJ
- 1Dados públicos do STJ (decisões e acórdãos do Diário da Justiça) são obtidos na fonte oficial.
- 2Ingestão: os documentos são coletados por rotinas de sincronização da plataforma.
- 3Normalização: campos como classe, ministro relator, órgão julgador e resultado são padronizados.
- 4Armazenamento: o conteúdo é guardado em um banco PostgreSQL dedicado a esses dados públicos.
- 5Indexação: cada decisão recebe um índice de busca textual (full-text search, tolerante a variações de escrita) e um vetor semântico (embedding) que captura o significado do texto.
- 6Uso: os mesmos dados alimentam a Pesquisa, a Inteligência Judicial (Jurimetria) e o Comparador de Casos.
- 7IA explicativa: quando aplicável (síntese analítica e comparação de casos), modelos de linguagem interpretam os números e textos já recuperados. Os dados originais não são alterados.
Busca Nacional | DataJud
- 1O usuário informa o tribunal e, opcionalmente, classes processuais, assuntos, órgão julgador e período de ajuizamento.
- 2O Estag.ia valida os filtros aceitos pela Busca Nacional e rejeita parâmetros não previstos.
- 3A consulta entra na infraestrutura compartilhada de fila e limitação de requisições ao DataJud.
- 4O backend consulta sob demanda a API Pública DataJud do Conselho Nacional de Justiça.
- 5A resposta é normalizada pelo mesmo serviço usado na Busca Nacional autenticada.
- 6Os metadados processuais são apresentados ao usuário e não geram histórico ou monitoramento.
- 7A fonte permanece identificada como CNJ/DataJud e os dados originais não são alterados.
A Busca Nacional consulta a fonte pública sob demanda. Esse fluxo não faz ingestão permanente, vetorização nem análise por inteligência artificial dos metadados retornados pelo DataJud.
Fontes de dados
Superior Tribunal de Justiça (STJ)
- Dataset:
- Íntegras de Decisões Terminativas e Acórdãos do Diário da Justiça.
- Organização responsável:
- Superior Tribunal de Justiça.
- Catálogo:
- Portal de Dados Abertos do STJ.
- Consulta oficial:
- SCON: Sistema de Consulta de Decisões do STJ.
- Conteúdo utilizado:
- texto integral das decisões.
- Licença:
- Creative Commons Atribuição, conforme o catálogo oficial.
- Periodicidade de verificação:
- diária. A data mais recente disponível depende da publicação dos arquivos pelo STJ.
- Uso:
- fonte principal da Pesquisa, da Inteligência Judicial e do Comparador. Cada decisão exibida pode ser conferida na fonte oficial.
Conselho Nacional de Justiça (CNJ) | DataJud
Fonte: Conselho Nacional de Justiça (CNJ), Base Nacional de Dados do Poder Judiciário (DataJud).
- Organização responsável:
- Conselho Nacional de Justiça.
- Fonte:
- Base Nacional de Dados do Poder Judiciário (DataJud).
- API pública:
- documentação oficial CNJ/DataJud.
- Informações utilizadas:
- número do processo, tribunal, classe processual, assuntos, órgão julgador e data de ajuizamento.
- Tribunais consultáveis:
- os aliases oficiais disponibilizados pela API Pública DataJud e listados na interface.
- Forma de consulta:
- sob demanda, a partir dos filtros informados pelo usuário, por meio do backend do Estag.ia e da infraestrutura compartilhada de fila e rate limit.
- Atualização:
- depende das remessas dos tribunais de origem e da disponibilidade da infraestrutura do CNJ.
- Tratamento:
- o Estag.ia valida a consulta, normaliza a resposta para exibição e não altera os dados originais.
- Limitações:
- os metadados podem apresentar atrasos, lacunas ou inconsistências decorrentes das informações remetidas pelos tribunais de origem.
Banco Central do Brasil
1. Cadastro Selic - Taxa Selic
- Organização responsável:
- Banco Central do Brasil (BCB), Departamento de Operações do Mercado Aberto (Demab).
- Licença:
- Open Data Commons Open Database License (ODbL), conforme o catálogo oficial.
- Forma de acesso:
- consulta à função OData oficial
recuperarCotacaoPublicaByFiltro, pelo backend do Estag.ia, com validação do payload e cache. Consulte a documentação oficial da API. - Dado exibido:
- último valor válido disponível no período consultado, preservando a unidade informada pela própria fonte.
- Atualização:
- conforme disponibilidade da fonte oficial; o Estag.ia mantém cache fresco por 6 horas e identifica quando precisa apresentar o último valor válido previamente consultado.
- Uso:
- bloco “Fator diário da Taxa Selic - último valor disponível” na Visão Geral pública.
2. SGS 4390 - Taxa de juros - Selic acumulada no mês (%)
- Série:
- SGS 4390: Selic acumulada no mês (%).
- Organização responsável:
- Banco Central do Brasil.
- Licença:
- Open Data Commons Open Database License (ODbL), conforme o catálogo oficial.
- Forma de acesso:
- JSON via API oficial SGS.
- Atualização:
- mensal, conforme publicação do BCB.
- Uso:
- consumida pela plataforma nas ferramentas de juros e correção monetária; nesta área pública, alimenta a tabela de registros recentes e a calculadora demonstrativa com memória mensal.
- Método da calculadora:
- capitalização composta das taxas mensais integrais retornadas pela série, sem rateio proporcional dentro de cada mês. O resultado é informativo e não substitui a metodologia aplicável a um caso específico.
Como funciona a pesquisa e a comparação
Busca por palavra-chave (textual): procura as palavras informadas nos campos pesquisáveis das decisões, ignorando acentos e variações de escrita. Os resultados são ordenados por relevância textual.
Busca semântica (por significado): cada decisão foi transformada em um vetor numérico (embedding) que representa seu significado. A busca converte a consulta em vetor e calcula a proximidade por similaridade de cosseno, recuperando as decisões com significado mais próximo, mesmo sem as palavras exatas.
Relevância semântica: medida de proximidade de significado entre o texto pesquisado (ou o caso descrito) e a decisão recuperada, calculada por meio de embeddings e similaridade de cosseno. Quanto maior o percentual, maior a proximidade semântica entre os textos. O indicador não representa probabilidade de êxito nem equivalência jurídica entre os casos.
Aderência jurídica: combina uma análise qualitativa assistida por IA, responsável por identificar pontos comuns, divergências e aplicabilidade, com um cálculo matemático determinístico que produz o indicador exibido. O score busca diferenciar mera proximidade textual de correspondência fática e jurídica mais relevante, sendo um indicador distinto da relevância semântica. Não representa probabilidade de resultado.
Classificação relativa no Comparador: a classificação exibida como Convergente, Divergente ou Neutro é gerada por IA e considera como o entendimento do precedente se relaciona com a pretensão descrita pelo usuário. Ela não corresponde necessariamente ao resultado processual original da decisão no STJ e não representa previsão do caso informado.
Diferenças relevantes (distinguishing): comparação que identifica pontos materialmente comuns e divergentes entre o caso informado e o precedente, ajudando a verificar em que medida o entendimento pode ou não ser aplicável ao contexto analisado. A comparação não prevê o resultado do caso.
Validação da comparação pública: a área pública utiliza instruções exclusivas e uma resposta estruturada com evidências e lacunas antes da classificação. Se a saída introduzir previsão, aconselhamento, fatos implícitos ou referências ausentes das fontes fornecidas, o precedente recebe uma classificação neutra e orientação para conferência na decisão oficial.
Cálculo dos indicadores
Categorias de resultado: os indicadores utilizam o campo categórico de resultado disponibilizado nos metadados oficiais do STJ. O Estag.ia realiza um mapeamento determinístico desses valores para quatro categorias analíticas: Provido, Negado, Não conhecido e Outros. Resultados de provimento parcial são atualmente incluídos na categoria Provido, acompanhando a classificação categórica disponibilizada pela fonte.
Taxa de provimento observada: proporção entre decisões classificadas como providas e o total de decisões da amostra analisada, multiplicada por 100.
Distribuição dos resultados observados: apresenta separadamente Provido, Negado, Não conhecido e Outros. Nenhuma categoria ou taxa é inferida por complemento. Outros contém somente registros classificados como OUTROS na base analítica.
Filtro de assunto / área temática: embora os metadados do STJ também contenham códigos de assuntos vinculados à TPU/CNJ, o filtro de assunto utilizado neste painel realiza atualmente correspondência textual nos campos pesquisáveis das decisões.
Duração: diferença observada entre a data de distribuição e a data de julgamento, considerando apenas registros com ambas as datas disponíveis e válidas. Os resultados são agrupados em 0–6 meses, 6–12 meses, 1–2 anos e 2+ anos.
Menções expressas a súmulas: contabiliza menções expressas às Súmulas 7, 83, 182 e 211 nas decisões classificadas como negadas ou não conhecidas. A presença da referência não permite, isoladamente, afirmar que a Súmula tenha causado o resultado.
Tendência temporal: calcula mensalmente a proporção de decisões providas no respectivo período, permitindo observar a evolução histórica da taxa de provimento. O indicador não realiza projeções futuras.
Por Ministro Relator: apresenta os 10 relatores com maiores amostras no recorte selecionado. A taxa de provimento de cada relator corresponde à divisão entre decisões providas e o total de decisões atribuídas a ele na amostra.
Órgãos julgadores: Compara a taxa de provimento observada entre órgãos com mais de 10 decisões no recorte selecionado. São considerados até 10 órgãos com maior volume de decisões, apresentados na interface conforme a taxa de provimento observada.
Classe recursal: calcula a proporção entre decisões providas e o total de cada classe. Em todos os recortes, são consideradas somente classes com mais de 10 decisões. A interface apresenta até 8 classes.
Síntese Analítica: a inteligência artificial recebe os indicadores já calculados e produz uma explicação descritiva do recorte. A IA não calcula, modifica ou substitui as métricas estatísticas exibidas no painel. A resposta passa por uma validação textual exclusiva da área pública. Se a revisão ainda não atender às limitações metodológicas, a interface exibe uma síntese descritiva determinística produzida com os mesmos indicadores já calculados.
Diferença entre estatística observada e previsão: todos os indicadores desta área descrevem o que aconteceu na amostra analisada. Eles não permitem prever o resultado de um processo específico.
Limitações e papel da IA
Amostra: os indicadores refletem apenas as decisões públicas indexadas pela plataforma no período selecionado, e não a totalidade dos processos do tribunal.
Papel da IA: na Inteligência Judicial e no Comparador, a IA é usada de forma explicativa para interpretar métricas e comparar textos. Ela não decide o que é exibido no banco de dados nem altera o conteúdo das decisões.
Possibilidade de erro: análises geradas por IA podem conter imprecisões. Use os resultados como ponto de partida e confirme sempre na fonte oficial.
Auditoria pela fonte oficial: As decisões e precedentes exibidos podem ser conferidos individualmente no SCON do STJ.
Privacidade no Comparador: o texto descrito anonimamente não é salvo, não gera histórico e não é associado a você. Ele existe apenas durante o processamento da sua consulta.
Privacidade na Busca Nacional: os filtros e resultados do job público permanecem apenas pelo tempo técnico necessário ao processamento e à consulta do resultado. Eles não são associados a usuário ou workspace, não criam monitor e não geram histórico na aplicação.
Limitações do DataJud: a disponibilidade, cobertura e atualização dos metadados dependem da API Pública DataJud e das remessas dos tribunais de origem ao CNJ. Eventuais inconsistências de datas ou campos podem refletir os dados recebidos pela fonte pública.
Quer explorar os dados? Volte para a visão geral ou conheça o Estag.ia completo.
