Pular para o conteúdo principal
Alimentado por Harness RLM · IBM Watsonx

O Oráculo do Diário Oficial do RJ.

DOERJ.IA transforma o Diário Oficial do Estado do Rio de Janeiro em conhecimento acessível. Busca semântica, síntese por inteligência artificial e rastreabilidade completa de cada publicação, desde 2024.

Alimentado pelo Harness RLM — metodologia proprietária Bravonix sobre o arcabouço IBM watsonx — combinando governança de IA, modelos de linguagem de última geração e infraestrutura corporativa para resultados confiáveis com conformidade LGPD.

LGPD|DOERJ|IOERJ|RAG Hierárquico|IBM Watsonx
···Documentos indexados
···Última atualização
RAGHierárquico 3 níveis
IBMWatsonx

Por que respostas sem alucinações

Enquanto ferramentas de busca convencionais retornam listas de links, o DOERJ.IA sintetiza respostas verificadas contra os documentos originais. Cada afirmação é rastreável ao PDF e à página exatos publicados pelo IOERJ.

Por que somos diferentes

Busca de texto vs. inteligência semântica.

Enquanto outras ferramentas exigem que você saiba as palavras exatas do texto, o DOERJ.IA entende o contexto real da sua pergunta e sintetiza a resposta a partir de todos os cadernos relevantes.

Busca Semântica

Pergunte como fala, não como o DOERJ escreve

Pesquise por cargo, nome, órgão ou qualquer tema, sem precisar saber as palavras exatas. A IA entende o que você quer e encontra onde está.

Síntese MAP-REDUCE

Uma resposta, não uma lista de links

Não retornamos fragmentos desconexos. Sintetizamos uma resposta consolidada a partir de todos os cadernos relevantes, com citação das fontes originais.

Rastreabilidade Total

Cada afirmação vinculada à fonte

Cada trecho da síntese é rastreado ao número de página e ao PDF original publicado no IOERJ. Nenhum dado fabricado.

Metodologia

Como processamos cada edição do DOERJ

Cada edição publicada passa por 7 etapas de processamento avançado de RAG antes de estar disponível para pesquisa semântica.

1

ETAPA 1

Ingestão Híbrida e OCR Fallback

Monitoramento em tempo real do portal IOERJ. O pipeline extrai texto nativo com PyMuPDF e aciona OCR automatizado se a página for escaneada ou tiver baixo volume de caracteres.

2

ETAPA 2

Análise Visual Multimodal (NVIDIA Vision)

Imagens, organogramas, anexos e layouts embutidos nas edições são analisados na ingestão via modelos de visão computacional da NVIDIA, gerando metadados descritivos integrados ao texto.

3

ETAPA 3

Contextual Retrieval & Chunking

Segmentação em blocos com sobreposição inteligente. Cada bloco recebe um resumo situacional pré-gerado por LLM para que o contexto semântico nunca se perca após a fragmentação.

4

ETAPA 4

Indexação Vetorial HNSW

Vetorização em 1024 dimensões com modelos integrados no IBM watsonx. Os embeddings são indexados em PostgreSQL com algoritmo HNSW para buscas ultra-rápidas.

5

ETAPA 5

RAG Adaptativo e RAG-Fusion

Classificação prévia da intenção da pergunta. O sistema gera variações da consulta (RAG-Fusion) e cria respostas hipotéticas (HyDE) para maximizar a assertividade da busca híbrida.

6

ETAPA 6

Expansão Contextual (Parent-Child)

Buscas por similaridade localizam os blocos precisos de texto e o mecanismo expande dinamicamente o contexto para blocos vizinhos (Small-to-Big) antes de acionar o LLM.

7

ETAPA 7

Síntese watsonx com Rastreabilidade

Modelos de linguagem corporativos geram a síntese final. Cada frase vem acompanhada de uma citação direta e clicável que abre o PDF oficial na página exata correspondente.

Pipeline Avançado de RAG (DOERJ.IA)

0

1. Ingestão Híbrida & OCR

Extração nativa + OCR de contingência

1

2. Visão Computacional

NVIDIA Vision decodificando diagramas e imagens

2

3. Contextual Chunking

Preservação de contexto por bloco via LLM

3

4. Indexação Vetorial HNSW

Embeddings 1024d com pgvector no PostgreSQL

4

5. RAG Adaptativo & Fusion

Classificação de intenção, HyDE e RRF

5

6. Expansão Parent-Child

Small-to-big para enriquecer a busca semântica

6

7. Síntese e Rastreabilidade

Modelos watsonx e links diretos à página do PDF

Resposta com rastreabilidade total

Funcionalidades

Tudo que você precisa para pesquisar o DOERJ

Da busca semântica à síntese multi-data: ferramentas para advogados, servidores, jornalistas e pesquisadores.

Busca Semântica

Entende o contexto real da sua pergunta. Pesquise por cargo, nome, órgão ou tema, sem precisar saber as palavras exatas do texto publicado.

Síntese por IA

Respostas consolidadas a partir de todos os cadernos relevantes, em linguagem clara, com citação das fontes originais.

Análise Multi-data

Pesquise em uma data específica ou em períodos. Ideal para acompanhar nomeações, contratos e atos normativos ao longo do tempo.

Pesquisa Profunda

Modo folha por folha, linha por linha. Percorre todos os chunks brutos do dia para máxima precisão quando detalhes são críticos.

Respostas Instantâneas

Cache semântico e resumos pré-computados por caderno garantem respostas em 3–5 segundos para consultas frequentes.

Fontes Rastreáveis

Cada trecho da síntese é rastreado à sua publicação original com número de página e link direto ao PDF do DOERJ.

Todos os Cadernos

Cobertura completa: Executivo, Legislativo (ALERJ), Judiciário (TJRJ), MPRJ, autarquias, fundações e empresas públicas.

Indexação Diária

Cada nova edição do DOERJ é indexada automaticamente. As informações estão disponíveis para pesquisa no mesmo dia da publicação.

Cadernos

Cobertura completa de todos os cadernos

Indexamos e mantemos atualizados todos os cadernos publicados no Diário Oficial do Estado do Rio de Janeiro.

Poder Executivo

Governador, Secretarias de Estado, órgãos da administração direta

Poder Legislativo

Assembleia Legislativa do Estado do Rio de Janeiro (ALERJ)

Poder Judiciário

Tribunal de Justiça do Estado do Rio de Janeiro (TJRJ)

Ministério Público

Ministério Público do Estado do Rio de Janeiro (MPRJ)

Administração Indireta

Autarquias, fundações, empresas públicas e sociedades de economia mista

Outros Poderes e Órgãos

Tribunal de Contas, Defensoria Pública e outros órgãos estaduais

Público

Para quem é o DOERJ.IA

Solução projetada para órgãos públicos e profissionais que precisam de agilidade, confiabilidade e governança na consulta a diários oficiais.

Secretarias de Estado

Governadoria, Casa Civil, Fazenda, Educação, Saúde — departamentos jurídicos que acompanham nomeações, licitações e atos normativos diariamente.

Autarquias e Fundações

Detran, Procon, UERJ, Fundação Ceperj, IplanRio e demais entidades da administração indireta que publicam e consultam atos no DOERJ.

Câmaras Municipais e TCE

Órgãos de controle e fiscalização que cruzam dados do DOERJ com legislação municipal e estadual para auditoria e conformidade.

Procuradorias e AGU

Advocacia pública que precisa de rastreabilidade total em cada ato publicado, com citação de fonte e página original para sustentação jurídica.

Departamentos Jurídicos Internos

Equipes de compliance, contratos e regulação que monitoram publicações oficiais de forma estruturada e com inteligência semântica.

Imprensa e Pesquisadores

Jornalistas, analistas e acadêmicos que investigam gastos públicos, concursos e movimentações na administração estadual.

Comparativo

DOERJ.IA vs. pesquisa tradicional

Compare as abordagens disponíveis para pesquisar publicações do Diário Oficial do Estado do Rio de Janeiro.

CapacidadeDOERJ.IAPesquisa ManualBusca por Palavras
Entende linguagem natural
Sintetiza resposta consolidada
Cobre todos os cadernos simultaneamenteParcial
Cita fontes com link ao PDF original
Histórico desde 2024Parcial
Indexação diária automática
Cache semântico com respostas instantâneas
Pesquisa em múltiplas datasParcial

Resultados

Resultados reais para quem pesquisa o DOERJ

Pesquisa em segundos

O que levaria horas de leitura manual de PDFs de centenas de páginas é encontrado e sintetizado em menos de 30 segundos.

Zero alucinações

Cada afirmação é rastreada ao documento original. Nenhum dado fabricado. Verificação cruzada com os PDFs publicados pelo IOERJ.

Cobertura completa desde 2024

Mais de 2.000 documentos indexados cobrindo todas as edições do DOERJ desde janeiro de 2024, com atualizações diárias.

Atualizações automáticas

O pipeline de ingestão monitora o IOERJ diariamente. Cada nova publicação é processada e disponibilizada para pesquisa no mesmo dia.

Diferenciais

Governança, segurança e melhores práticas de IA

O DOERJ.IA não é apenas uma ferramenta de busca — é uma plataforma corporativa construída com os mais rigorosos padrões de governança de IA, segurança e conformidade regulatória.

01

Governança de IA Corporativa

Metodologia Harness RLM sobre IBM watsonx com políticas de uso, auditoria de decisões, versionamento de modelos e rastreabilidade completa de cada inferência.

02

Segurança e LGPD

Dados criptografados em repouso e em trânsito. Sem compartilhamento com terceiros. Conformidade total com a Lei Geral de Proteção de Dados (LGPD).

03

Zero Alucinações

Cada afirmação gerada pela IA é rastreada ao PDF e à página original do DOERJ. Verificação cruzada com fontes oficiais do IOERJ. Resultado auditável.

04

Infraestrutura Robusta

Modelos de linguagem de última geração rodando em GPU dedicada. Disponibilidade 99,5%. Cache semântico para respostas instantâneas em consultas frequentes.

05

Implantação Rápida

Não precisa de infraestrutura própria. Não precisa de equipe de TI dedicada. Ativação em dias, não meses. Suporte Bravonix durante toda a implantação.

06

Propósito Público

Plataforma pensada para o serviço público. Doação de 5% das receitas para projetos de transparência e tecnologia cívica no Estado do Rio de Janeiro.

Quer implementar no seu órgão?

Leve o poder do DOERJ.IA para sua instituição com implantação rápida, sem necessidade de infraestrutura própria e com total conformidade LGPD.

Não precisa de infra própria
Dados ficam seguros
Conformidade LGPD
Implantação rápida