Iniciação científica de Marília Affonso (orientação: José de Jesus Filho) sobre uso de IA generativa na extração de dados de documentos jurídicos extensos, usando o método FIRAC.
R/ Scripts e funções (extração de PDF, questionários, cliente Gemini,
pipeline FIRAC, comparação com o gabarito humano)
python/ Script auxiliar para chamada ao Gemini via OCI (sem SDK OCI nativo em R)
data-raw/ Entradas brutas: PDFs dos processos (jec/), anotações manuais da
pesquisadora (CSV) e os dois questionários usados no teste A/B
data/ Saídas derivadas: respostas do Gemini e comparações com o gabarito
relatorio/ Fontes .qmd e versões renderizadas (Word/PDF) do relatório final
e do Capítulo 5 da monografia
Documentos/ Documentos de apoio (relatório parcial, plano de trabalho,
instruções de formatação, artigos de referência)
biblio.bib Bibliografia do projeto (formato BibTeX)
abnt.csl Estilo de citação ABNT usado na renderização dos .qmd
R/cjpg.R— coleta os PDFs dos processos do CJPG-TJSP (Juizado Especial Cível).R/pdf_extract.R— extrai texto dos PDFs e verifica se há necessidade de OCR.R/questionarios.R— estrutura as perguntas dos dois questionários (original e com engenharia de prompt).R/gemini.R— cliente para chamar o Gemini via API direta do Google ou via OCI.R/pipeline_firac.R— orquestra o pipeline completo (run_firac_pipeline()), com truncamento "cabeça e cauda" para processos extensos.R/comparacao.R— compara as respostas do Gemini com o gabarito humano (comparar_gemini_humano()).
Os capítulos da monografia (1 a 5) e o relatório parcial/final ficam no Google Drive compartilhado do projeto; apenas o relatório final e o Capítulo 5 têm fonte .qmd versionada aqui, em relatorio/.