# Dados sintéticos para aulas práticas

Os arquivos desta pasta foram criados exclusivamente para as atividades do site. Não representam pessoas, processos, documentos ou decisões reais. Os identificadores são artificiais e os textos são exemplos didáticos.

Todos os arquivos usam CSV UTF-8 com vírgula como separador e ponto como separador decimal.

| Arquivo | Uso sugerido |
| --- | --- |
| `capitulo-01_algoritmos.csv` | classificação, regressão, agrupamento, árvore e rede neural |
| `capitulo-01_processo_ml.csv` | limpeza, atributos, normalização, treino e teste |
| `capitulo-02_preditivo.csv` | limiar, matriz de confusão, métricas e comparação por grupo |
| `capitulo-03_ocr.csv` | qualidade de imagem, OCR, campos críticos e revisão |
| `capitulo-04_tokenizacao.csv` | tokenização, TF-IDF e representação lexical |
| `capitulo-04_rag.csv` | busca, contexto, fontes, vigência e verificação em RAG |
| `capitulo-05_implantacao.csv` | linha de base, portões, supervisão e decisão de avanço |
| `capitulo-06_risco.csv` | impacto, probabilidade, salvaguardas e reversibilidade |

Para aulas, recomenda-se começar lendo o cabeçalho, formular uma pergunta, fazer uma cópia do arquivo e registrar qual transformação foi aplicada. Não misture estes exemplos com bases reais.
