~/questoes/agentes-de-ia
Quando um Document Loader processa um arquivo, ele retorna um objeto Document com duas partes principais: o conteúdo do texto (em page_content) e as informações sobre origem e características (em metadata). Os metadados são armazenados em um atributo separado, não misturado com o conteúdo, permitindo que você acesse informações como nome do arquivo, página e URL de forma organizada.
O atributo metadata do objeto Document mantém todas as informações sobre origem e características do documento, como nome de arquivo, número de página e URL. Isso fica separado do page_content, que contém apenas o texto. Essa separação é fundamental para rastreabilidade e processamento posterior dos dados.
Não há criação automática de arquivo separado para armazenar metadados. Os metadados ficam dentro do próprio objeto Document, em memória, e não em arquivos do projeto.
Correta. O atributo metadata do objeto Document é exatamente onde ficam armazenadas informações como nome de arquivo, número de página, URL de origem e outras características do documento, mantendo-as separadas do conteúdo.
Os metadados não são apenas temporários. Eles são persistidos no objeto Document junto com o page_content e podem ser acessados e processados conforme necessário pela aplicação.
O page_content contém apenas o texto do documento. Os metadados ficam em um atributo separado chamado metadata. Manter essas informações separadas é importante para clareza e processamento.