Resolvido por Remover metadados de PDF
Este recurso ajuda a impedir que mecanismos de busca e scrapers automatizados coletem campos de metadados de PDF incorporados ao publicar PDFs em seu site. Ele reduz a exposição não intencional de nomes de autores, detalhes de software e outras propriedades ocultas de documentos que podem ser coletadas em larga escala.
Ao enviar PDFs para um site, o documento pode incluir metadados incorporados, como autor, organização, título do documento, ferramentas de criação, carimbos de data/hora, palavras-chave e campos personalizados. Este recurso foi projetado para reduzir a chance de que mecanismos de busca e ferramentas de scraping coletem esses campos de metadados de seus PDFs publicados. Ele se concentra em minimizar o que pode ser coletado das propriedades internas do arquivo PDF, ajudando você a evitar a divulgação inadvertida de nomes internos, sistemas ou detalhes de fluxo de trabalho. Use-o ao preparar PDFs para acesso público, para que apenas o conteúdo visível seja compartilhado, e não as propriedades ocultas do documento. Isso é especialmente útil para relatórios públicos, folhetos para download, documentos de políticas ou qualquer arquivo que possa ser espelhado, armazenado em cache ou coletado em massa. O recurso oferece suporte às melhores práticas de privacidade e segurança, limitando o vazamento passivo de informações que podem ser usadas para criação de perfis ou reconhecimento. Também pode ajudar com requisitos de conformidade onde dados pessoais ou identificadores internos não devem ser distribuídos. Para equipes, ele fornece uma maneira consistente de higienizar documentos antes da publicação, reduzindo o esforço manual e o risco de esquecer algum campo. O resultado é uma publicação de PDF mais limpa e segura, sem alterar o conteúdo visível dos documentos.
Recurso externo
https://cross-service-solutions.com/
Se conhece uma ferramenta ou abordagem que poderia ajudar as pessoas a resolver um problema que ainda não abordámos, gostaríamos de saber.