Ao finalizar a investigação

O responsável pelo conjunto de dados é a pessoa mais qualificada para decidir que materiais devem ser preservados ou eliminados. Ainda assim, existem alguns critérios transversais a observar: 

●Validação de resultados → Manter os dados mínimos essenciais para reproduzir conclusões publicadas.

● Obrigações legais/contratuais → Cumprir requisitos de financiadores (FCT, Horizonte Europa) e RGPD.

● Reutilização potencial → Avaliação do interesse disciplinar ou interdisciplinar dos dados.

● Singularidade → Dados de difícil recriação podem merecer ser mantidos.

● Valor científico, histórico ou cultural.

● Custo-benefício → ponderar o custo da manutenção face ao valor de reutilização.

 

A eliminação de dados ao final do período de retenção é obrigatória pelo RGPD. Os dados devem ser eliminados ao fim do prazo legal (por exemplo, dados clínicos devem ser eliminados ao fim de 10 anos), ou sempre que já não sejam necessários (por exemplo, no fim de um projeto), ou nos casos em que o titular solicita ao responsável pelo tratamento dos dados a eliminação dos seus dados pessoais (RGPD, Artigo 17°.: Direito ao apagamento dos dados ou o «direito a ser esquecido»).

A partilha dos dados de investigação constitui uma prática essencial na Ciência Aberta, por aumentar o grau de confiança nos resultados, a visibilidade e impacto do trabalho, e a abertura a novas oportunidades de colaboração.

Benefícios concretos da partilha

● Citação e impacto: Datasets com DOI contam como publicações; rastreiam citações (DataCite).

● Reprodutibilidade: Permite validação independente dos resultados publicados.

● Cumprimento de requisitos de financiadores: FCT, Horizonte Europa exigem DMP com plano de partilha aberta.

● Colaboração: Dados FAIR atraem parcerias (inter)disciplinares.

● Valor público: Dados financiados publicamente beneficiam a educação, decisões políticas, e abrem caminho à mais rápida inovação.

 

No entanto, ainda que a publicação em acesso aberto dos dados esteja em plena conformidade com os princípios da Ciência Aberta e constitua requisito obrigatório de diversas entidades financiadoras (FCT, Horizonte Europa), deve sempre prevalecer o princípio orientador "tão aberto quanto possível, tão fechado quanto necessário".

Esta abordagem garante:

→ Máxima transparência quando viável (dados anonimizados, irrestritos);

→ Proteção adequada perante restrições legais (RGPD), éticas (consentimento dos participantes) ou contratuais (propriedade intelectual)

Existem várias tipologias de acesso:

Aberto – livre reutilização.

Controlado – necessária uma autenticação ou pedido de autorização ao proprietário.

Embargado – indisponível temporariamente.

Fechado – só disponibiliza metadados.

Uma licença de reutilização é uma autorização clara e juridicamente sustentada que explica como e em que grau outras pessoas podem aceder, usar, adaptar e partilhar os dados de investigação. Permite que o criador mantenha os direitos de autor, ao mesmo tempo que disponibiliza os seus dados nas condições que entende adequadas.

·       Claridade legal: Evita ambiguidades sobre o que é permitido. Se não existe a explicitação de uma licença, os dados não podem legalmente ser reutilizados.

·       Interoperabilidade: Licenças standard (Creative Commons) garantem compatibilidade entre plataformas.

·       Obrigação: Repositórios certificados exigem licença; financiadores (FCT, Horizonte Europa) recomendam licenças Creative Commons.

 

As licenças Creative Commons (CC-BY) são as mais adequadas para dados de investigação aberta, e podem ser aplicadas a datasets e metadados, a imagens, figuras, código, materiais de divulgação e apresentações…

Existem sete tipos de licenças Creative Commons. Têm diferentes tipos de restrições, e quase todas exigem atribuição de créditos.

Tipo de licença

Identificador de licença

Permissões para reutilização por terceiros

CC0 Public Domain

Permite utilização incondicional sem necessidade de atribuição de créditos.

CC BY

Permite usar, partilhar e adaptar o seu trabalho para qualquer fim, desde que atribuam crédito ao autor.

CC BY-SA

(CC BY-ShareAlike)

Mesmas permissões da CC-BY, mas as eventuais adaptações devem ser partilhadas sob a mesma licença.

CC BY-NC

(CC BY-NonCommercial)

Permite usar e adaptar trabalho apenas para fins não comerciais, com atribuição de crédito ao autor.

CC BY-NC-SA

CC BY-(NonCommercial-ShareAlike)

Mesmas permissões da CC-BY-NC, mas as eventuais adaptações devem ser partilhadas sob a mesma licença.

CC BY-ND

(CC BY-NonDerivatives )

Permite partilhar o seu trabalho, sem o alterar, para qualquer fim, com atribuição de crédito ao autor.

CC BY-NC-ND

(CC BY-NonCommercial-NoDerivatives)

Permite partilhar o seu trabalho, sem o alterar, apenas para fins não comerciais, com atribuição de crédito ao autor.

 

Como se aplica uma licença?

No momento da criação do dataset ou no momento da sua publicação deve ser selecionada uma licença para a utilização dos dados:

o   Selecione uma licença ao carregar os seus dados num repositório. Existirá uma secção na inserção dos metadados que permite esta seleção. Dependendo do repositório:

§  Selecione o botão da licença conforme disponibilizado na interface do repositório ou,

§  Insira o código HTML respetivo a cada licença na caixa de texto determinada a esse fim (os repositórios por normas fornecem ou redirecionam a estes códigos)

o   Refira a licença na página/website onde estão os dados de investigação:

§  Coloque no rodapé da página

© 2019. This work is openly licensed via CC BY 4.0.”

o   Insira no ficheiro README a informação da licença para os dados:

§  LICENÇA

Este conjunto de dados está licenciado sob CC BY 4.0 https://creativecommons.org/licenses/by/4.0/

Recursos:

License Chooser – Questionário da Creative Commons para auxiliar a escolha da licença de reutilização. 

Toolkit for Researchers on Legal Issues – Guia jurídico da OpenAIRE (Comissão Europeia) para reutilização de dados de investigação e tratamento de dados sensíveis.

 

O depósito em repositórios certificados constitui a forma preferencial de partilhar dados de investigação, garantindo preservação a longo prazo, acessibilidade FAIR, atribuição de identificadores persistentes (DOI) e conformidade com exigências de financiadores, revistas e instituições.

Para encontrar um repositório de dados deve-se em primeira instância selecionar um repositório temático/disciplinar já que têm um foco específico (num tipo de dados, disciplina de investigação) e seguem padrões reconhecidos na área de investigação.

 Exemplos: NCBI Gene Expression Omnibus (GEO), NCBI Database of Genotypes and Phenotypes (dbGaP), NIMH Data Archive (NDA).

 

Alternativamente, pode usar-se um repositório institucional ou um repositório generalista confiável (como o Zenodo, OSF ou Figshare).

 

Também se pode recorrer a diretórios para localizar repositórios confiáveis e adequados para cada tipo de dados. Procure repositórios de dados nas plataformas  re3data ou FAIRsharing.

Checklist ao depositar o dataset:

·       Enriquecer os metadados

·       Incluir documentação contextual (README, Dicionário de dados)

·       Upload de dados em formatos abertos (CSV, PDF…)

·       Selecionar a licença de reutilização

·       Adicionar Identificadores Únicos Persistentes

o   ORCID dos autores e responsáveis

o   ROR da instituição associada

 

Recursos:

Best Practices for Data Submission in Generalist Repositories: A Checklist – Lista de verificação para o depósito de dados em repositórios generalistas. 

 

Também é possível submeter e publicar datasets em revistas científicas (data journals). Estes artigos descrevem o dataset (metodologia de criação, qualidade, contexto), constituindo uma publicação académica contabilizada, que aumenta significativamente a exposição, citações e impacto dos dados produzidos

PURE (Pure Portal da UNL), sistema institucional de gestão das produções científicas da Universidade NOVA, regista datasets como outputs académicos independentes.

Para efetuar a integração do dataset com o PURE, deverá contactar a Biblioteca NMS (biblioteca@nms.unl.pt), e ao fazer o pedido e facultar o DOI associado ao dataset + link do registo do repositório.