Comparaison des versions

Légende

  • Ces lignes ont été ajoutées. Ce mot a été ajouté.
  • Ces lignes ont été supprimées. Ce mot a été supprimé.
  • La mise en forme a été modifiée.

L'utilisation par Hal de vocabulaires contrôlés disciplinaires pour l'indexation des publications a tout d'une bonne nouvelle. En effet, l'utilisation des années durant, de mots-clés libres a généré une "dette technique de données" qui rend délicate pour les établissements, par exemple, la caractérisations des profils d'expertise des chercheurs ou des laboratoires.

Footnote

On n'oubliera pas ici les louables efforts de l'équipe Scanr pour fournir des versions des métadonnées Hal réalignées sur Idref/Rameau et WikiData.

Pour rendre le problème plus parlant, voici la liste des variantes de graphies pour quelques mots clés obtenues depuis l'API Hal :

...

Île-de-FranceIle-de-FranceIle-de-franceÎle de FranceIle-de FranceÎle-de-franceIle de franceILE DE FRANCEÏle-de-FranceÎle de franceIle-De-FranceILE-DE-FRANCEÎle-De-FranceÎle-de-France


Partenariat public-privéPartenariat public privéPartenariat Public-PrivéPartenariat public/privéParténariat public-privéPartenariat public-PrivéPartenariat Public PrivéParténariat public-PrivéPartenariat public-privé


Idéalement, pour gérer les informations sur la recherche selon les canons des "FAIR Data", il faudrait disposer pour chaque concept d'un identifiant unique (une URI) se prêtant, si possible, à un "déreférencement" : une opération qui consiste à . Par exemple, pour "Partenariat public-privé", si on dispose d'une URI telle que https://catalogue.bnf.fr/ark:/12148/cb13755654m ou https://www.idref.fr/061611514, on peut obtenir des traductions, des alignements avec des vocabulaires tiers (https://id.loc.gov/authorities/subjects/sh96011049.html), etc.

Exemple : les données indexées avec JEL


Raison de plus pour vouloir tirer parti au maximum des quelques vocabulaires contrôlés utilisés sur Hal ! C'est ce que nous avons voulu faire dans le cadre du projet SoVisu+, du consortium CRISalid, où plusieurs établissements œuvrent ensemble à la construction automatisée de leur "graphe de connaissance institutionnel", socle de la gestions des informations sur la recherche.